आवाज कोलोन

छोटे ऑडियो नमूना से कोई ध्वनि बनाता है. क्लोन किए गए आवाज में भाषण बनाता है.

संदर्भ ऑडियो

चरण 1: < ध्वनि का ऑडियो क्लिप अपलोड आप क्लोन करना चाहते हैं (5- 30 सेकण्ड). < मजबूत>

एक मॉडल चुनें. < caret> आपका पाठ प्रकार चुनें और क्लिक करें पर क्लिक करें.

अपनी फ़ाइल को यहाँ खींच लाएँ, या छोड़ दें ब्राउज़

एमपी3 से क्लोन करने के लिए एक आवाज नमूना अपलोड. एमपी3, WAC. चुने गए मॉडल का प्रति- इंजिन सीमा नीचे दिखाया गया है - शुद्ध भाग के लिए स्वचालित अपलोड कर रहे हैं. अधिकतम अपलोड 500MB.

फ़ाइल.एमपी3

0 MB
ऑडियो विशेषता ...
अवधि: -- ऊँचा: -- खामोशी: --
— या सीधे - सीधे — अभिलेख
00:00

कलोन मॉडल

संदर्भ ऑडियो: 5s – 30s (कार सबसे शुद्ध खंड में स्वतः कम- से- कम)

विशेषताः
तेज पूर्वावलोकन

बोलने के लिए पाठ

भाषा संदर्भ ऑडियो से मेल खाती है
प्रारंभ करने के लिए ऊपर एक आवाज नमूना अपलोड करें
5,000 अक्षर ऊपर हस्ताक्षर करें ट्रैक प्रयोग के लिए

परिणाम

एक संदर्भ आवाज अपलोड करें, पाठ प्रविष्ट करें, तथा क्लोन किए गए आवाज को सुनने के लिए तैयार हों

कैशिंग आवाज और बातचीत बनाई जा रही है...

0:00

आपकी जीत हुई

ऊपर हस्ताक्षर करें बाद में प्रयोग के लिए क्लोन किए गए आवाजों को सहेजने के लिए.

आवाज़ कैसे कार्य करती है

1. अपलोड रेफ़रेंस ऑडियो

आवाज से साफ भाषा के १०- 30 सेकण्ड दें जो आप क्लोन करना चाहते हैं. ऑडियो को स्पष्ट करें, परिणाम बेहतर होगा.

2 मॉडल चुनें

बहुत से मॉडलों को ओपन- स्पेसर, कोस्टिटरबॉक्स, या GEBOS. प्रत्येक में भिन्न भाषा और स्टाइल के लिए विशिष्ट शक्‍ति है.

3 पाठ प्रविष्ट करें (G)

क्लोन किए गए आवाज में बोले गए पाठ को टाइप करें तथा क्लिक करें. डाउनलोड या भविष्य के उपयोग के लिए आवाज सहेजें.

केस इस्तेमाल करें

हर सृष्टि और पेशेवर की ज़रूरत के लिए आवाजें

विषयवस्तु बनाने का निर्माण

बिना फिर से अपनी आवाज की आवाज़ के आधार पर बनाएं. गलत ग़लतियों को ठीक करें, नया खण्ड जोड़ें, या अपनी आवाज में सामग्री बनाता है जब तक कि Mic से दूर हो.

बहुमुखी दुबिंग

भाषा में बात करो आप अपनी आवाज पहचान को जारी रखने के दौरान पता नहीं है। क्रॉस-मिंग मॉडल जैसे कोस्टी 2 8 भाषाओं में सामग्री सक्षम करता है।

गैसिंग अक्षर (l)

खेल, चलचित्र, तथा अंतःक्रियात्मक मीडिया के लिए विशिष्ट अक्षर की आवाज़ बनाएँ. एक शब्दकोश आवाज तथा असीमित संवाद लाइनों तैयार करता है.

ऑडियोबुक्स

अपनी क्लोन की आवाज़ का इस्तेमाल बिना स्टूडियो रिकॉर्ड किए बिना घंटों के, बिना कुशलता से ऑडियोबुक तैयार करने के लिए कीजिए ।

पहुँच

ऐसे लोगों की मदद कीजिए जिन्होंने पहले लिखे गए नमूना को फिर से इस्तेमाल करने के लिए अपनी आवाज़ खो दी है ।

Brand आवाज

अपनी ब्रांडी बनाएं और बाजार ऑडियो बनाता हूँ, मैं प्रेरणा देता हूँ, और घोषणाओं को प्रेरित करता हूँ.

अच्छे परिणाम के लिए सुझाव

करें

  • साफ, शोर- फ्री रिकॉर्डिंग इस्तेमाल करें
  • छोटे नमूने = बेहतर क्लोन (नीचे देखें)
  • एकल स्पीकर इस्तेमाल करें
  • शांति से माहौल में रिकॉर्ड करें
  • स्वाभाविक बोलने की गति इस्तेमाल करें
  • WAV या उच्च गति एमपी3 प्रिय

टालें

  • पृष्ठभूमि शोर या संगीत
  • संदर्भ में कई स्पीकर
  • बहुत छोटा क्लिप्स ( 3 सेकेंड के भीतर)
  • Avi पुनः संपीडित ऑडियो
  • शोर या चिल्लाना
  • इको निरस्तीकरण में या फिर लोड करें (_R)

नमूना की लंबाई कैसे प्रभावित होती है

अब और अपने संदर्भ ऑडियो को साफ करें, क्लोन बेहतर होगा.

नमूना लंबाई क्लोन विशेषता के लिए उत्तम पहुँच
5–10s मूल त्वरित जाँच — सामान्य टोन कैप्चर करता है, परंतु चूकी नहीं जा सकती मुक्त
30–60s अच्छा ज़्यादातर प्रयोग के लिए ठोस क्लोन — स्वर, गति, और उच्चारण मुक्त
2–5 min बड़ा उच्च- चित्र क्लोन — स्वाभाविक चुनाव, आउटपुट के पार सतत क्वालिटी मुक्त खाता
10+ min उत्कृष्ट निकटतम पूर्ण विकास — ऑडियोबुक, ट्रेडल्स, पेशेवर उपयोग के लिए आदर्श मुक्त खाता
1–2+ hrs स्टूडियो श्रेणी आपकी आवाज पर एक मनपसंद मॉडल ट्यून करें - मूल से प्रभावी योजना

सबसे अच्छे परिणाम के लिए, एक वक्‍ता के साथ स्वच्छ ऑडियो का प्रयोग करें, कोई पृष्ठभूमि संगीत, और प्राकृतिक भाषा नहीं ।

आवाज क्रेडिंग प्लान्स

स्वतंत्र, उन्नयन करें जब आपको ज्यादा की आवश्यकता हो

मुक्त
  • 5-60 दूसरे संदर्भ ऑडियो
  • मूल क्लोन गुणवत्ता
  • गपशपक मॉडल
  • एमपी3 आउटपुट
सबसे अधिक लोकप्रिय
मुक्त खाता
  • 10 मिनट संदर्भ ऑडियो + 15,000 वर्ण
  • सभी क्रास मॉडल
  • HD गुणवत्ता मोड
  • क्लोन किए ध्वनि सहेजें
  • क्रास- कैरिकार्ड
  • सभी आउटपुट फॉर्मेट्स
मुक्त पर हस्ताक्षर करें
प्रोग्रेड
  • 2 घंटे + संदर्भ ऑडियो
  • स्टूडियो- ऑस्पेक्ट क्लोन क्वालिटी
  • मनपसंद मॉडल बढ़िया आत्म - निर्माण
  • बैच पीढ़ी
  • एपीआई पहुँच
  • प्राथमिकता प्रक्रिया
उन्नयन

बार बार पूछे जाने वाले प्रश्न

एआई आवाज चालू करने के लिए गहरी सीखने का उपयोग छोटे ऑडियो नमूना से एक व्यक्ति की आवाज फिर से बनाने के लिए. एक बार क्लोन किया, आप नया भाषण तैयार कर सकते हैं जो मूल स्पीकर की तरह लगता है. आधुनिक मॉडलों को ऑडियो के 5 सेकंड के रूप में कम की जरूरत है.

चैटर बॉक्स सबसे अच्छा शून्य के नियंत्रण के साथ प्रस्तुत करता है. कोस्टीला 2 अन्य भाषाओं (8 भाषाओं) के लिए महान है. GEESCOGICOGICONDCOS सिर्फ 5 सेकेंड के साथ. ओपन एडविएशन शैली नियंत्रण प्रदान करता है.

अधिकांश मॉडल स्पष्ट ऑडियो के ५- 30 सेकंड के साथ काम करते हैं. लंबे नमूने (ऊपर 60 से 60 सेकंड) आम तौर पर अच्छे परिणाम उत्पन्‍न होते हैं. ऑडियो शुद्ध होना चाहिए, एकल बोलते हुए, संगीत या ध्वनि के बिना.

आपको केवल क्लोन आवाजों को इस्तेमाल करने की अनुमति है. इसमें आपकी आवाज, अपनी सहमति व्यक्‍तियों से ध्वनि, या उचित रूप से लाइसेंस्ड स्रोतों से ध्वनि शामिल है ।

हाँ! क्रॉस-मिंग मॉडल जैसे कि कोसिफिक 2 और जी.एन.एन.एस.

एक ही वक्‍ता के साथ एक साफ - सफाई का इस्तेमाल कीजिए, न तो पृष्ठभूमि में संगीत और आवाज़ ।

आवाज वैध है जब आप आवाज मालिक से सहमति है या अपनी आवाज का उपयोग करें. बहुत से आदेशों के पास आवाज समानता अधिकार की रक्षा करने के लिए कानून हैं. कभी भी ध्वनि की आवाज़ दूसरों, गहरीffaps बनाने, या धोखाधड़ी बनाने के लिए. हमेशा किसी और की आवाज से पहले उचित अनुमति प्राप्त करें.

Yes, on a paid plan, as long as you have the rights to the reference voice. This includes your own voice, hired voice actors who consent, or properly licensed voice samples. Audio generated on a paid plan can be used in products, videos and applications, and upgrading also covers audio you made earlier on the free tier; free-tier audio is for personal, non-commercial use. On every plan, cloning models marked "Personal and non-commercial use only" in the model picker, such as Spark TTS, are excluded: their authors allow non-commercial use only.

हाँ, पंजीकृत उपयोक्ता अपने खाते में क्लोन प्रवेश कर सकते हैं. एक बार सहेजा गया है, आप भविष्य की पीढ़ियों के लिए क्लोन आवाज फिर से उपयोग कर सकते हैं बिना ऑडियो को फिर से लोड कर सकते हैं. यह आपके खाते के भाग के अंतर्गत उपलब्ध है.

क्लोन किए गए आवाजों के साथ मॉडलों की तरह विशिष्ट भावनाओं को नियंत्रित करता है (आनंदित, दुःखद, क्रोधित, इत्यादि). अन्य मॉडल आपके लिखित ऑडियो से सामान्य स्वर और शैली आकर्षित करते हैं. सबसे उत्तम भावना ट्रांसफर के लिए, आपके संदर्भ नमूना में अप्रयोगात्मक बोली शामिल है.

आवाज साधारणतौर पर मॉडल और पाठ लंबाई के आधार पर 3-10 सेकंड लगते हैं. चैट बाक्स तथा GEBSOCONTCONT तेज के लिए प्रारूपित कर रहे हैं. पहली पीढ़ी के लिए ऑडियो प्रक्रियाओं के रूप में थोड़ा और अधिक समय लग सकता है.

COWTCTECPERTEPECETete-टीट के मॉडलों के लिए 4x अक्षरों पर मॉडलों की तरह। मुक्त खाता पाया साइन अप पर 15,000 अक्षर मिलता है। मानक-टी-टियर मॉडल कोक 2x अक्षरों के रूप में इस्तेमाल करता है।
5.0/5 (2)

क्या हम सुधार कर सकते हैं?

एआई के साथ कोई भी आवाज क्लोन करें

छोटा ऑडियो नमूना अपलोड करें और किसी भी आवाज़ में भाषण तैयार करना प्रारंभ करें. प्रारंभ करने के लिए स्वतंत्र साइन अप करें.