पाठ को बोलने के लिए खोलें
हमारे मंच पर हर टीएस मॉडल खुला है, और सबसे अधिक MTCT या 2.0 का उपयोग करें. कुछ मॉडल और आवाज गैर-कंत्र उपयोग के लिए लाइसेंस और केवल 'निजी और गैर-कानूनी उपयोग के लिए' चिह्नित हैं. इन्हें हमारे होस्ट्ड या स्वापरपर नियंत्रण के माध्यम से इस्तेमाल करें.
अब इसे कोशिश करें
स्रोत टीएसएस फ़ायदे खोलें
अपने परियोजनाओं के लिए खुला विकल्प विषय क्यों खोलें
सभी खुले स्रोत लाइसेंस
Every model on TTS.ai is open source, and each model page lists its license. No proprietary black boxes and no vendor lock-in.
स्रोत लाइसेंस खोलें
अधिकतर मॉडल एमटीटी या 2.0 के तहत लाइसेंस दिए जाते हैं. कुछ लाइसेंस, और मॉडल या आवाजों का उपयोग गैर-क्शन के लिए किया गया है "निजी और गैर-c हक़ का प्रयोग केवल निजी रूप से किया जाता है.
स्व- होस्ट- नहीं
कोई मॉडल डाउनलोड करें और इसे अपने स्वयं के हार्डवेयर पर चलाएँ. आपके डाटा, लेटनर तथा इन्फाइस पर पूरा नियंत्रण है. बादल की आवश्यकता नहीं है.
गापीयू ऑप्टीमाइज़्ड
NVIDIA समर्थन के साथ NUPEPEACA के लिए मॉडलों का प्रतिनिधित्व किया जा रहा है. पाइप केवल सीपीयू पर चलता है. अधिकांश मॉडलों को 2-8-8GB वेन के लिए कुशल के लिए तैयार होना चाहिए.
समाज को बरकरार रखा गया
सक्रिय स्रोत समूह इन मॉडलों को बनाए रखते हैं और सुधार करते हैं. सहयोग दें - बग- फ़लब पर बग सुधार, सुधार तथा नए आवाज को स्वीकार करें.
व्यावसायिक लाइसेंस उपलब्ध
$5/मो से भुगतान योजना आप जो उत्पन्न करते हैं, व्यापार लाइसेंस ले रहे हैं, कोई शाही जाकाल या उपयोग भुगतान भुगतान के लिए; वर्वर निजी उपयोग के लिए है। मॉडल और आवाज चिह्नित "निजी और गैर-craphrapher" का उपयोग केवल अलग कर रहे हैं।
हमारा ओपन स्रोत मॉडल कैटालॉग
हर मॉडल, अपने लाइसेंस, और जो अच्छा करता है
Kokoro
Free
Lightweight 82M parameter model delivering studio-quality speech with blazing-fast inference.
के लिए उत्तम: DROWOT 2. 0 — उत्तम गुण मुक्त मॉडल, 82M खड़े, स्व-होल के लिए आसान
कोशिश करें Kokoro
Piper
Free
A fast, local neural text to speech system optimized for Raspberry Pi and embedded devices.
के लिए उत्तम: MIT — सिर्फ सीपीयू, किनारा उपकरणों के लिए सिद्ध और अंतर्निर्मित स्व- होस्टिंग
कोशिश करें Piper
VITS
Free
Conditional variational autoencoder with adversarial learning for end-to-end text-to-speech.
के लिए उत्तम: देश — बहुत - से मॉडलों के ज़रिए इस्तेमाल की गयी नींव - पत्थर की बनावट
कोशिश करें VITS
Bark
Standard
Transformer-based text-to-audio model that generates realistic speech, music, and sound effects.
के लिए उत्तम: देश — मानक टी से परे विशिष्ट ऑडियो पीढ़ी क्षमताओं को विशिष्ट किया जा सकता है
कोशिश करें Bark
Tortoise TTS
Premium
Multi-voice text-to-speech focused on quality with autoregressive architecture.
के लिए उत्तम: 2.0 — अधिकतम गुणवत्ता, व्यापक संदर्भ कार्यान्वयन का अध्ययन
कोशिश करें Tortoise TTS
OpenVoice
Premium
Instant voice cloning with granular control over style, emotion, and accent.
के लिए उत्तम: MTAT - ओपन-source परस्पर आग्रही शैली के साथ खोलें
कोशिश करें OpenVoiceकैसे खोलें स्रोत TS का प्रयोग करें
हमारे मेजबान्ड एपीआई का उपयोग करें या अपने आप को मॉडल चलाने के लिए
स्रोत मॉडल तैयार करें
20+ open-source टीएस मॉडल की हमारी सूची ब्राउज़ करें. प्रत्येक मॉडल पृष्ठ लाइसेंस, निर्माण, क्षमताओं, और स्व- युक्ति माँगों को दिखाता है.
अपने ब्राउज़र में कोशिश करें
कोई भी मॉडल सीधे TTS.ai पर जाँच बिना कुछ भी अधिष्ठापन के. हमारे जीपी सर्वर प्रक्रिया संभाल करता है ताकि आप खुद को संस्थापित करने से पहले गुणवत्ता की जाँच कर सकें.
स्व-धन या हमारे एपीआई का प्रयोग
GitHb से फिर से कनेक्ट करें और स्थानीय रूप से चलाने के लिए, या उत्पादन के लिए हमारे मेजबान्ड एपीआई इस्तेमाल करें. स्व-होलिंग पूर्ण नियंत्रण देता है, हमारा एपीआई sfundacents में सक्षम प्रदान करता है.
आपके अनुप्रयोग बिल्ड करें
स्वयं के मॉडल या हमारी steab. हर मॉडल लाइसेंस पहले देखें: कुछ मॉडल और आवाज अ-कंपर्य उपयोग के लिए हैं.
लाइसेंस तुलना
License of each model on TTS.ai
| मॉडल | लाइसेंस | व्यावसायिक उपयोग | परिवर्धन | स्व- होस्ट | आस - पास की आयतों पर गौर कीजिए । |
|---|---|---|---|---|---|
| Kokoro | Apache 2.0 | आवश्यक | |||
| Piper | MIT इंजिन; आवाज लाइसेंस अलग | कुछ ध्वनि केवल | वैकल्पिक | ||
| VITS | MIT | वैकल्पिक | |||
| MeloTTS | MIT | वैकल्पिक | |||
| Chatterbox | MIT | वैकल्पिक | |||
| Tortoise TTS | Apache 2.0 | आवश्यक | |||
| StyleTTS 2 | MIT | वैकल्पिक | |||
| OpenVoice | MIT | वैकल्पिक | |||
| Sesame CSM | Apache 2.0 | आवश्यक | |||
| Orpheus | Llama 3.2 | "Built with Llama" | |||
| Spark TTS | CC BY-NC-SA 4.0 | सिर्फ निजी तथा गैर-c्शन प्रयोग | आवश्यक | ||
| OuteTTS | CC BY-NC-SA 4.0 | सिर्फ निजी तथा गैर-c्शन प्रयोग | आवश्यक |
स्व-Hobs मेजबानित एपीआई
अपने आप को आदर्श चलाएँ या हम इन्फ्रास्ट्रक्चर को संभाल लें
आपके हार्डवेयर पर स्व-Hol
TTS.ai पर प्रत्येक मॉडल एक खुले स्रोत परियोजना के रूप में मौजूद है GiHHHब या Hyfing चेहरे पर. डाउनलोड, निर्भरता संस्थापित करें, और अपने स्वयं के जीपीएस पर चलाने के लिए चलाएँ. आपके पास देर से अधिक गोपनीयता, गोपनीयता, और स्केलिंग पर पूरी तरह नियंत्रण है.
- पूर्ण डाटा गोपनीयता — ऑडियो आपके सर्वर को कभी नहीं छोड़ता
- आरंभिक सेटअप के बाद कोई भी प्रति- निर्धारित लागत नहीं
- अपने स्वयं के डेटा पर मनपसंद बढ़िया-चंजिंग
- GPS हार्डवेयर की आवश्यकता है (एनईआईएमई अनुशंसित)
- आप अद्यतन, स्केलिंग, और निर्भरता प्रबंधन
TTS.ai होस्ट का प्रयोग करें
एक एकल पुनःसंक्रिया के माध्यम से सभी 20+ मॉडलों के लिए तत्काल पहुँच प्राप्त करें. हम GuUPATaning, मॉडल अद्यतन, कतार प्रबंधन प्रबंधन, और स्केलिंग नियंत्रण संभालता है. एक एपीआई कुंजी आपको हर मॉडल तक पहुँचने की जरूरत नहीं है, अलग-अलग निगरानी का प्रबंधन करने की जरूरत नहीं है.
- कोई GPS हार्डवेयर आवश्यक नहीं
- सभी 20+ मॉडल एक अक्षर के माध्यम से
- स्वचालित मॉडल अद्यतन तथा सुधार
- 99. 9% वैकल्पिक इंस्फीयर के साथ ऊपर का समय
- "तुम बदला वही तो पाओगे जो तुम करते हो
क्विक प्रारंभ: एपीआई या स्व- युक्ति
हमारे मेजबान्ड एपीआई इस्तेमाल करें, या मिनट में कोकोरो स्थानीय संस्थापित करें
import requests
response = requests.post("https://api.tts.ai/v1/tts", json={
"text": "Open source TTS with a simple API.",
"model": "kokoro",
"voice": "af_heart",
"format": "wav"
}, headers={"Authorization": "Bearer YOUR_API_KEY"})
with open("output.wav", "wb") as f:
f.write(response.content)
# Install Kokoro locally
pip install kokoro
# Generate speech on your own GPU
import kokoro
pipeline = kokoro.KPipeline(lang_code="a")
generator = pipeline("Hello from your own server!", voice="af_heart")
for i, (gs, ps, audio) in enumerate(generator):
kokoro.save(audio, f"output_{i}.wav")
स्रोत खोलें, AfrfordPing
हमारे मेजबानित एपीआई GUs के प्रबंधन के बिना ओपन-source Tecuts उपलब्ध बनाता है.
फ्री टीयर
$0
साइन अप पर 50 श्रेय
- 4 खुला- स्रोत मॉडल मुक्त
- मूल उपयोग के लिए कोई हस्ताक्षर नहीं
- निजी, नॉन-comिक उपयोग
प्रारंभ
$9
5,00,000 अक्षर/ माह
- सभी 20+ खुले स्रोत मॉडल
- आवाज कहीं नहीं
- एपीआई पहुँच
प्रोग्रेड
$29
2 लाख अक्षर/ माह
- प्राथमिकता जीपिपी प्रक्रिया
- सभी प्रीडिनियम मॉडल
- छोटे समर्थन
बार बार पूछे जाने वाले प्रश्न
खुले स्रोत पाठ को बोलने के बारे में आम सवाल
क्या हम सुधार कर सकते हैं?
आज खोलने की कोशिश करें
20+ खुली श्रोत मॉडल, प्रत्येक अपने लाइसेंस सूचीबद्ध है. हमारे एपीआई या स्व-host का प्रयोग करें, विकल्प आपका है.