Umthombo ovulekile we-Text to Speech Models
Yonke imodeli ye-TTS kwi-platform yethu ivulekile, futhi kusetshenziswa kakhulu i-MIT noma i-Apache 2.0. Imodeli nezwi elilodwa livunyelwe ukusebenzisa kuphela okungaba khona kokuthengiswayo futhi liphawulwe 'Ukusetshenziswa komuntu siqu nokungaba khona kokuthengiswayo kuphela'. Sebenzisa ngazo nge-API yethu ehostelwe, noma ubeke i-host yakho ku-infrastructure yakho yokulawula okugcwele.
Zama manje
Imiphumela ye-TTS yomthombo ovulekile
Kungani amamodeli avulekile abalulekile kumaphrojekthi akho
Zonke izitifiketi ezivulekile
Yonke imodeli ku-TTS.ai ivela kumthombo ovulekile, futhi yonke ikhasi lemodeli libonisa ilayisense layo. Akukho amabhokisi amnyama asemthethweni futhi akukho umhlinzeki ovala ngaphakathi.
Ilayisense yomthombo ovulekile
Izinhlobo eziningi zivunyelwe ngaphansi kwe MIT noma i-Apache 2.0. Ezinye zisebenzisa ezinye izinqumo, futhi izinhlobo noma izizwi ezivunyelwe ukusetshenziswa okungahwebi ziphawulwe "Ukusetshenziswa komuntu siqu nokungenahwebi kuphela".
I-self-hosted
Layisha ngezansi noma iyiphi imodeli bese uyiqhuba kwihardware yakho. Ukulawula okuphelele kudatha yakho, ukuphuma kwesikhathi, kanye nesakhiwo. Akukho sidingo sokungathembeki kwe-cloud.
GPU engcono kakhulu
Amamodeli alungele i-NVIDIA GPUs ne-CUDA support. I-Piper isebenza ku-CPU kuphela. Amamodeli amaningi adinga i-2-8GB VRAM ukuze kusebenze ukubikezela.
Inhlangano elondolozwe
Imindeni esebenzayo evulekile igcina futhi ithuthukise lezi zinhlobo. Izithonyelwe zidlalwa — thumela amaphutha, ukuthuthukiswa, namazwi amasha ku-GitHub.
Ilayisense Elisemthethweni Elikhona
I-plan ekhokhelwa kusuka ku-$5/mo ifaka ilayisense lokuthengiswa kwezimpahla, ngaphandle kwe-royalties noma izindleko zokusetshenziswa; i-level emahhala isetshenziswa ngokwezifiso. Amamodeli namazwi aphawulwe "Ukusetshenziswa kwezenhlalo nokungasebenzisi kwezenhlalo kuphela" akhishwa.
I-Open Source Model Catalog yethu
Yonke imodeli, ilayisense layo, nokuthi isebenza kanjani kahle
Kokoro
Free
Lightweight 82M parameter model delivering studio-quality speech with blazing-fast inference.
Okungcono kakhulu: Apache 2.0 — imodeli esezingeni eliphakeme, 82M params, elula ukuphatha ngokwayo
Zama Kokoro
Piper
Free
A fast, local neural text to speech system optimized for Raspberry Pi and embedded devices.
Okungcono kakhulu: MIT — CPU kuphela, ilungile kumadivayisi engxenyeni kanye nokuhoxiswa kwe-self-hosting okufakwe
Zama Piper
VITS
Free
Conditional variational autoencoder with adversarial learning for end-to-end text-to-speech.
Okungcono kakhulu: MIT — isakhiwo esiyinhloko esisetshenziswa ngamamodeli amaningi aphansi
Zama VITS
Bark
Standard
Transformer-based text-to-audio model that generates realistic speech, music, and sound effects.
Okungcono kakhulu: MIT — ukukhiqizwa komsindo okuhlukile ngaphezu kwe-TTS ejwayelekile
Zama Bark
Tortoise TTS
Premium
Multi-voice text-to-speech focused on quality with autoregressive architecture.
Okungcono kakhulu: Apache 2.0 — ubukhulu bekhwalithi, ukubuyekezwa okubanzi kokucwaninga
Zama Tortoise TTS
OpenVoice
Premium
Instant voice cloning with granular control over style, emotion, and accent.
Okungcono kakhulu: MIT — ukuklonya umsindo ovulekile-umthombo ngesimo sokulawula esincane
Zama OpenVoiceIndlela yokusetshenziswa kwe-Open Source TTS
Sebenzisa i-API yethu ehostelwe noma uqhube amamodeli ngokwakho
Thola amamodeli avulekile
Thola i-catalog yethu ye-20+ open-source TTS models. Ikhasi ngalinye lemodeli libonisa ilayisense, i-architecture, izimfanelo, kanye nezidingo zokuqasha.
Zama kwi-Browser yakho
Ukuhlolwa kwemodeli ngayinye ngokuqondile ku-TTS.ai ngaphandle kokufaka noma yini. Amaseva ethu we-GPU aphatha ukucubungula ukuze ukwazi ukulinganisa ukhwalithi ngaphambi kokufaka i-self-hosting.
Usizo lwe-API
Uklonyelisa imodeli ye-repos kusuka ku-GitHub futhi uqhube endaweni, noma sebenzisa i-API yethu ehostelwe ukukhishwa. Ukuhoxiswa kwe-self-hosting kunikeza ukulawula okuphelele; i-API yethu inikeza isakhiwo esilawulwayo.
Dala isisebenziso sakho
I-TTS ifaka i-TTS kumkhiqizo wakho usebenzisa amamodeli ahlala akhona noma i-REST API yethu. Khangela ilayisense ngayinye yemodeli kuqala: amamodeli ambalwa namazwi asetshenziswa kuphela ngaphandle kokuthengiswa.
Ukuqhathaniswa kwelayisense
Ilayisense yemodeli ngayinye ku-TTS.ai
| Imodeli | Ilayisense | Ukusetshenziswa kwebhizinisi | Ukushintsha | Umphathi-we-wedwa | Ukunikezwa |
|---|---|---|---|---|---|
| Kokoro | Apache 2.0 | Kudingeka | |||
| Piper | MIT engine; izilayisense zomsindo zihluka | Ezinye izizwi kuphela | Okukhethwa kukho | ||
| VITS | MIT | Okukhethwa kukho | |||
| MeloTTS | MIT | Okukhethwa kukho | |||
| Chatterbox | MIT | Okukhethwa kukho | |||
| Tortoise TTS | Apache 2.0 | Kudingeka | |||
| StyleTTS 2 | MIT | Okukhethwa kukho | |||
| OpenVoice | MIT | Okukhethwa kukho | |||
| Sesame CSM | Apache 2.0 | Kudingeka | |||
| Orpheus | Llama 3.2 | "Built with Llama" | |||
| Spark TTS | CC BY-NC-SA 4.0 | Ukusetshenziswa komuntu siqu nokungasebenzisi ibhizinisi kuphela | Kudingeka | ||
| OuteTTS | CC BY-NC-SA 4.0 | Ukusetshenziswa komuntu siqu nokungasebenzisi ibhizinisi kuphela | Kudingeka |
Ukuhlala ngokwezifiso vs. Ukuhlala API
Sebenzisa amamodeli wena noma sivumele siphathe isakhiwo
Umphathi-we-self ku-hardware yakho
Yonke imodeli ku-TTS.ai itholakala njengephrojekthi yomthombo ovulekile ku-GitHub noma ku-Hugging Face. Layisha ngezansi amasisindo, ufake izi dependances, futhi uqhube ukubikezela ku-GPUs zakho. Unomkhawulo ophelele wokulawula, ubumfihlo, nokukala.
- Ukuvikelwa kwedatha okuphelele — umsindo awusoze ushiya isisebenzisi sakho
- Akukho zindleko ezidingayo ngemuva kokumiswa kokuqala
- Ukuhlela ngokuzimela kudatha yakho
- Idinga i-hardware ye-GPU (i-NVIDIA ivunyelwe)
- Uphatha ukuhlaziywa, ukukala, kanye nokwethembeka
Sebenzisa i-TTS.ai Hosted API
Ukuthola ukufinyelela ngokushesha kuzo zonke 20 + imodeli nge REST API eyodwa. Siphatha GPU ukuhlinzekwa, imodeli ukuhlaziywa, ukulawula iqoqo, kanye nokulinganisa. I-API eyodwa inkinobho ikunikeza ukufinyelela kunoma iyiphi imodeli - akukho sidingo sokuphatha izisebenzisi ezahlukene.
- Akukho mishini ye-GPU edingekayo
- Zonke imodeli ezingu-20+ nge-API eyodwa
- Ukuhlaziywa nokuthuthukiswa kwemodeli ngokuzenzakalela
- 99.9% uptime ngesakhiwo esiningi
- Imali kuphela ngento oyisebenzisayo
Qala ngokushesha: API noma umphathi-we-self
Sebenzisa i-API yethu ehostelwe, noma ufake i-Kokoro endaweni emizuzwini
import requests
response = requests.post("https://api.tts.ai/v1/tts", json={
"text": "Open source TTS with a simple API.",
"model": "kokoro",
"voice": "af_heart",
"format": "wav"
}, headers={"Authorization": "Bearer YOUR_API_KEY"})
with open("output.wav", "wb") as f:
f.write(response.content)
# Install Kokoro locally
pip install kokoro
# Generate speech on your own GPU
import kokoro
pipeline = kokoro.KPipeline(lang_code="a")
generator = pipeline("Hello from your own server!", voice="af_heart")
for i, (gs, ps, audio) in enumerate(generator):
kokoro.save(audio, f"output_{i}.wav")
Umthombo ovulekile, ukuthengwa okunethezeka
I-API yethu ehostelwe yenza ukuthi i-open-source TTS ifinyeleleke ngaphandle kokuphatha ama-GPUs.
Izinga elikhululekile
$0
15,000 amaphawu ngesikhathi sokubhalisa
- 4 amamodeli avulekile-source amahhala
- Akukho ubhaliso lokusetshenziswa okujwayelekile
- Ukusetshenziswa komuntu siqu, okungaba yibhizinisi
Isiqalisi
$9
500,000 characters/month
- Zonke imodeli ezingu-20+ ezivulekile
- Ukuklona umsindo
- Ukufinyelela kwe-API
I-Pro
$29
2,000,000 characters/month
- Ukuphathwa kwe-GPU okunesihluthulelo
- Zonke imodeli eziphezulu
- Usizo lwebhizinisi
Imibuzo ebuzwa kaningi
Imibuzo ejwayelekile mayelana ne-open source text to speech
Yini esingayithuthukisa? Umbono wakho usiza ukuxazulula izinkinga.
Zama i-Open Source TTS namhlanje
20+ amamodeli avulekile, ngayinye inelayisense elibhalwe phansi. Sebenzisa i-API yethu noma umphathi, ukhetho luyakho.