Malfermkoda teksto- al- parolmodeloName
Every TTS model on our platform is open source, and most use MIT or Apache 2.0. A few models and voices are licensed for non-commercial use only and are marked 'Personal and non-commercial use only'. Use them through our hosted API, or self-host them on your own infrastructure with full control.
Provu nun
Liberkoda TTS- avantaĝoj
Kial malfermkodaj modeloj gravas por viaj projektoj
Ĉiuj malfermkodaj licencoj
Ĉiu modelo en TTS.ai estas malfermkoda, kaj ĉiu modelopaĝo listigas sian permesilon. Neniu proprietrajta nigra skatolo kaj neniu vendisto-ŝloso.
Malferma fonta permesilo
Most models are licensed under MIT or Apache 2.0. A few use other licenses, and models or voices licensed for non-commercial use are marked "Personal and non-commercial use only".
Mem- gastigebla
Elŝuti iun ajn modelon kaj ruli ĝin sur via propra aparataro. Plena kontrolo super viaj datumoj, latenco, kaj infrastrukturo. Neniu nuba dependeco necesas.
GPU optimumigita
Modeloj estas optimumigitaj por NVIDIA GPUoj kun CUDA subteno. Piper ruliĝas nur sur CPU. Plej modeloj bezonas 2-8GB VRAM por efika deduktado.
Komunuma prizorgo
Aktivaj malfermkodaj komunumoj prizorgas kaj plibonigas tiujn modelojn. Bonvenaj estas kontribuoj — sendu erarojn, plibonigojn, kaj novajn voĉojn ĉe GitHub.
Komerca permesilo disponebla
Paga plano de $5/mo havas komercan permesilon por tio, kion vi generas, sen rajt- aŭ uzado-kostoj; la libera nivelo estas por persona uzo. Modeloj kaj voĉoj markitaj "Persona kaj ne-komerca uzo nur" estas ekskluditaj.
Nia katalogo de malfermitkodaj modeloj
Ĉiu modelo, ĝia licenco, kaj kion ĝi faras plej bone
Kokoro
Free
Lightweight 82M parameter model delivering studio-quality speech with blazing-fast inference.
Plej bona por: Apache 2.0 — plej bona kvalito libera modelo, 82M parametroj, facila por mem gastigi
Provu Kokoro
Piper
Free
A fast, local neural text to speech system optimized for Raspberry Pi and embedded devices.
Plej bona por: MIT — nur CPU, perfekta por periferiaj aparatoj kaj enkorpigita mem- gastigado
Provu Piper
VITS
Free
Conditional variational autoencoder with adversarial learning for end-to-end text-to-speech.
Plej bona por: MIT — fundamenta arkitekturo uzata de multaj malsupraj modeloj
Provu VITS
Bark
Standard
Transformer-based text-to-audio model that generates realistic speech, music, and sound effects.
Plej bona por: MIT — unikaj kapabloj de aŭdgenerado trans la norma TTS
Provu Bark
Tortoise TTS
Premium
Multi-voice text-to-speech focused on quality with autoregressive architecture.
Plej bona por: Apache 2.0 — maksimuma kvalito, amplekse studita referenca realigo
Provu Tortoise TTS
OpenVoice
Premium
Instant voice cloning with granular control over style, emotion, and accent.
Plej bona por: MIT — malfermkoda voĉklonado kun granula stilkontrolo
Provu OpenVoiceKiel uzi malfermkodan TTS
Uzi nian gastigantan API aŭ lanĉi modelojn mem
Esploras malfermkodajn modelojn
Rigardu nian katalogon de pli ol 20 malfermkodaj TTS-modeloj. Ĉiu modelopaĝo montras la permesilon, arkitekturon, kapablojn, kaj mem-gastigajn postulojn.
Provu en via retumilo
Testu iun ajn modelon rekte sur TTS.ai sen instali ion ajn. Niaj GPU-serviloj pritraktas la prilaboradon, do vi povas taksi la kvaliton antaŭ ol decidi pri mem-gastigado.
Mem- gastigi aŭ uzi nian API
Kloni modelajn deponejojn de GitHub kaj ruli lokajn, aŭ uzi nian gastigantan API por produktado. Mem-hostado donas plenan kontrolon; nia API provizas administritan infrastrukturon.
Konstrui vian aplikaĵon
Integri TTS en via produkto uzante mem-gastigajn modelojn aŭ nian REST API. Kontrolu ĉiun modelan permesilon unue: kelkaj modeloj kaj voĉoj estas por nekomerca uzo nur.
Komparo de permesiloj
Licenco de ĉiu modelo sur TTS.ai
| & Modelo: | Licenco | Komerca uzo | Ŝanĝo | Memkomputilo | Atribuo |
|---|---|---|---|---|---|
| Kokoro | Apache 2.0 | Necesa | |||
| Piper | MIT motoro; voĉaj permesoj varias | Nur kelkaj voĉoj | Opcia | ||
| VITS | MIT | Opcia | |||
| MeloTTS | MIT | Opcia | |||
| Chatterbox | MIT | Opcia | |||
| Tortoise TTS | Apache 2.0 | Necesa | |||
| StyleTTS 2 | MIT | Opcia | |||
| OpenVoice | MIT | Opcia | |||
| Sesame CSM | Apache 2.0 | Necesa | |||
| Orpheus | Llama 3.2 | "Built with Llama" | |||
| Spark TTS | CC BY-NC-SA 4.0 | Nur persona kaj nekomerca uzo | Necesa | ||
| OuteTTS | CC BY-NC-SA 4.0 | Nur persona kaj nekomerca uzo | Necesa |
Mem- gastigado kontraŭ gastigita API
Ruli modelojn mem aŭ lasi nin prizorgi la infrastrukturon
Self- Host sur via aparataro
Ĉiu modelo en TTS.ai estas havebla kiel malfermkoda projekto ĉe GitHub aŭ Hugging Face. Elŝutu la pezojn, instalu la dependecojn, kaj lanĉu inferecon sur viaj propraj GPUoj. Vi havas plenan kontrolon pri latenco, privateco, kaj skalado.
- Plena datuma privateco - la sono neniam forlasas vian servilon
- Neniu kosto por ĉiu peto post komenca agordo
- Propra agordado de viaj propraj datumoj
- Bezonas GPU- aparataron (NVIDIA rekomendita)
- Vi administras ĝisdatigojn, skaladon, kaj dependecojn
Uzi la gastigantan API de TTS.ai
Akiru tujan aliron al ĉiuj 20+ modeloj tra ununura REST API. Ni prizorgas GPU-provizon, modelajn ĝisdatigojn, vicadministradon, kaj skaladon. Unu API-ŝlosilo donas al vi aliron al ĉiu modelo — ne necesas administri apartajn disvolviĝojn.
- Neniu GPU- aparataro bezonata
- Ĉiuj 20+ modeloj tra unu API
- Aŭtomata ĝisdatigo kaj plibonigo de modeloj
- 99. 9% disponebleco kun redunda infrastrukturo
- Pagu nur por tio, kion vi uzas
Rapidstarto: API aŭ mem- gastiganto
Uzi nian gastigantan API, aŭ instali Kokoron loke en kelkaj minutoj
import requests
response = requests.post("https://api.tts.ai/v1/tts", json={
"text": "Open source TTS with a simple API.",
"model": "kokoro",
"voice": "af_heart",
"format": "wav"
}, headers={"Authorization": "Bearer YOUR_API_KEY"})
with open("output.wav", "wb") as f:
f.write(response.content)
# Install Kokoro locally
pip install kokoro
# Generate speech on your own GPU
import kokoro
pipeline = kokoro.KPipeline(lang_code="a")
generator = pipeline("Hello from your own server!", voice="af_heart")
for i, (gs, ps, audio) in enumerate(generator):
kokoro.save(audio, f"output_{i}.wav")
Malferma fonto, malmultekosta
Nia gastigita API faras malfermkodan TTS-on alirebla sen administri GPU-ojn.
Libera tavolo
$0
15, 000 signoj ĉe enskribo
- 4 malfermitkodaj modeloj senpage
- Neniu aliĝo por baza uzo
- Persona, nekomerca uzo
Lanĉilo
$9
500 kreditoj/monato
- Ĉiuj 20+ malfermkodaj modeloj
- Voĉa klonado
- API- aliro
Pro
$29
2000 kreditoj/monato
- Prioritata GPU- prilaborado
- Ĉiuj premium-modeloj
- Subteno por entreprenoj
Oftaj demandoj
Oftaj demandoj pri malfermkoda teksto-al-vorto
Kion ni povus plibonigi? Via reago helpas nin solvi problemojn.
Provu malfermkodan TTS hodiaŭ
20+ malfermkodaj modeloj, ĉiu kun sia licenco listigita. Uzu nian API aŭ mem-gastigadon, la elekto estas via.