Raporti cimon / funkcipeton

Malfermkoda teksto- al- parolmodeloName

Every TTS model on our platform is open source, and most use MIT or Apache 2.0. A few models and voices are licensed for non-commercial use only and are marked 'Personal and non-commercial use only'. Use them through our hosted API, or self-host them on your own infrastructure with full control.

Malferma fonto MIT-permesilo Apache Mem- gastigebla GitHub

Provu nun

Libera kun Kokoro, Piper, VITS, MeloTTS
Via generita sono aperos tie ĉi
Generita
0:00
Elŝuti
Ĉu vi ŝatas TTS.ai? Diru al viaj amikoj!

Liberkoda TTS- avantaĝoj

Kial malfermkodaj modeloj gravas por viaj projektoj

Ĉiuj malfermkodaj licencoj

Ĉiu modelo en TTS.ai estas malfermkoda, kaj ĉiu modelopaĝo listigas sian permesilon. Neniu proprietrajta nigra skatolo kaj neniu vendisto-ŝloso.

Malferma fonta permesilo

Most models are licensed under MIT or Apache 2.0. A few use other licenses, and models or voices licensed for non-commercial use are marked "Personal and non-commercial use only".

Mem- gastigebla

Elŝuti iun ajn modelon kaj ruli ĝin sur via propra aparataro. Plena kontrolo super viaj datumoj, latenco, kaj infrastrukturo. Neniu nuba dependeco necesas.

GPU optimumigita

Modeloj estas optimumigitaj por NVIDIA GPUoj kun CUDA subteno. Piper ruliĝas nur sur CPU. Plej modeloj bezonas 2-8GB VRAM por efika deduktado.

Komunuma prizorgo

Aktivaj malfermkodaj komunumoj prizorgas kaj plibonigas tiujn modelojn. Bonvenaj estas kontribuoj — sendu erarojn, plibonigojn, kaj novajn voĉojn ĉe GitHub.

Komerca permesilo disponebla

Paga plano de $5/mo havas komercan permesilon por tio, kion vi generas, sen rajt- aŭ uzado-kostoj; la libera nivelo estas por persona uzo. Modeloj kaj voĉoj markitaj "Persona kaj ne-komerca uzo nur" estas ekskluditaj.

Nia katalogo de malfermitkodaj modeloj

Ĉiu modelo, ĝia licenco, kaj kion ĝi faras plej bone

KokoroKokoro

Free

Lightweight 82M parameter model delivering studio-quality speech with blazing-fast inference.

Fiksa 5/5

Plej bona por: Apache 2.0 — plej bona kvalito libera modelo, 82M parametroj, facila por mem gastigi

Provu Kokoro

PiperPiper

Free

A fast, local neural text to speech system optimized for Raspberry Pi and embedded devices.

Fiksa 3/5

Plej bona por: MIT — nur CPU, perfekta por periferiaj aparatoj kaj enkorpigita mem- gastigado

Provu Piper

VITSVITS

Free

Conditional variational autoencoder with adversarial learning for end-to-end text-to-speech.

Fiksa 3/5

Plej bona por: MIT — fundamenta arkitekturo uzata de multaj malsupraj modeloj

Provu VITS

BarkBark

Standard

Transformer-based text-to-audio model that generates realistic speech, music, and sound effects.

Malrapide 4/5

Plej bona por: MIT — unikaj kapabloj de aŭdgenerado trans la norma TTS

Provu Bark

Tortoise TTSTortoise TTS

Premium

Multi-voice text-to-speech focused on quality with autoregressive architecture.

Malrapide 5/5 Voĉa klonado

Plej bona por: Apache 2.0 — maksimuma kvalito, amplekse studita referenca realigo

Provu Tortoise TTS

OpenVoiceOpenVoice

Premium

Instant voice cloning with granular control over style, emotion, and accent.

Medium 4/5 Voĉa klonado

Plej bona por: MIT — malfermkoda voĉklonado kun granula stilkontrolo

Provu OpenVoice

Kiel uzi malfermkodan TTS

Uzi nian gastigantan API aŭ lanĉi modelojn mem

1

Esploras malfermkodajn modelojn

Rigardu nian katalogon de pli ol 20 malfermkodaj TTS-modeloj. Ĉiu modelopaĝo montras la permesilon, arkitekturon, kapablojn, kaj mem-gastigajn postulojn.

2

Provu en via retumilo

Testu iun ajn modelon rekte sur TTS.ai sen instali ion ajn. Niaj GPU-serviloj pritraktas la prilaboradon, do vi povas taksi la kvaliton antaŭ ol decidi pri mem-gastigado.

3

Mem- gastigi aŭ uzi nian API

Kloni modelajn deponejojn de GitHub kaj ruli lokajn, aŭ uzi nian gastigantan API por produktado. Mem-hostado donas plenan kontrolon; nia API provizas administritan infrastrukturon.

4

Konstrui vian aplikaĵon

Integri TTS en via produkto uzante mem-gastigajn modelojn aŭ nian REST API. Kontrolu ĉiun modelan permesilon unue: kelkaj modeloj kaj voĉoj estas por nekomerca uzo nur.

Komparo de permesiloj

Licenco de ĉiu modelo sur TTS.ai

& Modelo: Licenco Komerca uzo Ŝanĝo Memkomputilo Atribuo
Kokoro Apache 2.0 Necesa
Piper MIT motoro; voĉaj permesoj varias Nur kelkaj voĉoj Opcia
VITS MIT Opcia
MeloTTS MIT Opcia
Chatterbox MIT Opcia
Tortoise TTS Apache 2.0 Necesa
StyleTTS 2 MIT Opcia
OpenVoice MIT Opcia
Sesame CSM Apache 2.0 Necesa
Orpheus Llama 3.2 "Built with Llama"
Spark TTS CC BY-NC-SA 4.0 Nur persona kaj nekomerca uzo Necesa
OuteTTS CC BY-NC-SA 4.0 Nur persona kaj nekomerca uzo Necesa

Mem- gastigado kontraŭ gastigita API

Ruli modelojn mem aŭ lasi nin prizorgi la infrastrukturon

Self- Host sur via aparataro

Ĉiu modelo en TTS.ai estas havebla kiel malfermkoda projekto ĉe GitHub aŭ Hugging Face. Elŝutu la pezojn, instalu la dependecojn, kaj lanĉu inferecon sur viaj propraj GPUoj. Vi havas plenan kontrolon pri latenco, privateco, kaj skalado.

  • Plena datuma privateco - la sono neniam forlasas vian servilon
  • Neniu kosto por ĉiu peto post komenca agordo
  • Propra agordado de viaj propraj datumoj
  • Bezonas GPU- aparataron (NVIDIA rekomendita)
  • Vi administras ĝisdatigojn, skaladon, kaj dependecojn

Uzi la gastigantan API de TTS.ai

Akiru tujan aliron al ĉiuj 20+ modeloj tra ununura REST API. Ni prizorgas GPU-provizon, modelajn ĝisdatigojn, vicadministradon, kaj skaladon. Unu API-ŝlosilo donas al vi aliron al ĉiu modelo — ne necesas administri apartajn disvolviĝojn.

  • Neniu GPU- aparataro bezonata
  • Ĉiuj 20+ modeloj tra unu API
  • Aŭtomata ĝisdatigo kaj plibonigo de modeloj
  • 99. 9% disponebleco kun redunda infrastrukturo
  • Pagu nur por tio, kion vi uzas

Rapidstarto: API aŭ mem- gastiganto

Uzi nian gastigantan API, aŭ instali Kokoron loke en kelkaj minutoj

Opcio 1: TTS.ai gastigita API Plej facila
import requests

response = requests.post("https://api.tts.ai/v1/tts", json={
    "text": "Open source TTS with a simple API.",
    "model": "kokoro",
    "voice": "af_heart",
    "format": "wav"
}, headers={"Authorization": "Bearer YOUR_API_KEY"})

with open("output.wav", "wb") as f:
    f.write(response.content)
Opcio 2: mem- gastiganto kun pip Plena kontrolo
# Install Kokoro locally
pip install kokoro

# Generate speech on your own GPU
import kokoro

pipeline = kokoro.KPipeline(lang_code="a")
generator = pipeline("Hello from your own server!", voice="af_heart")
for i, (gs, ps, audio) in enumerate(generator):
    kokoro.save(audio, f"output_{i}.wav")

Malferma fonto, malmultekosta

Nia gastigita API faras malfermkodan TTS-on alirebla sen administri GPU-ojn.

Libera tavolo

$0

15, 000 signoj ĉe enskribo

  • 4 malfermitkodaj modeloj senpage
  • Neniu aliĝo por baza uzo
  • Persona, nekomerca uzo

Lanĉilo

$9

500 kreditoj/monato

  • Ĉiuj 20+ malfermkodaj modeloj
  • Voĉa klonado
  • API- aliro

Pro

$29

2000 kreditoj/monato

  • Prioritata GPU- prilaborado
  • Ĉiuj premium-modeloj
  • Subteno por entreprenoj
Vidu plenan priskribon

Oftaj demandoj

Oftaj demandoj pri malfermkoda teksto-al-vorto

Yes, every model on TTS.ai is open source, and most use MIT or Apache 2.0. A few use other licenses, including some licensed for non-commercial use only, which are marked "Personal and non-commercial use only" in the voice picker. Each model page lists its license.

Ambaŭ estas permesaj malfermkodaj permesiloj kiuj permesas komercan uzon, modifadon kaj redistribuadon. Apache 2. 0 aldonas eksplicitajn patentajn permesojn kaj postulas deklari ŝanĝojn se vi modifas la kodon. MIT estas pli simpla kun malpli da postuloj. Ambaŭ estas komercemaj.

Jes. Ĉiu modelo povas esti mem-gastigata. Klonu la modelan deponejon de GitHub, instalu dependecojn, elŝutu modelajn pezojn, kaj lanĉu dedukton. Ni provizas dokumentaron por ĉiu modelo mem-gastigaj postuloj inkluzive de GPU, RAM, kaj Pitona versio.

Postuloj varias laŭ modelo. Piper bezonas neniun GPU (nur CPU). Kokoro kaj MeloTTS bezonas 1-2GB VRAM. Plej multaj normaj modeloj bezonas 4GB VRAM. Tortoise kaj Sesame CSM bezonas 8GB. NVIDIA RTX 3060 (12GB) povas ruli plej multajn modelojn komforte.

Jes. Malfermkodaj licencoj permesas modifadon inkluzive de finpolurado. Modeloj kiel GPT-SoVITS kaj Bark disponigas finpolurajn skriptojn. Vi povas trejni modelojn sur viaj propraj voĉaj datumoj por krei proprajn voĉojn aŭ plibonigi rendimenton por specifaj lingvoj.

La plej bonaj malfermkodaj modeloj (Kokoro, StyleTTS 2, Chatterbox) nun egalas aŭ superas komercajn servojn kiel ElevenLabs kaj Google TTS laŭ kvalitaj kriterioj. La ĉefa avantaĝo de komercaj servoj estas administrita infrastrukturo kaj subteno, ne sonkvalito.

Kelkaj estis forigitaj: XTTS/XTTS-v2 (Coqui's CPML, nekomerca), F5-TTS (CC-BY-NC, nekomerca) kaj Higgs-v2 (Boson License, restrikta). Kelkaj restantaj modeloj kaj voĉoj, kiel Spark TTS, OuteTTS kaj plejparto de Piper-voĉoj, estas licencitaj nur por nekomerca uzo; ili estas markitaj "Persona kaj nekomerca uzo nur" en la voĉelektilo, do uzu alian voĉon por komercaj projektoj.

Jes. Plej multaj modeloj akceptas kontribuojn de la komunumo per GitHub. Vi povas sendi eraroraportojn, voĉajn registraĵojn por novaj lingvoj, kodajn plibonigojn, kaj dokumentaron. Kontrolu la GitHub-deponejon de ĉiu modelo por kontribuaj gvidlinioj kaj aktivaj problemoj.

Ŝargi modelojn laŭ postulo kaj malŝargi kiam neaktiva por kunhavigi GPU-memoron. Nia GPU-servilo ruligas pli ol 20 modelojn sur 4x Tesla P40 (96GB totala VRAM) uzante dinamikan ŝargadon. Por mem-gastigado, ununura 24GB GPU povas servi 3-5 modelojn samtempe.

Multaj modeloj provizas oficialajn Docker-bildojn aŭ Docker-dosierojn. Por ruli plurajn modelojn, vi povas konstrui propran Docker-agordon per NVIDIA Container Toolkit por GPU-aliro. Nia API-servila arkitekturo povas servi kiel referenca realigo.

Plej multaj modeloj bezonas Pitonon 3.10-3.12. Coqui TTS (VITS) specife bezonas Pitonon 3.11. Ni rekomendas Pitonon 3.12 por plej multaj modeloj. Kontrolu la dosierujon requirements.txt de ĉiu modelo por ekzakta versia kongrueco.

If you self-host, mostly yes: MIT and Apache 2.0 licenses explicitly allow commercial use, and most models here use them, so you can build SaaS products, mobile apps, games and services with no licensing fees or royalties. Check the license on each model page first, because a few models and voices are non-commercial. Audio generated on TTS.ai itself follows your plan: personal use on the free tier, commercial use on any paid plan.
5.0/5 (1)

Kion ni povus plibonigi? Via reago helpas nin solvi problemojn.

Provu malfermkodan TTS hodiaŭ

20+ malfermkodaj modeloj, ĉiu kun sia licenco listigita. Uzu nian API aŭ mem-gastigadon, la elekto estas via.