Avaa lähdekoodin teksti puhemalleille
Jokainen alustamme TTS-malli on avoin lähdekoodi, ja useimmat käyttävät MIT:tä tai Apache 2.0:a. Muutamat mallit ja äänet on lisensoitu vain ei-kaupalliseen käyttöön ja niissä on merkintä "vain henkilökohtainen ja ei-kaupallinen käyttö". Käytä niitä isäntärajapintamme kautta tai itseisännät niitä omassa infrastruktuurissasi täysin hallinnassasi.
Kokeile nyt
Avoimen lähdekoodin TTS-edut
Miksi avoimen lähdekoodin malleilla on merkitystä projekteillesi
Kaikki avoimen lähdekoodin lisenssit
Jokainen TTS.ai-malli on avoin lähdekoodi, ja jokainen mallisivu listaa lisenssinsä. Ei omia mustia laatikoita eikä myyjän lukitusta.
Avoimen lähdekoodin lisenssit
Useimmat mallit ovat MIT:n tai Apache 2.0:n käyttölupia. Muutamat käyttävät muita lisenssejä, ja ei-kaupalliseen käyttöön luvan saaneet mallit tai äänet on merkitty "vain henkilökohtaiseen ja ei-kaupalliseen käyttöön".
Omaehtoinen
Lataa mikä tahansa malli ja käytä sitä omalla laitteistollasi. Tietojesi, latenssisi ja infrastruktuurisi täysi hallinta. Pilviriippuvuus ei ole tarpeen.
GPU optimoitu
Mallit on optimoitu NVIDIA GPU -laitteille CUDA-tuella. Piper toimii vain suorittimella. Useimmat mallit tarvitsevat 2-8GB VRAM-muistia tehokasta päättelyä varten.
Yhteisöä ylläpidetään
Aktiiviset avoimen lähdekoodin yhteisöt ylläpitävät ja parantavat näitä malleja. Lahjoitukset ovat tervetulleita – lähettävät vikoja, parannuksia ja uusia ääniä GitHubille.
Kaupallinen lisenssi saatavilla
Maksullinen suunnitelma 5 dollaria/m2 sisältää kaupallisen lisenssin sille, mitä luot, ilman rojalteja tai käyttömaksuja; ilmainen taso on henkilökohtaiseen käyttöön. Mallit ja äänet, joissa on merkintä "vain henkilökohtaiseen ja ei-kaupalliseen käyttöön", eivät sisälly hintaan.
Avoimen lähdekoodin malliluettelo
Jokainen malli, sen lisenssi ja se, mitä se tekee parhaiten
Kokoro
Free
Lightweight 82M parameter model delivering studio-quality speech with blazing-fast inference.
Paras: Apache 2.0 – paras laatuvapaa malli, 82M paraamia, helppo itseisäntä
Kokeile Kokoro
Piper
Free
A fast, local neural text to speech system optimized for Raspberry Pi and embedded devices.
Paras: MIT – vain prosessori, täydellinen reunalaitteisiin ja itseohjautuviin laitteisiin
Kokeile Piper
VITS
Free
Conditional variational autoencoder with adversarial learning for end-to-end text-to-speech.
Paras: MIT – monien alapään mallien käyttämä perusarkkitehtuuri
Kokeile VITS
Bark
Standard
Transformer-based text-to-audio model that generates realistic speech, music, and sound effects.
Paras: MIT – TTS-standardia paremmat ainutlaatuiset äänentuotantoominaisuudet
Kokeile Bark
Tortoise TTS
Premium
Multi-voice text-to-speech focused on quality with autoregressive architecture.
Paras: Apache 2.0 – huippulaatua, laajalti tutkittu referenssitoteutus
Kokeile Tortoise TTS
OpenVoice
Premium
Instant voice cloning with granular control over style, emotion, and accent.
Paras: MIT – avoimen lähdekoodin äänikloonaus rakeisella tyyliohjauksella
Kokeile OpenVoiceMiten avoimen lähdekoodin TTS:ää käytetään
Käytä isännöityä API-rajapintaamme tai suorita mallit itse
Tutki Open-Source-malleja
Selaile 20+ avoimen lähdekoodin TTS-malleja. Jokainen mallisivu näyttää lisenssin, arkkitehtuurin, kyvyt ja omatoimisuuden vaatimukset.
Kokeile selaintasi
Testaa mikä tahansa malli suoraan TTS.aihin asentamatta mitään. GPU-palvelimemme käsittelevät käsittelyä, jotta voit arvioida laatua ennen kuin sitoudut itseesi.
Itsehosti tai käytä API:tä
Kloonimalli repoaa GitHubilta ja toimii paikallisesti tai käyttää isäntärajapintaamme tuotannossa. Itseohjautuvuus antaa täyden hallinnan; API tarjoaa hallinnoidun infrastruktuurin.
Rakenna sovellusta
Integroi TTS tuotteeseesi itseohjautuvilla malleilla tai REST API:lla. Tarkista ensin jokainen mallilisenssi: muutama malli ja ääni on tarkoitettu vain ei-kaupalliseen käyttöön.
Lisenssin vertailu
Jokaisen mallin lisenssi TTS.ai
| Malli | Lisenssi | Kaupallinen käyttö | Muutos | Itsekehotus | Nimeäminen |
|---|---|---|---|---|---|
| Kokoro | Apache 2.0 | Vaadittu | |||
| Piper | MIT moottori; ääniluvat vaihtelevat | Vain joitakin ääniä | Valinnainen | ||
| VITS | MIT | Valinnainen | |||
| MeloTTS | MIT | Valinnainen | |||
| Chatterbox | MIT | Valinnainen | |||
| Tortoise TTS | Apache 2.0 | Vaadittu | |||
| StyleTTS 2 | MIT | Valinnainen | |||
| OpenVoice | MIT | Valinnainen | |||
| Sesame CSM | Apache 2.0 | Vaadittu | |||
| Orpheus | Llama 3.2 | "Built with Llama" | |||
| Spark TTS | CC BY-NC-SA 4.0 | Vain henkilökohtaiseen ja ei-kaupalliseen käyttöön | Vaadittu | ||
| OuteTTS | CC BY-NC-SA 4.0 | Vain henkilökohtaiseen ja ei-kaupalliseen käyttöön | Vaadittu |
Self-Hosting vs Hosted API
Suorita mallit itse tai anna meidän hoitaa infrastruktuuri
Omaehtoisuus laitteille
Jokainen TTS.ain malli on saatavilla avoimen lähdekoodin projektina GitHubissa tai Hugging Facessa. Lataa painot, asenna riippuvuudet ja tee päätelmä omilla GPU:illasi. Sinulla on täysi kontrolli latenssista, yksityisyydestä ja kavennuksesta.
- Täysi tietosuoja – ääni ei koskaan poistu palvelimelta
- Ei per-pyyntökuluja alkuperäisen asennuksen jälkeen
- Mukautettu hienosäätö omiin tietoihin
- Vaatii GPU-laitteistoa (NVIDIA suositellaan)
- Hallitset päivityksiä, kavennuksia ja riippuvuuksia
Käytä TTS.ai Hosted API:tä
Tutustu kaikkiin 20+-malleihin yhdellä REST API-rajapinnalla. Käsittelemme GPU-tarjontaa, mallipäivityksiä, jononhallintaa ja skaalaamista. Yksi API-avain mahdollistaa pääsyn jokaiseen malliin – ei tarvitse hallita erillisiä käyttökohteita.
- GPU-laitteistoa ei tarvita
- Kaikki 20+-mallia yhden API:n kautta
- Automaattiset mallipäivitykset ja -parannukset
- 99,9 prosentin käyttöaika, kun infrastruktuuria ei ole hyödynnetty
- Maksa vain siitä, mitä käytät
Pikakäynnistys: API tai itsepalvelu
Käytä isännöityä API:tä tai asenna Kokoro paikallisesti muutamassa minuutissa
import requests
response = requests.post("https://api.tts.ai/v1/tts", json={
"text": "Open source TTS with a simple API.",
"model": "kokoro",
"voice": "af_heart",
"format": "wav"
}, headers={"Authorization": "Bearer YOUR_API_KEY"})
with open("output.wav", "wb") as f:
f.write(response.content)
# Install Kokoro locally
pip install kokoro
# Generate speech on your own GPU
import kokoro
pipeline = kokoro.KPipeline(lang_code="a")
generator = pipeline("Hello from your own server!", voice="af_heart")
for i, (gs, ps, audio) in enumerate(generator):
kokoro.save(audio, f"output_{i}.wav")
Avoin lähdekoodi, edullinen hinnoittelu
Isännöity APImme mahdollistaa avoimen lähdekoodin TTS:n käytön ilman GPU:iden hallintaa.
Vapaa Tier
$0
50 opintopistettä ilmoittautumisesta
- 4 avoimen lähdekoodin mallia ilmaiseksi
- Ei ilmoittautumista peruskäyttöön
- Henkilökohtainen, ei-kaupallinen käyttö
Käynnistin
$9
500 000 merkkiä/kuukausi
- Kaikki 20+ avoimen lähdekoodin mallit
- Äänien kloonaus
- API-yhteys
Pro
$29
2 miljoonaa merkkiä kuukaudessa
- Ensisijainen GPU-käsittely
- Kaikki premium-mallit
- Yritystuki
Usein kysyttyjä kysymyksiä
Yleisiä kysymyksiä avoimen lähdekoodin tekstistä puheeseen
Mitä voisimme parantaa? Palautteesi auttaa meitä korjaamaan ongelmia.
Kokeile avointa lähdekoodia TTS tänään
20+ avoimen lähdekoodin mallia, joissa on lisenssiluettelo. Käytä API- tai omatoimipuhelinta, valinta on sinun.