Bug / Feature Request mellen

Open Source Text-to-Speech Modeller

All TTS-Modell op eiser Plattform ass Open Source, an déi meescht benotzen MIT oder Apache 2.0. E puer Modeller a Stëmmen sinn nëmmen fir net-kommerziell Benotzung lizenzéiert an si mat 'Personal and non-commercial use only' markéiert. Benotzt se iwwer eis gehosted API, oder hostet se selwer op Ärer eegener Infrastruktur mat vollstänneger Kontroll.

Open Source MIT-Lizenz Apache Self-Hostable GitHub

Probéiert et elo aus

Free mat Kokoro, Piper, VITS, MeloTTS
Äert generéiert Audio wäert hei erscheinen
Generéiert
0:00
Erofgelueden
Liewe TTS.ai? Erzielt Är Frënn!

Lëscht vun de lëtzebuergesche Gemengen

Firwat Open-Source-Modeller fir Är Projeten wichteg sinn

Open-Source-Lizenz

All Modell op TTS.ai ass Open Source, an all Modell Säit lëscht seng Lizenz. Keng proprietär Black Boxen an keng Verkeefer Lock-in.

Open Source Lizenzen

D'Meeschte Modeller sinn ënner MIT oder Apache 2.0 lizenzéiert. E puer benotzen aner Lizenzen, a Modeller oder Stëmmen déi fir net kommerziell Benotzung lizenzéiert sinn, sinn "Personal and non-commercial use only" markéiert.

Self-Hostable

All Modell erofzelueden an op Ärer eegene Hardware lafen ze loossen. Volle Kontroll iwwer Är Donnéeën, Latenz an Infrastruktur. Keng Wollekabhängegkeet erfuerderlech.

GPU-optiméiert

Modeller si fir NVIDIA Grafikprozessoren mat CUDA-Unterstützung optiméiert. Piper leeft nëmmen op CPU. Déi meescht Modeller brauchen 2-8GB VRAM fir effizient Inferenzen.

Communautéit

Aktiv Open-Source Communautéiten ënnerhalen an verbesseren dës Modeller. Beiträg sinn wëllkomm — schéckt Bugs, Verbesserungen a nei Stimmen op GitHub.

Kommerziell Lizenz verfügbar

Eng bezuelte Versioun vu 5 €/Mount bitt eng kommerziell Lizenz fir dat wat Dir generéiert, ouni Lizenzgebühren oder Benotzungsgebühren; d'Fräiversioun ass fir de perséinleche Gebrauch. Modeller a Stëmmen, déi mat "Perséinlech a net-kommerziell Benotzung" markéiert sinn, sinn ausgeschloss.

Portal Astronomie Lëscht vun den Asteroiden

All Modell, seng Lizenz, wat et am Beschten mécht

KokoroKokoro

Free

Lightweight 82M parameter model delivering studio-quality speech with blazing-fast inference.

Schnell 5/5

Bescht fir: Den Apache 2.0 - best quality free model, 82M params, einfach fir sech selwer ze hosten

Versuchen Kokoro

PiperPiper

Free

A fast, local neural text to speech system optimized for Raspberry Pi and embedded devices.

Schnell 3/5

Bescht fir: D'Gréisst vun der Uewerfläch vun der Äerd ass ideal fir d'Entwécklung vun engem Planéit.

Versuchen Piper

VITSVITS

Free

Conditional variational autoencoder with adversarial learning for end-to-end text-to-speech.

Schnell 3/5

Bescht fir: D'Architektur vun der Uertschaft baséiert op verschiddene Stiler.

Versuchen VITS

BarkBark

Standard

Transformer-based text-to-audio model that generates realistic speech, music, and sound effects.

Langsam 4/5

Bescht fir: Lëscht vu lëtzebuergesche Komponisten Lëscht vu lëtzebuergesche Komponisten

Versuchen Bark

Tortoise TTSTortoise TTS

Premium

Multi-voice text-to-speech focused on quality with autoregressive architecture.

Langsam 5/5 Stëmmklonung

Bescht fir: Mee 2000, war e lëtzebuergesche Moler a Grafiker.

Versuchen Tortoise TTS

OpenVoiceOpenVoice

Premium

Instant voice cloning with granular control over style, emotion, and accent.

Medium 4/5 Stëmmklonung

Bescht fir: Lëscht vu lëtzebuergesche Schrëftsteller Lëscht vu lëtzebuergesche Literaturkritiker

Versuchen OpenVoice

Lëscht vun de lëtzebuergesche Gemengen

Benotzt eis gehostete API oder féiert Modeller selwer aus

1

Open-Source-Modeller entdecken

Bléck op eise Katalog mat méi wéi 20 Open-Source TTS-Modeller. All Modellsäit weist d'Lizenz, d'Architektur, d'Fäegkeeten an d'Self-Hosting-Ufuerderungen.

2

Probéiert et an Ärem Browser

Testt all Modell direkt op TTS.ai ouni eppes ze installéieren. Eis GPU-Server këmmeren sech ëm d'Veraarbechtung, sou datt Dir d'Qualitéit evaluéiere kënnt, ier Dir Iech selwer hoste kënnt.

3

D'Applikatioun ass gratis an open-source.

Klonen Modell Repositories vun GitHub a lafen lokal, oder benotzen eis gehost API fir d'Produktioun. Self-hosting gëtt voll Kontroll; eis API bitt verwaltete Infrastruktur.

4

Är Applikatioun bauen

Integréiert TTS an Ärem Produkt mat selbstgehost Modeller oder eiser REST API. Kontrolléiert all Modell Lizenz virdrun: e puer Modeller a Stëmmen sinn fir net kommerziell Benotzung.

Lizenzverglach

License of each model on TTS.ai

Modell Lizenz Kommerziell Benotzung Ännerung Selbst-Host Attributioun
Kokoro Apache 2.0 Erfuerderlech
Piper MIT engine; voice licenses vary Just e puer Stimmen Optional
VITS MIT Optional
MeloTTS MIT Optional
Chatterbox MIT Optional
Tortoise TTS Apache 2.0 Erfuerderlech
StyleTTS 2 MIT Optional
OpenVoice MIT Optional
Sesame CSM Apache 2.0 Erfuerderlech
Orpheus Llama 3.2 "Built with Llama"
Spark TTS CC BY-NC-SA 4.0 Fir perséinlech a net-kommerziell Notzung Erfuerderlech
OuteTTS CC BY-NC-SA 4.0 Fir perséinlech a net-kommerziell Notzung Erfuerderlech

Lëscht vu lëtzebuergesche Schrëftsteller

Modeller selwer ausféieren oder eis d'Infrastruktur verwalten loossen

Den Haaptuert ass Hardicourt.

All Modell op TTS.ai ass als Open-Source-Projet op GitHub oder Hugging Face verfügbar. Luet d'Gewiicht erof, installéiert d'Ofhängegkeeten a féiert Inferenzen op Ären eegene Grafikprozessoren aus. Dir hutt voll Kontroll iwwer Latenz, Privatsphär a Skaléierung.

  • Vollstänneg Privatsphär — Audio verléisst ni Äre Server
  • Keng Käschte pro Ufro no der initialer Installatioun
  • Personaliséiert Finetuning op Ären eegene Daten
  • Benötigt GPU-Hardware (NVIDIA empfohlen)
  • Dir verwaltet Updates, Skaléierung an Ofhängegkeeten

TTS.ai gehostete API benotzen

Gitt direkt Zougang zu all 20+ Modeller duerch eng eenzeg REST API. Mir këmmeren eis ëm GPU Provisioning, Modell Updates, Queue Management an Scaling. Eng API Schlëssel gëtt Iech Zougang zu all Modell - keng Notwendegkeet fir separat Deployments ze managen.

  • Keng GPU-Hardware néideg
  • 20 Säiten an 150 Biller.
  • Automatiséiert Modellupdates a Verbesserungen
  • 99,9 % vun der Bevëlkerung liewen an der Stad.
  • Bezuele just fir dat wat Dir benotzt

Lëscht vu lëtzebuergesche Schrëftsteller

Benotzt eis gehostete API, oder installéiert Kokoro lokal an e puer Minutten

Optioun 1: TTS.ai Hosted API Eelst
import requests

response = requests.post("https://api.tts.ai/v1/tts", json={
    "text": "Open source TTS with a simple API.",
    "model": "kokoro",
    "voice": "af_heart",
    "format": "wav"
}, headers={"Authorization": "Bearer YOUR_API_KEY"})

with open("output.wav", "wb") as f:
    f.write(response.content)
Optioun 2: Self-Host mat pip Volle Kontroll
# Install Kokoro locally
pip install kokoro

# Generate speech on your own GPU
import kokoro

pipeline = kokoro.KPipeline(lang_code="a")
generator = pipeline("Hello from your own server!", voice="af_heart")
for i, (gs, ps, audio) in enumerate(generator):
    kokoro.save(audio, f"output_{i}.wav")

Lëscht vu lëtzebuergesche Präisser

D'Gréisst vun der Uewerfläch vun der Uewerfläch ass net bekannt.

Free-Tier

$0

50 Säiten.

  • Lëscht vu lëtzebuergesche Moler
  • Keng Anmeldung fir einfache Gebrauch
  • Perséinlech, net kommerziell Benotzung

Starter

$9

500 Punkten/Mount

  • All 20+ Open-Source-Modeller
  • Stëmmklonung
  • API-Zugang

Pro

$29

Mäerz 2000

  • Prioritéit GPU-Veraarbechtung
  • All Premium Modeller
  • Enterprise-Unterstützung
Komplett Präislëscht

Häufig gestallte Froen

Lëscht vu lëtzebuergesche Literaturpräisser

Ja, all Modeller op TTS.ai sinn Open Source, an déi meescht benotzen MIT oder Apache 2.0. E puer benotzen aner Lizenzen, dorënner e puer fir net-kommerziell Benotzung, déi an der Stëmmauswiel "Personal and non-commercial use only" markéiert sinn. All Modellsäit lëscht hir Lizenz op.

Beide sinn permissiv Open-Source-Lizenzen, déi kommerziell Benotzung, Modifikatioun a Wiederverbreedung erlaben. Apache 2.0 füügt explizit Patentgewährungen bäi an erfuerdert Ännerungen, wann Dir de Code ännert. MIT ass einfacher mat manner Ufuerderungen. Beide sinn geschäftsfrëndlech.

Ja. All Modell ka selwer gehost ginn. Klont de Modell-Repository vu GitHub, installéiert Ofhängegkeeten, lued Modell-Gewiicht erof a féiert Inferenzen aus. Mir bidden Dokumentatioun fir all Modell-self-hosting Ufuerderunge mat GPU, RAM, a Python-Versioun.

D'Bedierfnesser variéieren je no Modell. Piper brauch keng GPU (nëmme CPU). Kokoro a MeloTTS brauchen 1-2GB VRAM. Déi meescht Standardmodelle brauchen 4GB VRAM. Tortoise a Sesame CSM brauchen 8GB. Eng NVIDIA RTX 3060 (12GB) kann déi meescht Modeller komfortabel lafen.

Ja. Open-Source-Lizenzen erlaben Ännerungen, inklusiv Feineinstellungen. Modeller wéi GPT-SoVITS a Bark bidden Feineinstellungsskripten. Dir kënnt Modeller op Ären eegene Stëmmdaten trainéieren, fir eege Stimmen ze kreéieren oder d'Performance fir spezifesch Sproochen ze verbesseren.

Top Open-Source Modeller (Kokoro, StyleTTS 2, Chatterbox) entspriechen elo oder iwwertreffen kommerziell Servicer wéi ElevenLabs a Google TTS a Qualitéitsbenchmarks. Den Haaptvirdeel vun kommerzielle Servicer ass verwaltete Infrastruktur an Ënnerstëtzung, net Audioqualitéit.

E puer goufen ewechgeholl: XTTS/XTTS-v2 (Coqui's CPML, net kommerziell), F5-TTS (CC-BY-NC, net kommerziell) an Higgs-v2 (Boson Lizenz, restriktiv). E puer Modeller a Stëmmen, wéi Spark TTS, OuteTTS an déi meescht Piper Stëmmen, sinn nëmmen fir net kommerziell Benotzung lizenzéiert; si sinn an der Stëmmauswiel mat "Personal and non-commercial use only" markéiert, sou datt Dir eng aner Stëmm fir kommerziell Projete benotzt.

Ja. Déi meescht Modeller akzeptéieren Community-Beiträg iwwer GitHub. Dir kënnt Fehlerberichter, Stëmmopnamen fir nei Sproochen, Codeverbesserungen a Dokumentatioun ubidden. Kontrolléiert d'GitHub-Repository vun all Modell fir Richtlinnen an aktiv Problemer.

Modeller on-demand laden an ofladen, wann se net gebraucht ginn, fir de GPU-Späicher ze deelen. Eise GPU-Server leeft mat méi wéi 20 Modeller op 4x Tesla P40 (96 GB VRAM am Ganzen) mat dynamesche Ladung. Fir selwer ze hosten, kann eng eenzeg 24 GB GPU 3-5 Modeller gläichzäiteg bedienen.

Vill Modeller bidden offiziell Docker-Bilder oder Docker-Dateien. Fir méi Modeller ze lafen, kënnt Dir en eegene Docker-Setup mat NVIDIA Container Toolkit fir GPU-Zugang bauen. Eis API-Server-Architektur kann als Referenzimplementatioun dienen.

Déi meescht Modeller erfuerderen Python 3.10-3.12. Coqui TTS (VITS) erfuerdert speziell Python 3.11. Mir empfeelen Python 3.12 fir déi meescht Modeller. Kontrolléiert d'Requirements.txt vun all Modell fir d'exakt Versiounskompatibilitéit.

Wann Dir selwer hostet, da meeschtens jo: MIT an Apache 2.0 Lizenzen erlaben explizitt kommerziell Benotzung, an déi meescht Modeller hei benotzen se, sou datt Dir SaaS Produkter, mobile Apps, Spiller a Servicer ouni Lizenzgebühren oder Royalties bauen kënnt. Kontrolléiert d'Lizenz op all Modell Säit virdrun, well e puer Modeller a Stimmen net kommerziell sinn. Audio generéiert op TTS.ai selwer folgt Ärem Plan: perséinlech Benotzung op der gratis Tier, kommerziell Benotzung op all bezuelte Plan.
5.0/5 (1)

Wat kéinte mir verbesseren? Äert Feedback hëlleft eis, Problemer ze léisen.

Open Source TTS haut ausprobéieren

20+ Open-Source Modeller, all mat senger Lizenz opgezielt. Benotzt eis API oder Self-Host, d'Wahl ass Är.