Open Source Text to Speech Modelli
Ogni modello TTS sulla nostra piattaforma è open source, e la maggior parte utilizza MIT o Apache 2.0. Alcuni modelli e voci sono autorizzati solo per uso non commerciale e sono contrassegnati'solo uso personale e non commerciale'. Utilizzali attraverso la nostra API ospitata, o self-host sulla propria infrastruttura con controllo completo.
Provalo ora.
Vantaggi TTS Open Source
Perché i modelli open-source contano per i vostri progetti
Tutti Open-Source con licenza
Ogni modello su TTS.ai è open source, e ogni pagina del modello elenca la sua licenza. Nessuna scatola nera proprietaria e nessun blocco dei fornitori.
Licenze open source
La maggior parte dei modelli sono concessi in licenza MIT o Apache 2.0. Alcuni utilizzano altre licenze, e modelli o voci autorizzate per uso non commerciale sono contrassegnati "solo uso personale e non commerciale."
Self-hostable
Scarica qualsiasi modello ed eseguilo sul tuo hardware. Controllo completo dei dati, della latenza e dell'infrastruttura. Non è richiesta alcuna dipendenza dal cloud.
GPU ottimizzata
I modelli sono ottimizzati per le GPU NVIDIA con supporto CUDA. Piper funziona solo su CPU. La maggior parte dei modelli hanno bisogno di VRAM 2-8GB per un'inferenza efficiente.
Comunità Mantenuta
Le comunità attive open-source mantengono e migliorano questi modelli. I contributi sono benvenuti, i bug, i miglioramenti e le nuove voci su GitHub.
Licenza commerciale disponibile
Un piano a pagamento da $5/mo porta la licenza commerciale per ciò che si genera, senza diritti o tasse di utilizzo; il livello gratuito è per uso personale. Modelli e voci contrassegnati "solo uso personale e non commerciale" sono esclusi.
Il nostro catalogo di modelli Open Source
Ogni modello, la sua licenza, e quello che fa meglio
Kokoro
Free
Lightweight 82M parameter model delivering studio-quality speech with blazing-fast inference.
Meglio per: Apache 2.0 modello gratuito di migliore qualità, 82M parami, facile da auto-ospitare
Prova Kokoro
Piper
Free
A fast, local neural text to speech system optimized for Raspberry Pi and embedded devices.
Meglio per: MIT CPU-Solo, perfetto per i dispositivi di bordo e self-hosting incorporato
Prova Piper
VITS
Free
Conditional variational autoencoder with adversarial learning for end-to-end text-to-speech.
Meglio per: Architettura fondamentale del MIT Hoppenstedt utilizzata da molti modelli a valle
Prova VITS
Bark
Standard
Transformer-based text-to-audio model that generates realistic speech, music, and sound effects.
Meglio per: Capacità uniche di generazione audio MIT oltre lo standard TTS
Prova Bark
Tortoise TTS
Premium
Multi-voice text-to-speech focused on quality with autoregressive architecture.
Meglio per: Apache 2.0 Massima qualità, implementazione di riferimento ampiamente studiata
Prova Tortoise TTS
OpenVoice
Premium
Instant voice cloning with granular control over style, emotion, and accent.
Meglio per: Clonazione vocale open source MIT con controllo in stile granulare
Prova OpenVoiceCome usare Open Source TTS
Utilizzare la nostra API ospitata o eseguire i modelli da soli
Esplora modelli Open-Source
Sfoglia il nostro catalogo di 20+ modelli TTS open-source. Ogni pagina dei modelli mostra i requisiti di licenza, architettura, funzionalità e auto-ospitalità.
Prova nel tuo browser
Testare qualsiasi modello direttamente su TTS.ai senza installare nulla. I nostri server GPU gestiscono l'elaborazione in modo da poter valutare la qualità prima di impegnarsi a self-hosting.
Self-Host o utilizzare la nostra API
Il modello Clone repos da GitHub ed esegui localmente, o usa la nostra API ospitata per la produzione. L'auto-hosting dà il pieno controllo; la nostra API fornisce l'infrastruttura gestita.
Costruisci la tua applicazione
Integrare TTS nel tuo prodotto utilizzando modelli auto-hosted o la nostra API REST. Controllare ogni licenza modello prima: alcuni modelli e voci sono solo per uso non commerciale.
Confronto delle licenze
Licenza di ogni modello su TTS.ai
| Modello | Licenza | Uso commerciale | Modifica | Self-Host | Attribuzione |
|---|---|---|---|---|---|
| Kokoro | Apache 2.0 | Richiesto | |||
| Piper | MIT motore; le licenze vocali variano | Solo alcune voci | Facoltativo | ||
| VITS | MIT | Facoltativo | |||
| MeloTTS | MIT | Facoltativo | |||
| Chatterbox | MIT | Facoltativo | |||
| Tortoise TTS | Apache 2.0 | Richiesto | |||
| StyleTTS 2 | MIT | Facoltativo | |||
| OpenVoice | MIT | Facoltativo | |||
| Sesame CSM | Apache 2.0 | Richiesto | |||
| Orpheus | Llama 3.2 | "Built with Llama" | |||
| Spark TTS | CC BY-NC-SA 4.0 | Solo uso personale e non commerciale | Richiesto | ||
| OuteTTS | CC BY-NC-SA 4.0 | Solo uso personale e non commerciale | Richiesto |
Self-Hosting vs API ospitate
Eseguire modelli da soli o lasciarci gestire l'infrastruttura
Self-Host sul vostro hardware
Ogni modello su TTS.ai è disponibile come progetto open-source su GitHub o Hugging Face. Scarica i pesi, installa le dipendenze ed esegui l'inferenza sulle tue GPU. Hai il pieno controllo su latenza, privacy e scala.
- Privacy completa dei dati L'audio non lascia mai il tuo server
- Nessun costo per richiesta dopo la configurazione iniziale
- Messa a punto personalizzata dei propri dati
- Richiede hardware GPU (NVIDIA raccomandato)
- Gestisci gli aggiornamenti, la scalatura e le dipendenze
Usa TTS.ai API ospitate
Ottieni l'accesso immediato a tutti i 20+ modelli tramite una singola API REST. Gestiamo il provisioning della GPU, gli aggiornamenti dei modelli, la gestione delle code e la scalatura. Una chiave API ti dà accesso a ogni modello non c'è bisogno di gestire implementazioni separate.
- Nessun hardware GPU necessario
- Tutti i 20+ modelli tramite una API
- Aggiornamenti e miglioramenti automatici dei modelli
- 99,9% uptime con infrastruttura ridondante
- Paga solo per quello che usi
Quick Start: API o Self-Host
Utilizzare la nostra API ospitata, o installare Kokoro localmente in pochi minuti
import requests
response = requests.post("https://api.tts.ai/v1/tts", json={
"text": "Open source TTS with a simple API.",
"model": "kokoro",
"voice": "af_heart",
"format": "wav"
}, headers={"Authorization": "Bearer YOUR_API_KEY"})
with open("output.wav", "wb") as f:
f.write(response.content)
# Install Kokoro locally
pip install kokoro
# Generate speech on your own GPU
import kokoro
pipeline = kokoro.KPipeline(lang_code="a")
generator = pipeline("Hello from your own server!", voice="af_heart")
for i, (gs, ps, audio) in enumerate(generator):
kokoro.save(audio, f"output_{i}.wav")
Open Source, prezzi accessibili
La nostra API ospitata rende TTS open-source accessibile senza gestire le GPU.
Livello libero
$0
15.000 caratteri al momento dell'iscrizione
- 4 modelli open-source gratuiti
- Nessuna registrazione per l'uso di base
- Uso personale, non commerciale
Avviatore
$9
500.000 caratteri/mese
- Tutti i 20+ modelli open-source
- Clonazione vocale
- Accesso API
Pro
$29
2.000.000 di caratteri/mese
- Elaborazione GPU prioritaria
- Tutti i modelli premium
- Sostegno alle imprese
Domande frequenti
Domande comuni sul testo open source al discorso
Cosa potremmo migliorare? Il tuo feedback ci aiuta a risolvere i problemi.
Prova Open Source TTS oggi
20+ modelli open-source, ognuno con la propria licenza elencato. Utilizzare la nostra API o auto-host, la scelta è vostra.