Modele otwartego tekstu źródłowego do mowy
Każdy model TTS na naszej platformie jest otwartym źródłem, a większość używa MIT lub Apache 2.0. Kilka modeli i głosy są licencjonowane tylko do użytku niekomercyjnego i są oznaczone "wyłącznie użytkowanie osobowe i niekomercyjne". Użyj ich za pośrednictwem naszego hostowanego API lub samorządzający je w swojej infrastrukturze z pełną kontrolą.
Spróbuj teraz
Korzyści z otwartego źródła TTS
Dlaczego modele open-source mają znaczenie dla twoich projektów
Wszystkie otwarte źródła licencjonowane
Każdy model na TTS.ai jest otwartym źródłem, a każda strona modelu zawiera swoją licencję. Żadnych zastrzeżonych czarnych skrzynek i żadnych zamykań.
Licencje otwartego źródła
Większość modeli jest licencjonowana pod MIT lub Apache 2.0. Kilka innych licencji, a modele lub głosy licencjonowane do niekomercyjnego użytku są oznaczone "wyłącznie użytkowanie osobowe i niekomercyjne".
Właściwość
Pobierz dowolny model i uruchomić go na własny sprzęt. Pełna kontrola nad danymi, latencją i infrastrukturą. Nie wymaga się chmury zależności.
Zoptymalizowany GPU
Modele są zoptymalizowane dla GPU NVIDIA z obsługą CUDA. Piper działa tylko na procesorze. Większość modeli wymaga 2-8GB VRAM do efektywnych wyników.
Wspólnota utrzymywana
Aktywne społeczności otwarte utrzymują i ulepszają te modele. Wkłady powitane — przekazywanie błędów, ulepszenia i nowych głosów na GitHub.
Licencja handlowa dostępna
Plan płatniczy od $5/mo posiada licencję handlową za to, co generujesz, bez opłat licencyjnych lub opłat za korzystanie z opłat; bezpłatny poziom jest przeznaczony do użytku osobistego. Modele i głosy oznaczone "wyłącznie użytkowanie osobowe i niekomercyjne" są wyłączone.
Nasz katalog modelu Open Source
Każdy model, jego licencja, i to, co robi najlepiej
Kokoro
Free
Lightweight 82M parameter model delivering studio-quality speech with blazing-fast inference.
Najlepsze dla: Apache 2.0 – najlepszy model bez jakości, 82M params, łatwy do samoporządkowania
Spróbuj. Kokoro
Piper
Free
A fast, local neural text to speech system optimized for Raspberry Pi and embedded devices.
Najlepsze dla: MIT – tylko procesor, idealny dla urządzeń krawędziowych i wbudowanych samoprzyrządów
Spróbuj. Piper
VITS
Free
Conditional variational autoencoder with adversarial learning for end-to-end text-to-speech.
Najlepsze dla: MIT – architektura fundamentalna używana przez wiele modeli poniżej
Spróbuj. VITS
Bark
Standard
Transformer-based text-to-audio model that generates realistic speech, music, and sound effects.
Najlepsze dla: MIT – niepowtarzalne możliwości wytwarzania dźwięku poza standardową TTS
Spróbuj. Bark
Tortoise TTS
Premium
Multi-voice text-to-speech focused on quality with autoregressive architecture.
Najlepsze dla: Apache 2.0 – maksymalna jakość, szeroko badane wdrażanie odniesienia
Spróbuj. Tortoise TTS
OpenVoice
Premium
Instant voice cloning with granular control over style, emotion, and accent.
Najlepsze dla: MIT – klonowanie głosu z otwartym źródłem z granularną kontrolą stylu
Spróbuj. OpenVoiceJak korzystać z otwartego źródła TTS
Użyj naszych hosted API lub uruchomi modele samodzielnie
Poznaj modele otwartego źródła
Przeglądaj nasz katalog modeli 20+ otwartego źródła TTS. Każda strona modelowa przedstawia licencję, architekturę, możliwości i wymagania samodzielnego hostingu.
Spróbuj w swojej przeglądarce
Testuj dowolny model bezpośrednio na TTS.ai bez instalacji nic. Nasze serwery GPU obsługują przetwarzanie, aby można ocenić jakość przed zaangażowaniem się w samo-hosting.
Właściwość lub korzystanie z naszego API
Repos modelu klonowego z GitHub i uruchomić lokalnie, lub użyć naszego hostowanego API do produkcji. Samodomowca daje pełną kontrolę; nasz API zapewnia zarządzaną infrastrukturę.
Zbuduj aplikację
Iнтегрuj TTS do swojego produktu przy użyciu modeli samorządzonych lub naszego REST API. Sprawdź najpierw każdą licencję modelu: kilka modeli i głosów jest tylko dla niekomercyjnych zastosowań.
Porównanie licencji
Licencja każdego modelu na TTS.ai
| Wzór | Licencja | Stosowanie handlowe | Zmiana | Właściwość | Attribucja |
|---|---|---|---|---|---|
| Kokoro | Apache 2.0 | Wymagane | |||
| Piper | MIT silnik; licencje głosowe różnią się | Tylko niektóre głosy | Opcjonalnie | ||
| VITS | MIT | Opcjonalnie | |||
| MeloTTS | MIT | Opcjonalnie | |||
| Chatterbox | MIT | Opcjonalnie | |||
| Tortoise TTS | Apache 2.0 | Wymagane | |||
| StyleTTS 2 | MIT | Opcjonalnie | |||
| OpenVoice | MIT | Opcjonalnie | |||
| Sesame CSM | Apache 2.0 | Wymagane | |||
| Orpheus | Llama 3.2 | "Built with Llama" | |||
| Spark TTS | CC BY-NC-SA 4.0 | Wyłącznie użytkowanie osobowe i niehandlowe | Wymagane | ||
| OuteTTS | CC BY-NC-SA 4.0 | Wyłącznie użytkowanie osobowe i niehandlowe | Wymagane |
Samoprzygotowanie ws hosted API
Uruchom modele sami lub pozwól nam zarządzać infrastrukturą
Właściwość na Twoim sprzętie
Każdy model na TTS.ai jest dostępny jako projekt open-source na GitHub lub Hugging Face. Pobierz wagi, zainstaluj zależności i uruchomij inferencję na własnych GPU. Masz pełną kontrolę nad latencją, prywatnością i skalowaniem.
- Pełna prywatność danych — audio nigdy nie opuszcza serwera
- Brak kosztów na żądanie po początkowym ustawieniu
- Właściwe dostosowywanie do własnych danych
- Wymaga sprzętu GPU (zalecana NVIDIA)
- Zarządzasz aktualizacjami, skalowaniem i zależnościami
Użyj TTS.ai hosted API
Otrzymamy natychmiastowy dostęp do wszystkich modeli 20+ poprzez pojedynczy REST API. Zajmujemy się dostarczaniem GPU, aktualizacjami modeli, zarządzaniem kolejką i skalowaniem. Jeden klucz API daje dostęp do każdego modelu – nie ma potrzeby do zarządzania oddzielnym rozmieszczeniem.
- Brak sprzętu GPU
- Wszystkie modele 20+ przez jeden API
- Automatyczne aktualizacje i ulepszenia modeli
- 99,9% przerwy na zbędną infrastrukturę
- Zapłać tylko za to, co użyjesz
Szybki rozpoczątek: API lub samoprzybycie
Użyj naszego hosted API, lub zainstaluj Kokoro lokalnie w minutach
import requests
response = requests.post("https://api.tts.ai/v1/tts", json={
"text": "Open source TTS with a simple API.",
"model": "kokoro",
"voice": "af_heart",
"format": "wav"
}, headers={"Authorization": "Bearer YOUR_API_KEY"})
with open("output.wav", "wb") as f:
f.write(response.content)
# Install Kokoro locally
pip install kokoro
# Generate speech on your own GPU
import kokoro
pipeline = kokoro.KPipeline(lang_code="a")
generator = pipeline("Hello from your own server!", voice="af_heart")
for i, (gs, ps, audio) in enumerate(generator):
kokoro.save(audio, f"output_{i}.wav")
Otwarte źródło, dostępne ceny
Nasz hosted API sprawia, że otwarte źródło TTS jest dostępne bez zarządzania GPU.
Wolny poziom
$0
15 kredytów na zarejestrowanie
- 4 modele open-source za darmo
- Brak rejestracji dla podstawowego użytku
- Osobowe, niehandlowe zastosowanie
Rozpoczynacz
$9
500 000 znaków/miesiąc
- Wszystkie modele 20+ open-source
- Klonowanie głosu
- Dostęp API
Prof.
$29
2 000 000 znaków/miesiąc
- Priorytet przetwarzania GPU
- Wszystkie modele premium
- Wsparcie dla przedsiębiorstw
Często zadawane pytania
Wspólne pytania dotyczące tekstu otwartego źródła do wypowiedzi
Co moglibyśmy ulepszyć? Twoje zwroty zwrotne pomagają nam rozwiązać problemy.
Spróbuj Open Source TTS Dzisiaj
20+ modele open-source, każdy z wyszczególnionych licencji. Użyj naszego API lub samo-domowca, wybór jest twój.