KhanomTan TTS TTS
An open, commercially-licensed Thai-first text-to-speech model with multiple speaker voices.
Zawiń tekst w tagi SSML dla precyzyjnej kontroli:
<speak><prosody rate="slow">Slow speech</prosody></speak>
Tagi wybrany model rozumie — kliknij aby usunąć jeden do swojego tekstu, gdzie się to dzieje:
Model ten czyta tekst zwykły, więc w linii tagi są ignorowane. Dla emocji na tag, przełącz na model wyrażony jak Orfeus lub Bark.
Definiuj własny wymówki (słowo = wymówka):
O tematie KhanomTan TTS
KhanomTan TTS was built by Thai NLP contributor Wannaphong Phatthiyaphaibun on top of the YourTTS multilingual VITS architecture, and trained on CC0 and other permissively-licensed Thai corpora including TSync. Where most open TTS models only cover Thai under research-only or non-commercial terms, KhanomTan ships under Apache 2.0, making it a rare commercially-safe choice for the language. It offers a small roster of speaker voices and runs fast at roughly five seconds per generation in around 2GB of VRAM. It fits Thai voiceovers, narration for Thai-language apps, and accessibility tooling where licensing clarity matters.
Najlepsze dla: Thai voiceovers, Thai-language content and apps
Przeglądaj wszystkie KhanomTan TTS głosyNa jedno spojrzenie
- Rozwijacz
- Wannaphong Phatthiyaphaibun
- Licencja
- Apache 2.0
- Poziom szczelności
- standard
- Prędkość
- fast
- Klonowanie głosu
- Nie.
- Języki
- Thai
- Maksymalna liczba znaków
- 500