Kitten TTS TTS
An ultra-lightweight ONNX model under 80MB that runs high-quality TTS on CPU with no GPU at all.
Envolva o seu texto em tags SSML para controle preciso:
<speak><prosody rate="slow">Slow speech</prosody></speak>
Etiquetas o modelo selecionado entende — clique para soltar um para o seu texto onde acontece:
Este modelo lê texto simples, por isso as etiquetas inline são ignoradas. Para emoção baseada em tags, mude para um modelo expressivo como Orpheus ou Bark.
Definir pronúncias personalizadas (palavra = pronúncia):
Sobre Kitten TTS
Kitten TTS by KittenML is built for extreme portability: an ONNX-based model with variants from 15M to 80M parameters, weighing just 25-80 MB on disk. It runs entirely on CPU with 0 VRAM, yet ships 8 built-in voices, adjustable speech speed, and built-in text preprocessing that handles numbers, currencies, and units before synthesis. Output is 24kHz. While its quality sits below the larger models, its tiny size and fast (~2s) CPU inference make it ideal for edge deployment and latency-sensitive applications that can't assume a GPU is present.
Melhor para: Fast lightweight TTS, edge deployment, low-latency applications
Procurar todos Kitten TTS vozesDe uma olhada
- Desenvolvedor
- KittenML
- Licença
- Apache 2.0
- Tier
- free
- Velocidade
- fast
- Clonagem de voz
- Não
- Línguas
- English
- Número máximo de caracteres
- 5000