Kitten TTS TTS
An ultra-lightweight ONNX model under 80MB that runs high-quality TTS on CPU with no GPU at all.
Envuelva su texto en etiquetas SSML para un control preciso:
<speak><prosody rate="slow">Slow speech</prosody></speak>
Etiquetas el modelo seleccionado entiende — haga clic para soltar uno en su texto donde sucede:
Este modelo lee texto plano, por lo que las etiquetas en línea son ignoradas. Para la emoción basada en etiquetas, cambie a un modelo expresivo como Orfeo o Bark.
Definir pronunciaciones personalizadas (palabra = pronunciación):
Acerca de Kitten TTS
Kitten TTS by KittenML is built for extreme portability: an ONNX-based model with variants from 15M to 80M parameters, weighing just 25-80 MB on disk. It runs entirely on CPU with 0 VRAM, yet ships 8 built-in voices, adjustable speech speed, and built-in text preprocessing that handles numbers, currencies, and units before synthesis. Output is 24kHz. While its quality sits below the larger models, its tiny size and fast (~2s) CPU inference make it ideal for edge deployment and latency-sensitive applications that can't assume a GPU is present.
Lo mejor para: Fast lightweight TTS, edge deployment, low-latency applications
Examinar todo Kitten TTS vocesDe un vistazo
- Desarrollador
- KittenML
- Licencia
- Apache 2.0
- Nivel
- free
- Velocidad
- fast
- Clonación de voz
- No
- Idiomas
- English
- Máx. caracteres
- 5000