OpenVoice TTS
MyShell.ai's instant voice-cloning model with granular control over style, emotion, accent, and rhythm.
Envuelva su texto en etiquetas SSML para un control preciso:
<speak><prosody rate="slow">Slow speech</prosody></speak>
Etiquetas el modelo seleccionado entiende — haga clic para soltar uno en su texto donde sucede:
Este modelo lee texto plano, por lo que las etiquetas en línea son ignoradas. Para la emoción basada en etiquetas, cambie a un modelo expresivo como Orfeo o Bark.
Definir pronunciaciones personalizadas (palabra = pronunciación):
Acerca de OpenVoice
OpenVoice from MyShell.ai is built around a ToneColorConverter on top of a MeloTTS backbone, and its defining trait is granular controllability. It clones a voice from a short clip and then lets you independently tune style, emotion, accent, rhythm, pauses, and intonation, generating speech in multiple languages while preserving the speaker's identity. It also doubles as a voice converter for transforming one voice into another. On TTS.ai it covers English, Chinese, Japanese, Korean, French, and Spanish, accepts up to 5,000 characters, and needs roughly 10 seconds of reference audio to clone.
Lo mejor para: Voice cloning with fine-grained style control, voice conversion
Examinar todo OpenVoice vocesDe un vistazo
- Desarrollador
- MyShell.ai / MIT
- Licencia
- MIT
- Nivel
- premium
- Velocidad
- medium
- Clonación de voz
- Sí
- Idiomas
- English, Chinese, Japanese, Korean, French, Spanish
- Máx. caracteres
- 5000