OpenVoice ТТС
MyShell.ai's instant voice-cloning model with granular control over style, emotion, accent, and rhythm.
Текстти SSML тегдерине өткөрүп берүү:
<speak><prosody rate="slow">Slow speech</prosody></speak>
Белгилер, тандалган модель түшүнөт — текстке бирин коюу үчүн, аны чыкылдатыңыз:
Бул модель жөнөкөй текстти окуйт, ошондуктан тексттеги тегдер эске алынбайт. Тегдер менен эмоцияларды жаратууда Orpheus же Bark сыяктуу экспрессивдүү моделдерге өтүү керек.
Өзгөчө сүйлөмдөрдү аныктоо (сөз = сүйлөм):
Маалымат OpenVoice
OpenVoice from MyShell.ai is built around a ToneColorConverter on top of a MeloTTS backbone, and its defining trait is granular controllability. It clones a voice from a short clip and then lets you independently tune style, emotion, accent, rhythm, pauses, and intonation, generating speech in multiple languages while preserving the speaker's identity. It also doubles as a voice converter for transforming one voice into another. On TTS.ai it covers English, Chinese, Japanese, Korean, French, and Spanish, accepts up to 5,000 characters, and needs roughly 10 seconds of reference audio to clone.
Эң жакшысы: Voice cloning with fine-grained style control, voice conversion
Баарын кароо OpenVoice үнБир көз салуу
- Жазуучу
- MyShell.ai / MIT
- Лицензия
- MIT
- Тигр
- premium
- Жылдамдыгы
- medium
- Сөздү клондоо
- Ооба
- Тилдер
- English, Chinese, Japanese, Korean, French, Spanish
- Макс. символдор
- 5000