OpenVoice ТТС
MyShell.ai's instant voice-cloning model with granular control over style, emotion, accent, and rhythm.
Матнни аниқ назорат учун SSML теглар билан ўраб қўйиш:
<speak><prosody rate="slow">Slow speech</prosody></speak>
Танланган модел тушунадиган тегилар — уларни матнга тушириш учун босинг:
Бу модел оддий матн ўқийди, шунинг учун тегишли теги эътиборга олинмайди. Эмоционал теги асосида, Orpheus ёки Bark каби ифодали моделга ўтинг.
Ўз нутқини белгилаш (сўз = нутқ):
Маълумот OpenVoice
OpenVoice from MyShell.ai is built around a ToneColorConverter on top of a MeloTTS backbone, and its defining trait is granular controllability. It clones a voice from a short clip and then lets you independently tune style, emotion, accent, rhythm, pauses, and intonation, generating speech in multiple languages while preserving the speaker's identity. It also doubles as a voice converter for transforming one voice into another. On TTS.ai it covers English, Chinese, Japanese, Korean, French, and Spanish, accepts up to 5,000 characters, and needs roughly 10 seconds of reference audio to clone.
Энг яхшиси: Voice cloning with fine-grained style control, voice conversion
Ҳаммасини кўриш OpenVoice овозларБир қарашда
- Ижодкор
- MyShell.ai / MIT
- Лицензия
- MIT
- Тир
- premium
- Тезлик
- medium
- Овозни клонлаш
- Ҳа
- Тиллар
- English, Chinese, Japanese, Korean, French, Spanish
- Максимум ҳарфлар
- 5000