OpenVoice ТТС
MyShell.ai's instant voice-cloning model with granular control over style, emotion, accent, and rhythm.
Матнро дар SSML тегҳо барои идоракунии дақиқ гузоред:
<speak><prosody rate="slow">Slow speech</prosody></speak>
Барчаспҳо, ки аз тарафи намунаи интихобшуда фаҳмида мешаванд - барои гузоштани яке аз онҳо дар матни худ, ки дар он ҷо рӯй медиҳад, пахш кунед:
Ин намуна матни оддиро мехонад, аз ин рӯ, нишонаҳои дар сатр бударо нодида мегиранд. Барои нишонаҳои асосӣ ба намунаи ифодакунандаи Orpheus ё Bark гузаред.
Муайян кардани талаффузи оддӣ (калима = талаффуз):
Дар бораи OpenVoice
OpenVoice from MyShell.ai is built around a ToneColorConverter on top of a MeloTTS backbone, and its defining trait is granular controllability. It clones a voice from a short clip and then lets you independently tune style, emotion, accent, rhythm, pauses, and intonation, generating speech in multiple languages while preserving the speaker's identity. It also doubles as a voice converter for transforming one voice into another. On TTS.ai it covers English, Chinese, Japanese, Korean, French, and Spanish, accepts up to 5,000 characters, and needs roughly 10 seconds of reference audio to clone.
Беҳтарин барои: Voice cloning with fine-grained style control, voice conversion
Баррасии ҳама OpenVoice овозҳоДар як назар
- Тайёркунанда
- MyShell.ai / MIT
- Иҷозатнома
- MIT
- & Тағйиротҳо
- premium
- Суръат
- medium
- Тасвири овоз
- & Тасвир
- Забонҳо
- English, Chinese, Japanese, Korean, French, Spanish
- Аломатҳои зиёд
- 5000