Qwen3 TTS ТТС
Alibaba's 1.7B multilingual model offering both 9 preset voices and voice design from a plain-text description.
Матнро дар SSML тегҳо барои идоракунии дақиқ гузоред:
<speak><prosody rate="slow">Slow speech</prosody></speak>
Барчаспҳо, ки аз тарафи намунаи интихобшуда фаҳмида мешаванд - барои гузоштани яке аз онҳо дар матни худ, ки дар он ҷо рӯй медиҳад, пахш кунед:
Ин намуна матни оддиро мехонад, аз ин рӯ, нишонаҳои дар сатр бударо нодида мегиранд. Барои нишонаҳои асосӣ ба намунаи ифодакунандаи Orpheus ё Bark гузаред.
Муайян кардани талаффузи оддӣ (калима = талаффуз):
Дар бораи Qwen3 TTS
Qwen3-TTS is a 1.7-billion-parameter model from Alibaba's Qwen team, built on the Qwen3 backbone with a multi-codebook decoder. What sets it apart is its dual operating mode: you can pick from 9 preset speakers with emotion control, or switch to a voice-design mode where you describe the voice you want in natural language and the model synthesizes a matching one. It spans 10 languages — English, Chinese, Japanese, Korean, German, French, Russian, Portuguese, Spanish, and Italian — with high expressiveness and natural prosody. It handles up to 2,000 characters per request, making it a flexible choice for multilingual content that needs either consistent preset voices or bespoke custom ones.
Беҳтарин барои: Multilingual content with preset voices or custom voice design
Баррасии ҳама Qwen3 TTS овозҳоДар як назар
- Тайёркунанда
- Alibaba (Qwen)
- Иҷозатнома
- Apache 2.0
- & Тағйиротҳо
- standard
- Суръат
- medium
- Тасвири овоз
- & Намоиши хатҳои равон
- Забонҳо
- English, Chinese, Japanese, Korean, German, French, Russian, Portuguese, Spanish, Italian
- Аломатҳои зиёд
- 2000