Darwin TTS

Darwin TTS ТТС

A Qwen3-TTS variant whose talker FFN weights are blended from the Qwen3 language model for sharper cross-lingual cloning.

Упиши се за ограничење 5.000 знакова

Умотајте текст у ССМЛ ознаке за прецизну контролу:

<speak><prosody rate="slow">Slow speech</prosody></speak>

Означе изабрани модел разуме — кликните да га испустите у текст где се то дешава:

Овај модел чита обичан текст, па се ознаке за успостављене на линији игноришу. За емоције засноване на ознакама пребаците на изражавајући модел попут Орфеја или Барка.

Дефинишите посебне изговоре (слов = изговор):

-12 +12
0.5x 2.0x
Слободна са Пајпер, Витс, Мелоттс
Овд› је ће се појавити генерисани звук. Изаберите модел, унесите текст и кликните на Генериши.
аудио генерисано усп› јешно
0:00
Преузми аудио Преузми.рт Веза истекава за 24х
Слободни ниво: лично коришћење. Комерцијална дозвола од 5 долара/мо
Нека ово буде твој глас Клонирај глас за 30 секунди
Љубав ТТС.аи?

О Darwin TTS

Darwin-TTS-1.7B-Cross by FINAL-Bench is a research variant of Qwen3-TTS-1.7B with an unusual construction: 84 of its talker-FFN tensors (about 8.6% of them) are blended at a 3% ratio with the matching tensors from Qwen3-1.7B-Base, all without any retraining. The result is a model that produces noticeably crisper cross-lingual voice cloning across Korean, English, Japanese, and Chinese — its four core languages. It operates in zero-shot voice-clone mode, needing only about three seconds of reference audio to capture a speaker. Darwin is best suited to transferring a single reference voice across those four languages, for example dubbing or multilingual narration with consistent speaker identity.

Најбоље за: Cross-lingual voice cloning between English / Korean / Japanese / Chinese with a single reference voice

Прегледај све Darwin TTS гласови

На један поглед

Програмер
FINAL-Bench
Лиценца
Apache 2.0
Низ
standard
Брзина
medium
Гласово клонирање
Да.
језици
English, Korean, Japanese, Chinese
Макс. знакова
2000

Darwin TTS гласови

Default

English
стандардни Neutral

Default (Chinese)

Chinese
стандардни Neutral

Default (Japanese)

Japanese
стандардни Neutral

Default (Korean)

Korean
стандардни Neutral

Darwin TTS ТТС — честа питања

Darwin starts from Qwen3-TTS-1.7B but blends a small fraction of its talker-FFN weights with the matching weights from the Qwen3-1.7B base language model. This training-free blend sharpens cross-lingual voice cloning rather than changing the base voices.

English, Korean, Japanese, and Chinese. The FINAL-Bench release specifically markets its cross-lingual blend for those four, and the deployed model ships voices for them.

About three seconds. It works in zero-shot mode, so no fine-tuning or training is required — you provide a short reference clip and it generates new speech in that voice.
← Сви гласови