Tags ang napili modelo nauunawaan — i-click upang ihulog ang isa sa iyong teksto kung saan ito ay nangyayari:
Ang modelong ito ay nagbabasa ng karaniwang teksto, kaya inline tags ay hindi pinapansin. Para sa tag-based na damdamin, lumipat sa isang makahulugang modelo tulad ng Orpheus o Bark.
Natural-language delivery cues. Pinarangalan ng Qwen3-TTS ngayon; iba pang mga masining na modelo darating sa lalong madaling panahon.
Ang modelong ito ay hindi sumusuporta sa mga tagubilin ng estilo — lumipat sa isang modelo na ginagawa (halimbawa Qwen3-TTS).
Tukuyin ang mga pasadyang mga panlapi (word = panlapi):
-12
+12
Controls katangian ng pagpapakita (0 = neutral, 1 = napaka-katangian ng pagpapakita)
Classifier-free gabay timbang (mas mataas = mas prompt-sunod)
Ipaliwanag ang estilo ng boses sa natural na wika (Parler gumagamit ito sa halip ng preset na boses)
Dia Dialog Format: Ang mga salitang ito ay maaaring isulat sa mga titik na [S1] at [S2]. Halimbawa: [S1] Hello there! [S2] Hi, how are you?
Ito ay isang premium na modelo ng boses, magagamit sa anumang bayad na plano. Maaari pa ring mag-preview ng mga boses nito nang libre sa play button sa tabi ng boses picker.
Dia by Nari Labs is a 1.6-billion-parameter text-to-speech model designed from the ground up for dialogue rather than monologue. It generates conversations between two speakers with realistic turn-taking, prosody, and emotional expression, producing audio that sounds like a real exchange instead of two voices read separately. Architecturally it pairs an autoregressive transformer with the Descript Audio Codec (DAC) for waveform generation. Dia is a strong fit for podcast-style content, scripted audiobook dialogue, and conversational scenes, and is released under Apache 2.0. Generations are heavier than single-voice models, so it favors quality over raw speed.
Pinakamahusay para sa: Podcasts, audiobook dialogues, conversational content
Multi-speaker dialogue. Unlike most TTS models that read one voice at a time, Dia generates a two-speaker conversation with natural turn-taking, prosody, and emotion in a single pass — ideal for podcasts and scripted scenes.
It is a 1.6-billion-parameter model from Nari Labs, built on an autoregressive transformer with the Descript Audio Codec for audio generation.
On TTS.ai, Dia is configured for English. Its strength is dialogue generation rather than broad multilingual coverage.
Ipasok ang iyong email upang makakuha ng 15,000 libreng mga character at panatilihin ang pagbuo ng pagsasalita.
Walang kailangang password — ipapa-email sa iyo ang isang link upang magtakda ng isa mamaya.
Libreng Limita sa Antas Naabot
Ginamit mo na ang iyong 5,000 libreng araw-araw na mga character. Lumikha ng isang libreng account upang makakuha ng 15,000 bonus na mga character pati na rin ang 10,000 libreng mga character bawat buwan.
Naabot mo na ang iyong libreng limitasyon ng modelo. Mag-upgrade para sa higit pang mga character, o bumili ng isang character pack upang gamitin ang mga premium na modelo.