Dia TTS ಟಿಟಿಟ್ಸ್Name
A 1.6B-parameter model purpose-built for generating natural multi-speaker dialogue, not just single-voice narration.
ನಿಖರವಾದ ನಿಯಂತ್ರಣಕ್ಕಾಗಿ ನಿಮ್ಮ ಪಠ್ಯವನ್ನು SSML ಟ್ಯಾಗ್ಗಳಲ್ಲಿ ಭದ್ರಗೊಳಿಸು:
<speak><prosody rate="slow">Slow speech</prosody></speak>
ಆಯ್ಕೆ ಮಾಡಲಾದ ಮಾದರಿಗೆ ಗೊಂಬೆ ಹಾಕಿದರೆ ಅದು ನಡೆಯುವ ನಿಮ್ಮ ಪಠ್ಯದಲ್ಲಿ ಒಂದನ್ನು ಹಾಕಲು ಒತ್ತಿ:
ಈ ನಮೂನೆಯನ್ನು ಸರಳ ಪಠ್ಯವಾಗಿ ಓದುವುದರಿಂದ, ಆನ್ಲೈನ್ ಟ್ಯಾಗ್ಗಳನ್ನು ನಿರ್ಲಕ್ಷಿಸಲಾಗುತ್ತದೆ. ಟ್ಯಾಗ್- ಸಂಬಂಧಿತ ಭಾವನಾತಕ್ಕಾಗಿ, ಆರೆಫಸ್ ಅಥವ ಬಾರ್ಕ್ ನಂತಹ ಒಂದು ಚಿತ್ರಾಂಶದ ನಮೂನೆಗೆ ಬದಲಾಯಿಸಲಾಗುತ್ತದೆ.
ಗ್ರಾಹಕೀಯ ಉದ್ಧರಣೆಗಳನ್ನು (ಮಾತು = ಉಚ್ಚಾರಣೆಯನ್ನು) ಅರ್ಥನಿರೂಪಿಸು:
ಕುರಿತು Dia TTS
Dia by Nari Labs is a 1.6-billion-parameter text-to-speech model designed from the ground up for dialogue rather than monologue. It generates conversations between two speakers with realistic turn-taking, prosody, and emotional expression, producing audio that sounds like a real exchange instead of two voices read separately. Architecturally it pairs an autoregressive transformer with the Descript Audio Codec (DAC) for waveform generation. Dia is a strong fit for podcast-style content, scripted audiobook dialogue, and conversational scenes, and is released under Apache 2.0. Generations are heavier than single-voice models, so it favors quality over raw speed.
ಇದಕ್ಕೆ ಉತ್ತಮ: Podcasts, audiobook dialogues, conversational content
ಎಲ್ಲವನ್ನೂ ವೀಕ್ಷಿಸು Dia TTS ಧ್ವನಿಗಳುಒಂದು ನೋಟದಲ್ಲಿ
- ವಿಕಾಸಕ
- Nari Labs
- ಪರವಾನಗಿ
- Apache 2.0
- ಟೈಅರ್
- standard
- ವೇಗ
- medium
- ಧ್ವನಿ ಕ್ಯೂನಿಫಾರಂ
- ಇಲ್ಲ
- ಭಾಷೆಗಳುName
- English
- ಗರಿಷ್ಟ ಅಕ್ಷರಗಳು
- 800