VieNeu-TTS-v2 TTS
A Vietnamese-first, CPU-only model with en-vi code-switching, 7 regional preset voices, and zero-shot cloning.
Wrap test tiegħek fil-tags SSML għall-kontroll preċiż:
<speak><prosody rate="slow">Slow speech</prosody></speak>
Tags li l-mudell magħżul jifhem — ikklikkja biex tqiegħed waħda fit-test tiegħek fejn jiġri:
Dan il-mudell jaqra test sempliċi, għalhekk it-tags inline huma injorati.Għal emozzjoni bbażata fuq it-tag, aqleb għal mudell espressiv bħal Orpheus jew Bark.
Iddefinixxi pronunzji tad-dwana (kelma = pronunzja):
Dwar VieNeu-TTS-v2
VieNeu-TTS-v2 is a 300M-parameter Vietnamese-first model built on a Qwen3 backbone and trained on more than 10,000 hours of bilingual data. It handles seamless English-Vietnamese code-switching, ships 7 preset voices spanning Northern and Southern accents, and clones a voice instantly from just 3-5 seconds of reference audio. Notably it runs entirely on CPU — using GGUF Q4 inference plus an ONNX audio decoder — with no GPU required, finishing a generation in about 7 seconds. It's purpose-built for Vietnamese content and bilingual en-vi narration, an underserved niche in open TTS.
L-aħjar għal: Vietnamese content and bilingual en-vi narration
Ibbrawżja kollox VieNeu-TTS-v2 vuċijietDaqqa t'għajn
- Żviluppatur
- Phạm Nguyễn Ngọc Bảo
- Liċenzja
- Apache 2.0
- Annimali
- standard
- Veloċità
- fast
- Klonazzjoni tal-vuċi
- Iva
- Lingwi
- Vietnamese, English
- Karattri massimi
- 1000