CosyVoice 2

CosyVoice 2 TTS

Alibaba Tongyi Lab's streaming TTS reaching human-parity naturalness with near-zero latency and zero-shot cloning.

Daftar masuk had 5,000 aksara

Lilitkan teks anda dalam tag SSML untuk kawalan tepat:

<speak><prosody rate="slow">Slow speech</prosody></speak>

Tag model dipilih memahami - klik untuk jatuhkan satu ke dalam teks anda di mana ia berlaku:

Model ini membaca teks biasa, jadi tag dalam baris diabaikan. Untuk emosi berdasar tag, beralih ke model ekspresif seperti Orpheus atau Bark.

Tetapkan sebutan tersendiri (perkataan = sebutan):

-12 +12
0.5x 2.0x
Bebas dengan Piper, VITS, MeloTTS
Audio yang dijana akan muncul di sini. Pilih model, masukkan teks, dan klik Janakan.
Audio Dijana Dengan Berjaya
0:00
Muat turun Audio Muat turun.srt Pautan luput dalam 24 jam
Tahap percuma: penggunaan peribadi. Lesen Komersial dari $5/mo
Cinta TTS.ai? Beritahu kawan-kawan anda!

Tentang CosyVoice 2

CosyVoice 2, from Alibaba's Tongyi Lab, was designed to make high-quality speech viable in real time. It uses a finite scalar quantization approach combined with flow matching to support streaming synthesis at extremely low latency, while reaching human-comparable naturalness that outperforms many commercial systems in subjective tests. Beyond quality, it offers zero-shot voice cloning from about 3 seconds of audio, cross-lingual synthesis, and fine-grained emotion control. Covering 8 languages with a 1,000-character cap, it's a strong fit for voice assistants, streaming TTS, and other real-time applications.

Terbaik untuk: Real-time applications, streaming TTS, voice assistants

Layari semua CosyVoice 2 suara

Dengan sekejap mata

Pemaju
Alibaba (Tongyi Lab)
Lesen
Apache 2.0
Tajuk
standard
Kelajuan
medium
Klon suara
Ya
Bahasa
English, Chinese, Japanese, Korean, French, German, Italian, Spanish
Aksara maksimum
1000

CosyVoice 2 suara

Chinese Female

Chinese
Piawai Female

Chinese Male

Chinese
Piawai Male

English Female

English
Piawai Female

English Male

English
Piawai Male

French Female

French
Piawai Female

German Female

German
Piawai Female

Italian Female

Italian
Piawai Female

Japanese Female

Japanese
Piawai Female

Korean Female

Korean
Piawai Female

Spanish Female

Spanish
Piawai Female

CosyVoice 2 TTS - FAQ

Yes. CosyVoice 2 uses finite scalar quantization for streaming synthesis at very low latency, which is what makes it suitable for voice assistants and real-time applications.

Yes. It offers zero-shot voice cloning from roughly 3 seconds of reference audio, plus cross-lingual synthesis and emotion control.

Yes. CosyVoice 2 is Apache 2.0 licensed. It supports 8 languages: English, Chinese, Japanese, Korean, French, German, Italian, and Spanish.
← Semua suara