Kokoro

Kokoro نووسراو بۆ بیستراو

An 82M-parameter open model from Hexgrad that delivers studio-quality speech at nearly 100x real-time.

تۆماربکە بۆ ٥٠٠٠ هێما

نوسراوەکەت بگۆڕە بۆ تگەکانی SSML بۆ کۆنتڕۆڵی ڕاستەقینە:

<speak><prosody rate="slow">Slow speech</prosody></speak>

تگەکان کە مۆدێلی هەڵبژێردراو تێیدەگات - بکەرەوە بۆ ئەوەی یەکێکیان بخەیتە ناو دەقەکەتەوە کە تیایدا ڕوودەدات:

ئەم مۆدێلە نوسراوێکی ئاسایی دەخوێنێتەوە، بۆیە تاگەکانی ناو ڕستە پشتگوێ دەخرێت. بۆ هەستێکی لەسەر بنەمای تاگ، بگەڕێ بۆ مۆدێلێکی دەربڕین وەک ئۆرفیۆس یان بارک.

پێناسەکردنی دەنگی خۆت (وشە = دەنگی):

-12 +12
0.5x 2.0x
بەبێ پارە لەگەڵ Piper, VITS, MeloTTS
دەنگی دروستکراوت لێرەدا دەردەکەوێت. مۆدێلێک هەڵبژێرە، نوسراوێک دابنێ، پاشان کلیک بکە لەسەر دروستکردن.
دەنگ بە سەرکەوتن دروست کرا
0:00
دابەزاندنی دەنگ دابەزاندن پەیوەستەکە دوای ٢٤ کاتژمێر کۆتایی دێت
پلەی ئازاد: بەکارهێنانی تایبەتی. مۆڵەتی بازرگانی لە ٥$/ مانگ
خۆشت دەوێت TTS.ai؟ بە هاوڕێکانت بڵێ!

دەربارەی Kokoro

Kokoro, built by Hexgrad, is a deliberately tiny 82-million-parameter model that punches far above its size class. It uses a StyleTTS + ISTFTNet architecture and was trained on roughly 1,200 hours of speech, yet generates audio close to 100x faster than real-time on a GPU while staying remarkably natural and expressive. It covers English, Japanese, Chinese, French, Italian, Portuguese, Spanish, and Hindi with a varied set of expressive voicepacks, and supports streaming. The combination of small footprint, low latency, and a permissive license has made Kokoro one of the most popular free models for high-volume and streaming use — it carries the largest share of traffic on TTS.ai.

باشترین بۆ: High-quality TTS with minimal latency, streaming applications

سەردانی هەموویان بکە Kokoro دەنگی

چاوپێکەوتن

پەرەپێدەر
Hexgrad
مۆڵەتی بەکارھێنەر
Apache 2.0
یه‌مه‌ن
free
خێرایی
fast
دووبارە دروستکردنی دەنگی
نەخێر
زمان
English, Japanese, Chinese, French, Italian, Portuguese, Spanish, Hindi
زۆرترین پیت
500

Kokoro دەنگی

Adam

English
ئازادە Male

Alex

Spanish
ئازادە Male

Alex

Portuguese
ئازادە Male

Alpha

Japanese
ئازادە Female

Alpha

Hindi
ئازادە Female

Bella

English
ئازادە Female

Dora

Portuguese
ئازادە Female

Dora

Spanish
ئازادە Female

Emma (British)

English
ئازادە Female

George (British)

English
ئازادە Male

Gongitsune

Japanese
ئازادە Female

Heart

English
ئازادە Female

Isabella (British)

English
ئازادە Female

Lewis (British)

English
ئازادە Male

Michael

English
ئازادە Male

Nicola

Italian
ئازادە Male

Nicole

English
ئازادە Female

Omega

Hindi
ئازادە Male

Sara

Italian
ئازادە Female

Sarah

English
ئازادە Female

Siwis

French
ئازادە Female

Sky

English
ئازادە Female

Xiaobei

Chinese
ئازادە Female

Xiaoni

Chinese
ئازادە Female

Xiaoxiao

Chinese
ئازادە Female

Yunjian

Chinese
ئازادە Male

Kokoro پرسیاری زۆر کراوە

Yes. Kokoro is released under the Apache 2.0 license and sits in the free tier, so it can be used commercially at no cost.

Kokoro is only 82M parameters and uses an efficient StyleTTS + ISTFTNet design, letting it generate audio nearly 100x faster than real-time on a GPU with just ~1.5GB VRAM while staying natural-sounding.

Kokoro supports English, Japanese, Chinese, French, Italian, Portuguese, Spanish, and Hindi, each with its own expressive voicepacks. It does not support voice cloning.
← هەموو دەنگەکان