Kokoro

Kokoro ТТС

An 82M-parameter open model from Hexgrad that delivers studio-quality speech at nearly 100x real-time.

Ёзиш 5000 белги чегараси

Матнни аниқ назорат учун SSML теглар билан ўраб қўйиш:

<speak><prosody rate="slow">Slow speech</prosody></speak>

Танланган модел тушунадиган тегилар — уларни матнга тушириш учун босинг:

Бу модел оддий матн ўқийди, шунинг учун тегишли теги эътиборга олинмайди. Эмоционал теги асосида, Orpheus ёки Bark каби ифодали моделга ўтинг.

Ўз нутқини белгилаш (сўз = нутқ):

-12 +12
0.5x 2.0x
Piper, VITS, MeloTTS билан бепул
Сизнинг яратилган аудионгиз бу ерда намоён бўлади. Модельни танланг, матнни киритинг ва Юклаш тугмасини босинг.
Аудио муваффақиятли яратилди
0:00
Аудио юклаб олиш .srt юклаб олиш Уланиш муддати 24 соатдан сўнг тугайди
Бепул даража: шахсий фойдаланиш. $5/mo дан бошланувчи коммерциявий лицензия
Буни ўз овозингизга айлантиринг 30 сония ичида овозни клонлаш
TTS.ai'ни севасанми? Дўстларингга айт!

Маълумот Kokoro

Kokoro, built by Hexgrad, is a deliberately tiny 82-million-parameter model that punches far above its size class. It uses a StyleTTS + ISTFTNet architecture and was trained on roughly 1,200 hours of speech, yet generates audio close to 100x faster than real-time on a GPU while staying remarkably natural and expressive. It covers English, Japanese, Chinese, French, Italian, Portuguese, Spanish, and Hindi with a varied set of expressive voicepacks, and supports streaming. The combination of small footprint, low latency, and a permissive license has made Kokoro one of the most popular free models for high-volume and streaming use — it carries the largest share of traffic on TTS.ai.

Энг яхшиси: High-quality TTS with minimal latency, streaming applications

Ҳаммасини кўриш Kokoro овозлар

Бир қарашда

Ижодкор
Hexgrad
Лицензия
Apache 2.0
Тир
free
Тезлик
fast
Овозни клонлаш
Йўқ
Тиллар
English, Japanese, Chinese, French, Italian, Portuguese, Spanish, Hindi
Максимум ҳарфлар
500

Kokoro овозлар

Adam

English
Оқ Male

Alex

Spanish
Оқ Male

Alex

Portuguese
Оқ Male

Alpha

Japanese
Оқ Female

Alpha

Hindi
Оқ Female

Bella

English
Оқ Female

Dora

Portuguese
Оқ Female

Dora

Spanish
Оқ Female

Emma (British)

English
Оқ Female

George (British)

English
Оқ Male

Gongitsune

Japanese
Оқ Female

Heart

English
Оқ Female

Isabella (British)

English
Оқ Female

Lewis (British)

English
Оқ Male

Michael

English
Оқ Male

Nicola

Italian
Оқ Male

Nicole

English
Оқ Female

Omega

Hindi
Оқ Male

Sara

Italian
Оқ Female

Sarah

English
Оқ Female

Siwis

French
Оқ Female

Sky

English
Оқ Female

Xiaobei

Chinese
Оқ Female

Xiaoni

Chinese
Оқ Female

Xiaoxiao

Chinese
Оқ Female

Yunjian

Chinese
Оқ Male

Kokoro ТТС — кўп бериладиган саволлар

Yes. Kokoro is released under the Apache 2.0 license and sits in the free tier, so it can be used commercially at no cost.

Kokoro is only 82M parameters and uses an efficient StyleTTS + ISTFTNet design, letting it generate audio nearly 100x faster than real-time on a GPU with just ~1.5GB VRAM while staying natural-sounding.

Kokoro supports English, Japanese, Chinese, French, Italian, Portuguese, Spanish, and Hindi, each with its own expressive voicepacks. It does not support voice cloning.
← Барча овозлар