Kani TTS 2

Kani TTS 2 អត្ថបទ​ទៅ​សំឡេង

An ultra-lightweight 400M English model that runs in just 3GB of VRAM at a 0.2 real-time factor.

ចុះឈ្មោះ កំណត់​សម្រាប់​តួអក្សរ ៥, ០០០

រុំ​អត្ថបទ​របស់​អ្នក​ក្នុង​ស្លាក SSML សម្រាប់​ការ​ត្រួតពិនិត្យ​ជាក់លាក់ ៖

<speak><prosody rate="slow">Slow speech</prosody></speak>

ស្លាក​ដែល​ម៉ូដែល​ដែល​បាន​ជ្រើស​យល់​ — ចុច​ដើម្បី​ទម្លាក់​មួយ​ទៅ​ក្នុង​អត្ថបទ​របស់​អ្នក​នៅ​កន្លែង​ដែល​វា​កើតឡើង ៖

ម៉ូដែល​នេះ​អាន​អត្ថបទ​ធម្មតា ដូច្នេះ​ស្លាក​ក្នុង​បន្ទាត់​ត្រូវ​បាន​មិន​អើពើ ។ សម្រាប់​អារម្មណ៍​ដែល​មាន​មូលដ្ឋាន​លើ​ស្លាក ប្ដូរ​ទៅ​ម៉ូដែល​បង្ហាញ​ដូច​ជា Orpheus ឬ Bark ។

កំណត់​ការ​បញ្ចេញ​សំឡេង​ផ្ទាល់ខ្លួន (ពាក្យ = ការ​បញ្ចេញ​សំឡេង) ៖

-12 +12
0.5x 2.0x
ឥតគិតថ្លៃ​ជាមួយ Piper, VITS, MeloTTS
អូឌីយ៉ូ​ដែល​បាន​បង្កើត​របស់​អ្នក​នឹង​លេចឡើង​នៅ​ទីនេះ ។ ជ្រើស​ម៉ូដែល បញ្ចូល​អត្ថបទ ហើយ​ចុច បង្កើត ។
បាន​បង្កើត​អូឌីយ៉ូ​ដោយ​ជោគជ័យ
0:00
ទាញយក​អូឌីយ៉ូ ទាញយក.srt តំណផុតកំណត់ក្នុង 24h
កម្រិត​ឥត​គិត​ថ្លៃ ៖ ការ​ប្រើ​ផ្ទាល់​ខ្លួន ។ អាជ្ញាប័ណ្ណពាណិជ្ជកម្មពី $5/ខែ
ធ្វើ​ឲ្យ​នេះ​ជា​សំឡេង​របស់​អ្នក ក្លូន​សំឡេង​ក្នុង ៣០ វិនាទី
ស្រឡាញ់ TTS.ai? ប្រាប់មិត្តភក្តិរបស់អ្នក!

អំពី Kani TTS 2

Kani-TTS-2 by NineNineSix is an ultra-lightweight 400M-parameter text-to-speech model built on a Liquid AI LFM2 backbone with NVIDIA's NanoCodec. It runs in just 3GB of VRAM and generates roughly ten seconds of speech in about two seconds on an A100 — a real-time factor near 0.2. The current public release ships an English-only checkpoint and, unlike its predecessor, does not expose the speaker-embedding hook needed for voice cloning. Its strength is fast, low-cost English generation on modest hardware, which makes it a good fit for quick previews and high-volume English narration. It is released under Apache 2.0 and offered on the free tier.

ល្អបំផុត​សម្រាប់: Fast English generation on low-VRAM hardware, quick previews

រកមើល​ទាំងអស់ Kani TTS 2 សំឡេង

ទិដ្ឋភាព​ទូទៅ

អ្នក​អភិវឌ្ឍន៍
NineNineSix
អាជ្ញាបណ្ណ
Apache 2.0
ផ្កាយ
free
ល្បឿន
fast
ការ​ក្លូន​សំឡេង
គ្មាន
ភាសា
English
តួអក្សរ​អតិបរមា
1000

Kani TTS 2 សំឡេង

Default

English
លំនាំដើម Neutral

Kani TTS 2 TTS - សំណួរ​ដែល​សួរ​ញឹកញាប់

It runs in just 3GB of VRAM and produces about ten seconds of speech in roughly two seconds on an A100 — a real-time factor near 0.2 — thanks to its 400M-parameter LFM2 backbone and NanoCodec.

No. The current v2 release removed the public speaker-embedding hook, so cloning is not available. For cloning, use Chatterbox, IndexTTS-2, or GPT-SoVITS.

English only. The public release ships a single English checkpoint; for non-English speech, use a model like Kokoro or MeloTTS.
← សំឡេង​ទាំងអស់