Kani TTS 2

Kani TTS 2 टीएसटी

An ultra-lightweight 400M English model that runs in just 3GB of VRAM at a 0.2 real-time factor.

ऊपर हस्ताक्षर करें 5,000 अक्षर सीमा के लिए

अस्थायी नियंत्रण के लिए एसएसएमएल टैग में अपने पाठ को लपेटें:

<speak><prosody rate="slow">Slow speech</prosody></speak>

चुने गए मॉडल को समझने के लिए टैग - पर क्लिक करें जहाँ हो वहाँ किसी को छोड़ा जाए:

यह मॉडल सादा पाठ पढ़ता है, तो इनलाइन टैग नज़रअंदाज़ किया जाता है. टैग आधारित भावना के लिए, ओरे-हिक मॉडल या बारक में स्विच करता है.

मनपसंद उच्चारण पारिभाषित करें (नाम = उच्चारण):

-12 +12
0.5x 2.0x
पाइप, VITS, मेरोच के साथ मुक्त
आपका उत्पन्न ऑडियो यहाँ प्रकट होगा. कोई मॉडल चुनें, पाठ भरें, और क्लिक करें.
ऑडियो सफलतापूर्वक बनाया गया
0:00
ऑडियो डाउनलोड करें डाउनलोड लिंक का समय 24h में
फ्री टाई: निजी इस्तेमाल । $5/मो से व्यावसायिक लाइसेंस
मुक्त अक्षरों पर कम चला रहा है हर महीने 200के अक्षर लाएँ — $5/मो या एक बार 100के पैक
अपनी आवाज़ इस तरह बुझाइए 30 सेकंड में एक आवाज क्लोन करें
अपने दोस्तों को बताइए!

के बारे में Kani TTS 2

Kani-TTS-2 by NineNineSix is an ultra-lightweight 400M-parameter text-to-speech model built on a Liquid AI LFM2 backbone with NVIDIA's NanoCodec. It runs in just 3GB of VRAM and generates roughly ten seconds of speech in about two seconds on an A100 — a real-time factor near 0.2. The current public release ships an English-only checkpoint and, unlike its predecessor, does not expose the speaker-embedding hook needed for voice cloning. Its strength is fast, low-cost English generation on modest hardware, which makes it a good fit for quick previews and high-volume English narration. It is released under Apache 2.0 and offered on the free tier.

के लिए उत्तम: Fast English generation on low-VRAM hardware, quick previews

सभी ब्राउज़ करें Kani TTS 2 आवाज़

एक नज़र

डेवलपर
NineNineSix
लाइसेंस
Apache 2.0
टीयर
free
गति
fast
आवाज कहीं नहीं
नहीं
भाषाएँ
English
अधिकतम अक्षर
1000

Kani TTS 2 आवाज़

Default

English
मानक Neutral

Kani TTS 2 टीएस — प्रयोग कर रहा है

It runs in just 3GB of VRAM and produces about ten seconds of speech in roughly two seconds on an A100 — a real-time factor near 0.2 — thanks to its 400M-parameter LFM2 backbone and NanoCodec.

No. The current v2 release removed the public speaker-embedding hook, so cloning is not available. For cloning, use Chatterbox, IndexTTS-2, or GPT-SoVITS.

English only. The public release ships a single English checkpoint; for non-English speech, use a model like Kokoro or MeloTTS.
← सभी आवाज