Kani TTS 2 TTS
An ultra-lightweight 400M English model that runs in just 3GB of VRAM at a 0.2 real-time factor.
Wrap uw tekst in SSML-tags voor nauwkeurige controle:
<speak><prosody rate="slow">Slow speech</prosody></speak>
Tags het geselecteerde model begrijpt
Dit model leest platte tekst, dus inline tags worden genegeerd. Voor emotie op basis van tags, schakel naar een expressief model zoals Orpheus of Bark.
Definieer aangepaste uitspraaken (woord = uitspraak):
Info Kani TTS 2
Kani-TTS-2 by NineNineSix is an ultra-lightweight 400M-parameter text-to-speech model built on a Liquid AI LFM2 backbone with NVIDIA's NanoCodec. It runs in just 3GB of VRAM and generates roughly ten seconds of speech in about two seconds on an A100 — a real-time factor near 0.2. The current public release ships an English-only checkpoint and, unlike its predecessor, does not expose the speaker-embedding hook needed for voice cloning. Its strength is fast, low-cost English generation on modest hardware, which makes it a good fit for quick previews and high-volume English narration. It is released under Apache 2.0 and offered on the free tier.
Beste voor: Fast English generation on low-VRAM hardware, quick previews
Alles doorbladeren Kani TTS 2 stemmenIn een oogopslag
- Ontwikkelaar
- NineNineSix
- Licentie
- Apache 2.0
- Niveau
- free
- Snelheid
- fast
- Klonen van stemmen
- Nee
- Talen
- English
- Max. tekens
- 1000