Pocket TTS

Pocket TTS TTS

A compact 100M-parameter CPU model from Kyutai (makers of Moshi) with single-sample voice cloning.

Upišite se za 5000 ograničenja znakova

Umotaj svoj tekst u SSML oznake za preciznu kontrolu:

<speak><prosody rate="slow">Slow speech</prosody></speak>

Oznake odabrani model razumije — kliknite da bacite jedan u vaš tekst gdje se to događa:

Ovaj model čita običan tekst, tako da inline oznake se zanemaruju. Za tag-based emocije, prebaci na ekspresivni model kao što su Orfeus ili Bark.

Definiši vlastite izgovore (riječ = izgovor):

-12 +12
0.5x 2.0x
Besplatno s Piper, VITS, Melotts
Ovdje će se pojaviti vaš generirani zvuk. Odaberite model, unesite tekst i kliknite Generirati.
Zvučni generisan uspješno
0:00
Preuzmi zvuk Preuzmite.rt Veza isteče za 24 sata
Besplatna uporaba: osobna upotreba. Komercijalna licenca od $5/mo
Reci svojim prijateljima!

O Pocket TTS

Pocket TTS comes from Kyutai, the lab behind the Moshi speech model, and is built around a transformer paired with the Mimi codec. At just 100M parameters it runs efficiently on CPU, yet it still supports zero-shot voice cloning from a single audio sample — an unusual feature at this size. It covers English and French and handles up to 1,000 characters per request at fast (~2s) speeds. The small footprint and ~1GB VRAM make it a natural fit for edge deployment and low-resource or CPU-only environments where quick voice cloning is needed.

Najbolje za: Lightweight deployment, CPU-only environments, quick voice cloning

Pregledaj sve Pocket TTS glasovi

Na jedan pogled

Programer
Kyutai
Dozvola
MIT
Nivo
free
Brzina
fast
Kloniranje glasa
-Da.
Jezici
English, French
Maks. znakova
1000

Pocket TTS glasovi

Alba

English
Slobodno Female

Azelma

English
Slobodno Female

Cosette

English
Slobodno Female

Eponine

English
Slobodno Female

Fantine

English
Slobodno Female

Fantine (French)

French
Slobodno Female

Javert

English
Slobodno Male

Jean

English
Slobodno Male

Jean (French)

French
Slobodno Male

Marius

English
Slobodno Male

Pocket TTS TTS – FAQ

Yes. Pocket TTS does zero-shot voice cloning from a single reference sample (about 3 seconds), which is notable for a model this small.

Yes. At 100M parameters it runs efficiently on CPU and needs only about 1GB VRAM if a GPU is used, making it well suited to edge and low-resource deployment.

Yes. Pocket TTS is MIT-licensed and in the free tier. It supports English and French.
← Svi glasovi