Pocket TTS

Pocket TTS TTS

A compact 100M-parameter CPU model from Kyutai (makers of Moshi) with single-sample voice cloning.

Regjistrohu për 5,000 karaktere

Rrotullo tekstin në etiketa SSML për kontroll të saktë:

<speak><prosody rate="slow">Slow speech</prosody></speak>

Tags që modeli i zgjedhur i kupton - kliko për të vendosur një në tekstin tuaj ku ndodh:

Ky model lexon tekst të thjeshtë, kështu që etiketat e brendshme injorohen. Për emocione të bazuara në etiketa, kalo në një model shprehës si Orpheus ose Bark.

Përcakto përkthimin e personalizuar (fjalë = përkthim):

-12 +12
0.5x 2.0x
Pa pagesë me Piper, VITS, MeloTTS
Audio e gjeneruar do të shfaqet këtu. Zgjidh një model, shkruaj tekstin dhe kliko Gjenero.
Audio u krijua me sukses
0:00
Shkarko audio Shkarko.srt Lidhja skadoi për 24 orë
Niveli i lirë: përdorim personal. Liçenca komerciale nga $5/muaj
Të pëlqen TTS.ai?

Për Pocket TTS

Pocket TTS comes from Kyutai, the lab behind the Moshi speech model, and is built around a transformer paired with the Mimi codec. At just 100M parameters it runs efficiently on CPU, yet it still supports zero-shot voice cloning from a single audio sample — an unusual feature at this size. It covers English and French and handles up to 1,000 characters per request at fast (~2s) speeds. The small footprint and ~1GB VRAM make it a natural fit for edge deployment and low-resource or CPU-only environments where quick voice cloning is needed.

Më i miri për: Lightweight deployment, CPU-only environments, quick voice cloning

Shfleto gjithçka Pocket TTS zëra

Me një sy

Programues
Kyutai
Liçenca
MIT
Animal
free
Shpejtësia
fast
Klonimi i zërit
Po
Gjuhë
English, French
Maksimumi i gërmave
1000

Pocket TTS zëra

Alba

English
I lirë Female

Azelma

English
I lirë Female

Cosette

English
I lirë Female

Eponine

English
I lirë Female

Fantine

English
I lirë Female

Fantine (French)

French
I lirë Female

Javert

English
I lirë Male

Jean

English
I lirë Male

Jean (French)

French
I lirë Male

Marius

English
I lirë Male

Pocket TTS FAQ

Yes. Pocket TTS does zero-shot voice cloning from a single reference sample (about 3 seconds), which is notable for a model this small.

Yes. At 100M parameters it runs efficiently on CPU and needs only about 1GB VRAM if a GPU is used, making it well suited to edge and low-resource deployment.

Yes. Pocket TTS is MIT-licensed and in the free tier. It supports English and French.
← Të gjitha zërat