Pocket TTS

Pocket TTS TTS

A compact 100M-parameter CPU model from Kyutai (makers of Moshi) with single-sample voice cloning.

Kayıt ol 5000 karakter sınırı için

Kesin kontrol için metninizi SSML etiketleri içinde sarılın:

<speak><prosody rate="slow">Slow speech</prosody></speak>

Seçilmiş modeli anlayan etiketler — bir tanesini metinde olduğu yere bırakmak için tıklayınız:

Bu model sıradan metin okur, bu yüzden satır içindeki etiketler göz ardı edilir. Etiket tabanlı duygular için, Orpheus veya Bark gibi ifadesel bir modele geçin.

Özel telaffuzları tanımla (kelime = telaffuz):

-12 +12
0.5x 2.0x
Piper, VITS, MeloTTS ile ücretsiz
Oluşturduğunuz ses burada görünecek. Bir model seçin, metni girin ve Oluştur' a basın.
Ses Başarıyla Oluşturuldu
0:00
Ses İndir İndir Bağlantı 24 saat içinde sona erer
Özgür katman: kişisel kullanım. Ticari lisans ayda 5$'dan
TTS.ai'yi seviyor musunuz?

Hakkında Pocket TTS

Pocket TTS comes from Kyutai, the lab behind the Moshi speech model, and is built around a transformer paired with the Mimi codec. At just 100M parameters it runs efficiently on CPU, yet it still supports zero-shot voice cloning from a single audio sample — an unusual feature at this size. It covers English and French and handles up to 1,000 characters per request at fast (~2s) speeds. The small footprint and ~1GB VRAM make it a natural fit for edge deployment and low-resource or CPU-only environments where quick voice cloning is needed.

En iyi: Lightweight deployment, CPU-only environments, quick voice cloning

Hepsini Ara Pocket TTS sesleri

Bir bakışta

Geliştirici
Kyutai
Lisans
MIT
Hayvan
free
Hız
fast
Ses klonlama
Evet
Dilleri
English, French
Maksimum karakterler
1000

Pocket TTS sesleri

Alba

English
Özgür Female

Azelma

English
Özgür Female

Cosette

English
Özgür Female

Eponine

English
Özgür Female

Fantine

English
Özgür Female

Fantine (French)

French
Özgür Female

Javert

English
Özgür Male

Jean

English
Özgür Male

Jean (French)

French
Özgür Male

Marius

English
Özgür Male

Pocket TTS TTS - FAQ

Yes. Pocket TTS does zero-shot voice cloning from a single reference sample (about 3 seconds), which is notable for a model this small.

Yes. At 100M parameters it runs efficiently on CPU and needs only about 1GB VRAM if a GPU is used, making it well suited to edge and low-resource deployment.

Yes. Pocket TTS is MIT-licensed and in the free tier. It supports English and French.
← Tüm sesleri