Бусад
Pocket TTS

Pocket TTS ТТС

A compact 100M-parameter CPU model from Kyutai (makers of Moshi) with single-sample voice cloning.

Бүртгүүлэх 5000 тэмдэгтээс хэтрэхгүй

Тодорхой хяналтын тулд SSML тэмдгээр текстээ буулгах:

<speak><prosody rate="slow">Slow speech</prosody></speak>

Бүх

Энэ загвар нь энгийн утга уншдаг, тиймээс доторх тэмдгийг үл тоомсорлодог. Тэг- суурилсан сэтгэл хөдлөл, Orpheus эсвэл Bark- шиг илэрхийлэх загвар руу шилжинэ.

Өөрийн дуудлагыг тодорхойлох (үг = дуудлага):

-12 +12
0.5x 2.0x
Piper, VITS, MeloTTS-тэй чөлөөт
Таны үүсгэсэн дууны файл энд гарч ирнэ. Модель сонгож, текстийг оруулж, Бүтээгдэх товчийг дарна уу.
Аудио амжилттай бүтээгдсэн
0:00
Дуу татаж авах .srt татаж авах Холбоо 24 цагийн дараа дуусна
Хязгааргүй: хувийн хэрэглээ. Бизнесийн лиценз $5/сараас
TTS.ai-г хайрладаг уу? Найзуудаа хэлж өгөөрэй!

Тодорхойлолт Pocket TTS

Pocket TTS comes from Kyutai, the lab behind the Moshi speech model, and is built around a transformer paired with the Mimi codec. At just 100M parameters it runs efficiently on CPU, yet it still supports zero-shot voice cloning from a single audio sample — an unusual feature at this size. It covers English and French and handles up to 1,000 characters per request at fast (~2s) speeds. The small footprint and ~1GB VRAM make it a natural fit for edge deployment and low-resource or CPU-only environments where quick voice cloning is needed.

Хамгийн сайн: Lightweight deployment, CPU-only environments, quick voice cloning

Бүхнийг харах Pocket TTS дуунууд

Нүүр хуудас

Хөгжүүлэгч
Kyutai
Лиценз
MIT
Үхрийн
free
Хурд
fast
Дууны дугуй
Тийм
Хэл
English, French
Хамгийн их үсэг
1000

Pocket TTS дуунууд

Alba

English
Хязгааргүй Female

Azelma

English
Хязгааргүй Female

Cosette

English
Хязгааргүй Female

Eponine

English
Хязгааргүй Female

Fantine

English
Хязгааргүй Female

Fantine (French)

French
Хязгааргүй Female

Javert

English
Хязгааргүй Male

Jean

English
Хязгааргүй Male

Jean (French)

French
Хязгааргүй Male

Marius

English
Хязгааргүй Male

Pocket TTS ТТС - Тодорхойгүй асуултууд

Yes. Pocket TTS does zero-shot voice cloning from a single reference sample (about 3 seconds), which is notable for a model this small.

Yes. At 100M parameters it runs efficiently on CPU and needs only about 1GB VRAM if a GPU is used, making it well suited to edge and low-resource deployment.

Yes. Pocket TTS is MIT-licensed and in the free tier. It supports English and French.
← Бүх дуунууд