Pocket TTS

Pocket TTS TTS

A compact 100M-parameter CPU model from Kyutai (makers of Moshi) with single-sample voice cloning.

ثبت نام برای حد ۵۰۰۰ کاراکتر

برای کنترل دقیق ، متن خود را در برچسبهای SSML بپیچید:

<speak><prosody rate="slow">Slow speech</prosody></speak>

برچسبهایی که مدل برگزیده می‌فهمد — برای انداختن یکی در متن خود ، جایی که اتفاق می‌افتد ، کلیک کنید:

این مدل متن ساده را می‌خواند ، بنابراین برچسب‌های خطی نادیده گرفته می‌شوند. برای احساسات مبتنی بر برچسب ، به یک مدل بیانی مانند Orpheus یا Bark تغییر دهید.

تعریف تلفظ سفارشی) کلمه = تلفظ (:

-12 +12
0.5x 2.0x
آزاد با Piper, VITS, MeloTTS
صدای تولید شده شما در اینجا ظاهر خواهد شد. یک مدل را انتخاب کنید ، متن را وارد کنید ، و تولید را فشار دهید.
صدا با موفقیت تولید شد
0:00
بارگیری صدا دانلود پیوند در ۲۴ ساعت پایان می‌یابد
1- استفاده شخصی: استفاده شخصی. مجوز تجاری از $5/mo
دوست داريد TTS.ai؟ به دوستانتون بگو!

در مورد Pocket TTS

Pocket TTS comes from Kyutai, the lab behind the Moshi speech model, and is built around a transformer paired with the Mimi codec. At just 100M parameters it runs efficiently on CPU, yet it still supports zero-shot voice cloning from a single audio sample — an unusual feature at this size. It covers English and French and handles up to 1,000 characters per request at fast (~2s) speeds. The small footprint and ~1GB VRAM make it a natural fit for edge deployment and low-resource or CPU-only environments where quick voice cloning is needed.

بهترین برای: Lightweight deployment, CPU-only environments, quick voice cloning

مرور همۀ Pocket TTS صداها

يه نگاهي بنداز

توسعه‌دهنده
Kyutai
مجوز
MIT
حیوان
free
سرعت
fast
شبیه‌سازی صدا
آره
زبانها
English, French
بیشینه نویسه‌ها
1000

Pocket TTS صداها

Alba

English
آزاد Female

Azelma

English
آزاد Female

Cosette

English
آزاد Female

Eponine

English
آزاد Female

Fantine

English
آزاد Female

Fantine (French)

French
آزاد Female

Javert

English
آزاد Male

Jean

English
آزاد Male

Jean (French)

French
آزاد Male

Marius

English
آزاد Male

Pocket TTS FAQ - پرسش و پاسخ

Yes. Pocket TTS does zero-shot voice cloning from a single reference sample (about 3 seconds), which is notable for a model this small.

Yes. At 100M parameters it runs efficiently on CPU and needs only about 1GB VRAM if a GPU is used, making it well suited to edge and low-resource deployment.

Yes. Pocket TTS is MIT-licensed and in the free tier. It supports English and French.
← همه صداها