اوپن سورس ٹیکس سے اسپیکینگ ماڈلز
ہمارے پليٽ فارم پر ہر TTS ماڈل اوپن سورس ہے اور اکثر MIT يا Apache 2.0 استعمال کرتے ہیں چند ماڈل اور آوازیں صرف غیر تجارتی استعمال کے ليزنز سے ہیں اور 'شخصي اور غير تجارتی استعمال کے ليزنز سے' نشان زد ه هے ان کو ہمارے ہوسٹ API کے ذریعے استعمال کريں يا ان کو اپنے خود کے بنياد پر پورے کنٹرول کے ساتھ خود ہوسٹ کريں
اب کوشش کریں
اوپن سورس TTS کے فائدے
آپ کے پروجیکٹ کے لئے اوپن سورس ماڈلز کی اہمیت کیوں ہے
تمام اوپن سورس لائسنس
TTS.ai پر ہر ماڈل اوپن سورس ہے، اور ہر ماڈل صفحے اس کی لائسنس کی فہرست ہے. کوئی مختصہ بلیک باکس اور کوئی وینڈر لوک-ان.
اوپن سورس لائسنس
اکثر ماڈل MIT يا Apache 2.0 کے تحت لائسنس هے بعض ديگر لائسنس استعمال کريں اور ماڈل يا آوازوں کو غير تجارتي استعمال کے ليے لائسنس ديے گيا هے "شخصي اور غير تجارتي استعمال صرف"
خود مہمان
کوئی ماڈل ڈاؤن لوڈ کریں اور اسے اپنے ہیڈریڈر پر چلائیں. اپنے ڈیٹا، لیٹی سی اور بنیادی ڈھانچے پر مکمل کنٹرول. کوئی کلاؤڈ انحصار ضروری نہیں.
GPU بہتری
ماڈل NVIDIA GPUs کے ليے CUDA سپورٹ کے ساتھ مطلوبه هے پيپر صرف سي پي يو پر چلتا هے اکثر ماڈل کو موثر انفرا نسی کے ليے 2-8GB VRAM کا احتياج هے
کمونٹی محفوظ
فعال اوپن سورس کمیونٹیز ان ماڈلز کو برقرار رکھتے اور بہتر کرتے ہیں۔ تعاون کا استقبال کیا جاتا ہے – بگ، بہتری اور گیٹ ہاب پر نئی آوازیں پیش کریں۔
تجارتی لائسنس دستیاب ہے
$5/مئی سے ایک ادا کردہ منصوبہ آپ کی پیدا کردہ چیزوں کے لئے تجارتی لائسنس لے جاتا ہے، کوئی روایتی یا استعمال کی فیس کے ساتھ نہیں؛ مفت سطح ذاتی استعمال کے لئے ہے۔ ماڈل اور آوازیں جن پر "شخصی اور غیر تجارتی استعمال صرف" نشان لگایا گیا ہے، مستثنی ہیں۔
ہمارا اوپن سورس ماڈل کتلا گ
ہر ماڈل، اس کی لائسنس، اور یہ سب سے بہتر کیا کرتا ہے
Kokoro
Free
Lightweight 82M parameter model delivering studio-quality speech with blazing-fast inference.
بہترین: آپاچی 2.0 — بہترین کیفیت کا مفت ماڈل، 82M پارامٹس، خود مہمان بنانے میں آسان
کوشش کریں Kokoro
Piper
Free
A fast, local neural text to speech system optimized for Raspberry Pi and embedded devices.
بہترین: MIT — CPU-only, ایج ڈیوائس اور embedded self-hosting کے لئے بہترین
کوشش کریں Piper
VITS
Free
Conditional variational autoencoder with adversarial learning for end-to-end text-to-speech.
بہترین: ایم آئی ٹی - بنیادی فن تعمیر جو بہت سے ڈاؤنسٹریم ماڈلز کے ذریعے استعمال کی جاتی ہے
کوشش کریں VITS
Bark
Standard
Transformer-based text-to-audio model that generates realistic speech, music, and sound effects.
بہترین: ایم آئی ٹی - معیاری TTS سے باہر منفرد آڈیو پیدا کرنے کی صلاحیتیں
کوشش کریں Bark
Tortoise TTS
Premium
Multi-voice text-to-speech focused on quality with autoregressive architecture.
بہترین: آپاچی 2.0 - حداکثر کیفیت، وسیع طور پر مطالعہ کیا گیا حوالہ نفاذ
کوشش کریں Tortoise TTS
OpenVoice
Premium
Instant voice cloning with granular control over style, emotion, and accent.
بہترین: MIT — اوپن سورس وائٹ کلونینگ گرينل سٹیل کنٹرول کے ساتھ
کوشش کریں OpenVoiceاوپن سورس TTS استعمال کرنا
ہمارے مہمان API استعمال کریں یا خود ماڈل چلائیں
اوپن سورس ماڈلز کا مطالعہ کریں
20+ اوپن سورس TTS ماڈلز کے ہمارے کتلا گ براؤز کریں. ہر ماڈل صفحہ لائسنس، فن تعمیر، صلاحیتوں اور خود مہمانداری کی ضرورتوں کو دکھاتا ہے.
اپنے براؤزر میں کوشش کریں
TTS.ai پر براہ راست کوئی ماڈل جانچیں بغیر کسی چیز کو انسٹال کرنے کے۔ ہمارے GPU سرور پروسیسنگ کو ہینڈل کرتے ہیں تاکہ آپ خود مہمانداری کے لئے عہد کرنے سے پہلے معیار کا اندازہ لگا سکتے ہیں۔
خود مہمان یا ہماری API استعمال کریں
GitHub سے کلون ماڈل ریپو اور مقامی طور پر چلاؤ، یا پیداوار کے لیے ہماری ہوسٹڈ API استعمال کریں. خود ہوسٹڈ مکمل کنٹرول دیتا ہے؛ ہمارا API انتظامی ڈھانچے فراہم کرتا ہے.
آپ کا ایپلیکیشن بنائیں
آپ کے پرو ڈکٹ ميں TTS شامل کريں خود پر مختص ماڈل يا REST API استعمال کريں ہر ماڈل لائسنس کو پہلے چکيں: چند ماڈل اور آوازیں صرف غير تجارتي استعمال کے ليے هے
لائسنس موازنہ
ہر ماڈل کی لائسنس TTS.ai پر
| ماڈل | لائسنس | تجارتي استعمال | تبدیل | خود کار میزبان | مختص |
|---|---|---|---|---|---|
| Kokoro | Apache 2.0 | ضروری | |||
| Piper | MIT انجن | صرف کچھ آوازیں | اختیاری | ||
| VITS | MIT | اختیاری | |||
| MeloTTS | MIT | اختیاری | |||
| Chatterbox | MIT | اختیاری | |||
| Tortoise TTS | Apache 2.0 | ضروری | |||
| StyleTTS 2 | MIT | اختیاری | |||
| OpenVoice | MIT | اختیاری | |||
| Sesame CSM | Apache 2.0 | ضروری | |||
| Orpheus | Llama 3.2 | "Built with Llama" | |||
| Spark TTS | CC BY-NC-SA 4.0 | صرف ذاتی اور غیر تجارتی استعمال | ضروری | ||
| OuteTTS | CC BY-NC-SA 4.0 | صرف ذاتی اور غیر تجارتی استعمال | ضروری |
خود مہمان vs مہمان API
ماڈل خود چلو یا ہمیں بنیادی ڈھانچے کا انتظام کرنے دو
آپ کے ہارڈ ویئر پر خود میزبان
TTS.ai پر ہر ماڈل گٹ ہب يا حوا نگ فيس پر اوپن سورس پروجیکٹ کے طور پر دستياب هے وزن ڈائون لوڈ کريں ، وابستگياں انسٹال کريں ، اور اپنے GPUs پر انفريشن چلايں آپ کے پاس لا ٹنسي ، پرائيو ائيٹي اور سکيلينگ پر مکمل کنٹرول هے
- مکمل ڈیٹا پرائیویٹی - آڈیو آپ کے سرور کو کبھی نہیں چھوڑتی
- ابتدائي ترتیب کے بعد کوئی پر-مطالبہ خرچ نہیں
- آپ کے خود کے ڈیٹا پر ذاتي fine-tuning
- GPU ہارڈ ویئر کی ضرورت ہے (NVIDIA کی سفارش کی جاتی ہے)
- آپ اپڈیٹ، اسکیلنگ، اور انحصارات کا انتظام کرتے ہیں
TTS.ai ہوسٹ API استعمال کریں
ایک REST API کے ذریعے تمام 20+ ماڈلز تک فوری رسائی حاصل کریں۔ ہم GPU کی فراہمی، ماڈل اپڈیٹ، کیو مدیریت اور پیمانے بندی کا انتظام کرتے ہیں۔ ایک API کی کلید آپ کو ہر ماڈل تک رسائی فراہم کرتی ہے۔
- کوئی GPU ہارڈ ویئر کی ضرورت نہیں
- ایک API کے ذریعے تمام 20+ ماڈل
- خودکار ماڈل اپڈیٹ اور بہتری
- 99.9% اپ ٹائم اضافی بنیادی ڈھانچے کے ساتھ
- صرف اس کے لئے ادا کریں جو آپ استعمال کرتے ہیں
تیز شروع: API یا خود- مہمان
ہمارے مہمان API استعمال کریں، یا Kokoro کو منٹوں میں مقامی طور پر انسٹال کریں
import requests
response = requests.post("https://api.tts.ai/v1/tts", json={
"text": "Open source TTS with a simple API.",
"model": "kokoro",
"voice": "af_heart",
"format": "wav"
}, headers={"Authorization": "Bearer YOUR_API_KEY"})
with open("output.wav", "wb") as f:
f.write(response.content)
# Install Kokoro locally
pip install kokoro
# Generate speech on your own GPU
import kokoro
pipeline = kokoro.KPipeline(lang_code="a")
generator = pipeline("Hello from your own server!", voice="af_heart")
for i, (gs, ps, audio) in enumerate(generator):
kokoro.save(audio, f"output_{i}.wav")
اوپن سورس، سستا قیمت
ہمارا مہمانداری API مفت سورس TTS کو GPUs کے انتظام کے بغیر دستیاب کرتا ہے۔
مفت سطح
$0
15 کریڈٹس پر سائن اپ
- 4 مفت اوپن سورس ماڈل
- بنیادی استعمال کے لیے کوئی رجسٹریشن نہیں
- ذاتی، غیر تجارتی استعمال
شروع
$9
500,000 حروف/مہین
- تمام 20+ اوپن سورس ماڈل
- آواز کا کلوننگ
- API رسائی
پرو
$29
2,000,000 حروف/مہین
- GPU پروسیسنگ کی ترجیح
- تمام پرائم ماڈل
- انٹرپرائز سپورٹ
بار بار پوچھے گئے سوالات
اوپن سورس ٹیکس سے اسپیکینگ کے بارے میں عام سوالات
ہم کیا بہتر کر سکتے ہیں؟ آپ کا رائے ہمیں مسائل حل کرنے میں مدد کرتا ہے.
آج اوپن سورس TTS کو آزمائیں
20+ اوپن سورس ماڈل، ہر ایک اپنے لائسنس کے ساتھ فہرست. ہمارے API یا خود-ہوسٹ استعمال کریں، انتخاب آپ کا ہے.