AI لپ سنک ویڈیو جنریٹر

چہرے کا فوٹو اور آ ڈيو کلپ کو لفٹ سنک، سر کے پوز اور بلنگ سے بات کرنے والے سر کے ويڈیو ميں تبديل کريں حاليں غير دستياب جب تک ہم اس ماڈل کو تلاش کريں جس کا لائسنس اس کو اجازت دے

آپ کی زبان میں اب تک ہمارے پاس TTS آوازیں نہیں ہیں. ہمیں آپ کی آوازیں شامل کرنے میں مدد کریں! آپ کی آواز فروخت کریں
لب سینک اب تک دستیاب نہیں ہے اس نے استعمال کئے گئے SadTalker ماڈل کو Basel Face Model پر تربیت دی گئی تھی جو صرف غیر تجارتی تحقیق کے ليزنس کے ليے ہے، اس ليے ہم اسے ادا کئے جانے والے سروس پر پيش نہیں کر سکتے۔ کوئی مناسب لائسنس کے ساتھ بدلا نہیں ہے ابھی تک انسٹال کیا گیا ہے۔

اپ لوڈ چہرہ + آڈیو

1000 حروف پر سیکنڈ

اپنی فائل یہاں گھسیٹ کر ڈالیں، یا براؤز

JPG, PNG, or short MP4/WebM. Max 10MB. One clear, well-lit face works best.

فائلیں

0 MB

اپنی فائل یہاں گھسیٹ کر ڈالیں، یا براؤز

MP3, WAV, M4A, or FLAC. Max 10MB. Free: up to 30 sec. Pro: up to 5 min.

فائلیں

0 MB

پروسیسنگ...

آپ کی ویڈیو رینڈرنگ. یہ عام طور پر 30 سیکنڈ سے 2 منٹ لے جاتا ہے.

آپ کا بات کرنے والا سر ویڈیو

MP4 ڈاؤن لوڈ کریں

ساڈ ٹوکر کے بارے میں

سڈ ٹوکر (CVPR 2023، Tencent ARC) ایک اوپن سورس بات کرنے والا سر ماڈل ہے جو کسی بھی آڈیو بولنے کے لئے ایک چہرے کی تصویر کو زندہ کرتا ہے۔Wav2Lip کے مختلف قسموں کی برعکس، سڈ ٹوکر بھی سر کے پوز، بلیک اور ایک زیادہ قدرتی نتیجہ کے لئے اظہار کو زندہ کرتا ہے۔

سڈ ٹوکر کا کوڈ آپاچی-2.0 ہے، لیکن اس کے 3D چہرے کے تعمیر وزن Basel چہرے ماڈل پر تربیت کی گئی تھی، جس کی لائسنس صرف غیر تجارتی تحقیق کی اجازت دیتی ہے۔ TTS.ai ایک تجارتی سروس ہے، تو اس ٹول کو 15 ستمبر 2026 کو بند کر دیا گیا تھا۔

بہترین نتائج کے لیے ہدایات

  • اعليٰ معيار ، اچھی روشني کا پورٹریٹ استعمال کريں - آنکھیں نظر آتي هيں ، منہ بند
  • مرکزي چہره، مربع يا 4:5 تناسب سب سے بہتر کام کرتا هے
  • صاف بولنے کی آڈیو (کوئی موسیقی نہیں) زیادہ مضبوط لپ سینک حاصل کرتی ہے
  • هيرو شوٹ کے ليے GFPGAN فعال کريں - دو گنا رنڈر وقت ليے
  • جب آپ ایک مستحکم آوٹار شوٹ چا هيتے هيں تو سٹائل پرائز استعمال کريں

لپ سنک ویڈیو منصوبے

مفت شروع کریں، آپ کو مزید ضرورت ہو تو اپگریڈ کریں

مفت
  • 30 سیکنڈ آڈیو حد
  • 256 px آؤٹ پٹ
  • صرف "Still" پریسیٹ
  • کوئی چہرہ انکشاف نہیں
سب سے زیادہ مقبول
مفت اکاؤنٹ
  • 30 سیکنڈ آڈیو حد
  • "فایل" اور "پیش سیٹ" دونوں
  • 256 / 512 px آؤٹ پٹ
  • GFPGAN چہرے کي طاقت افزائي
مفت میں رجسٹر کریں
پرو
  • 5 منٹ آڈیو حد
  • GPU کی ترجیح
  • API رسائی (مختلف حصوں کو اپ لوڈ)
  • Webhook مکمل کرنے کے کالبیکٹس
  • اب تک دستیاب نہیں (غیر تجارتی ماڈل لائسنس)
بہتری

بار بار پوچھے گئے سوالات

ایک چہرے کی فوٹو اور ایک آڈیو کلیپ اپ لوڈ کریں اور AI اس چہرے کی ویڈیو بناتا ہے جو زبانی آواز کو زبانی آواز کے ساتھ حوصلہ افزائی کرتا ہے، سر کے poz اور بلیکنگ۔ یہ ٹول اب تک دستیاب نہیں ہے: اس نے SadTalker (CVPR 2023) کو چلایا، جس کے 3D چہرے کے تعمیر کے وزن کو Basel Face Model پر تربیت دی گئی تھی، جو صرف غیر تجارتی تحقیق کے لیے لائسنس ہے.

چہرے کا انٹاپ ایک JPG يا PNG تصوير (10 ميگا بائٹ تک) يا يک مختصر MP4/WebM ڈرائنگ ويڈیو ( ہم اول فريم استعمال کريں ) ہو سکتا هے ڈرائنگ آڊيو MP3, WAV, M4A يا FLAC 10 ميگا بائٹ تک ہو سکتا هے ہم آڈیو کو 16 kHz تک اندروني طور پر ريسمپل کريں

مفت اکاؤنٹ: ہر کلیپ کے لیے 30 سیکنڈ تک۔ ادا کرنے والے صارف: ہر درخواست کے لیے 5 منٹ تک۔ زیادہ اوڈیو کا مطلب زیادہ رینڈر وقت اور زیادہ کردار کی قیمت ہے۔

لب سینک ویڈیو 1000 حروف پر سیکنڈ پیدا کی گئی ویڈیو استعمال کرتا ہے. 30 سیکنڈ کی کلیپ = 30 حروف. لاگ آپ کے حروف کے بلین سے پہلے سے بل کی جاتی ہے اور خودکار طور پر واپس کی جاتی ہے اگر پیدائش ناکام ہو.

نہیں، اس ٹول کو بند کر دیا گیا ہے کیونکہ ماڈل لائسنس اس کو اجازت نہیں دیتی۔ سڈ ٹوکر کوڈ آپاچي-2.0 ہے، لیکن اس کا چہرے کو دوبارہ بنانے والا نیٹ ورک Basel Face Model 2009 پر تربيت دیا گیا تھا، جس لا ئسنس صرف اندروني، غیر تجارتی تحقیق کو اجازت دیتا ہے۔ اس سے پہلے 15 ستمبر 2026 سے گيڑے ويڈیوز تجارتي استعمال کے ليے نہیں ہیں، شامل ہیں ادا کئے گئے پلان۔ آپ اس چہرے کے اسمائل اور او ڊيو کے حقوں کے ليے ذمہ دار ہیں جو آپ اپ لوڈ کريں۔

جب ٹول چل رہا تھا، 5 سیکنڈ کلیپ نے 30 سیکنڈ کا وقت لیا، اوڈيو لمبائی کے ساتھ تقریباً لاینری پیمانے پر. یہ اب تک دستیاب نہیں ہے جب تک ہم ایک بات کرنے والے سر ماڈل کو تلاش کرتے ہیں جس کی لائسنس اسے اجازت دیتی ہے.

پورا پرائزٹ (دفٹر) سر کے پوز، نگا ں جھپکنا اور زبان کے ساتھ ساتھ اظہار کو زندہ کرتا ہے، ایک زیادہ قدرتی بات کرنے والا سر ویڈیو بناتا ہے. ابھی پرائزٹ سر کو جگہ پر بند کرتا ہے اور صرف منہ کو زندہ کرتا ہے -فائدہ مند جب آپ ایک مستحکم آوٹار شوٹ چاہتے ہیں.

GFPGAN چہرے کے اعادہ کا ماڈل هے جو رنڈرنگ کے بعد چہرے کے تفصيل کو تیز کر تا هے یہ پيش نہیں کيا جاتا هے: اس کا StyleGAN2 پرينچر NVIDIA غير تجارتي لائسنس کے تحت هے اور اس کے چہرے کے تجزیے کا ماڈل CC BY-NC-SA هے

SadTalker 256px پر ديافتا عي طور پر رينڈر کيا گيا هے ، 512px کے ساتھ سست آپشن کے طور پر. اس وقت ٹول موجود نهيں هے ، ايک خوب روشن ، اعلي معيار پورٹرٹ کو ايک بات کر نے والے سر ماڈل کے ساتھ بهترين نتيجہ ديتا هے

جی ہاں. ایک MP4 یا WebM کو چہرے کی انپٹ کے طور پر اپ لوڈ کریں اور ہم پہلے فریم کو ڈرائینگ شناخت کے طور پر استعمال کریں گے۔ مکمل ویڈیو ری-ڈوبنگ کے لئے (پر فریم منہ کی جگہ)، آنے والی ڈوبنگ سٹوڈیو ویڈیو پائپ لائن دیکھیں.

ہاں. /api/v1/lipsync/ کو چہرے اور آڈیو فیلڈز کے ساتھ ایک ملٹی پارٹ درخواست POST کریں، پھر پول /api/v1/lipsync/result/?uuid= تک کہ حالت "تمام ہو جائے". جواب میں MP4 کے لئے ایک URL شامل ہے. API رسائی کے لیے ایک پیسہ لینے والا پلان ضروری ہے.

سڈ ٹوکر چہرے کا تناسب استعمال کرتا ہے تا کہ سب سے زیادہ نمایاں چہرے کو تلاش اور کرپ کريں بهترين نتيجے کے ليے ،اے شخص کے مرکز ، آنکھیں نظر آتي هيں اور کم از کم غلظت کے ليے پورٹریٹ اپ لوڈ کريں گروپ فوٹو نا پیش گوئي نتيجے لا سکتے هيں
5.0/5 (1)

ہم کیا بہتر کر سکتے ہیں؟ آپ کا رائے ہمیں مسائل حل کرنے میں مدد کرتا ہے.

شروع کرنے کے لئے تیار ہیں؟

مفت میں رجسٹر کریں اور 50 کریڈٹ حاصل کریں. کوئی کریڈٹ کارڈ کی ضرورت نہیں.