Generator Video Syncher AI Lip

הפעל תמונת פנים וקליפ אודיו לתוך וידאו מדבר ראש עם סנכרון שפתיים, תנוחת ראש וממצמץ. זמין כרגע בזמן שאנחנו מחפשים מודל רישיון שמאפשר את זה.

אין לנו קולות TTS בשפה שלך עדיין עזור לנו להוסיף את שלך! מכור את קולך
הסינכרון של שפות אינו זמין כרגע. המודל SadTalker בו השתמש הוכשר במודל Basel Face, אשר מורשה למחקר ללא פרסומות בלבד, כך שאנחנו לא יכולים להציע אותו על שירות בתשלום. אין מחליף עם רישיון מתאים מותקן עדיין.

העלה פנים + שמע

1,000 תווים לשנייה

גרור & שחרר את הקובץ שלך כאן, או דפדף

JPG, PNG, or short MP4/WebM. Max 10MB. One clear, well-lit face works best.

קובץ. mp3

0 MB

גרור & שחרר את הקובץ שלך כאן, או דפדף

MP3, WAV, M4A, or FLAC. Max 10MB. Free: up to 30 sec. Pro: up to 5 min.

קובץ. mp3

0 MB

מעבד...

זה בדרך כלל לוקח 30 שניות ל-2 דקות.

הסרטון המדבר שלך

הורד MP4

אודות SadTalker

SadTalker (באנגלית: SadTalker 2023) הוא מודל של קוד פתוח, הנפוץ בראש, ומעורר תמונה בודדת של הפנים כדי לדבר אודיו כלשהו.

SadTalker's code is Apache-2.0, but its 3D face reconstruction weights were trained on the Basel Face Model, whose license allows non-commercial research only. TTS.ai is a commercial service, so the tool was switched off on September 15, 2026.

עצות לתוצאות הטובות ביותר

  • השתמש דיוקן באיכות גבוהה, מואר היטב עיניים נראות לעין, פה סגור
  • פנים ממוקדות, ריבוע או 4.5 יחס ההיבטים עובד הכי טוב
  • שמע דיבור נקי (ללא מוסיקה) מניב סנכרון שפתיים הדוק יותר
  • אפשר GFPGAN עבור יריות גיבור □ מכפיל את הזמן אבל מחדד פירוט
  • השתמש בהגדרה עדיין כאשר אתה רוצה זריקת אווטאר קבועה

Lip Synchro Planations

התחל חופשי, שדרוג כאשר אתה צריך יותר

חופשי
  • הגבלת אודיו של 30 שניות
  • תפוקת 256 פיקסלים
  • "עדיין" נקבע מראש בלבד
  • אין משפר פנים
הפופולרי ביותר
חשבון חינם
  • הגבלת אודיו של 30 שניות
  • הן "מלא" והן "עדיין" קובע מראש
  • 256 / 512 px output
  • משפר הפנים של GFPGAN
הרשמה חופשית
בעד
  • הגבלת אודיו של 5 דקות
  • תור GPU עדיפות
  • API access (העלאה חלקית)
  • קריאת סיום של Webhook
  • כרגע לא זמין (רישיון מודל לא מסחרי)
שדרוג

שאלות ששואלים לעתים קרובות

העלה תמונת פנים וקליפ שמע, וה-AI מייצר וידאו של הפנים האלה המדברים על אודיו עם תנועות שפתיים, תנוחת ראש וממצמצת. הכלי אינו זמין כרגע: הוא רץ SadTalker (CVPR 2023), שמשקולות שחזור הפנים 3D הוכשרו על מודל Basel Face, אשר מורשה למחקר לא מסחרי בלבד.

קלט הפנים יכול להיות תמונת JPG או PNG (עד 10 MB) או וידאו קצר של MP4/WebM (אנחנו משתמשים במסגרת הראשונה). האודיו המניע יכול להיות MP3, WAV, M4A, או FLAC עד 10 MB.

חשבונות חינם: עד 30 שניות למחסנית. משתמשים משלמים: עד 5 דקות לכל בקשה. אודיו ארוך יותר פירושו זמן ומחיר אופי גבוה יותר.

וידאו סנכרון שפתיים משתמש ב-1,000 תווים לשנייה של וידאו שנוצר. קליפ של 30 שניות = 30,000 תווים. העלות מופקדת מראש מאזן הדמויות שלך ומחזירה באופן אוטומטי אם הדור נכשל.

מס 'הכלי הוא כבוי כי רישיון המודל אינו מאפשר זאת. קוד SadTalker הוא Apache-2.0, אבל רשת שחזור הפנים שלה הוכשרה על מודל Basel Face 2009, שהרישיון מאפשר מחקר פנימי, ללא פרסומות בלבד. וידאו שנוצר עם זה לפני 15 בספטמבר 2026 הם לא לשימוש מסחרי, תוכניות בתשלום. אתה אחראי לכך שיש לך את הזכויות לתמונת הפנים הפנימית והאודיו שאתה מעלה.

כאשר הכלי רץ, קליפ של 5 שניות לקח בערך 30 שניות, ובערך בקו ישר עם אורך השמע. הוא כרגע לא זמין בזמן שאנו מחפשים מודל מדבר ראש של רישיון זה.

היסט מלא (default) animates head pace, lambers, and expression with the lips, production a more natural spalking-head video. עדיין מכוונן מראש את הראש וanimates רק הפה □ שימושי כאשר אתה רוצה זריקת אווטאר קבועה.

GFPGAN הוא מודל שחזור פנים שחידד את פרטי הפנים לאחר עיבוד. הוא לא מוצע: ה-SyleGAN2 שלו קודם הוא תחת רישיון NVIDIA שאינו מסחרי ומודל החיתוך הפנים שלו הוא CC-NC-SA.

SadTalker ergumented at 256 px by default, with 512 px as a late possible. the hystone is unablely; a litted, high-tyturned px group with any talking-head modle.

העלה MP4 או WebM כקלט הפנים ואנו נשתמש במסגרת הראשונה כזהות הנהיגה. עבור החלפת וידאו מחדש (per-frame-Futh), ראה צינור וידאו סטודיו Dubbing הקרוב.

POST a multipart question to /api/v1/lipsync/ with face and eudio fields, then scal / api/v1/lipsync/result/?uid===/white state is "falled". The response contains a URL to the revolutioned MP4. API access דורש תוכנית בתשלום.

SadTalker משתמש בהתאמה פנים כדי לזהות ולקצור את הפנים הבולטות ביותר. עבור התוצאות הטובות ביותר, להעלות דיוקן עם אדם אחד מרוכז, עיניים נראות, וחסימה מינימלית. תמונות קבוצתיות יכולות לייצר תוצאות בלתי צפויות.
5.0/5 (1)

המשוב שלך עוזר לנו לפתור בעיות.

מוכן להתחיל?

תחתמי בחינם ותקבלי 50 קרדיטים, אין צורך בכרטיס אשראי.