AI тешләрне синхронлаштыру видео генераторы

Юз фотосын һәм аудиоклибын авыз синхронизациясе, баш кую һәм күзләр йомылу белән сөйләшүче баш видеосына әйләндерә. Хәзерге вакытта бу мөмкинлек юк, без лицензиясе моны рөхсәт иткән модельне эзлибез.

Сүзләрне бер-берсенә туры китерү хәзерге вакытта юк. SadTalker моделе Basel Face Model буенча өйрәтелгән, ул коммерцияле булмаган тикшеренүләр өчен генә лицензияләнгән, шуңа күрә без аны түләүле хезмәт буларак тәкъдим итә алмыйбыз. Хәзерге вакытта аны алмаштыручы тиешле лицензия урнаштырылмаган.

Җавапны җибәрү

Бер секундта 1000 символ

Файлды монда күчереп куегыз яки карау

JPG, PNG, or short MP4/WebM. Max 10MB. One clear, well-lit face works best.

файл.mp3

0 MB

Файлды монда күчереп куегыз яки карау

MP3, WAV, M4A, or FLAC. Max 10MB. Free: up to 30 sec. Pro: up to 5 min.

файл.mp3

0 MB

Эшләнү...

Видеогызны күрсәтү. Бу гадәттә 30 секундтан 2 минутка кадәр вакытны ала.

Сезнең сөйләшүче баш видеосы

Җибәрү

СадТокер турында

SadTalker (CVPR 2023, Tencent ARC) — ачык чыганаклы сөйләшүче баш моделе, ул бер йөз сурәтен анимацияли һәм теләсә нинди аудионы сөйли. Wav2Lip вариантларыннан аермалы буларак, SadTalker шулай ук баш тору, күзләр йому һәм йөз билгеләрен анимацияли, нәтиҗәсе табигыйрәк булсын өчен.

SadTalker's code is Apache-2.0, but its 3D face reconstruction weights were trained on the Basel Face Model, whose license allows non-commercial research only. TTS.ai is a commercial service, so the tool was switched off on September 15, 2026.

Иң яхшы нәтиҗәләр өчен киңәшләр

  • Югары сыйфатлы, яхшы яктыртылган портретны кулланыгыз - күзләр күренеп тора, авыз ябык
  • Үзәккә юнәлтелгән, квадрат яки 4:5 киңлек мөнәсәбәте иң яхшы эшли
  • Чиста сөйләм тавышы (музыка юк) тешләрне синхронлаштыруны яхшырта
  • ГФПГАНны геройлар өчен куллану - рендер вакытын ике тапкыр арттыра, ләкин детальне яхшырта
  • Аватарны бер урында тотып төшерергә теләсәгез, "Тиз" параметрын кулланыгыз

Лип Синхронизациясе Видео Планнары

Бушлай башлагыз, күбрәк кирәк булганда яңартыгыз

Бушлай
  • Аудио чикләү
  • 256 px чыганак
  • "Стой" алдан билгеләнгән генә
  • Күзләрне яхшырту юк
Иң популяр
Акчасыз исәп
  • Аудио чикләү
  • "Төп" һәм "Төз" алдан билгеләнмәләре
  • 256 / 512 px чыганак
  • GFPGAN йөзләрне яхшырту
Бушлай теркәлү
Про
  • Аудио чикләү
  • Графика процессоры чираты
  • APIга керү (бөтенлеген йөкләү)
  • Веб-җыйнакны тәмамлау чакырулары
  • Хәзерге вакытта юк (коммерцияле булмаган модель лицензиясе)
Яңарту

Кайвакыт бирелә торган сораулар

Юз фотосын һәм аудио клипны куегыз, һәм ИИ бу йөзнең видеосын ясый, ул авыз хәрәкәтләре, баш тоту һәм күз йому белән аудионы сөйли. Хәзерге вакытта бу программа юк: ул SadTalker (CVPR 2023) программасын эшли, аның 3D йөз реконструкциясе авырлыклары Basel Face Model моделе буенча өйрәтелгән, ул лицензияләнгән коммерцияле булмаган тикшеренүләр өчен генә.

Бу битләр JPG яки PNG форматындагы (10 МБ кадәр) яки кыска MP4/WebM видеосы (беренче кадр кулланыла) булырга мөмкин. Аудио MP3, WAV, M4A яки FLAC форматында 10 МБ кадәр булырга мөмкин. Без аудионы эчке яктан 16 кГцга кадәр күчерәбез.

Бушлай кулланучылар өчен: клипка 30 секундка кадәр. Акча түләүче кулланучылар өчен: клипка 5 минутка кадәр. Аудионың озынлыгы рендер вакытын озайта һәм символ бәясен арттыра.

Лип синхронизациясе видеосы секундына 1000 символ куллана. 30 секундлык клип = 30 000 символ. Бу бәя сезнең символ балансыннан алдан исәпләнә һәм генерация уңышсыз булса автоматик рәвештә кире кайтарыла.

Юк. Модел лицензиясе моны рөхсәт итмәгән өчен бу ярдәмче эшләми. SadTalker коды Apache-2.0, ләкин аның йөзләрне реконструкцияләү челтәре Basel Face Model 2009 буенча өйрәтелгән, аның лицензиясе эчке, коммерцияле булмаган тикшеренүләр өчен генә. 2026 елның 15 сентябреннән элек ясалган видеолар коммерцияле куллану өчен түгел, түләүле планнар да кертелгән. Сез йөз сурәте һәм аудио чыганаклары хокукларын үзегез өчен җаваплысыз.

Бу инструмент эшләгәндә, 5 секундлык клип якынча 30 секунд дәвам итә иде, аудио озынлыгы белән якынча турыдан-туры масштаблана. Хәзерге вакытта бу мөмкинлек юк, без лицензиясе моны рөхсәт иткән сөйләшүче баш моделен эзлибез.

Төп алдан билгеләнгән (стандарт) анимацияләр баш тору, күз йому һәм йөз хәрәкәтләрен, авыз белән бергә, сөйләүче баш видеосын табигыйрәк итеп ясый. Шулай да алдан билгеләнгән анимацияләр башны урынында тота һәм авызны гына анимацияли - анимацияләнгән аватарны бер урында тотарга теләгәндә файдалы.

GFPGAN - бу йөзләрне рендерлаудан соң йөз деталләрен ныгыту өчен йөзләрне торгызу моделе. Ул тәкъдим ителми: аның StyleGAN2 элеккеге версиясе NVIDIA коммерцияле булмаган лицензиясе астында һәм аның йөз анализлау моделе CC BY-NC-SA.

SadTalker 256 px дәрәҗәсендә күрсәтелә, 512 px тизрәк вариант. Хәзерге вакытта бу инструмент юк; яхшы яктыртылган, югары сыйфатлы портрет һәрбер сөйләшүче баш моделе белән иң яхшы нәтиҗә бирә.

Әйе. MP4 яки WebM файлын йөз кертем итеп куегыз һәм без беренче кадрны йөртүче идентификатор буларак кулланачакбыз. Видеоны тулы күләмдә кабат дубллау өчен (кадр буенча авыз алмаштыру), Dubbing Studio видео каналын карагыз.

Әйе. /api/v1/lipsync/ адресына күп өлешле сорауны POST итеп җибәрегез, анда йөз һәм аудио кырлары күрсәтелсен, аннары /api/v1/lipsync/result/?uuid= адресына сорау җибәрегез, хәтта хәл "комплект" булганчы. Җавап MP4 форматына URLны күрсәтә. APIга керү өчен түләүле план кирәк.

SadTalker иң күренекле йөзләрне ачыклау һәм кисү өчен йөз турылаштыруын куллана. Иң яхшы нәтиҗәләр өчен, бер кеше үзәгендә, күзләре күренеп торган һәм минималь каплау белән портретны урнаштырыгыз. Бер төркем фотолар көтелмәгән нәтиҗәләргә китерергә мөмкин.
5.0/5 (1)

Без нәрсәне яхшыртырга мөмкин? Сезнең фикерләрегез безгә проблемаларны чишәргә ярдәм итә.

Башларга әзерме?

Бушлай теркәлегез һәм 15,000 символны алыгыз. Кредит картасы кирәкми.