Zahtjev za greškom / osobinama

AI Lip Sync Video generator

Okrenite sliku lica i audio klip u razgovor-glava video s usnom sinhronizacijom, glavom pozom i trepće. Trenutno nedostupan dok tražimo model čija licenca to dopušta.

Još nemamo TTS glasove na vašem jeziku. Pomozite nam dodati svoje! Prodaj svoj glas
Sinhronizacija usana trenutno nije dostupna. SadTalker model je upotrijebljen je obučen na Basel Face Modelu, koji je licenciran samo za nekomercijalna istraživanja, tako da ga ne možemo ponuditi na plaćenoj usluga. Još nije instalirana zamjena s odgovarajućom licencom.

Pošalji lice + zvuk

1000 znakova u sekundi

Dovucite i ispustite datoteku ovdje, ili pregledaj

JPG, PNG, or short MP4/WebM. Max 10MB. One clear, well-lit face works best.

datoteka. mp3

0 MB

Dovucite i ispustite datoteku ovdje, ili pregledaj

MP3, WAV, M4A, or FLAC. Max 10MB. Free: up to 30 sec. Pro: up to 5 min.

datoteka. mp3

0 MB

Obrada...

Snimanje vašeg videa. To obično traje 30 sekundi do 2 minute.

Vaš govorno-glavi video

Preuzmi

O SadTalkeru

SadTalker (CVPR 2023, Tencent ARC) je model otvorenog izvora razgovor-glava koji animira jednu sliku lica da govori bilo koji zvuk. Za razliku od Wav2Lip varijante, SadTalker također animira i pozu glave, trepće i izraz za prirodniji rezultat.

SadTalkerov kod je Apači-2.0, ali njegove 3D rekonstrukcije lica su obučene na Basel Face Model, čija licenca omogućuje samo nekomercijalna istraživanja. TTS.ai je komercijalna usluga, tako da je alat isključen 15. rujna 2026.

Savjeti za najbolje rezultate

  • Koristi kvalitetan, dobro osvijetljen portret – oči vidljive, usta zatvorena
  • Usredsređeno lice, kvadrat ili 4:5 omjer djeluje najbolje
  • Čisti govor zvuk (bez glazbe) daje čvršće usne sinhronizacija
  • Omogući GFPGAN za junačke snimke — dvostruko prikazivanje vremena, ali oštri detalj
  • Koristite i dalje predpostavljanje kada želite stalni avatar snimak

Lip Sync Video planovi

Započnite besplatno, nadogradnja kada trebate više

Slobodno
  • Ograničenje zvuka od 30 sekundi
  • 256 px izlaz
  • Samo "još" predefiniranje
  • Nema pojačavača lica
Najpopularnije
Besplatan korisnički račun
  • Ograničenje zvuka od 30 sekundi
  • I "pune" i "još uvijek" predpostavke
  • 256 / 512 px izlaz
  • GFPGAN pojačavač lica
Slobodno se prijavite
Profesionalno
  • 5-minutno ograničenje zvuka
  • Prioritet GPU reda
  • API pristup (multipartni upload)
  • Webhook povratni poziv
  • Trenutno nedostupna (nekomercijalni model licenca)
Nadogradi

Česta pitanja

Ubacite sliku lica i audio klip, a AI generira video tog lica govoreći audio s pokretima usana, pozama glave i treptajem. Alat je trenutno nedostupan: pokrenuo SadTalker (CVPR 2023), čije 3D rekonstrukcije lica su obučeni na Basel Face Modelu, koji je licenciran samo za nekomercijalna istraživanja.

Ulaz lica može biti JPG ili PNG slika (do 10 MB) ili kratak MP4/WebM vožnja video (koristimo prvi okvir). Vožnja zvuka može biti MP3, WAV, M4A, ili FLAC do 10 MB. Preuzoravamo zvuk na 16 kHz interno.

Besplatni računi: do 30 sekundi po klipu. Plaćanje korisnika: do 5 minuta po zahtjevu. Duži audio znači duže vrijeme prikazivanja i veće troškove karaktera.

Lip sinhronizacija video koristi 1.000 znakova u sekundi generiranog videa. 30-sekundni klip = 30.000 znakova. Trošak se plaća naprijed od vašeg karakter balansa i vraćena automatski ako generacija ne uspije.

Ne. Alat je isključen jer model licence to ne dozvoljava. SadTalker kod je Apache-2.0, ali njegova svezana mreža rekonstrukcije lica je obučena na Basel Face Model 2009, čija licenca omogućuje samo interno, ne-komercijalno istraživanje. Videosnimke generirane s njom prije 15. rujna 2026 nisu za komercijalne upotrebe, plaćeni planovi uključeni. Vi ste odgovorni za posjedovanje prava na izvorni lice sliku i audio koji ste postavili.

Kada je alat pokrenuo, 5 sekundi klip trajao oko 30 sekundi, skaliranje otprilike linearno s audio dužinom. Trenutno je nedostupan dok tražimo razgovor-glava model čija licenca to dopušta.

Puna predefinacija (uobičajeno) animira pozu glave, trepće i izražavanje zajedno s usnama, stvarajući više prirodni razgovor-glava video. Još uvijek predefinira zaključavanje glave na mjestu i animira samo usta - korisno kada želite stalni avatar snimak.

GFPGAN je model restauracije lica koji je oštrio detalje lica nakon prikazivanja. Nije ponuđen: njegov StyleGAN2 prije je pod NVIDIA nekomercijalnu licencu, a njegov model lica parsing je CC BY-NC-SA.

SadTalker iscrtano na 256 px zadano, s 512 px kao sporija opcija. Alat je trenutno nedostupan; dobro osvijetljen, visokokvalitetan portret daje najbolji rezultat s bilo kojim razgovor-glavom modela.

Da. Ubacite MP4 ili WebM kao ulaz za lice i mi ćemo koristiti prvi okvir kao vozački identitet. Za cijeli video re-dubbing (po okviru zamjena usta), pogledajte predstojeći Dubbing Studio video cjevovod.

Da. POST višedijelni zahtjev na /api/v1/lipsync/ s licem i zvučnim poljima, zatim anketa /api/v1/lipsync/result/?uuid= dok status nije "dovršen". Odgovor sadrži URL na nadopunjen MP4. API pristup zahtijeva plaćeni plan.

SadTalker koristi lice-alignment za otkrivanje i usjeda najpoznatije lice. Za najbolje rezultate, upload portret s jednom osobom centriran, oči vidljive, i minimalna okcluzija. Grupne fotografije mogu dovesti do nepredvidljivih rezultata.
5.0/5 (1)

Što možemo poboljšati? Vaša povratna informacija nam pomaže riješiti probleme.

Spreman za početak?

Prijavite se besplatno i dobiti 15.000 znakova. Nije potrebna kreditna kartica.