AI Lip Sync տեսանյութի գեներատոր

Ընդունել դեմքի լուսանկարը և ձայնային կտորը որպես խոսող գլխի տեսահոլովակ՝ ատամների սինխրոնիզացիայի, գլխի դիրքորոշման և մռայլման միջոցով։ Այժմ հասանելի չէ, քանի դեռ մենք փնտրում ենք մոդել, որի լիցենզիան թույլ է տալիս դա անել։

Մենք դեռևս չունենք TTS ձայներ ձեր լեզվով։ Կօգնեք մեզ ավելացնել ձերը! Ձեր ձայնը վաճառել
Առայժմ ատամների համընկնումը հասանելի չէ։ SadTalker-ի մոդելը, որը օգտագործվում է այժմ, սովորեցվել է Basel Face Model-ի վրա, որը լիցենզավորված է միայն ոչ առևտրային հետազոտությունների համար, այնպես որ մենք չենք կարող առաջարկել այն վճարովի ծառայության համար։ Ոչ մի փոխարինիչ օրինական լիցենզիայով դեռ չի տեղադրվել։

Տեղադրել Face + Audio

1000 սանտիմետր վայրկյանում

Սեղմել և տեղադրել ֆայլը այստեղ, կամ ընթերցել

JPG, PNG, or short MP4/WebM. Max 10MB. One clear, well-lit face works best.

ֆայլ.mp3

0 MB

Սեղմել և տեղադրել ֆայլը այստեղ, կամ ընթերցել

MP3, WAV, M4A, or FLAC. Max 10MB. Free: up to 30 sec. Pro: up to 5 min.

ֆայլ.mp3

0 MB

Աշխատանք...

Ձեր տեսանյութի ցուցադրումը։ Սա սովորաբար տևում է 30 վայրկյանից մինչև 2 րոպե։

Ձեր Talking-Head վիդեոն

Տեղադրել

Օգտագործողի ինտերֆեյս

SadTalker-ը (CVPR 2023, Tencent ARC) բաց կոդով խոսող գլխի մոդել է, որը միակ դեմքի պատկերը անիմացնում է ցանկացած ձայնային հաղորդագրություն արտասանելու համար։ Անգամ Wav2Lip տարբերակներից տարբեր, SadTalker-ը նաև անիմացնում է գլխի դիրքերը, մրմռոցները և արտահայտությունները՝ ավելի բնական արդյունքի համար։

SadTalker's code is Apache-2.0, but its 3D face reconstruction weights were trained on the Basel Face Model, whose license allows non-commercial research only. TTS.ai is a commercial service, so the tool was switched off on September 15, 2026.

Լավագույն արդյունքների համար խորհուրդներ

  • Օգտագործել բարձր որակի, լավ լուսավորված դիմանկար՝ աչքերը տեսանելի, բերանը փակ
  • Կենտրոնացված աչքեր, քառակուսի կամ 4:5 հարաբերակցությունը լավագույնն է
  • Խոսքի ձայնային ձայնագրությունը (չկա երաժշտություն) ավելի լավ է համընկնում ականջների հետ
  • Գործարկել GFPGAN-ը հերոսների նկարների համար — կրկնապատկում է ցուցադրման ժամանակը, բայց մանրամասնությունները ավելի մանրամասն են դառնում
  • Օգտագործել Still նախընտրությունը, երբ ցանկանում եք կայուն նկարել ավատարը

Լեզուի սինխրոնիզացիայի տեսահոլովակ

Սկսեք անվճար, բարձրացրեք, երբ ավելի շատ բանի կարիք ունեք

Ազատ
  • 30 վայրկյան ձայնային սահմանափակում
  • 256 px արտահանում
  • Ընդամենը "Still" նախատեսված
  • Չկա դեմքի բարելավում
Ամենատարածված
Ազատ հաշիվ
  • 30 վայրկյան ձայնային սահմանափակում
  • Երկու "բոլոր" և "հանգիստ" նախատեսումներ
  • 256 / 512 px արտահանում
  • GFPGAN դեմքի բարելավում
Անվճար գրանցում
Օգտագործող
  • 5 րոպե ձայնային սահմանափակում
  • Գրաֆիկական պրոցեսորի ուշադրության գիծ
  • API- ի հասանելիություն (բազմամասնային ներբեռնում)
  • Webhook ավարտման հետազոտություն
  • Այժմ հասանելի չէ (չբիզնես մոդելի թույլտվություն)
Նորացնել

Հաճախ տրվող հարցեր

Բեռնեք դեմքի լուսանկար և ձայնային կտոր, և AI-ն կստեղծի այդ դեմքի տեսահոլովակ, որը խոսում է ձայնային ձայնագրությունը, որն ունի ատամների շարժումներ, գլխի դիրք և աչքերի շարժումներ։ Ապրանքը ներկայումս հասանելի չէ։ Այն օգտագործում է SadTalker (CVPR 2023)-ը, որի 3D դեմքի վերականգնման արժեքները սովորեցվել են Basel Face Model-ի վրա, որը լիցենզավորված է միայն ոչ առևտրային հետազոտությունների համար։

Ձևի մուտք կարող է լինել JPG կամ PNG պատկեր (մինչև 10 ՄԲ) կամ կարճ MP4/WebM տեսանյութ (մենք օգտագործում ենք առաջին կտավը)։ Ձևի ձայնը կարող է լինել MP3, WAV, M4A կամ FLAC մինչև 10 ՄԲ։ Մենք ներսում ձայնը վերադառնում ենք 16 kHz։

Ազատ հաշիվներ. մինչև 30 վայրկյան յուրաքանչյուր կտորում: Պետք է վճարել: մինչև 5 րոպե յուրաքանչյուր խնդրանքում: Ավելի երկար ձայնը նշանակում է ավելի երկար ցուցադրման ժամանակ և ավելի բարձր արժեքը:

Լեզուների համատեղելիության տեսահոլովակը օգտագործում է 1000 հերոս վայրկյանում սերվերի կողմից ստեղծված տեսահոլովակի համար։ 30 վայրկյան տևողությամբ տեսանյութը = 30,000 հերոս։ Ձեր հերոսների հաշվին վճարվում է արժեքը, որը ավտոմատ կերպով փոխհատուցում է, եթե ստեղծումը ձախողվի։

Ոչ։ Ապրանքը անջատված է, քանի որ մոդելի թույլտվությունը թույլ չի տալիս դա անել։ SadTalker-ի կոդը Apache-2.0 է, բայց նրա դեմքի վերականգնման ցանցը սովորեցվել է Basel Face Model 2009-ի վրա, որի թույլտվությունը թույլ է տալիս միայն ներքին, ոչ առևտրային հետազոտություններ։ 2026 թվականի սեպտեմբերի 15-ից առաջ ստեղծված տեսանյութերը չեն կարող օգտագործվել առևտրային նպատակներով, ներառյալ վճարովի պլանները։ Դուք պատասխանատու եք ձեր վերբեռնած դեմքի պատկերի և ձայնի իրավունքների համար։

Երբ գործիքները գործում էին, 5 վայրկյան տևողությամբ կադրը մոտավորապես 30 վայրկյան էր տևում, ձայնային երկարության հետ արագորեն մեծացվում։ Այժմ այն հասանելի չէ, քանի դեռ մենք փնտրում ենք խոսող գլխի մոդել, որի լիցենզիան թույլ է տալիս դա անել։

Ամբողջական նախընտրելի (լռելյայն) մոդելները անիմատացնում են գլխի դիրքերը, մռայլումները և արտահայտությունները, ինչպես նաև ատամները, ստեղծելով ավելի բնական խոսող գլխի տեսահոլովակ։ Ավելի նախընտրելի մոդելները անընդհատ փակում են գլուխը և անիմատացնում են միայն բերանը, ինչը օգտակար է, երբ ցանկանում եք վավերագրի նկարը պահել անշարժ։

GFPGAN-ը դեմքի վերականգնման մոդել է, որը դեմքի մանրամասները ցուցադրելուց հետո արագացնում է։ Այն չի առաջարկվում։ Այն ունի StyleGAN2 նախնական տարբերակ, որը NVIDIA-ի ոչ առևտրային թույլտվության տակ է, իսկ դեմքի վերլուծության մոդելը՝ CC BY-NC-SA:

SadTalker-ը լռելյայն ցուցադրվում է 256 px-ով, իսկ 512 px-ը դանդաղ գործողություն է։ Այժմ գործիքը հասանելի չէ։ Լավ լուսավորված, բարձր որակով կախարդական նկարը լավագույն արդյունք է տալիս ցանկացած խոսող գլխի մոդելի դեպքում։

Այո։ Բեռնեք MP4 կամ WebM ֆայլը որպես դեմքի մուտք, և մենք կօգտագործենք առաջին ֆայլը որպես վարելու համար անհրաժեշտ անձնագիր։ Տեսահոլովակի ամբողջական կրկնօրինակման համար (առաջին ֆայլի ականջը փոխարինելու համար), տե՛ս Dubbing Studio-ի մոտակա տեսահոլովակի ալիքը։

Այո։ POST-ել բազմակողմանի խնդրանք /api/v1/lipsync/-ին դեմքի և ձայնային դաշտերով, ապա հարցնել /api/v1/lipsync/result/?uuid=, մինչև վիճակը դառնա «ավարտված»։ Պատասխանը պարունակում է ցուցադրված MP4-ի URL-ը։ API-ի համար անհրաժեշտ է վճարովի պլան։

SadTalker-ը օգտագործում է դեմքի ուղղումը՝ հայտնաբերելու և կտրել ամենահայաց դեմքը։ Լավագույն արդյունքների համար ներբեռնեք մի մարդու պատկեր, որի կենտրոնում գտնվում են նրա աչքերը և նվազագույն փակվածություն։ Ընդհանուր լուսանկարները կարող են առաջացնել անկանխատեսելի արդյունքներ։
5.0/5 (1)

Ի՞նչ կարող ենք բարելավել: Ձեր կարծիքը օգնում է մեզ լուծել խնդիրները:

Պատրա՞ստ եք սկսելու։

Գրանցվեք անվճար և ստացեք 50 կետ։ Կրեդիտային քարտի կարիք չկա։