ബഗ് / സാങ്കേതിക അപേക്ഷ അറിയിയ്ക്കുക

AILp Sync വീഡിയോ നിര്‍മ്മാണം

ഒരു മുഖചിത്രവും ഒരു ഓഡിയോ ക്ലിപ്പ്‌ ലിപ്‌സ്‌ സിന്ക്, ഹെഡ്‌ പോസ്, ലിങ്ക്‌ എന്നിവയുമായി ഒരു വര്‍ത്തമാനം പറയുന്ന വീഡിയോയിലേക്ക് മാറ്റുക. ഇപ്പോള്‍ ഒരു മോഡലിലേക്ക് നോക്കുമ്പോള്‍, അത് ലൈസന്‍സ് അനുവദിക്കുന്നു.

ലിപ് സിന്‍ക് ഇപ്പോള്‍ ലഭ്യമല്ല. സോഡ്‌ ടെലിഫോര്‍ഡര്‍ മോഡില്‍ ഉപയോഗിച്ചിരുന്നു. ഇത് ബാസ്ട്രേസല്‍ മുഖാമുഖം, ഇത് ലൈസന്‍സ് ഇല്ലാതെയുള്ള ഗവേഷണങ്ങള്‍ക്ക് മാത്രമേ നല്‍കുകയുള്ളൂ. അതുകൊണ്ട്, ഒരു ശമ്പളത്തില്‍ മാത്രമേ നമുക്കത് നല്‍കുവാന്‍ കഴിയൂ. ഒരു ലൈസന്‍സ് ലൈസന്‍സ് ഇന്‍സ്റ്റോള്‍ ചെയ്തിട്ടുള്ളു.

മോഡിഫയര്‍ & ഓഡിയോ ലോഡ് ചെയ്യുക

ഒരു സെക്കന്‍ഡില്‍ 1,000 അക്ഷരങ്ങള്‍

നിങ്ങളുടെ ഫയല്‍ ഇവിടെ വലിച്ചിടുക, അല്ലെങ്കില്‍ വലിച്ചിടുക പരതുക

JPG, PNG, or short MP4/WebM. Max 10MB. One clear, well-lit face works best.

ഫയല്‍.mp3

0 MB

നിങ്ങളുടെ ഫയല്‍ ഇവിടെ വലിച്ചിടുക, അല്ലെങ്കില്‍ വലിച്ചിടുക പരതുക

MP3, WAV, M4A, or FLAC. Max 10MB. Free: up to 30 sec. Pro: up to 5 min.

ഫയല്‍.mp3

0 MB

പ്രവര്‍ത്തനത്തില്‍...

നിങ്ങളുടെ വീഡിയോ പൂര്‍ത്തിയാക്കുന്നതിന് 30 സെക്കന്‍റ് എടുക്കും.

നിങ്ങളുടെ സംസാര വീഡിയോ

എംപി4 ഡൌണ്‍ലോഡ് ചെയ്യുക

സാഡ് ടെലിഫോര്‍ഡിനെക്കുറിച്ച്

സാദി ടെലിഫോര്‍ഡര്‍ (CVPR23, റ്റെനാന്റ് ARC) ഏതു് ഓഡിയോ സംസാരിക്കുന്നതിനായി ഒരു മുഖത്തെ ചലിപ്പിക്കുന്ന ഒരു തുറന്ന ശബ്ദ-തല അച്ചടക്കമാണ്. വവ്‌ലിപ്‌നീറ്റുകള്‍ പോലെ, സാദി ഡ്രാഡിനേറ്റര്‍ തലവെട്ടികള്‍, മിന്നലുകള്‍, കൂടുതല്‍ സ്വാഭാവികമായ ഫലങ്ങള്‍ എന്നിവയും.

SadTalker's code is Apache-2.0, but its 3D face reconstruction weights were trained on the Basel Face Model, whose license allows non-commercial research only. TTS.ai is a commercial service, so the tool was switched off on September 15, 2026.

നല്ല ഫലങ്ങളുടെ സൂചനകൾ

  • ഉയര്‍ന്ന, സുതാര്യമായ ചിത്രചിത്രം ഉപയോഗിക്കുക — കണ്ണുകള്‍ കാണാവുന്നവ, വായ അടച്ചിരിക്കുന്നു
  • സെന്‍ട്രല്‍ മുഖത്തെ, സ്ക്വയര്‍ അല്ലെങ്കില്‍ 4: 5 ആംഗ്യ റേറ്റ് നന്നായി പ്രവര്‍ത്തിക്കുന്നു
  • സംസാര സംയോജക ഓഡിയോ (സംഗീതം ഇല്ല) ശക്തമായ ലിപി സിന്‍ക് നല്‍കുന്നുName
  • ഹീറോ ഷൂട്ടുകള്‍ക്കായി GFPGAN പ്രവര്‍ത്തന സജ്ജമാക്കുക —⁠ ഇരട്ട റെന്‍റ്, പക്ഷെ മിന്നല്‍ വിശദാംശങ്ങള്‍
  • നിങ്ങള്‍ക്ക് ഒരു സ്ഥിരമായ അവതാര വെടിവയ്ക്കണമെങ്കില്‍ മുന്‍ഗണന ഉപയോഗിക്കുക.

ലിപി സിന്‍ക് വീഡിയോ പ്ലാന്‍സ്Name

നിങ്ങള്‍ക്ക് കൂടുതല്‍ ആവശ്യമുണ്ടെങ്കില്‍ സ്വതന്ത്രമായി തുടങ്ങുക, അപ്ഗ്രേഡ് ചെയ്യുക

ഫ്രീ
  • 30- സെക്കന്റ് ഓഡിയോ പരിധി
  • 256 px ഔട്ട്പുട്ട്
  • "സ്റ്റില്‍" മുന്‍സെറ്റ് മാത്രം
  • മുഖത്തെ കൂടുതല്‍ മെച്ചപ്പെടുത്താന്‍ പറ്റില്ല.
ഏറ്റവും പ്രസിദ്ധം
ഫ്രീ അക്കൗണ്ട്
  • 30- സെക്കന്റ് ഓഡിയോ പരിധി
  • "മുഴുവന്‍" എന്നും "വിജയിച്ചു" എന്നും.
  • 256 / 512 px ഔട്ട്പുട്ട്
  • ജിപിപിജിന്‍ മുഖമുദ്രാകൃതിName
ഫ്രീ ആയി ഒപ്പ് വയ്ക്കുക
പ്രൊഫൈല്‍
  • 5- മിനിട്ട് ഓഡിയോ പരിധി
  • മുന്‍ഗണന GPU റേറ്റര്‍
  • API സമീപനം (multipart അപ്‌ലോഡ്) Name
  • വെബ് ഹൂക്ക് കോള്‍ പൂര്‍ത്തിയാക്കല്‍ ബാക്കെന്‍ഡുകള്‍
  • നിലവില്‍ ലഭ്യമല്ല (അംഗത്വമുളള മോഡല്‍ ലൈസന്‍സ്)
അപ്ഗ്രേഡ് ചെയ്യുക

പലപ്പോഴും ചോദിക്കപ്പെടുന്ന ചോദ്യങ്ങൾ

ഒരു മുഖചിത്രവും ഓഡിയോ ക്ലിപ്പും, AI ആ വീഡിയോ നിര്‍മ്മിക്കുന്നു. ആ ഉപകരണം ഇപ്പോള്‍ ലഭ്യമല്ല: അത് സത്‌പി 2023 (CVR23) പ്രവര്‍ത്തിച്ചു. ആ റെക്കോര്‍ഡ്‌ പ്രൊഫഷണല്‍ പ്രവര്‍ത്തിച്ചു. അവരുടെ 3D മുഖമുദ്രകള്‍ ബാസ്പെക്ടൈല്‍ മോഡലില്‍ പരിശീലിപ്പിച്ചിരുന്നു. അത് കോമറൈന്‍ അല്ലാത്ത ഗവേഷണത്തിനു മാത്രം.

മുഖത്തിന്റെ ഇന്‍പുട്ട് ഒരു JPG അല്ലെങ്കില്‍ PNG ഇമേജ് (ഉപയോഗിയ്ക്കാന്‍ 10 എം.പി.എം.എം. എസ് ഡ്രോഡ് വീഡിയോ (ഞങ്ങള്‍ ആദ്യത്തെ ഫ്രെയിം ഉപയോഗിക്കാം). ഡ്രൈവിങ് ഓഡിയോ MP3, WAV, MAV, FLAC, അല്ലെങ്കില്‍ FLAC 10 എം. ല്‍ (KHSLC) - ല്‍ നിന്നും 16HS-ല്‍ നിന്നും ഓഡിയോ ആണ്.

ഫ്രീ അക്കൗണ്ടുകള്‍: ഒരു ക്ലിപ് ചെയ്യാന്‍ 30 സെക്കന്റ് വരെ. ഉപയോക്താക്കള്‍ക്ക് നല്‍കുന്നു: ഒരു അപേക്ഷയ്ക്ക് 5 മിനിറ്റോളം വരെ സമയം നല്‍കുന്നു. അധികകാലം ഓഡിയോ വര്‍ദ്ധിപ്പിക്കുന്നു.

നിര്‍മ്മിച്ച വീഡിയോയുടെ ഒരു സെക്കന്‍ഡില്‍ 1,000 അക്ഷരങ്ങള്‍ ലിപ് സിന്‍സിങ്ക് ഉപയോഗിക്കുന്നു. ഒരു 30- സെക്കന്‍ഡ് ക്ലിക്ക് = 30,000 അക്ഷരങ്ങള്‍. ഈ വില നിങ്ങളുടെ ക്ളൈന്‍ സ്കൌണ്ടില്‍ നിന്നും മുന്‍പോട്ട് മാറ്റി, തലമുറ പരാജയപ്പെട്ടാല്‍ സ്വയം പുതുക്കി.

No. The tool is switched off because the model license does not allow it. SadTalker code is Apache-2.0, but its bundled face reconstruction network was trained on the Basel Face Model 2009, whose license allows internal, non-commercial research only. Videos generated with it before September 15, 2026 are not for commercial use, paid plans included. You are responsible for having the rights to the source face image and audio you upload.

5 സെക്കന്റ് ക്ലിക്ക് 30 സെക്കന്റ് എടുക്കും. ഒരു ശബ്ദത്തിന്റെ നീളം കൊണ്ട് കൃത്യമായി വലിപ്പം കുറയ്ക്കുക. സംസാര-തലം വെക്കുന്ന ഒരു മോഡലിലേക്ക് നോക്കുമ്പോള്‍, അത് ഇവിടെ ലഭ്യമല്ല.

ഏറ്റവും മുന്‍പുള്ള (സഹജമായ) തല (സഹജമായ) അഭിനയിക്കുന്ന തലകള്‍, ചുണ്ടുകള്‍, ഭാവം, ഭാവം എന്നിവ കൂടുതല്‍ സ്വാഭാവികമായ ഒരു വീഡിയോ ഉല്‍പാദിപ്പിക്കുന്നു.

GFPGAN ആണ് റെഗുഡ് ചെയ്തതിനു ശേഷം മുഖവിവരങ്ങള്‍ ഉരുക്കിവിടുന്ന മുഖാമജ്ജാമാതൃക. അതിന്റെ ശൈലിാഗതം നല്‍കിയിട്ടില്ല: സ്റ്റൈല്‍ഗാന്‍2 മുന്‍പ് ഒരു NVIIDA കമ്മറേഷ്യന്‍ അമേരിഷ്യ ലൈസന്‍സിനും മുഖപടം 'CNC-SA' ആണ്.

256 പിക്സ് സ്വതവേ നല്‍കിയ സാദി വോളെറ്റര്‍, 512 px വേഗത്തില്‍ തെരഞ്ഞെടുക്കുന്ന ഒരു ഉപാധിയില്‍. ടൂള്‍ ഇപ്പോള്‍ ലഭ്യമല്ല; വര്‍ക്ക് നന്നായി, ഉയര്‍ന്ന, ഉയര്‍ന്ന, വര്‍ത്തമാനങ്ങളുടെ മാതൃകയില്‍ ഏറ്റവും നല്ല ഫലം നല്‍കുന്നു.

അതെ. ഒരു എംബി4 അല്ലെങ്കില്‍ വെബ്എം ഇന്‍പുട്ടായി അപ്‌ലോഡ് ചെയ്യുക. ആദ്യത്തെ ഫ്രെയിം ഡ്രൈവര്‍ തിരിച്ചറിയല്‍ തിരിച്ചറിയല്‍ ഐഡന്റിറ്റി ആയി ഉപയോഗിക്കാം. പൂര്‍ണ്ണ വീഡിയോ വീണ്ടും നിര്‍വ്വീര്യമാക്കാന്‍ (ഓപ്പര്‍ ഫ്രെയിമിങ്ങ്), വരുന്ന ഡ്ബിങ് സ്റ്റുഡിയോ പൈപ്പ്.

അതെ. /ap/v1/ lib/ lib ഫീള്‍ഡുകള്‍, മുഖവും ഓഡിയോ ഫീള്‍ഡുകളുമായി ഒന്നിലധികം അഭ്യർഥനകള്‍, പിന്നെ /api/vip/1 lib/ libsocus/ riputt/? uuid= " പൂര്‍ത്തിയാകുന്നതുവരെ" എന്ന യുആര്‍എല്‍ MP4- ല്‍ ഒരു യുആര്‍എല്‍ ലഭ്യമാണു്. API സമീപനത്തിന് ഒരു പ്രൊജക്റ്റ് പദ്ധതി ആവശ്യമുണ്ട്.

ഏറ്റവും പ്രമുഖമായ മുഖം കണ്ടുപിടിക്കാനും വിതയ്ക്കാനും സാഡ് റിമോര്‍ട്ടര്‍ ഉപയോഗിക്കുന്നു. നല്ല ഫലങ്ങള്‍ക്കായി, ഒരു വ്യക്തിയുമായി ഒരു ചിത്രം അപ്‌ലോഡ് ചെയ്യുക. ഗ്രൂപ്പ് ഫോട്ടോകള്‍ തെറ്റായ ഫലങ്ങള്‍ ഉളവാക്കിയേക്കാം.
5.0/5 (1)

നിങ്ങളുടെ പ്രതികരണം പ്രശ്‌നങ്ങൾ പരിഹരിക്കാൻ നമ്മെ സഹായിക്കുന്നു.

തുടങ്ങാന്‍ തയ്യാറാണോ?

ഫ്രീ ആയി 50 ക്രെഡിറ്റ്‌ എടുക്ക്.