Xəta / Xüsusiyyət İxtiyarını İdarə Et

AI Lip Sync Video Yaratıcısı

Üz şəklini və səs klipini ağzının sinxronizasiyası, başının mövqeyi və gözlərinin parıldaması ilə danışan baş videosuna çevir. Lisenziyasını bu işə imkan verən bir model axtardığımız üçün hazırda mövcud deyil.

Sizin dilində hələlik TTS səsləri yoxdur. Bizə öz səslərinizi əlavə etməyə kömək edin! Səsini Sat
Dilin sinxronizasiyası indi mövcud deyil. SadTalker modeli yalnız ticarəti olmayan tədqiqatlar üçün lisenziyalı Basel Face Model üzərində təlim edilmişdir, buna görə də biz onu ödənişli xidmətdə təklif edə bilmərik. Əlavə lisenziyalı əvəzedici hələ quraşdırılmamışdır.

Yüz + Audio yüklə

1000 karakter/saniyə

Faylınızı buraya sürükləyin və atın, ya da _Göstər

JPG, PNG, or short MP4/WebM. Max 10MB. One clear, well-lit face works best.

fayl.mp3

0 MB

Faylınızı buraya sürükləyin və atın, ya da _Göstər

MP3, WAV, M4A, or FLAC. Max 10MB. Free: up to 30 sec. Pro: up to 5 min.

fayl.mp3

0 MB

İşlənir...

Videonuz renderlənir. Bu adətən 30 saniyədən 2 dəqiqəyə qədər davam edir.

Talking-Head Videonuz

Endir

SadTalker haqqında

SadTalker (CVPR 2023, Tencent ARC) hər hansı səsi danışmaq üçün tək bir üz şəklini animasiya edən açıq mənbəli danışan baş modelidir. Wav2Lip variantlarından fərqli olaraq, SadTalker daha təbii nəticə üçün baş mövqeyini, göz qırpımını və mimikanı da animasiya edir.

SadTalker-in kodu Apache-2.0-dır, lakin onun 3D üz bərpası ağırlıqları Basel Face Model-də təlim edilmişdir, onun lisenziyası yalnız kommersiya olmayan tədqiqatlara icazə verir. TTS.ai kommersiya xidmətidir, buna görə də alət 15 sentyabr 2026-cı ildə söndürülmüşdür.

Ən Yaxşı Nəticə üçün İpuçları

  • Yüksək keyfiyyətli, yaxşı işıqlandırılmış portret istifadə et - göz görünən, ağız bağlanmış
  • Mərkəzi şəkil, kvadrat və ya 4:5 nisbət ən yaxşı işləyir
  • Təmiz səsli danışıq (müzik yoxdur) daha sıx ağız sinxronizasiyası verir
  • Hero shots üçün GFPGAN fəallaşdır — render vaxtını ikiqat artırır amma detalları daha aydın göstərir
  • Əvvəlcədən təyin edilmiş sabit avatar şəklini istədiyiniz zaman istifadə edin

Video Planları

Pulsuz başlayın, daha çoxuna ehtiyacınız olduqda yüksəldin

Pulsuz
  • 30 saniyə səs həddi
  • 256 px çıxıntı
  • Yalnız "Still" əvvəlcədən qurğuları
  • Yüz artırıcı yoxdur
Ən populyar
Hesab
  • 30 saniyə səs həddi
  • Hər iki "full" və "still" əvvəlcədən qurğuları
  • 256 / 512 px çıxarış
  • GFPGAN üz artırıcı
Qeydiyyatdan keç
Pro
  • 5 dəqiqəlik audio limiti
  • GPU-nun prioritet qrupu
  • API girişi (bir çox hissəli yükləmə)
  • Webhook tamamlama geri çağırışları
  • Hazırda mövcud deyil (ticarətsiz model lisenziyası)
Yenilə

Tez-tez Sorulan Sual

Üz şəklini və səs klipini yükləyin və AI bu üz videonu yaradaraq səsi ağzının hərəkətləri, başının mövqeyi və gözlərinin qırpması ilə danışır. Alət hazırda mövcud deyil: SadTalker (CVPR 2023) proqramını işlədir, onun 3D üz rekonstruksiya ağırlığı Basel Üz Modeli üzərində təlim edilmişdir, ki bu da yalnız ticarəti olmayan tədqiqatlar üçün lisenziyalıdır.

Üz girişi JPG ya da PNG şəkli (10 MB-a qədər) ya da qısa MP4/WebM video sürücüsüdür (biz ilk kadrı istifadə edirik). Səs sürücüsüdür MP3, WAV, M4A, ya da FLAC 10 MB-a qədər. Səs daxili olaraq 16 kHz-ə qədər yenidən nümunə götürülür.

Pulsuz hesablar: klip başına 30 saniyəyə qədər. Ödənişli istifadəçilər: istək başına 5 dəqiqəyə qədər. Uzun səs uzun render vaxtı və yüksək karakter qiyməti deməkdir.

Lip sync video saniyədə 1000 karakter istifadə edir. 30 saniyəlik klip = 30,000 karakter. Qiymətlər karakter balansınızdan əvvəlcədən hesablanır və yaradılma bacarılmadıqda avtomatik olaraq geri qaytarılır.

Xeyr. Model lisenziyası buna imkan vermədiyi üçün alət söndürülmüşdür. SadTalker kodu Apache-2.0'dır, lakin onun üzə bərpa şəbəkəsi Basel Face Model 2009'da təlim edilmişdir, onun lisenziyası yalnız daxili, ticarəti olmayan araşdırmalara icazə verir. 15 Sentyabr 2026-dan əvvəl yaradılan videolar ticarəti olmayan istifadə üçündür, ödənişli planlar daxildir. Yüklədiyiniz mənbə üzün şəkli və səsi üçün hüquqlarınızın olmasına cavabdehsiniz.

Vasitə işlədiyi zaman 5 saniyəlik klip 30 saniyə çəkdi və səs uzunluğu ilə bərabər düzbucaqlı ölçüldü. Lisenziyasını icazə verən bir danışan baş modeli axtardığımız üçün bu hazırda mövcud deyil.

Tam əvvəlcədən qurğu (öncəki) baş mövqeyini, göz qırpımını və mimikanı duşlarla birlikdə animasiya edir, daha təbii danışan baş videosu yaradaraq. Hələ də əvvəlcədən qurğu başı yerdə bağlayır və yalnız ağzı animasiya edir - sabit avatar şəkli istədiyiniz zaman faydalıdır.

GFPGAN render edildikdən sonra üz detallarını kəskinləşdirən üz bərpa modelidir. Bu təklif edilmir: onun StyleGAN2 əvvəli NVIDIA'nın ticarətsiz lisenziyası altındadır və onun üz analiz modeli CC BY-NC-SA'dır.

SadTalker ön qurğulu olaraq 256 px-də render edilir, daha yavaş seçim olaraq 512 px-də. Bu alət hazırda mövcud deyil; yaxşı işıqlandırılmış, yüksək keyfiyyətli portret hər hansı bir danışan baş modeli ilə ən yaxşı nəticə verir.

Bəli. Üz girişi olaraq MP4 ya da WebM yükləyin və biz ilk kadrı sürücü kimliyi kimi istifadə edəcəyik. Videonun tam yenidən dublajlanması üçün (qadra görə ağız əvəzi) Dubbing Studio video boru kəmərinə baxın.

Bəli. /api/v1/lipsync/-ə şəkil və səs sahələri ilə çox hissəli bir tələb göndər, sonra vəziyyət "komplet" olana qədər /api/v1/lipsync/result/?uuid= sorğusunu göndər. Cavabda render edilmiş MP4-ün URL-ü var. API-yə çıxış üçün ödənişli plan tələb olunur.

SadTalker ən çox görünən üzü aşkar etmək və kəsmək üçün üzün düzəldilməsini istifadə edir. Ən yaxşı nəticələr üçün bir şəxsin mərkəzdə, gözlərin görünən və minimal örtülmüş olduğu bir portret yükləyin. Qrup şəkilləri gözlənilməz nəticələr verə bilər.
5.0/5 (1)

Nəyi yaxşılaşdıra bilərik? Sizin rəyiniz problemləri düzəltməyə kömək edir.

Başlamağa hazırsan?

Pulsuz qeydiyyatdan keçin və 15,000 karakter əldə edin. Kredit kartı tələb olunmur.