Générateur de vidéo AI Lip Sync
Transformez une photo du visage et un clip audio en une vidéo en tête-à-tête parlante avec synchronisation des lèvres, pose de la tête et cligne des yeux. Actuellement indisponible pendant que nous recherchons un modèle dont la licence le permet.
Télécharger Face + Audio
1 000 caractères par secondeFaites glisser et déposez votre fichier ici, ou parcourir
JPG, PNG, or short MP4/WebM. Max 10MB. One clear, well-lit face works best.fichier.mp3
0 MBFaites glisser et déposez votre fichier ici, ou parcourir
MP3, WAV, M4A, or FLAC. Max 10MB. Free: up to 30 sec. Pro: up to 5 min.fichier.mp3
0 MBRendu votre vidéo. Cela prend généralement 30 secondes à 2 minutes.
Votre vidéo en tête de conversation
À propos de SadTalker
SadTalker (CVPR 2023, Tencent ARC) est un modèle de tête parlante open source qui anime une seule image de visage pour parler n'importe quel son. Contrairement aux variantes Wav2Lip, SadTalker anime également la pose de tête, les clignements et l'expression pour un résultat plus naturel.
Le code de SadTalker est Apache-2.0, mais ses poids de reconstruction du visage 3D ont été formés sur le modèle Basel Face, dont la licence permet la recherche non commerciale seulement. TTS.ai est un service commercial, donc l'outil a été éteint le 15 septembre 2026.
Conseils pour les meilleurs résultats
- Utilisez un portrait de haute qualité, bien éclairé — yeux visibles, bouche fermée
- Face centrée, carré ou 4:5 le rapport d'aspect fonctionne mieux
- Le son de la parole propre (pas de musique) donne une synchronisation des lèvres plus serrée
- Activer GFPGAN pour les coups de héros — double rend le temps mais affûte les détails
- Utilisez le Toujours préréglé lorsque vous voulez un tir d'avatar stable
Plans vidéo Lip Sync
Commencez gratuitement, mise à niveau lorsque vous avez besoin de plus
- Limite audio de 30 secondes
- Sortie 256 px
- Préréglage "Still" uniquement
- Pas de rehausseur de visage
- Limite audio de 30 secondes
- Préréglages "plein" et "toujours"
- Sortie 256 / 512 px
- Enrichisseur du visage GFPGAN
- Limite sonore de 5 minutes
- file d'attente GPU prioritaire
- Accès à l'API (téléchargement en plusieurs parties)
- Callbacks d'achèvement de Webhook
- Actuellement indisponible (licence modèle non commerciale)
Foire aux questions
Que pourrions-nous améliorer? Vos commentaires nous aident à résoudre les problèmes.
Prêt à commencer?
Inscrivez-vous gratuitement et obtenez 50 crédits. Aucune carte de crédit requise.