Kling AI

Kling Avatar V2

Le modèle avatar parlant de Kling — transformez une image et une piste audio en une performance synchronisée aux lèvres.

Pas d'abonnement
Les crédits n'expirent jamais
En savoir plus

Payez une fois pour les crédits - utilisez-les sur tous les modèles de ZOOOP. · Rechargez quand vous en avez besoin, pas de brûlure mensuelle.

Powered by Kling AI's API on ZOOOP

Caractéristiques clés

Image + audio vers performance

Fournissez une image de personnage et une piste audio, et Kling Avatar V2 génère une vidéo de ce personnage parlant l'audio avec synchronisation labiale et expression.

Niveaux Standard et Pro

Standard pour des prises rapides et économiques ; Pro pour une fidélité supérieure. Mêmes entrées — choisissez selon l'importance du plan.

Guidance par prompt

Ajoutez un prompt pour orienter l'expression et la livraison alongside l'audio pilote.

Depuis une simple photo

Aucune vidéo nécessaire — une seule image suffit pour produire une performance de tête parlante.

Cas d'utilisation

Vidéos de têtes parlantes

Vidéos de têtes parlantes

Transformez un portrait en présentateur — explications, annonces et avatars hôtes à partir d'une image et d'une piste vocale.

Voix off de personnage

Voix off de personnage

Donnez à un personnage illustré ou généré une performance parlante synchronisée avec votre audio.

Porte-parole localisé

Porte-parole localisé

Pilotez le même avatar avec de l'audio dans différentes langues pour des versions localisées.

Contenu avatar social

Contenu avatar social

Produisez des clips d'avatars parlants pour les réseaux sociaux sans filmer un présentateur.

Choisissez le bon modèle

Choisissez le bon outil. Vos crédits fonctionnent partout sur ZOOOP.

Avatar parlant à partir d'une imageKling Avatar V2
Re-synchroniser une vidéo existanteKling Lipsync
Lip-sync, coût inférieurPixverse Lipsync
Voix off pour piloterMultilingual V3
Vidéo texte-vers-vidéo avec audio synchroniséKling O3

Comment utiliser

01

Ouvrez Kling Avatar V2 depuis cette page ou sélectionnez-le dans le Générateur de vidéos.

02

Téléchargez une image de personnage et une piste audio ; ajoutez un prompt pour guider l'expression.

03

Choisissez Standard ou Pro.

04

Générez, puis téléchargez ou envoyez le clip sur votre canvas.

Plongée profonde

Ce que Kling Avatar V2 fait bien — et ce qu'il fait moins bien

Kling Avatar V2 est un modèle d'avatar parlant : donnez-lui une image de personnage et une piste audio, et il génère une vidéo de ce personnage parlant l'audio avec synchronisation labiale et expression correspondante. La clé est qu'il part d'une simple photo — aucune vidéo de présentateur requise — de sorte qu'un portrait, une illustration ou un personnage généré devient un performeur parlant. Pour les explications, annonces, avatars hôtes et voix off de personnages, c'est le chemin le plus rapide de « image plus script » à « vidéo parlante ».

Il est disponible en niveaux Standard et Pro avec les mêmes entrées : Standard pour des prises rapides et peu coûteuses, Pro pour le final en haute fidélité. Un prompt optionnel oriente l'expression et la livraison alongside l'audio pilote.

L'association naturelle est avec un modèle TTS : générez la voix avec Multilingual V3 (ou un autre modèle vocal), puis pilotez l'avatar avec pour une vidéo parlante complète sans aucun enregistrement — et échangez la langue audio pour localiser.

Quand c'est le mauvais outil : si vous avez déjà un clip vidéo et avez juste besoin que sa bouche soit re-synchronisée avec un nouvel audio, c'est le travail de Kling Lipsync, et Pixverse Lipsync est une alternative lip-sync moins coûteuse. La voie de Kling Avatar V2 est de générer une performance parlante à partir d'une image fixe.

Un modèle mental raisonnable : par défaut avec Kling Avatar V2 quand votre point de départ est une seule image et une piste audio. Pour re-synchroniser des séquences vidéo existantes, utilisez Kling Lipsync.

Questions fréquemment posées

Qu'a besoin Kling Avatar V2 ?+

Une image de personnage et une piste audio. Il génère une vidéo de ce personnage parlant l'audio avec synchronisation labiale et expression. Un prompt optionnel oriente la livraison.

Quelle est la différence entre Standard et Pro ?+

Standard est le niveau rapide et économique ; Pro est une fidélité supérieure. Mêmes entrées — choisissez selon l'importance du plan.

En quoi Kling Avatar V2 diffère-t-il de Kling Lipsync ?+

Kling Avatar V2 pilote une image fixe avec de l'audio pour créer un avatar parlant. Kling Lipsync re-synchronise un clip vidéo existant avec un nouvel audio. Choisissez Avatar V2 quand vous partez d'une seule image.

Puis-je utiliser une voix générée ?+

Oui — générez d'abord l'audio avec un modèle TTS, puis pilotez l'avatar avec pour une vidéo parlante complète sans aucun enregistrement.

Plus de modèles

Kling AI
Kling Lipsync
Kling AI
Pixverse AI
Pixverse Lipsync
Pixverse AI
ElevenLabs
Multilingual V3
ElevenLabs
Kling AI
Kling O3
Kling AI
OpenAI
GPT Image 2.5
OpenAI
OpenAI
GPT Image 2.0
OpenAI
ByteDance
Seedance V2.0
ByteDance
ByteDance
Seedance V2.0 Fast
ByteDance
ByteDance
Seedance V1.5 Pro
ByteDance
ByteDance
Seedance V1.0 Pro
ByteDance
ByteDance
Seedance V1.0 Pro Fast
ByteDance
ByteDance
Seedance V1.0 Lite
ByteDance
ByteDance
Seedream 5.0 Pro
ByteDance
ByteDance
Seedream 5.0 Lite
ByteDance
ByteDance
Seedream 4.5
ByteDance
ByteDance
Seedream 4
ByteDance
ByteDance
Dreamactor V2
ByteDance
MiniMax
MiniMax H3
MiniMax
MiniMax
Minimax Music V2.6
MiniMax
MiniMax
Minimax Music V2
MiniMax
MiniMax
Speech-2.8-HD
MiniMax
MiniMax
Speech-2.8-Turbo
MiniMax
Kling AI
Kling V3
Kling AI
Kling AI
Kling V3 Pro
Kling AI
Kling AI
Kling V2.6 Pro
Kling AI
Kling AI
Kling V2.6
Kling AI
Kling AI
Kling O1
Kling AI
Midjourney
Midjourney V8.2
Midjourney
Midjourney
Midjourney V8.1
Midjourney
Midjourney
Midjourney
Midjourney
Alibaba
Happy Horse V1.1
Alibaba
Alibaba
Happy Horse
Alibaba
xAI
Grok Imagine V1.5
xAI
xAI
Grok Imagine
xAI
xAI
xAI TTS
xAI
Google
Veo 3.1
Google
Google
Veo 3.1 Fast
Google
Google
Veo 3
Google
Google
Nano Banana Pro
Google
Google
Nano Banana 2
Google
Google
Nano Banana
Google
Google
Lyria 3 Pro
Google
Google
Lyria 3
Google
Google
Lyria2
Google
Google
Gemini 3.1 Flash TTS
Google
Wan AI
Wan V3.0
Wan AI
Wan AI
Wan V2.2
Wan AI
Wan AI
Wan V2.2 Turbo
Wan AI
Wan AI
Wan V2.5
Wan AI
Wan AI
Wan V2.6
Wan AI
Wan AI
Wan V2.6 Flash
Wan AI
Wan AI
Wan V2.7
Wan AI
Pixverse AI
Pixverse V6
Pixverse AI
Pixverse AI
Pixverse V5.5
Pixverse AI
Pixverse AI
Pixverse V5
Pixverse AI
Vidu AI
Vidu Q3 Pro
Vidu AI
Vidu AI
Vidu Q3
Vidu AI
Vidu AI
Vidu Q3 Turbo
Vidu AI
Vidu AI
Vidu Q2 Pro
Vidu AI
Vidu AI
Vidu Q2 Turbo
Vidu AI
Luma AI
Luma Ray 2
Luma AI
Luma AI
Luma Ray 2 Flash
Luma AI
Flux AI
Flux 2 Pro
Flux AI
Flux AI
Flux 2
Flux AI
Flux AI
Flux 2 Flash
Flux AI
ElevenLabs
Multilingual V2
ElevenLabs
ElevenLabs
Sound Effects V2
ElevenLabs
Hailuo AI
Hailuo 2.3
Hailuo AI
Hailuo AI
Hailuo 2.3 Fast
Hailuo AI
Hailuo AI
Hailuo 02
Hailuo AI
Lightricks
LTX-2.3 Pro
Lightricks
Lightricks
LTX-2.3 Fast
Lightricks
Lightricks
LTX-2.3
Lightricks
Pika AI
Pika V2.2
Pika AI
Qwen
Qwen3-TTS
Qwen
Inworld
Inworld TTS
Inworld
Bilibili Index
Index TTS 2
Bilibili Index
Resemble AI
Chatterbox TTS Multilingual
Resemble AI
Open Source
ACE-Step
Open Source
Open Source
LUX TTS
Open Source
CassetteAI
Music Generator
CassetteAI
Recraft
Text to Vector V4.1
Recraft
Recraft
Text to Vector V4.1 Pro
Recraft
Recraft
Image to Vector
Recraft