Kling AI

Kling Avatar V2

O modelo de avatar falante da Kling — transforme uma imagem mais uma pista de áudio numa performance sincronizada com os lábios.

Sem assinatura
Os créditos nunca expiram
Saiba mais

Pague uma vez por créditos e use-os em todos os modelos em ZOOOP. · Recarregue quando precisar, sem queima mensal.

Powered by Kling AI's API on ZOOOP

Principais características

Imagem + áudio para performance

Forneça uma imagem de personagem e uma pista de áudio, e o Kling Avatar V2 gera um vídeo dessa personagem a falar o áudio com sincronização labial e expressão.

Níveis Standard e Pro

Standard para tomadas rápidas e econômicas; Pro para maior fidelidade. Mesmas entradas — escolha pela importância do plano.

Orientação por prompt

Adicione um prompt para orientar a expressão e a entrega alongside o áudio condutor.

De uma única foto

Não precisa de vídeo — uma única imagem é suficiente para produzir uma performance de cabeça falante.

Casos de uso

Vídeos de cabeças falantes

Vídeos de cabeças falantes

Transforme um retrato num apresentador — explicações, anúncios e avatares anfitriões a partir de uma imagem e uma pista de voz.

Voz off de personagem

Voz off de personagem

Dê a uma personagem ilustrada ou gerada uma performance falante sincronizada com o seu áudio.

Porta-voz localizado

Porta-voz localizado

Conduza o mesmo avatar com áudio em diferentes línguas para versões localizadas.

Conteúdo de avatar social

Conteúdo de avatar social

Produza clipes de avatar falante para redes sociais sem filmar um apresentador.

Escolha o modelo certo

Escolha a ferramenta certa. Os seus créditos funcionam em todo o ZOOOP.

Avatar falante a partir de uma imagemKling Avatar V2
Re-sincronizar vídeo existenteKling Lipsync
Lip-sync, menor custoPixverse Lipsync
Pista de voz para conduzirMultilingual V3
Vídeo texto-para-vídeo com áudio sincronizadoKling O3

Como usar

01

Abra o Kling Avatar V2 a partir desta página ou selecione-o no Gerador de Vídeo.

02

Carregue uma imagem de personagem e uma pista de áudio; adicione um prompt para orientar a expressão.

03

Escolha Standard ou Pro.

04

Gere, depois baixe ou envie o clipe para a tela.

Mergulho profundo

O que o Kling Avatar V2 faz bem — e o que não faz

O Kling Avatar V2 é um modelo de avatar falante: dê-lhe uma imagem de personagem e uma pista de áudio, e gera um vídeo dessa personagem a falar o áudio com sincronização labial e expressão correspondente. A chave é que parte de uma única foto — sem vídeo de apresentador necessário — pelo que um retrato, uma ilustração ou uma personagem gerada se torna um performer falante. Para explicações, anúncios, avatares anfitriões e voz off de personagens, é o caminho mais rápido de "imagem mais roteiro" para "vídeo falante".

Vem em níveis Standard e Pro com as mesmas entradas: Standard para tomadas rápidas e baratas, Pro para o final de alta fidelidade. Um prompt opcional orienta a expressão e a entrega alongside o áudio condutor.

A combinação natural é com um modelo TTS: gere a voz com Multilingual V3 (ou outro modelo de voz), depois conduza o avatar com ela para um vídeo falante completo sem gravação — e troque a língua do áudio para localizar.

Quando é a ferramenta errada: se já tem um clipe de vídeo e só precisa que a boca seja re-sincronizada com novo áudio, isso é trabalho do Kling Lipsync, e o Pixverse Lipsync é uma alternativa lip-sync de menor custo. A via do Kling Avatar V2 é gerar uma performance falante a partir de uma imagem fixa.

Um modelo mental razoável: use o Kling Avatar V2 por padrão quando o seu ponto de partida é uma única imagem e uma pista de áudio. Para re-sincronizar vídeo existente, use o Kling Lipsync.

Perguntas frequentes

De que precisa o Kling Avatar V2?+

Uma imagem de personagem e uma pista de áudio. Gera um vídeo dessa personagem a falar o áudio com sincronização labial e expressão. Um prompt opcional orienta a entrega.

Qual é a diferença entre Standard e Pro?+

Standard é o nível mais rápido e econômico; Pro é maior fidelidade. Mesmas entradas — escolha pela importância do plano.

Como difere o Kling Avatar V2 do Kling Lipsync?+

O Kling Avatar V2 conduz uma imagem fixa com áudio para criar um avatar falante. O Kling Lipsync re-sincroniza um clipe de vídeo existente com novo áudio. Escolha Avatar V2 quando parte de uma única imagem.

Posso usar uma voz gerada?+

Sim — gere primeiro o áudio com um modelo TTS, depois conduza o avatar com ele para um vídeo falante completo sem qualquer gravação.

Mais modelos

Kling AI
Kling Lipsync
Kling AI
Pixverse AI
Pixverse Lipsync
Pixverse AI
ElevenLabs
Multilingual V3
ElevenLabs
Kling AI
Kling O3
Kling AI
OpenAI
GPT Image 2.5
OpenAI
OpenAI
GPT Image 2.0
OpenAI
ByteDance
Seedance V2.0
ByteDance
ByteDance
Seedance V2.0 Fast
ByteDance
ByteDance
Seedance V1.5 Pro
ByteDance
ByteDance
Seedance V1.0 Pro
ByteDance
ByteDance
Seedance V1.0 Pro Fast
ByteDance
ByteDance
Seedance V1.0 Lite
ByteDance
ByteDance
Seedream 5.0 Pro
ByteDance
ByteDance
Seedream 5.0 Lite
ByteDance
ByteDance
Seedream 4.5
ByteDance
ByteDance
Seedream 4
ByteDance
ByteDance
Dreamactor V2
ByteDance
MiniMax
MiniMax H3
MiniMax
MiniMax
Minimax Music V2.6
MiniMax
MiniMax
Minimax Music V2
MiniMax
MiniMax
Speech-2.8-HD
MiniMax
MiniMax
Speech-2.8-Turbo
MiniMax
Kling AI
Kling V3
Kling AI
Kling AI
Kling V3 Pro
Kling AI
Kling AI
Kling V2.6 Pro
Kling AI
Kling AI
Kling V2.6
Kling AI
Kling AI
Kling O1
Kling AI
Midjourney
Midjourney V8.2
Midjourney
Midjourney
Midjourney V8.1
Midjourney
Midjourney
Midjourney
Midjourney
Alibaba
Happy Horse V1.1
Alibaba
Alibaba
Happy Horse
Alibaba
xAI
Grok Imagine V1.5
xAI
xAI
Grok Imagine
xAI
xAI
xAI TTS
xAI
Google
Veo 3.1
Google
Google
Veo 3.1 Fast
Google
Google
Veo 3
Google
Google
Nano Banana Pro
Google
Google
Nano Banana 2
Google
Google
Nano Banana
Google
Google
Lyria 3 Pro
Google
Google
Lyria 3
Google
Google
Lyria2
Google
Google
Gemini 3.1 Flash TTS
Google
Wan AI
Wan V3.0
Wan AI
Wan AI
Wan V2.2
Wan AI
Wan AI
Wan V2.2 Turbo
Wan AI
Wan AI
Wan V2.5
Wan AI
Wan AI
Wan V2.6
Wan AI
Wan AI
Wan V2.6 Flash
Wan AI
Wan AI
Wan V2.7
Wan AI
Pixverse AI
Pixverse V6
Pixverse AI
Pixverse AI
Pixverse V5.5
Pixverse AI
Pixverse AI
Pixverse V5
Pixverse AI
Vidu AI
Vidu Q3 Pro
Vidu AI
Vidu AI
Vidu Q3
Vidu AI
Vidu AI
Vidu Q3 Turbo
Vidu AI
Vidu AI
Vidu Q2 Pro
Vidu AI
Vidu AI
Vidu Q2 Turbo
Vidu AI
Luma AI
Luma Ray 2
Luma AI
Luma AI
Luma Ray 2 Flash
Luma AI
Flux AI
Flux 2 Pro
Flux AI
Flux AI
Flux 2
Flux AI
Flux AI
Flux 2 Flash
Flux AI
ElevenLabs
Multilingual V2
ElevenLabs
ElevenLabs
Sound Effects V2
ElevenLabs
Hailuo AI
Hailuo 2.3
Hailuo AI
Hailuo AI
Hailuo 2.3 Fast
Hailuo AI
Hailuo AI
Hailuo 02
Hailuo AI
Lightricks
LTX-2.3 Pro
Lightricks
Lightricks
LTX-2.3 Fast
Lightricks
Lightricks
LTX-2.3
Lightricks
Pika AI
Pika V2.2
Pika AI
Qwen
Qwen3-TTS
Qwen
Inworld
Inworld TTS
Inworld
Bilibili Index
Index TTS 2
Bilibili Index
Resemble AI
Chatterbox TTS Multilingual
Resemble AI
Open Source
ACE-Step
Open Source
Open Source
LUX TTS
Open Source
CassetteAI
Music Generator
CassetteAI
Recraft
Text to Vector V4.1
Recraft
Recraft
Text to Vector V4.1 Pro
Recraft
Recraft
Image to Vector
Recraft