Google

Gemini 3.1 Flash TTS

O Gemini 3.1 Flash TTS da Google — síntese de voz expressiva com 30 vozes e controle de estilo.

Sem assinatura
Os créditos nunca expiram
Saiba mais

Pague uma vez por créditos e use-os em todos os modelos em ZOOOP. · Recarregue quando precisar, sem queima mensal.

Powered by Google's API on ZOOOP

Principais características

30 vozes

Uma biblioteca de 30 vozes com nome — de Kore e Puck a Zephyr e Achernar — cobrindo uma vasta gama de tons e personagens.

Instruções de estilo

Adicione uma instrução de estilo separada para orientar a entrega — ritmo, tom e emoção — para além das próprias palavras.

Linhagem Google Gemini

Construído sobre os modelos de voz Gemini da Google para uma saída natural e expressiva.

Faturação por 1.000 caracteres

Faturado por comprimento de texto, os custos escalam com o tamanho do roteiro.

Casos de uso

Narração e voz over

Narração e voz over

Gere narração clara e expressiva para vídeos, explicações e apresentações.

Entrega orientada por estilo

Entrega orientada por estilo

Use instruções de estilo para definir uma leitura animada, calma ou dramática a partir do mesmo texto.

Vozes de personagens

Vozes de personagens

Escolha entre 30 vozes para dar a diferentes personagens entregas distintas.

Conduzir um avatar falante

Conduzir um avatar falante

Gere a voz, depois conduza um modelo de avatar como o Kling Avatar V2 com ela.

Áudio e-learning

Áudio e-learning

Produza narração de curso consistente ao longo de muitas lições.

Podcast e conteúdo áudio

Podcast e conteúdo áudio

Gere segmentos falados e intros com uma voz e estilo escolhidos.

Escolha o modelo certo

Escolha o modelo de voz certo. Os seus créditos funcionam em todo o ZOOOP.

TTS expressivo com controle de estiloGemini 3.1 Flash TTS
Voz over carro-chefe ElevenLabsMultilingual V3
TTS multilíngue, QwenQwen3-TTS
TTS barato, muitas vozesInworld TTS
Conduzir um avatar falanteKling Avatar V2
Efeitos sonoros e ambienteSound Effects V2

Como usar

01

Abra o Gemini 3.1 Flash TTS a partir desta página ou selecione-o nas ferramentas de Áudio.

02

Cole o seu texto e escolha uma voz.

03

Adicione uma instrução de estilo para orientar a entrega se necessário.

04

Gere, depois baixe ou envie o áudio para a tela.

Mergulho profundo

O que o Gemini 3.1 Flash TTS faz bem — e o que não faz

O Gemini 3.1 Flash TTS é o modelo de síntese de voz expressiva da Google, construído sobre a linhagem de voz Gemini. As suas duas forças distintivas são uma biblioteca de 30 vozes com nome — Kore, Puck, Zephyr, Achernar e mais, cobrindo uma vasta gama de tons e personagens — e um campo de instrução de estilo separado que lhe permite orientar a entrega. O mesmo roteiro pode ser lido de forma animada, calma ou dramática dependendo da instrução, o que oferece controle mais fino do que escolher apenas uma voz.

A faturação é por 1.000 caracteres, os custos escalam proporcionalmente ao comprimento do roteiro — previsível para tudo, desde uma curta voz over até uma narração completa. É um emparelhamento natural para trabalho de avatar falante: gere a voz aqui, depois conduza um modelo como o Kling Avatar V2 com ela.

Entre os modelos de voz do ZOOOP: o Multilingual V3 é o carro-chefe da ElevenLabs com controle profundo de voz; o Qwen3-TTS e o Inworld TTS lideram em cobertura multilíngue e valor. O ponto forte do Gemini 3.1 Flash TTS é a narração expressiva e orientada por estilo com as vozes da Google.

Um modelo mental razoável: use o Gemini 3.1 Flash TTS por padrão quando quer narração expressiva com controle explícito de estilo, e mude para o Multilingual V3 para a biblioteca de vozes da ElevenLabs ou Inworld/Qwen para ampla cobertura multilíngue.

Perguntas frequentes

Quantas vozes tem o Gemini 3.1 Flash TTS?+

30 vozes com nome cobrindo uma vasta gama de tons e personagens.

O que são instruções de estilo?+

Um campo separado para orientar a entrega — ritmo, tom, emoção — para que o mesmo texto possa ser lido de forma animada, calma ou dramática.

Como é faturado?+

Por 1.000 caracteres de texto, os custos escalam com o comprimento do roteiro.

Como se compara ao ElevenLabs Multilingual V3?+

Ambos são TTS de alta qualidade. O Gemini 3.1 Flash TTS oferece as vozes da Google com instruções de estilo; o Multilingual V3 é o carro-chefe da ElevenLabs com controle profundo de voz. Escolha pela preferência de voz e workflow.

Mais modelos

ElevenLabs
Multilingual V3
ElevenLabs
Qwen
Qwen3-TTS
Qwen
Inworld
Inworld TTS
Inworld
Kling AI
Kling Avatar V2
Kling AI
OpenAI
GPT Image 2.5
OpenAI
OpenAI
GPT Image 2.0
OpenAI
ByteDance
Seedance V2.0
ByteDance
ByteDance
Seedance V2.0 Fast
ByteDance
ByteDance
Seedance V1.5 Pro
ByteDance
ByteDance
Seedance V1.0 Pro
ByteDance
ByteDance
Seedance V1.0 Pro Fast
ByteDance
ByteDance
Seedance V1.0 Lite
ByteDance
ByteDance
Seedream 5.0 Pro
ByteDance
ByteDance
Seedream 5.0 Lite
ByteDance
ByteDance
Seedream 4.5
ByteDance
ByteDance
Seedream 4
ByteDance
ByteDance
Dreamactor V2
ByteDance
MiniMax
MiniMax H3
MiniMax
MiniMax
Minimax Music V2.6
MiniMax
MiniMax
Minimax Music V2
MiniMax
MiniMax
Speech-2.8-HD
MiniMax
MiniMax
Speech-2.8-Turbo
MiniMax
Kling AI
Kling O3
Kling AI
Kling AI
Kling V3
Kling AI
Kling AI
Kling V3 Pro
Kling AI
Kling AI
Kling V2.6 Pro
Kling AI
Kling AI
Kling V2.6
Kling AI
Kling AI
Kling Lipsync
Kling AI
Kling AI
Kling O1
Kling AI
Midjourney
Midjourney V8.2
Midjourney
Midjourney
Midjourney V8.1
Midjourney
Midjourney
Midjourney
Midjourney
Alibaba
Happy Horse V1.1
Alibaba
Alibaba
Happy Horse
Alibaba
xAI
Grok Imagine V1.5
xAI
xAI
Grok Imagine
xAI
xAI
xAI TTS
xAI
Google
Veo 3.1
Google
Google
Veo 3.1 Fast
Google
Google
Veo 3
Google
Google
Nano Banana Pro
Google
Google
Nano Banana 2
Google
Google
Nano Banana
Google
Google
Lyria 3 Pro
Google
Google
Lyria 3
Google
Google
Lyria2
Google
Wan AI
Wan V3.0
Wan AI
Wan AI
Wan V2.2
Wan AI
Wan AI
Wan V2.2 Turbo
Wan AI
Wan AI
Wan V2.5
Wan AI
Wan AI
Wan V2.6
Wan AI
Wan AI
Wan V2.6 Flash
Wan AI
Wan AI
Wan V2.7
Wan AI
Pixverse AI
Pixverse V6
Pixverse AI
Pixverse AI
Pixverse V5.5
Pixverse AI
Pixverse AI
Pixverse V5
Pixverse AI
Pixverse AI
Pixverse Lipsync
Pixverse AI
Vidu AI
Vidu Q3 Pro
Vidu AI
Vidu AI
Vidu Q3
Vidu AI
Vidu AI
Vidu Q3 Turbo
Vidu AI
Vidu AI
Vidu Q2 Pro
Vidu AI
Vidu AI
Vidu Q2 Turbo
Vidu AI
Luma AI
Luma Ray 2
Luma AI
Luma AI
Luma Ray 2 Flash
Luma AI
Flux AI
Flux 2 Pro
Flux AI
Flux AI
Flux 2
Flux AI
Flux AI
Flux 2 Flash
Flux AI
ElevenLabs
Multilingual V2
ElevenLabs
ElevenLabs
Sound Effects V2
ElevenLabs
Hailuo AI
Hailuo 2.3
Hailuo AI
Hailuo AI
Hailuo 2.3 Fast
Hailuo AI
Hailuo AI
Hailuo 02
Hailuo AI
Lightricks
LTX-2.3 Pro
Lightricks
Lightricks
LTX-2.3 Fast
Lightricks
Lightricks
LTX-2.3
Lightricks
Pika AI
Pika V2.2
Pika AI
Bilibili Index
Index TTS 2
Bilibili Index
Resemble AI
Chatterbox TTS Multilingual
Resemble AI
Open Source
ACE-Step
Open Source
Open Source
LUX TTS
Open Source
CassetteAI
Music Generator
CassetteAI
Recraft
Text to Vector V4.1
Recraft
Recraft
Text to Vector V4.1 Pro
Recraft
Recraft
Image to Vector
Recraft