Google

Gemini 3.1 Flash TTS

Le Gemini 3.1 Flash TTS de Google — synthèse vocale expressive avec 30 voix et contrôle du style.

Pas d'abonnement
Les crédits n'expirent jamais
En savoir plus

Payez une fois pour les crédits - utilisez-les sur tous les modèles de ZOOOP. · Rechargez quand vous en avez besoin, pas de brûlure mensuelle.

Powered by Google's API on ZOOOP

Caractéristiques clés

30 voix

Une bibliothèque de 30 voix nommées — de Kore et Puck à Zephyr et Achernar — couvrant un large éventail de tons et de personnages.

Instructions de style

Ajoutez une instruction de style séparée pour orienter la livraison — rythme, ton et émotion — au-delà des mots eux-mêmes.

Lignée Google Gemini

Construit sur les modèles vocaux Gemini de Google pour une sortie naturelle et expressive.

Facturation par tranche de 1 000 caractères

Facturé par longueur de texte, le coût augmente proportionnellement à la taille du script.

Cas d'utilisation

Narration et voix off

Narration et voix off

Générez une narration claire et expressive pour les vidéos, explications et présentations.

Livraison dirigée par le style

Livraison dirigée par le style

Utilisez les instructions de style pour définir une lecture dynamique, calme ou dramatique à partir du même texte.

Voix de personnages

Voix de personnages

Choisissez parmi 30 voix pour donner à différents personnages des livraisons distinctes.

Piloter un avatar parlant

Piloter un avatar parlant

Générez la voix, puis pilotez un modèle d'avatar comme Kling Avatar V2 avec.

Audio e-learning

Audio e-learning

Produisez une narration de cours cohérente sur de nombreuses leçons.

Podcast et contenu audio

Podcast et contenu audio

Générez des segments parlés et des intros avec une voix et un style choisis.

Choisissez le bon modèle

Choisissez le bon modèle vocal. Vos crédits fonctionnent partout sur ZOOOP.

TTS expressif avec contrôle du styleGemini 3.1 Flash TTS
Voix off phare ElevenLabsMultilingual V3
TTS multilingue, QwenQwen3-TTS
TTS pas cher, nombreuses voixInworld TTS
Piloter un avatar parlantKling Avatar V2
Effets sonores et ambianceSound Effects V2

Comment utiliser

01

Ouvrez Gemini 3.1 Flash TTS depuis cette page ou sélectionnez-le dans les outils Audio.

02

Collez votre texte et choisissez une voix.

03

Ajoutez une instruction de style pour orienter la livraison si nécessaire.

04

Générez, puis téléchargez ou envoyez l'audio sur votre canvas.

Plongée profonde

Ce que Gemini 3.1 Flash TTS fait bien — et ce qu'il fait moins bien

Gemini 3.1 Flash TTS est le modèle de synthèse vocale expressive de Google, construit sur la lignée vocale Gemini. Ses deux forces distinctives sont une bibliothèque de 30 voix nommées — Kore, Puck, Zephyr, Achernar et plus, couvrant un large éventail de tons et de personnages — et un champ d'instruction de style séparé qui vous permet de diriger la livraison. Le même script peut être lu de manière dynamique, calme ou dramatique selon l'instruction, ce qui offre un contrôle plus fin que le choix d'une voix seule.

La facturation est par tranche de 1 000 caractères, le coût augmente proportionnellement à la longueur du script — prévisible pour tout, d'une courte voix off à une narration complète. C'est un appariement naturel pour le travail d'avatar parlant : générez la voix ici, puis pilotez un modèle comme Kling Avatar V2 avec.

Parmi les modèles vocaux de ZOOOP : Multilingual V3 est le phare d'ElevenLabs avec un contrôle vocal approfondi ; Qwen3-TTS et Inworld TTS mènent en couverture multilingue et en valeur. Le point fort de Gemini 3.1 Flash TTS est la narration expressive et dirigée par le style avec les voix de Google.

Un modèle mental raisonnable : par défaut avec Gemini 3.1 Flash TTS quand vous voulez une narration expressive avec un contrôle explicite du style, et passez à Multilingual V3 pour la bibliothèque vocale d'ElevenLabs ou Inworld/Qwen pour une large couverture multilingue.

Questions fréquemment posées

Combien de voix possède Gemini 3.1 Flash TTS ?+

30 voix nommées couvrant un large éventail de tons et de personnages.

Que sont les instructions de style ?+

Un champ séparé pour diriger la livraison — rythme, ton, émotion — pour que le même texte puisse être lu de manière dynamique, calme ou dramatique.

Comment est-il facturé ?+

Par tranche de 1 000 caractères de texte, le coût augmente avec la longueur du script.

Comment se compare-t-il à ElevenLabs Multilingual V3 ?+

Les deux sont des TTS de haute qualité. Gemini 3.1 Flash TTS offre les voix de Google avec des instructions de style ; Multilingual V3 est le phare d'ElevenLabs avec un contrôle vocal approfondi. Choisissez selon la préférence vocale et le workflow.

Plus de modèles

ElevenLabs
Multilingual V3
ElevenLabs
Qwen
Qwen3-TTS
Qwen
Inworld
Inworld TTS
Inworld
Kling AI
Kling Avatar V2
Kling AI
OpenAI
GPT Image 2.5
OpenAI
OpenAI
GPT Image 2.0
OpenAI
ByteDance
Seedance V2.0
ByteDance
ByteDance
Seedance V2.0 Fast
ByteDance
ByteDance
Seedance V1.5 Pro
ByteDance
ByteDance
Seedance V1.0 Pro
ByteDance
ByteDance
Seedance V1.0 Pro Fast
ByteDance
ByteDance
Seedance V1.0 Lite
ByteDance
ByteDance
Seedream 5.0 Pro
ByteDance
ByteDance
Seedream 5.0 Lite
ByteDance
ByteDance
Seedream 4.5
ByteDance
ByteDance
Seedream 4
ByteDance
ByteDance
Dreamactor V2
ByteDance
MiniMax
MiniMax H3
MiniMax
MiniMax
Minimax Music V2.6
MiniMax
MiniMax
Minimax Music V2
MiniMax
MiniMax
Speech-2.8-HD
MiniMax
MiniMax
Speech-2.8-Turbo
MiniMax
Kling AI
Kling O3
Kling AI
Kling AI
Kling V3
Kling AI
Kling AI
Kling V3 Pro
Kling AI
Kling AI
Kling V2.6 Pro
Kling AI
Kling AI
Kling V2.6
Kling AI
Kling AI
Kling Lipsync
Kling AI
Kling AI
Kling O1
Kling AI
Midjourney
Midjourney V8.2
Midjourney
Midjourney
Midjourney V8.1
Midjourney
Midjourney
Midjourney
Midjourney
Alibaba
Happy Horse V1.1
Alibaba
Alibaba
Happy Horse
Alibaba
xAI
Grok Imagine V1.5
xAI
xAI
Grok Imagine
xAI
xAI
xAI TTS
xAI
Google
Veo 3.1
Google
Google
Veo 3.1 Fast
Google
Google
Veo 3
Google
Google
Nano Banana Pro
Google
Google
Nano Banana 2
Google
Google
Nano Banana
Google
Google
Lyria 3 Pro
Google
Google
Lyria 3
Google
Google
Lyria2
Google
Wan AI
Wan V3.0
Wan AI
Wan AI
Wan V2.2
Wan AI
Wan AI
Wan V2.2 Turbo
Wan AI
Wan AI
Wan V2.5
Wan AI
Wan AI
Wan V2.6
Wan AI
Wan AI
Wan V2.6 Flash
Wan AI
Wan AI
Wan V2.7
Wan AI
Pixverse AI
Pixverse V6
Pixverse AI
Pixverse AI
Pixverse V5.5
Pixverse AI
Pixverse AI
Pixverse V5
Pixverse AI
Pixverse AI
Pixverse Lipsync
Pixverse AI
Vidu AI
Vidu Q3 Pro
Vidu AI
Vidu AI
Vidu Q3
Vidu AI
Vidu AI
Vidu Q3 Turbo
Vidu AI
Vidu AI
Vidu Q2 Pro
Vidu AI
Vidu AI
Vidu Q2 Turbo
Vidu AI
Luma AI
Luma Ray 2
Luma AI
Luma AI
Luma Ray 2 Flash
Luma AI
Flux AI
Flux 2 Pro
Flux AI
Flux AI
Flux 2
Flux AI
Flux AI
Flux 2 Flash
Flux AI
ElevenLabs
Multilingual V2
ElevenLabs
ElevenLabs
Sound Effects V2
ElevenLabs
Hailuo AI
Hailuo 2.3
Hailuo AI
Hailuo AI
Hailuo 2.3 Fast
Hailuo AI
Hailuo AI
Hailuo 02
Hailuo AI
Lightricks
LTX-2.3 Pro
Lightricks
Lightricks
LTX-2.3 Fast
Lightricks
Lightricks
LTX-2.3
Lightricks
Pika AI
Pika V2.2
Pika AI
Bilibili Index
Index TTS 2
Bilibili Index
Resemble AI
Chatterbox TTS Multilingual
Resemble AI
Open Source
ACE-Step
Open Source
Open Source
LUX TTS
Open Source
CassetteAI
Music Generator
CassetteAI
Recraft
Text to Vector V4.1
Recraft
Recraft
Text to Vector V4.1 Pro
Recraft
Recraft
Image to Vector
Recraft