Google lance Gemini 3.8 Flash TTS et Flash-Lite TTS, deux modèles de synthèse vocale
2 sourcesmis à jour 23 sept.pertinence 3,3 sur5
L’essentiel
Flash TTS crée des voix par prompt, Flash-Lite TTS vise les gros volumes. Ils sont disponibles dans l’API Gemini et Google AI Studio, et prennent en charge plus de 100 langues. Chaque extrait audio reçoit un filigrane SynthID.
Couverture
- Sources
- 2
- Articles
- 2
- Par type (sources)
- Officiel 1Analyse 1
- Par rôle (articles)
- Primaire 1Analyse 1
Propagation2 articles en 1 h 47, de Google DeepMind à Simon Willison.
Les sources
2 articles, du plus ancien au plus récent
Google DeepMindOfficiel : fiche de la sourceSource primairePremier
Google DeepMind (Google, Alphabet)Leland Rechisblog.google
Gemini 3.8 text-to-speech says hello (site externe)
Gemini 3.8 Flash TTS and Gemini 3.8 Flash-Lite TTS are our most expressive audio generation models yet. Generate custom character voices and direct scene dialogue across Google AI Studio, Gemini API, Gemini Enterprise, Gemini Notebook, and Google Vids.
Simon WillisonAnalyse : fiche de la source+ 1 h 47
Simon Willison, développeur indépendant (créateur de Datasette, co-créateur de Django)simonwillison.net
Gemini 3.8 TTS Playground (site externe)
Test and experiment with Google’s Gemini 3.8 text-to-speech API through an interactive playground where you can compose single-voice narration or multi-speaker conversations, preview the generated audio, and explore request and response details.
Sur les mêmes thèmes
Modèles
Google DeepMind annonce Gemini 4 Argon, déployé d’abord auprès de défenseurs cyber de confiance via Fairwind
Modèles
OpenAI lance GPT-6 Sol et GPT-6 Luna, deux modèles plus économiques qui complètent GPT-6 Astra
Modèles
Anthropic publie Claude Opus 5.5 et OpenAI lance GPT-6 Sol et GPT-6 Luna à environ une heure d’écart
Modèles
Anthropic lance Claude Sonnet 5.5, deuxième modèle de la famille Claude 5.5
À lire ensuite
Sécurité
OpenAI reconnaît que ses agents d’IA ont pu perturber les sites de dizaines d’institutions
Modèles
Mistral AI présente Mistral Large 4, disponible en préversion via son API
Modèles
Xiaomi publie MiMo-V2.6-Pro, un modèle open-weights omnimodal de 1 000 milliards de paramètres
Modèles
TypeSafe AI lance Jev, un modèle « System One » qui renvoie des décisions typées et non du texte