Lecture · veille du 16 septembre 2026
Gemini 3.8 Live et 3.8 Live Extended Thinking lancés
Google DeepMind Blog Publié le 15 septembre 2026 à 17:05 Angle commercial Article en anglais pertinence 4 sur 5
Lire l'article original sur Google DeepMind Blog, dans une nouvelle fenêtre
Google DeepMind présente Gemini 3.8 Live et 3.8 Live Extended Thinking, deux nouveaux modèles d’IA conversationnelle axés sur le raisonnement en temps réel.
- Gemini 3.8 Live est conçu pour l'efficacité et la scalabilité, combinant intelligence conversationnelle avec une base visuelle.
- Gemini 3.8 Live Extended Thinking est optimisé pour les tâches complexes nécessitant un raisonnement multi-étapes.
- Ces modèles ont obtenu des résultats exceptionnels sur l'index de qualité Speech to Speech (82.6) et surpassent la concurrence en termes d’achèvement de tâches agentiques.
- Gemini 3.8 Live peut traiter les entrées visuelles en temps quasi réel et gère automatiquement plusieurs langues pendant une conversation.
- Gemini 3.8 Live Extended Thinking utilise des signaux verbaux pour reconnaître les prompts et fournit une narration en direct des étapes de travail en arrière-plan.
- SynthID est utilisé pour marquer tous les contenus audio générés par l'IA afin d'éviter la diffusion de fausses informations.
Google DeepMind a lancé deux nouveaux modèles d’IA conversationnelle, Gemini 3.8 Live et 3.8 Live Extended Thinking, conçus pour améliorer les interactions en temps réel avec l’intelligence artificielle. Ces modèles visent à rendre la conversation avec l'IA plus intuitive et efficace, notamment dans le contexte des agents vocaux.
Gemini 3.8 Live est axé sur la performance et l'efficacité, capable de gérer des tâches complexes grâce à sa capacité à combiner intelligence conversationnelle et compréhension visuelle. Il a démontré une grande efficacité en termes de qualité de la parole et d’achèvement de tâches agentiques, surpassant les modèles concurrents.
Gemini 3.8 Live Extended Thinking se distingue par sa capacité à effectuer un raisonnement plus approfondi et complexe, tout en maintenant une conversation fluide. Il est disponible via l'API Gemini et Google AI Studio, ainsi que pour les entreprises via des plateformes partenaires comme Salesforce et Lumeris.
Pour lutter contre la désinformation, tous les contenus audio générés par ces modèles sont marqués avec SynthID, un watermark imperceptible garantissant la traçabilité de l’origine de l'audio.
Mots-clés : GeminiDeepMindIA
Transparence : synthèse en français produite automatiquement par un modèle de langage local (gemma3:4b (Ollama, local sur le VPS)), non révisée. Le texte intégral reste chez l'éditeur d'origine.