Gemini 3.5 Flash est disponible depuis le 19 mai 2026. Lancé au Google I/O, ce modèle surpasse l’ancien flagship Gemini 3.1 Pro sur les benchmarks tout en restant quatre fois plus rapide.
Quand le modèle rapide bat le modèle premium
Dans l’univers des grands modèles de langage, les appellations comptent. Les variantes « Flash » ont longtemps désigné des modèles allégés, pensés pour la vitesse au détriment de la qualité. Gemini 3.5 Flash renverse cette logique : Google revendique des performances qui rivalisent avec de grands modèles flagship sur plusieurs dimensions, tout en conservant la rapidité d’exécution caractéristique de la gamme Flash.
Dans son billet de blog officiel publié le 19 mai 2026 et intitulé « Gemini 3.5: frontier intelligence with action », Google présente ce nouveau modèle comme un tournant majeur dans le développement d’agents IA plus capables et plus intelligents. La formulation n’est pas anodine : il ne s’agit plus seulement de répondre à des questions, mais d’exécuter des tâches complexes de manière autonome.
Des benchmarks qui situent le modèle dans la compétition
Sur les évaluations qui comptent pour les cas d’usage agentiques, Gemini 3.5 Flash dépasse Gemini 3.1 Pro sur plusieurs indicateurs clés : Terminal-Bench 2.1 (76,2 %), GDPval-AA (1 656 points Elo) et MCP Atlas (83,6 %). Pour la compréhension multimodale, il obtient 84,2 % sur CharXiv Reasoning.
D’autres tests partagés par Google révèlent 90,4 % sur GPQA Diamond, un benchmark qui évalue le raisonnement scientifique de niveau doctoral, ainsi que 81,2 % sur MMMU-Pro pour les tâches de compréhension multimodale. En matière de développement logiciel, Gemini 3.5 Flash atteint 78 % sur SWE-bench Verified.
Il convient cependant de contextualiser ces chiffres. Au mois de mai 2026, GPT-5.5 devance Gemini sur plusieurs benchmarks agentiques, et Claude Opus 4.7 conserve une avance sur certains tests de programmation, notamment SWE-bench Verified, avec le taux d’hallucination le plus faible des trois. L’avantage de Gemini 3.5 Flash se situe donc clairement sur le rapport vitesse/prix à qualité quasi-flagship, et non sur une domination absolue du marché.
La vitesse comme argument central
Gemini 3.5 Flash produit des tokens de sortie quatre fois plus vite que les autres modèles frontier de référence, ce qui en fait le moteur haute cadence nécessaire aux workflows agentiques réels. Dans la pratique, cette performance se traduit par une capacité à traiter des tâches qui prenaient des jours à un développeur ou des semaines à un auditeur en une fraction du temps.
Google DeepMind souligne que le modèle atteint ce niveau de performance grâce à une co-conception spécifique entre le modèle et l’infrastructure matérielle, ce qui permet d’entraîner des capacités de raisonnement plus profondes plus efficacement à chaque nouvelle génération. Sur le plan économique, les tarifs pour les développeurs s’établissent à 1,50 dollar par million de tokens en entrée et 9,00 dollars par million de tokens en sortie via l’API, soit environ 40 % de moins que Gemini 3.1 Pro.
Une disponibilité immédiate sur tous les canaux
Dès ce 19 mai 2026, Gemini 3.5 Flash est accessible à des milliards d’utilisateurs dans le monde : via l’application Gemini et le mode IA de Google Search pour le grand public, dans Google Antigravity et l’API Gemini pour les développeurs, et au travers de la plateforme Gemini Enterprise Agent Platform pour les entreprises.
Pour les développeurs en particulier, Google Antigravity 2.0, une application desktop autonome, permet désormais de déployer des agents collaboratifs capables d’exécuter des workflows et des tâches de programmation simultanément sous supervision humaine. Une API dite « Managed Agents » simplifie encore le déploiement : un seul appel API suffit désormais pour lancer un agent capable de raisonner, d’utiliser des outils et d’exécuter du code dans un environnement Linux isolé.
Les retours de partenaires intégrés sur la page officielle de Google DeepMind illustrent ce potentiel. Box indique que Gemini 3.5 Flash surpasse Gemini 3 Flash de 19,6 % sur son propre jeu d’évaluation interne, et que ses clients dans les sciences de la vie constatent une amélioration de 96,4 % en précision d’extraction de données scientifiques.
Gemini Spark, le premier agent bénéficiaire
Gemini 3.5 Flash ne se déploie pas uniquement dans des outils pour développeurs. Google l’utilise pour alimenter Gemini Spark, un agent IA personnel fonctionnant 24 heures sur 24 et 7 jours sur 7, qui prend des actions pour le compte de l’utilisateur dans sa vie numérique quotidienne.
Spark est conçu pour automatiser des tâches récurrentes, notamment l’analyse des relevés de carte bancaire pour détecter des frais cachés, la surveillance des boîtes mail pour signaler des mises à jour importantes, ou la gestion de workflows à travers les applications Google Workspace comme Gmail, Docs et Slides. Il s’intégrera également à des services tiers comme Canva, OpenTable et Instacart. Gemini Spark est en cours de déploiement auprès d’un groupe de testeurs de confiance ce jour, avec une version bêta plus large prévue pour les abonnés Google AI Ultra aux États-Unis la semaine prochaine.
Gemini 3.5 Pro : le modèle qui se fait attendre
Le lancement du 19 mai marque aussi une absence remarquée. Google confirme travailler activement sur Gemini 3.5 Pro, déjà utilisé en interne, avec un déploiement prévu le mois prochain. Lors de la keynote du Google I/O 2026, Sundar Pichai a déclaré à l’adresse du public : « Je sais que vous avez hâte de l’avoir entre les mains. Donnez-nous jusqu’au mois prochain pour vous le remettre », (I know you can’t wait to get your hands on it. Give us until next month to get it to you.) selon les informations rapportées par Business Insider, qui précise que la nouvelle a suscité des réactions audibles dans la salle.
Sur les benchmarks de raisonnement pur les plus exigeants, Gemini 3.1 Pro demeure pour l’instant la meilleure option disponible dans la gamme Google. La version Pro du modèle 3.5, attendue en juin 2026, devrait combler cet écart résiduel.
Google franchit avec Gemini 3.5 Flash une étape symbolique : les modèles rapides ne sont plus des alternatives au rabais, mais des concurrents directs des flagships. Pour les utilisateurs grand public, le changement est transparent, l’application Gemini basculant automatiquement sur ce nouveau moteur. Pour les développeurs, le vrai intérêt réside dans la combinaison du modèle avec Google Antigravity 2.0 et les Managed Agents, qui ouvrent la voie à des pipelines agentiques jusqu’ici trop coûteux ou trop lents à déployer à grande échelle. La prochaine étape, avec Gemini 3.5 Pro prévu en juin, sera de déterminer si Google peut répliquer cette équation gagnante à un niveau de raisonnement encore plus élevé.




No Comment! Be the first one.