[I/O 2026] Gemini 3.5 inaugure l'ère des modèles agentiques chez Google
Google lance Gemini 3.5 Flash, son premier modèle agentique qui surpasse Gemini 3.1 Pro en codage et s'intègre à l'application Gemini et à Google Search.
Avec Gemini 3.5, Google ouvre sa première famille de modèles pensée nativement pour l'agentic AI : des systèmes qui raisonnent, planifient et agissent de façon autonome sur des tâches longues et complexes, au-delà de la simple réponse.
La série démarre avec Gemini 3.5 Flash, présenté comme le modèle le plus puissant de la lignée Flash à ce jour. Il dépasse le précédent Gemini 3.1 Pro sur les tests les plus exigeants en codage et en tâches agentiques : Terminal-Bench 2.1 → 76,2 % (contre 70,3 % pour 3.1 Pro) MCP Atlas (multi-step workflows avec outils) → 83,6 % (contre 78,2 %) CharXiv Reasoning (compréhension multimodale avancée) → 84,2 %
Google revendique par ailleurs un débit quatre fois supérieur aux autres modèles frontier en tokens de sortie par seconde, pour un coût souvent réduit de moitié.
Le modèle devient dès maintenant la version par défaut de l'application Gemini et du mode IA de Google Search à l'échelle mondiale, et alimente Gemini Spark, l'agent personnel qui tourne en continu sur des machines virtuelles Google Cloud. Développeurs et entreprises y accèdent via Antigravity, l'API Gemini dans AI Studio, Android Studio et Gemini Enterprise. La version 3.5 Pro, déjà employée en interne, est attendue le mois prochain. Toute la famille a été entraînée et évaluée selon le Frontier Safety Framework maison, avec un renforcement des protections en cybersécurité et sur les risques CBRN (chimique, biologique, radiologique et nucléaire), une réduction des refus abusifs sur les requêtes légitimes et des outils d'interprétabilité capables d'inspecter le raisonnement interne avant les réponses sensibles.
L'expérience Gemini est par la même occasion entièrement repensée à travers un nouveau langage visuel baptisé Neural Expressive : animations fluides, couleurs vives, typographie inédite et retours haptiques. Le mode conversationnel Gemini Live se trouve désormais intégré directement à Gemini, ce qui permet de passer d'une question tapée à un échange parlé continu sans rupture, le micro ayant été revu pour dérouler une idée complexe à son rythme sans être coupé. Des dialectes régionaux et un choix de voix sont prévus prochainement. Les réponses, enfin, sont mises en forme en temps réel avec images, frises interactives, vidéos commentées et graphiques dynamiques plutôt qu'un bloc de texte.
Neural Expressive se déploie dès aujourd'hui sur le Web, Android et iOS.