Trois nouveaux modèles Flash taillés pour les agents à grande échelle
La gamme Gemini Flash s'agrandit pour réduire les coûts de calcul des agents. Analyse des tarifs et des performances de ces trois nouveaux modèles.
Pensée pour faire tourner des agents à grande échelle plutôt que pour le raisonnement de pointe, la série Flash de Gemini accueille trois modèles aux rôles distincts.
Gemini 3.6 Flash fait office de cheval de bataille. Il progresse sur le code comme sur les tâches documentaires et multimodales, tout en consommant, selon l'Artificial Analysis Index, environ 17 % de tokens de sortie en moins que 3.5 Flash, avec moins d'étapes de raisonnement et d'appels d'outils. Son tarif passe aussi sous celui de son prédécesseur, à 1,50 dollar le million de tokens en entrée et 7,50 dollars en sortie, ce qui abaisse le coût par tâche agentique.
Gemini 3.5 Flash-Lite vise le volume. Présenté comme le plus rapide de la classe 3.5, il est mesuré à 350 tokens de sortie par seconde par la même source, pour 0,30 dollar en entrée et 2,50 dollars en sortie. Son terrain est la recherche agentique et le traitement de documents en flux tendu, avec le computer use désormais intégré comme outil natif.
Le troisième, Gemini 3.5 Flash Cyber, se spécialise dans la détection et la correction de vulnérabilités, greffé sur l'agent CodeMender où plusieurs instances collaborent pour produire un rapport unique. Compte tenu de son caractère à double usage, Google en réserve l'accès aux États et à des partenaires de confiance, via un programme pilote fermé.
En parallèle, la version 3.5 Pro est en test chez des partenaires, et Google indique avoir lancé l'entraînement de Gemini 4, qu'il présente comme son cycle de pré-entraînement le plus ambitieux à ce jour.