{DevDay 2026} GPT-6.1 Sol se rapproche d’Astra sans reprendre ses tarifs
GPT-6.1 Sol améliore les performances de GPT-6 Sol en programmation agentique, Computer Use, travail professionnel et recherche scientifique. OpenAI conserve un tarif de 2 dollars par million de tokens en entrée et 10 dollars en sortie, soit un cinquième des tarifs standards de GPT-6 Astra.
L’écart avec Astra se réduit
Entre le modèle quotidien et le modèle de pointe, OpenAI resserre les écarts. GPT-6.1 Sol reprend le positionnement tarifaire de Sol tout en se rapprochant de GPT-6 Astra sur plusieurs évaluations consacrées aux tâches agentiques et professionnelles.
Les tarifs API standards restent fixés à 2 dollars par million de tokens en entrée et 10 dollars en sortie. L’entrée mise en cache descend à 0,10 dollar par million de tokens, soit 95 % de moins que l’entrée standard.
À titre de comparaison, GPT-6 Astra est facturé 10 dollars par million de tokens en entrée et 50 dollars en sortie. GPT-6.1 Sol se situe donc à un cinquième de ces deux tarifs standards, sans qu’OpenAI le positionne pour autant comme son modèle le plus performant. Le code agentique rejoint Astra sur DeepSWE
Sur DeepSWE v1.1, une évaluation consacrée aux tâches d’ingénierie logicielle de longue durée réalisées dans de véritables bases de code, GPT-6.1 Sol égale le score de GPT-6 Astra dans les tests d’OpenAI pour environ un cinquième du coût par tâche.
Le modèle dépasse également le meilleur résultat de GPT-6 Sol de 6,4 points de pourcentage, avec un niveau de raisonnement et un coût inférieurs.
Cette progression s’étend aux workflows professionnels. Sur AutomationBench 1.0.6, où les agents utilisent 47 outils pour accomplir des processus complets en vente, marketing, opérations, support, finance et ressources humaines, GPT-6.1 Sol dépasse GPT-6 Sol de 4,8 points avec le même réglage de raisonnement.
OpenAI rapporte également un avantage de 2,2 points sur Opus 5.5 avec solutions de repli à effort moyen, pour environ un tiers du coût par tâche. Les PDF complexes entrent dans l’équation
GDP.pdf mesure la capacité des modèles à répondre à des questions professionnelles à partir de PDF comprenant tableaux, graphiques, schémas et informations en petits caractères dans dix domaines, dont la finance, la santé et le droit.
Dans les évaluations publiées par OpenAI, GPT-6.1 Sol dépasse Opus 5.5 avec solutions de repli pour moins de la moitié du coût par tâche sur l’ensemble des niveaux de raisonnement testés.
Ses résultats se rapprochent également de GPT-6 Astra pour environ un cinquième du coût par tâche. À 2,1 points d’Astra sur Computer Use
Les interactions avec des applications progressent également. Sur le jeu hors ligne d’OSWorld 2.0, GPT-6.1 Sol gagne sept points par rapport à GPT-6 Sol avec le niveau de raisonnement maximal, tout en coûtant moins de la moitié par tâche.
À ce même niveau d’effort, il reste à 2,1 points du résultat obtenu par GPT-6 Astra, pour environ un septième de son coût par tâche selon OpenAI.
L’évaluation porte sur des workflows de longue durée réalisés directement dans des environnements informatiques, couvrant aussi bien des tâches quotidiennes que professionnelles. La recherche scientifique reste dominée par Astra
L’écart reste plus visible sur les travaux scientifiques les plus difficiles. Terminal-Bench Science 0.1 teste des agents sur des tâches comprenant analyse de données, simulations, ajustement de modèles et démonstration de théorèmes à l’aide de code et d’outils en ligne de commande.
GPT-6.1 Sol fait plus que doubler le score de GPT-6 Sol au niveau de raisonnement maximal. OpenAI chiffre alors son coût moyen à 5,47 dollars par tâche, contre 23,21 dollars pour Opus 5.5 et 23,80 dollars pour GPT-6 Astra.
Astra conserve toutefois le meilleur résultat de cette comparaison avec 68,1 %, et reste le modèle recommandé par OpenAI pour ses tâches de recherche scientifique les plus exigeantes. 4,1 % d’erreurs sur une évaluation volontairement difficile
OpenAI mesure également l’exactitude factuelle à partir de conversations ChatGPT dé-identifiées dans lesquelles les utilisateurs avaient précédemment signalé une erreur.
Avec un niveau de raisonnement très élevé, 4,1 % des réponses de GPT-6.1 Sol contiennent au moins une erreur factuelle, contre 4,5 % pour GPT-6 Sol et 4 % pour GPT-6 Astra.
L’entreprise précise que cet ensemble a volontairement été constitué à partir de conversations propices aux erreurs et ne représente donc pas leur fréquence dans les usages ordinaires. Disponible dans Work, Codex et l’API
GPT-6.1 Sol arrive dans ChatGPT Work et Codex pour les utilisateurs Plus, Pro, Business, Enterprise et Edu. Il n’est pas encore accessible dans Chat.
Les développeurs peuvent utiliser le modèle via l’API sous l’identifiant `gpt-6.1-sol`.
OpenAI introduit parallèlement GPT-6 Astra Ultrafast et GPT-6.1 Sol Ultrafast, annoncés jusqu’à huit fois plus rapides que GPT-6 Astra. Ces variantes sont proposées dans l’API, ChatGPT Work et Codex avec un nouveau palier Pro facturé 500 dollars par mois.