Anthropic mesure sa progression vers l'auto-amélioration récursive

Anthropic évalue l'auto-amélioration de l'IA avec Claude, qui génère désormais 80 % de son code et accélère l'optimisation des modèles jusqu'à 52 fois.

Jusqu'où l'IA peut-elle prendre en charge son propre développement ? The Anthropic Institute publie « When AI builds itself », une analyse signée Marina Favaro et Jack Clark qui croise benchmarks publics et données internes inédites pour évaluer la progression vers la recursive self-improvement, soit un système capable de concevoir et d'entraîner seul son successeur. Le texte précise d'emblée que ce stade n'est ni atteint ni inévitable, mais qu'il pourrait survenir plus tôt que les institutions ne s'y préparent.

Les chiffres donnent la mesure du phénomène. La durée des tâches que les modèles accomplissent seuls double environ tous les quatre mois. En interne, plus de 80 % du code intégré à la base d'Anthropic est désormais écrit par Claude, contre quelques pourcents avant Claude Code, et un ingénieur fusionne en moyenne 8 fois plus de code qu'en 2024, un indicateur que l'entreprise juge elle-même imparfait. Sur l'optimisation d'expériences à objectif fixé, Claude est passé d'un gain de vitesse de 3x à 52x en moins d'un an, quand un chercheur expérimenté atteint 4x en quatre à huit heures. Des agents ont aussi mené de bout en bout un problème ouvert de sécurité IA, récupérant 97 % de l'écart de performance visé là où deux chercheurs humains en couvraient 23 % en une semaine, avec des réserves méthodologiques que les auteurs signalent eux-mêmes.

L'avantage comparatif humain reste le jugement : choisir les problèmes, trier les résultats, repérer les impasses. L'analyse esquisse trois scénarios, du plateau technologique à l'auto-amélioration complète, et tient pour le plus probable celui de gains d'efficacité composés avec des humains à la direction. Anthropic affirme enfin qu'une option de ralentissement ou de pause coordonnée du développement de frontière serait souhaitable pour le monde, et indique qu'elle s'y rangerait si les autres laboratoires en faisaient autant de manière vérifiable.