Le travail autonome s’étend sur plusieurs jours avec Qwen3.8-Max
Avec 2,4 mille milliards de paramètres, Qwen3.8-Max vise les tâches longues, multimodales et de programmation. Ses open weights arrivent prochainement.
Accessible via QwenCloud, Qwen3.8-Max réunit 2,4 mille milliards de paramètres, dont 95 milliards activés lors de l’inférence. Le modèle traite le texte et l’image, avec un contexte pouvant atteindre un million de tokens. Ses open weights doivent être publiés prochainement sur Hugging Face et ModelScope. Qwen3.8-27B doit suivre le même chemin.
L’équipe met particulièrement en avant les tâches de programmation prolongées. Lors d’une expérience menée sur plus de deux semaines, le modèle a construit le projet `oh-my-cli` depuis un dossier vide, tout en gérant les demandes, les tests, les corrections et les pull requests. Le dépôt public comptait alors 265 commits, 127 pull requests et 151 issues.
D’autres essais portent sur la reproduction d’un article scientifique, l’amélioration autonome de sa méthode et la participation à une compétition de classification multimodale. Dans ce dernier cas, Qwen3.8-Max aurait dépassé 458 des 526 équipes participantes après 45 soumissions réalisées sans intervention humaine.
Les tâches longues concernent aussi la conception matérielle et la simulation d’entreprise. Dans un environnement de conception de puces, le modèle a effectué environ 500 tours d’optimisation et réduit un circuit de 8 298 à 678 portes. Une autre expérience lui a confié la gestion simulée de commerces en ligne sur une année, avec plus de 2 000 interactions portant sur les stocks, les prix, les fournisseurs et la trésorerie.
La dimension multimodale intervient pendant toute l’exécution. Qwen3.8-Max peut examiner ses résultats intermédiaires, repérer une erreur visuelle ou fonctionnelle, puis adapter son plan. Cette approche associe programmation et manipulation d’interfaces pour des tâches liées au web, aux applications, aux documents, à la vidéo, à Blender ou à la CAO.
L’API facture 2 dollars par million de tokens en entrée, 6 dollars en sortie et 0,25 dollar pour le cache implicite. Trois niveaux d’effort de raisonnement sont proposés. Le service utilise des interfaces compatibles avec les protocoles d’OpenAI et d’Anthropic, avec des intégrations documentées pour Claude Code, Codex, Qwen Code, Qoder et OpenClaw.