118 milliards de paramètres, huit milliards actifs et une machine locale

Le modèle Laguna S 2.1 de Poolside réduit l'activation à huit milliards de paramètres par token. Une architecture pensée pour le code agentique lourd.

Avec Laguna S 2.1, Poolside concentre un modèle de 118 milliards de paramètres autour d’une architecture Mixture-of-Experts qui n’en active que huit milliards par token. Cette réduction doit lui permettre de fonctionner sur un seul NVIDIA DGX Spark, tout en conservant une fenêtre de contexte pouvant atteindre un million de tokens.

Le modèle cible principalement le code agentique et les tâches longues, avec une attention particulière portée à la persistance, à la vérification et à la capacité de revenir sur une approche incomplète. Poolside revendique 70,2 % sur Terminal-Bench 2.1 et 40,4 % sur DeepSWE v1.1 avec son propre harnais d’évaluation. Les trajectoires complètes des essais finaux sont publiées pour permettre leur examen.

Le mode de réflexion maximale améliore fortement les résultats, mais peut aussi entraîner des séquences inutilement longues. L’entreprise signale également des difficultés avec certains formats d’appels d’outils utilisés par des harnais tiers et avec les arguments JSON imbriqués.

Laguna S 2.1 est distribué en open weights sous licence OpenMDW-1.1, avec plusieurs niveaux de compression sur Hugging Face. Il est également accessible via OpenRouter, l’API de Poolside et une interface web sans connexion obligatoire.