DeepSeek-V4-Pro et V4-Flash rejoignent BytePlus ModelArk
Les modèles DeepSeek-V4-Pro et V4-Flash intègrent la plateforme BytePlus ModelArk, optimisant les coûts des usages agentiques grâce à la gestion du cache.
Les deux déclinaisons de DeepSeek V4 rejoignent ModelArk, la plateforme de modèles de BytePlus, qui en profite pour défendre une lecture des coûts au-delà du simple prix au token.
Dans les usages agentiques et à long contexte, où les tokens d'entrée dépassent largement ceux de sortie et où un même corpus (base de code, documentation interne, référentiels de connaissances) est sollicité en boucle, l'efficacité du cache pèse selon elle davantage sur le rapport prix-performance que le tarif unitaire, aux côtés du débit, de la stabilité du service et des limites d'usage.
Pro et Flash se répartissent les rôles : le premier vise le raisonnement exigeant et les workflows agentiques, le second privilégie l'équilibre entre performance en code, vitesse et efficacité pour le développement quotidien. Sur ModelArk, ces modèles open source s'accompagnent d'un contexte d'un million de tokens, de limites montant jusqu'à 15 000 requêtes et 1,5 million de tokens par minute et d'un accès API, un Playground permettant les premiers essais et le Coding Plan de BytePlus regroupant plusieurs modèles pour le code assisté.