En bref
- Qwen3.8-Max exécute 2,4 billions de paramètres et est le premier modèle de classe Max que Alibaba publiera en poids ouverts.
- Il est livré avec des instructions de configuration pour Claude Code d'Anthropic et Codex d'OpenAI—des outils concurrents.
- Sur le propre tableau de référence d'Alibaba, Fable 5 remporte 15 des 31 tests. Qwen3.8-Max en remporte sept.
Alibaba a publié Qwen3.8-Max lundi, le qualifiant de modèle le plus performant qu'il ait jamais construit. Les poids arrivent sur Hugging Face et ModelScope la semaine prochaine—la première fois que l'entreprise offre un modèle à l'échelle Max.
Les spécifications sont importantes : 2,4 billions de paramètres au total, avec 95 milliards activés à tout moment. Les paramètres sont le nombre de variables qu'un modèle est capable de gérer.
C'est extrêmement important pour l'efficacité car cela signifie qu'il ne nécessiterait pas trop de ressources pour fonctionner. Considérez-le comme une immense bibliothèque où seule l'étagère pertinente s'illumine pour chaque question. Les petites entreprises et les laboratoires disposant d'un matériel suffisamment performant peuvent désormais exécuter un modèle de pointe sans dépenser autant qu'un énorme centre de données.
Le post de sortie d'Alibaba évite le récit habituel de course aux benchmarks et mise plutôt sur l'endurance. Le modèle a passé 16 jours à construire un outil de codage par lui-même—265 commits, 127 pull requests, 151 issues, sans qu'aucun humain ne touche au clavier. Il a passé cinq jours à reproduire un article de recherche dont il n'avait jamais vu le code, puis a battu les résultats de l'article de 2,7 points. Lors d'un concours d'apprentissage automatique de 24 heures, il a terminé devant 458 des 526 équipes humaines.
Conçu pour fonctionner dans les outils d'un concurrent
Qwen3.8-Max est livré avec des instructions pour Claude Code et Codex, les outils de codage créés par Anthropic et OpenAI. L'API d'Alibaba parle les protocoles des deux entreprises. La plupart de ses benchmarks de codage ont été exécutés dans Claude Code.
Et ces benchmarks ne lui sont pas favorables. Sur 31 tests textuels, Fable 5 d'Anthropic remporte 15 premières places, GPT-5.6 Sol d'OpenAI en remporte neuf, Qwen en remporte sept. Sur les 12 tests de codage, Qwen en gagne exactement un. Cependant, en termes de coûts d'intelligence, ce modèle est extrêmement bon marché et efficace, ce qui signifie que même s'il nécessite plus d'itérations ou de raisonnement, le coût pour accomplir le travail sera bien inférieur, près de 30 % de ce que facture Claude Fable 5.

Cela dit, passons aux travaux multimodaux—documents, vidéo, raisonnement spatial—et les classements s'inversent. Qwen mène la plupart de ce tableau.
Il y a aussi un renversement en termes de stratégie commerciale. En avril, Alibaba a supprimé le niveau gratuit de Qwen Code, l'équipe s'orientant vers des modèles fermés et payants après les départs de dirigeants. Notre revue de Qwen 3.7 Max a noté que la version Plus serait ouverte tandis que Max resterait verrouillé derrière l'API.
Cette porte est maintenant ouverte, et le moment n'est pas un hasard. Les modèles chinois à poids ouvert sont passés de moins de 2% des jetons sur OpenRouter fin 2024 à environ 61% à la mi-2026. Qwen a dépassé Llama de Meta en tant que modèle le plus auto-hébergé au monde.
Pendant ce temps, Washington a restreint Fable 5 et Mythos 5 en vertu des contrôles à l'exportation en juin, et Pékin envisagerait également des limites sur les modèles chinois allant à l'étranger.
Ainsi, Alibaba perd sur le papier et gagne sur la distribution. Si vous pouvez télécharger quelque chose qui s'en rapproche gratuitement, la deuxième place est une bonne place.






