ActualitésActionsAlibaba publie Qwen3.8-Max en poids ouverts, défiant Claude et ChatGPT sur le coût et la distribution

Alibaba publie Qwen3.8-Max en poids ouverts, défiant Claude et ChatGPT sur le coût et la distribution

Auteur: Decrypt·

Points clés

  • Alibaba a publié Qwen3.8-Max en poids ouverts, ce qui en fait le premier modèle Qwen de classe Max disponible en téléchargement gratuit et en auto-hébergement.
  • Le modèle de 2,4 billions de paramètres emploie une conception Mixture-of-Experts qui n'active que 95 milliards de paramètres par calcul afin de réduire les coûts d'inférence tout en préservant la capacité globale.
  • Qwen3.8-Max domine la plupart des catégories de benchmarks pour les tâches multimodales impliquant des documents, de la vidéo et le raisonnement spatial, mais n'a remporté que sept des trente et un tests textuels et un seul des douze évaluations spécifiques au codage.
  • Alibaba indique que Qwen3.8-Max fonctionne à environ 30 % du coût du Claude Fable 5 d'Anthropic, ce qui en fait une alternative nettement moins coûteuse même lorsque des étapes de raisonnement supplémentaires sont nécessaires.
  • La publication en poids ouverts marque un revers stratégique par rapport au mois d'avril, lorsqu'Alibaba avait supprimé l'offre gratuite de Qwen Code dans le cadre d'une transition plus large vers des modèles fermés et payants.
Alibaba publie Qwen3.8-Max en poids ouverts, défiant Claude et ChatGPT sur le coût et la distribution

Alibaba a publié Qwen3.8-Max, le modèle d'intelligence artificielle le plus performant qu'il ait jamais construit, marquant la première fois que l'entreprise rend un modèle Qwen de classe Max disponible en poids ouverts.

Les poids du modèle seront publiés sur Hugging Face et ModelScope la semaine suivant le lancement du lundi. Avec un total de 2,4 billions de paramètres — dont 95 milliards sont activés à un moment donné — le modèle utilise une architecture Mixture-of-Experts qui achemine chaque calcul à travers un sous-ensemble de sous-réseaux spécialisés plutôt que d'engager l'ensemble du modèle d'un seul coup. Cette conception préserve la capacité globale tout en réduisant les coûts d'inférence, et vise à permettre aux petites entreprises et aux laboratoires de recherche disposant d'un matériel suffisant d'exécuter un système de pointe sans encourir les coûts par jeton associés à l'appel d'une API de centre de données à grande échelle.

Performances axées sur l'endurance

Plutôt que de s'appuyer sur des comparaisons de benchmarks conventionnelles, Alibaba a mis l'accent sur les capacités autonomes soutenues du modèle. Selon l'entreprise, Qwen3.8-Max a passé 16 jours à construire indépendamment un outil de codage, produisant 265 commits, 127 pull requests et 151 tickets sans intervention humaine. Il aurait également reproduit un article de recherche dont il n'avait pas le code source en cinq jours, puis dépassé les résultats originaux de l'article de 2,7 points. Lors d'une compétition d'apprentissage automatique de 24 heures, le modèle a surpassé 458 des 526 équipes humaines participantes.

Compatibilité avec les outils de codage concurrents

Qwen3.8-Max est livré avec des instructions de configuration pour Claude Code d'Anthropic et Codex d'OpenAI — deux plateformes concurrentes. L'API d'Alibaba est compatible avec les protocoles des deux entreprises, et la plupart des benchmarks de codage du modèle ont été réalisés dans Claude Code.

Les résultats des benchmarks sont cependant mitigés. Sur 31 tests textuels figurant dans le tableau d'évaluation d'Alibaba, Fable 5 d'Anthropic a obtenu la première place dans 15 catégories, GPT-5.6 Sol d'OpenAI en a remporté neuf, et Qwen3.8-Max sept. Sur 12 tests spécifiques au codage, Qwen n'en a gagné qu'un seul.

Le modèle se distingue par son efficacité en matière de coûts. Alibaba indique que Qwen3.8-Max fonctionne à environ 30 % de ce qu'Anthropic facture pour Claude Fable 5, ce qui signifie que même lorsque des itérations ou des étapes de raisonnement supplémentaires sont nécessaires, le coût total d'accomplissement d'une tâche reste nettement inférieur.

Le classement change considérablement pour les tâches multimodales impliquant des documents, de la vidéo et le raisonnement spatial, où Qwen3.8-Max domine la plupart des catégories de benchmarks.

Revers stratégique sur l'accès ouvert

Cette publication représente un changement de direction notable. En avril, Alibaba a supprimé l'offre gratuite de Qwen Code, l'équipe s'orientant vers des modèles fermés et payants à la suite de départs de dirigeants. Une revue de Qwen 3.7 Max par Decrypt avait précédemment noté que si la version Plus serait ouverte, la variante Max devrait rester accessible uniquement via l'API.

Le calendrier de la publication en poids ouverts coïncide avec des évolutions plus larges dans le paysage de l'IA. Les modèles chinois à poids ouverts sont passés de moins de 2 % des jetons traités sur OpenRouter fin 2024 à environ 61 % à la mi-2026. Qwen a surpassé le Llama de Meta en tant que modèle le plus auto-hébergé au monde.

La disponibilité en poids ouverts signifie que les organisations peuvent télécharger, auditer et exécuter le modèle sur leur propre infrastructure — une proposition attrayante pour les entreprises ayant des exigences de souveraineté des données ou cherchant à éviter la dépendance à un fournisseur, d'autant plus que les tensions géopolitiques compliquent les dépendances aux API transfrontalières.

Parallèlement, Washington a restreint Fable 5 et Mythos 5 dans le cadre de contrôles à l'exportation en juin, et Pékin envisagerait d'imposer ses propres limitations sur les modèles chinois déployés à l'étranger.

Bien que Qwen3.8-Max soit devancé par ses concurrents sur plusieurs classements de benchmarks, Alibaba semble donner la priorité à la distribution et à l'accessibilité — positionnant le modèle comme une alternative gratuite et téléchargeable qui approche les performances des systèmes propriétaires de pointe pour une fraction du coût.