Alibaba défie OpenAI et Anthropic avec Qwen3.8-Max, son plus grand modèle d'IA à ce jour
Points clés
- •Le Qwen3.8-Max d'Alibaba dispose de 2,4 billions de paramètres et aurait des résultats égaux ou supérieurs à ceux de Fable 5 d'Anthropic sur plusieurs benchmarks, tout en surpassant Kimi K3 de Moonshot.
- •L'entreprise prévoit de publier publiquement les poids du modèle la semaine prochaine, permettant aux développeurs de télécharger et de personnaliser le système, marquant ainsi un retour aux pratiques open-source après une période propriétaire.
- •Dans les arènes d'évaluation par vote des utilisateurs, Qwen3.8-Max s'est classé cinquième dans les tâches de texte et deuxième dans les tâches de vision, ne devancé que par certains modèles Claude premium.
- •Anthropic a accusé des opérateurs liés à Alibaba d'avoir utilisé des milliers de faux comptes pour effectuer près de 29 millions d'échanges avec Claude, décrivant cette campagne comme la plus grande attaque par distillation qu'elle ait affrontée.
- •Les actions d'Alibaba ont progressé de jusqu'à 7,3 % suite à l'annonce du lancement, marquant la meilleure performance de l'action en près d'un mois.

Alibaba Group Holding Ltd. a dévoilé Qwen3.8-Max, son modèle d'intelligence artificielle le plus avancé à ce jour, en prévision d'une version open-weight destinée au public prévue la semaine prochaine.
Le modèle dispose de 2,4 billions de paramètres et surpasse Kimi K3 de Moonshot, récemment lancé, sur plusieurs benchmarks. Ce lancement marque également le retour d'Alibaba à ses origines open-source, après une période durant laquelle plusieurs de ses modèles d'IA haut de gamme avaient été publiés en tant qu'offres propriétaires au début de cette année.
Qwen3.8-Max est actuellement disponible via les API Model Studio d'Alibaba Cloud et QwenWork, la plateforme d'assistant d'IA de l'entreprise destinée aux clients professionnels. La version open-weight prévue la semaine prochaine permettra aux utilisateurs de télécharger les poids du modèle et d'affiner eux-mêmes le système. Ce positionnement place Alibaba en concurrence directe avec ses rivaux américains OpenAI et Anthropic.
Contrairement aux systèmes d'IA propriétaires qui offrent un accès exclusif via API, une version open-weight permet aux développeurs et aux entreprises de télécharger les poids du modèle, de les personnaliser pour leurs propres systèmes d'IA et de développer des applications sur cette base. Cette approche offre aux entreprises un meilleur contrôle en matière de déploiement, de confidentialité et d'optimisation des performances, tout en permettant aux chercheurs de reproduire et d'étendre les travaux d'Alibaba sans partir de zéro. Cette stratégie s'inscrit dans l'objectif plus large d'Alibaba d'accélérer l'adoption de son écosystème d'IA par les entreprises. Les versions open-weight sont devenues un levier concurrentiel majeur dans l'industrie de l'IA — la série Llama de Meta a démontré que des poids de modèle librement disponibles peuvent attirer de vastes communautés de développeurs et stimuler l'adoption des plateformes de cloud et d'outils de l'entreprise émettrice.
Performance sur les benchmarks et capacités autonomes
Selon Alibaba, Qwen3.8-Max a obtenu des résultats comparables — voire supérieurs dans certains cas — à ceux de Fable 5 d'Anthropic sur plusieurs benchmarks. Le modèle est capable de transformer des sources de données complexes, notamment des flux vidéo et de longs manuels techniques, en archives consultables.
Ses capacités supplémentaires incluent la recréation d'applications à partir de captures d'écran, la conception de jeux interactifs et de contenus éducatifs, ainsi que la conversion de plans d'étage en deux dimensions en visualisations 3D immersives. Alibaba a déclaré que le modèle excelle dans le codage autonome, la recherche complexe et d'autres tâches nécessitant un traitement soutenu sur de longues périodes. Pour démontrer son autonomie, le modèle a géré de manière indépendante un projet logiciel interne pendant 16 jours consécutifs. Le système améliore également l'efficacité grâce à l'activation sélective des seuls composants nécessaires — une architecture Mixture-of-Experts qui permet au modèle d'atteindre des billions de paramètres tout en maintenant des coûts d'inférence et une latence gérables, une approche également utilisée dans les modèles de pointe d'autres laboratoires de premier plan.
Dans les arènes d'évaluation où les utilisateurs votent, le modèle d'Alibaba a obtenu des classements parmi les meilleurs, ne devancé que par un groupe restreint de modèles Claude premium. Il s'est classé cinquième dans les tâches de texte et deuxième dans les tâches de vision. Le modèle a été initialement publié le 19 juillet via l'offre d'abonnement d'Alibaba et son écosystème Qoder, l'entreprise affirmant à l'époque que ses performances se classaient juste derrière celles de Fable 5.
Suite à l'annonce de ce lancement, les actions d'Alibaba ont progressé de jusqu'à 7,3 %, marquant leur meilleure performance en près d'un mois. La réaction du marché souligne la conviction croissante des investisseurs quant au rôle de l'IA comme principal moteur de croissance à long terme pour l'entreprise. Alibaba a consacré des ressources considérables à l'informatique en nuage et à l'IA générative, avec l'attente que l'amélioration des performances des modèles attirera davantage de clients professionnels vers sa plateforme cloud et son écosystème de développeurs.
Intensification de la concurrence en IA entre la Chine et les États-Unis
Ce lancement reflète la rivalité croissante entre les développeurs d'IA chinois et américains, tous deux engagés dans une course pour publier des modèles fondamentaux de plus en plus performants à un rythme accéléré. Les entreprises se distinguent désormais non seulement par leurs scores de benchmark, mais aussi par leurs compétences en codage, leurs fonctionnalités multimodales, leur intégration en entreprise et la disponibilité de modèles open-source que les développeurs peuvent librement adapter.
Le lancement de Qwen3.8-Max apporte un élan supplémentaire à l'avancée rapide de la Chine dans le secteur, arrivant peu après que le modèle Kimi de Moonshot a attiré une attention significative dans les centres technologiques occidentaux. Les laboratoires chinois continuent de travailler à combler l'écart avec OpenAI et Anthropic tout en disposant de ressources de calcul comparativement moindres, une contrainte due en partie aux contrôles américains à l'exportation sur les puces d'IA avancées qui restreignent l'accès aux derniers GPU NVIDIA et autres composants haute performance. Parmi les développements récents, DeepSeek a élargi l'accès à son modèle V4 Flash, tandis que ByteDance et MiniMax ont tous deux lancé de nouveaux modèles de génération vidéo vendredi.
Vey-Sern Ling, directeur général chez Union Bancaire Privée, a fait valoir que les modèles chinois approchent de la parité avec les systèmes américains de pointe. Il a déclaré : « De nombreux investisseurs continuent de sous-estimer les modèles d'IA chinois en raison des restrictions américaines sur les puces ou d'un scepticisme général. En réalité, l'écart est probablement bien plus mince et se réduit rapidement. Qwen 3.8 d'Alibaba en est une nouvelle preuve, à la suite de Kimi K3. »
La rivalité technologique entre les deux nations s'est intensifiée ces derniers mois. Le gouvernement américain a précédemment inscrit sur liste noire l'accès étranger aux modèles Fable 5 et Mythos 5 d'Anthropic, les restreignant temporairement à titre de mesure de précaution pour empêcher tout contournement de sécurité potentiel par les autorités chinoises. Anthropic a par la suite rétabli l'accès pour sa base d'utilisateurs outre-mer sur ordre de Washington, tout en indiquant qu'elle mettait en place des garanties renforcées et avait pris des engagements envers le gouvernement concernant la protection de la technologie.
Plus récemment, Anthropic a accusé des développeurs chinois de mener des attaques par distillation. Dans une lettre adressée à deux législateurs américains, l'entreprise basée à San Francisco a déclaré que des opérateurs liés à Alibaba avaient utilisé des milliers de faux comptes pour effectuer près de 29 millions d'échanges avec Claude — la qualifiant de la plus grande campagne d'extraction qu'elle ait rencontrée. Les attaques par distillation consistent à interroger systématiquement un modèle pour extraire ses résultats et les utiliser pour entraîner un modèle concurrent, reproduisant ainsi efficacement les capacités du système cible sans accès autorisé. Anthropic a exhorté les législateurs à tenir responsables les entités derrière ces attaques et à renforcer les mesures empêchant l'appropriation non autorisée de la technologie américaine.
Selon Anthropic, l'opération était hautement ciblée, se concentrant spécifiquement sur les capacités de Claude dans la gestion de projets complexes et le raisonnement de haut niveau. L'entreprise a déclaré : « Les attaques par distillation transforment des centaines de milliards de dollars d'investissement et de [recherche et développement] américains en un subventionnement massif de nos concurrents géopolitiques. »