新闻股票阿里巴巴以开放权重形式发布Qwen3.8-Max,在成本与分发层面挑战Claude和ChatGPT

阿里巴巴以开放权重形式发布Qwen3.8-Max,在成本与分发层面挑战Claude和ChatGPT

作者: Decrypt·

要点速览

  • 阿里巴巴已将Qwen3.8-Max以开放权重形式发布,使其成为首个可免费下载和自托管的Max级Qwen模型。
  • 该2.4万亿参数模型采用混合专家设计,每次计算仅激活950亿参数,在保持整体能力的同时降低推理成本。
  • Qwen3.8-Max在涉及文档、视频和空间推理的多模态任务中领先大多数基准类别,但在31项文本测试中仅赢得7项,在12项编码专项评测中仅赢得1项。
  • 阿里巴巴表示,Qwen3.8-Max的运行成本约为Anthropic Claude Fable 5的30%,即使需要额外的推理步骤,也是一个显著更经济的替代方案。
  • 此次开放权重发布标志着对4月份战略的逆转,当时阿里巴巴取消了Qwen Code的免费层级,向封闭的付费模型转型。
阿里巴巴以开放权重形式发布Qwen3.8-Max,在成本与分发层面挑战Claude和ChatGPT

阿里巴巴发布了Qwen3.8-Max,这是其迄今构建的最强大的人工智能模型,标志着该公司首次以开放权重形式发布Max级Qwen模型。

该模型权重将在周一发布后的次周上线至Hugging Face和ModelScope平台。该模型总参数量达2.4万亿,其中任意时刻激活950亿参数,采用混合专家架构,每次计算仅通过部分专用子网络路由,而非同时调用整个模型。这一设计在保持整体能力的同时降低了推理成本,旨在使具备足够硬件条件的中小企业和研究实验室能够在不承担调用大型数据中心API所产生的逐token成本的情况下,运行最先进的系统。

以持久力为核心的性能主张

阿里巴巴并未以常规的基准对比作为卖点,而是强调了模型持续自主工作的能力。据该公司介绍,Qwen3.8-Max独立耗时16天构建了一款编码工具,产出了265次提交、127个拉取请求和151个问题,全程无需人工干预。该模型还据报道在五天内复现了一篇此前从未见过源代码的研究论文,随后以2.7分的优势超越了该论文的原始结果。在一场为期24小时的机器学习竞赛中,该模型的表现超过了526支参赛人类队伍中的458支。

与竞争对手编码工具的兼容性

Qwen3.8-Max附带Anthropic Claude Code和OpenAI Codex——两个竞争平台——的设置说明。阿里巴巴的API兼容两家公司的协议,且该模型的大多数编码基准测试是在Claude Code内部进行的。

然而,基准测试结果喜忧参半。在阿里巴巴自有评估表的31项文本测试中,Anthropic的Fable 5在15个类别中获得第一名,OpenAI的GPT-5.6 Sol获得9个,Qwen3.8-Max赢得7个。在12项编码专项测试中,Qwen仅赢得一项。

该模型的突出之处在于成本效率。阿里巴巴表示,Qwen3.8-Max的运行成本约为Anthropic Claude Fable 5收费的30%,这意味着即使需要更多的迭代或推理步骤,完成任务的总成本仍然显著更低。

在涉及文档、视频和空间推理的多模态任务上,排名发生了显著变化,Qwen3.8-Max在大多数基准类别中处于领先地位。

开放获取的战略转向

此次发布标志着方向的重大转变。今年4月,阿里巴巴取消了Qwen Code的免费层级,在领导层人事变动后,团队转向封闭的付费模型。Decrypt对Qwen 3.7 Max的评测此前指出,虽然Plus版本将开放,但Max版本预计将仅通过API提供访问。

此次开放权重发布的时机与AI领域更广泛的变化相呼应。中国开放权重模型在OpenRouter上处理的token占比从2024年末的不足2%增长至2026年中期的约61%。Qwen已超越Meta的Llama,成为全球自托管使用最广泛的模型。

开放权重意味着各组织可以在自有基础设施上下载、审计和运行该模型——这对有数据主权需求或希望避免供应商锁定的企业而言具有吸引力,尤其是在地缘政治紧张局势使跨境API依赖变得复杂的背景下。

与此同时,华盛顿于6月根据出口管制措施对Fable 5和Mythos 5实施了限制,据报道北京也在考虑对中国的模型出海实施自身的限制措施。

尽管Qwen3.8-Max在多项基准排行榜上落后于竞争对手,阿里巴巴似乎正在优先考虑分发和可及性——将该模型定位为一种免费的、可下载的替代方案,以远低于领先专有系统的成本接近其性能水平。