新闻股票阿里巴巴以迄今最大 AI 模型 Qwen3.8-Max 挑战 OpenAI 和 Anthropic

阿里巴巴以迄今最大 AI 模型 Qwen3.8-Max 挑战 OpenAI 和 Anthropic

作者: Cryptopolitan·

要点速览

  • 阿里巴巴的 Qwen3.8-Max 拥有 2.4 万亿参数,据称在多项基准测试中可与 Anthropic 的 Fable 5 持平或更优,并且优于 Moonshot 的 Kimi K3。
  • 公司计划于下周公开发布模型权重,使开发者能够下载并定制系统,这也标志着其在专有阶段后回归开源路线。
  • 在用户投票的评测平台中,Qwen3.8-Max 在文本任务中排名第五,在视觉任务中排名第二,仅落后于少数高端 Claude 模型。
  • Anthropic 指控与阿里巴巴有关联的运营者使用数千个虚假账户与 Claude 进行了近 2900 万次交互,称这是其遭遇过的最大蒸馏攻击。
  • 公告发布后,阿里巴巴股价一度上涨高达 7.3%,创下近一个月来最佳表现。
阿里巴巴以迄今最大 AI 模型 Qwen3.8-Max 挑战 OpenAI 和 Anthropic

阿里巴巴集团控股有限公司推出了 Qwen3.8-Max,这是其迄今最先进的人工智能模型,计划于下周向公众发布开放权重版本。

该模型拥有 2.4 万亿参数,并在多项基准测试中优于 Moonshot 近期发布的 Kimi K3。此次发布也标志着阿里巴巴回归其开源起点,因为今年早些时候,公司曾将数款顶级 AI 模型作为专有产品推出。

Qwen3.8-Max 目前可通过阿里云的 Model Studio APIs 以及企业 AI 助手平台 QwenWork 使用。计划于下周发布的开放权重版本将允许用户下载模型权重并自行微调系统。此举使阿里巴巴与美国竞争对手 OpenAI 和 Anthropic 直接竞争。

与仅提供 API 访问的专有 AI 系统不同,开放权重发布允许开发者和企业下载模型权重,将其定制为专有 AI 系统,并在其基础上构建应用。这一方式使企业在部署、隐私和性能优化方面拥有更大控制权,同时也让研究人员无需从头开始即可复现并扩展阿里巴巴的工作。该策略与阿里巴巴推动其 AI 生态系统中企业采用的更广泛目标一致。开放权重发布已成为 AI 行业的重要竞争手段——Meta 的 Llama 系列表明,免费提供的模型权重能够吸引庞大的开发者社区,并推动发布方云平台和工具平台的采用。

Qwen3.8-Max 在处理与自主能力方面表现突出,阿里巴巴称

据阿里巴巴介绍,Qwen3.8-Max 在多项基准测试中的结果与 Anthropic 的 Fable 5 相当,甚至在部分测试中更优。该模型可以将视频流和厚重手册等复杂数据映射为可检索档案。

此外,它还能根据截图重建应用,设计互动游戏和教育内容,并将平面户型图转换为沉浸式 3D 可视化。公司还指出,该模型在自主编码、复杂研究以及其他需要长时间持续处理的任务上表现突出。为证明其自主性,该模型曾独立完成一项内部软件项目,持续 16 天。该系统还通过仅激活所需部分来提升效率,从而帮助降低处理成本和延迟。

到目前为止,在由用户投票的评测平台中,阿里巴巴的模型已占据前列位置,仅落后于少数高端 Claude 模型。它在文本任务中排名第五,在视觉任务中排名第二。该模型最初于 7 月 19 日通过阿里巴巴的订阅计划和 Qoder 生态系统发布,当时公司表示其性能仅次于 Fable 5。

此次亮相推动阿里巴巴股价一度上涨高达 7.3%,创下近一个月来最佳表现。市场反应表明,投资者将 AI 视为阿里巴巴长期增长的关键驱动力之一。公司已在云计算和生成式 AI 方面投入大量资源,市场预期更强的模型性能将吸引更多企业客户使用其云服务和开发者生态系统。

中美 AI 竞争持续加剧

最新发布反映出中国与美国 AI 开发者之间日益激烈的竞争,双方正竞相以更快速度推出更强大的基础模型。如今,企业不仅通过基准分数展开竞争,还通过编码能力、多模态功能、企业采用情况,以及开发者可自由定制的开源模型可用性来区分自身。

Qwen3.8-Max 的亮相进一步推动了中国在这一领域的快速追赶。就在几天前,Moonshot 的 Kimi 曾在西方科技圈引发广泛关注。中国实验室仍在努力缩小与 OpenAI 和 Anthropic 的差距,同时使用相对更少的计算资源,这一限制在一定程度上源于美国对先进 AI 芯片的出口管制,使其难以获得最新的 NVIDIA GPU 和其他高性能芯片。近期,DeepSeek 扩大了其 V4 Flash 模型的访问范围,而 ByteDance 和 MiniMax 也于周五推出了新的视频生成模型。

Union Bancaire Privée 董事总经理 Vey-Sern Ling 甚至认为,中国模型与美国领先系统的性能差距正变得越来越小。他表示:“Many investors continue to underestimate Chinese AI models because of US chip restrictions or general skepticism. In reality, the gap is probably much closer and narrowing fast. Alibaba's Qwen 3.8 is another proof point, following Kimi K3.”

过去几个月,两国之间的技术竞争进一步升温。此前,美国政府曾将 Anthropic 的 Fable 5 和 Mythos 5 的海外访问列入黑名单,作为防止中国当局规避安全限制的临时预防措施,对这些模型实施了限制。随后,Anthropic 按照华盛顿的要求恢复了海外用户的访问,同时表示将实施更强的保护措施,并已就技术保护问题向政府作出承诺。

最近,Anthropic 还指控中国开发者实施蒸馏攻击。这家总部位于旧金山的公司在致两名美国国会议员的信中表示,与阿里巴巴有关联的运营者使用了数千个虚假账户,与 Claude 进行了近 2900 万次交互,称这是其见过的最大规模提取行动。这家 AI 初创公司还敦促立法者追究这些攻击背后公司的责任,并加强防止美国技术被盗用的措施。

据这家旧金山公司称,这一攻击高度定向,重点针对 Claude 处理复杂项目和高阶推理的能力。公司补充说:“Distillation attacks turn hundreds of billions of dollars in American investment and [research and development] into a massive subsidy for our geopolitical competitors.”

不要只阅读加密新闻,要真正理解它。订阅我们的新闻简报,免费。