新聞股票阿里巴巴將 Qwen3.8-Max 以開源權重形式釋出,挑戰 Claude 與 ChatGPT 的成本與分發優勢

阿里巴巴將 Qwen3.8-Max 以開源權重形式釋出,挑戰 Claude 與 ChatGPT 的成本與分發優勢

作者: Decrypt·

重點速覽

  • 阿里巴巴已將 Qwen3.8-Max 以開源權重形式釋出,這是首個可免費下載並自架的 Max 級 Qwen 模型。
  • 這款擁有 2.4 兆參數的模型採用 Mixture-of-Experts 設計,每次運算僅啟用 950 億參數,以降低推理成本並保留整體容量。
  • Qwen3.8-Max 在涉及文件、影片與空間推理的多模態任務中領先多數基準類別,但在 31 項文字測試中只贏得 7 項,在 12 項程式設計測試中只贏得 1 項。
  • 阿里巴巴表示,Qwen3.8-Max 的成本約為 Anthropic Claude Fable 5 的 30%,即使需要更多推理步驟,總成本仍低得多。
  • 這次開源權重發布標誌著策略逆轉;4 月時阿里巴巴才剛取消 Qwen Code 的免費方案,轉向更封閉的付費模式。
阿里巴巴將 Qwen3.8-Max 以開源權重形式釋出,挑戰 Claude 與 ChatGPT 的成本與分發優勢

阿里巴巴已推出 Qwen3.8-Max,這是其迄今建構的最強大人工智慧模型,也標誌著該公司首次將 Max 級 Qwen 模型以開源權重形式提供。

模型權重將於週一發布後的下一週上架 Hugging Face 與 ModelScope。該模型總計 2.4 兆參數,其中在任何時刻會啟用 950 億參數。它採用 Mixture-of-Experts 架構,將每次運算導向一部分專門子網路,而非一次啟用整個模型。這種設計在保留整體容量的同時降低推理成本,旨在讓擁有足夠硬體的小型企業與研究實驗室,也能運行先進模型,而無需承擔呼叫大規模資料中心 API 時每個 token 的成本。

以續航能力為核心的性能主張

阿里巴巴並未以傳統基準比較作為重點,而是強調模型持續自主運作的能力。根據公司說法,Qwen3.8-Max 花了 16 天獨立建立一個編碼工具,產生了 265 次 commit、127 個 pull request 和 151 個 issue,期間沒有任何人類介入。它還在五天內重現了一篇其沒有原始碼可參考的研究論文,並將論文原始結果提高了 2.7 分。在一場 24 小時的機器學習競賽中,該模型表現優於 526 支人類隊伍中的 458 支。

為競爭對手的工具而設計

Qwen3.8-Max 隨附 Anthropic 的 Claude Code 與 OpenAI 的 Codex 這兩種競爭平台的設定說明。阿里巴巴的 API 與兩家公司協議相容,而且該模型的大多數程式設計基準測試都是在 Claude Code 內完成的。

不過,基準結果並不亮眼。根據阿里巴巴自己的評測表,在 31 項文字測試中,Anthropic 的 Fable 5 拿下 15 項第一,OpenAI 的 GPT-5.6 Sol 拿下 9 項,Qwen 拿下 7 項。在 12 項程式設計相關測試中,Qwen 只贏得 1 項。然而,就智慧成本而言,這款模型非常便宜且高效,這意味著即使它需要更多迭代或推理,完成工作的總成本仍會低得多,約為 Claude Fable 5 收費的 30%。

若切換到涉及文件、影片與空間推理的多模態工作,排名則會反轉。Qwen 在那份表格的大多數項目中居於領先。

商業策略上也出現了反轉。4 月,阿里巴巴取消了 Qwen Code 的免費方案,隨著高層離職,團隊逐步轉向封閉付費模型。我們對 Qwen 3.7 Max 的評論曾指出,Plus 版本會開放,但 Max 仍會被鎖在 API 之後。

如今這道門已經打開,而時機並非巧合。中國的開源權重模型在 2024 年底於 OpenRouter 上處理的 token 佔比不到 2%,到 2026 年中已升至約 61%。Qwen 也已超越 Meta 的 Llama,成為全球最常自架的模型。

與此同時,華盛頓在 6 月對 Fable 5 和 Mythos 5 實施出口管制,北京方面則傳出也在考慮對中國模型出海設定限制。

因此,阿里巴巴在紙面競爭中落後,卻在分發上取勝。如果你能免費下載一個表現接近的模型,拿到第二名也不是壞事。

Daily Debrief Newsletter