新聞股票阿里巴巴推出 Qwen3.8-Max,以其迄今最大 AI 模型挑戰 OpenAI 與 Anthropic

阿里巴巴推出 Qwen3.8-Max,以其迄今最大 AI 模型挑戰 OpenAI 與 Anthropic

作者: Cryptopolitan·

重點速覽

  • 阿里巴巴的 Qwen3.8-Max 擁有 2.4 兆參數,據報導在多項基準測試中達到或超越 Anthropic 的 Fable 5,同時優於 Moonshot 的 Kimi K3。
  • 該公司計畫下週公開發布模型權重,允許開發者下載並客製化系統,標誌著在專有化時期之後回歸開源實踐。
  • 在使用者投票的評測競技場中,Qwen3.8-Max 在文字任務中排名第五、視覺任務中排名第二,僅落後於少數精選的高階 Claude 模型。
  • Anthropic 指控與阿里巴巴相關的操作者使用數千個虛假帳號對 Claude 進行了近 2,900 萬次交換,稱之為其面臨過最大規模的蒸餾攻擊行動。
  • 阿里巴巴股價在發布消息公布後上漲幅度高達 7.3%,創下該股近一個月以來的最強表現。
阿里巴巴推出 Qwen3.8-Max,以其迄今最大 AI 模型挑戰 OpenAI 與 Anthropic

阿里巴巴集團控股有限公司推出了迄今最先進的人工智慧模型 Qwen3.8-Max,並計畫於下週向公眾進行開放權重發布。

該模型擁有 2.4 兆參數,在多項基準測試中優於 Moonshot 近期發布的 Kimi K3。此次發布也標誌著阿里巴巴回歸其開源根源,此前該公司今年稍早曾將多款頂級 AI 模型以專有產品形式推出。

Qwen3.8-Max 目前可透過阿里雲的 Model Studio API 以及該公司的企業 AI 助手平台 QwenWork 使用。計畫於下週進行的開放權重發布將允許使用者下載模型權重並自行微調系統。此舉使阿里巴巴與美國競爭對手 OpenAI 和 Anthropic 展開直接競爭。

與僅提供 API 存取的專有 AI 系統不同,開放權重發布使開發者和企業能夠下載模型權重,為自己的專有 AI 系統進行客製化,並在其基礎上構建應用程式。這種方式讓企業對部署、隱私和效能優化擁有更大的控制權,同時讓研究人員能夠複製並延伸阿里巴巴的研究成果,而無需從零開始。該策略與阿里巴巴加速其 AI 生態系統企業採用的更廣泛目標一致。開放權重發布已成為 AI 產業中的關鍵競爭利器——Meta 的 Llama 系列證明了免費可用的模型權重能夠吸引龐大的開發者社群,並推動發布公司的雲端和工具平台的採用率。

基準測試表現與自主能力

根據阿里巴巴的說法,Qwen3.8-Max 在多項基準測試中取得了與 Anthropic 的 Fable 5 相當——甚至在某些情況下超越——的結果。該模型能將複雜的資料來源(包括影音串流和冗長的技術手冊)轉換為可搜尋的檔案庫。

其他功能包括從截圖重建應用程式、設計互動遊戲與教育內容,以及將平面平面圖轉換為沉浸式 3D 視覺化效果。阿里巴巴表示,該模型在自主編碼、複雜研究以及需要長時間持續處理的其他任務方面表現出色。為展示其自主性,該模型獨立管理了一個內部軟體專案長達連續 16 天。該系統還透過僅選擇性啟動必要元件來提升效率——這是一種混合專家架構設計,使模型能夠擴展至數兆參數,同時將推理成本和延遲保持在可控範圍內,其他頂尖實驗室的前沿模型也採用了相同方法。

在使用者投票的評測競技場中,阿里巴巴的模型取得了頂尖排名,僅落後於少數精選的高階 Claude 模型。在文字任務中排名第五,在視覺任務中排名第二。該模型最初於 7 月 19 日透過阿里巴巴的訂閱方案及其 Qoder 生態系統發布,該公司當時宣稱其效能僅次於 Fable 5。

發布消息公布後,阿里巴巴股價上漲幅度高達 7.3%,創下近一個月以來的最佳表現。市場反應凸顯了投資人日益將 AI 視為該公司主要長期成長動力。阿里巴巴已投入大量資源於雲端運算和生成式 AI,預期模型效能的提升將吸引更多企業客戶使用其雲端平台和開發者生態系統。

中美 AI 競爭持續升溫

此次發布反映了中美 AI 開發者之間日益激烈的競爭,雙方都在加速推出功能更強大的基礎模型。各公司如今不僅透過基準測試分數來區分自身,還透過編碼能力、多模態功能、企業整合以及開發者可自由改編的開源模型可用性來建立差異化。

Qwen3.8-Max 的發布為中國在該領域的快速推進增添了進一步動能,發布時機緊接在 Moonshot 的 Kimi 模型引起西方科技中心廣泛關注之後。中國實驗室在運算資源相對較少的情況下,持續努力縮小與 OpenAI 和 Anthropic 之間的差距——這一限制部分源於美國對先進 AI 晶片的出口管制,限制了對最新 NVIDIA GPU 和其他高效能晶片的取得。在近期的發展中,DeepSeek 擴大了其 V4 Flash 模型的存取範圍,而字節跳動和 MiniMax 皆於週五推出了新的影片生成模型。

Union Bancaire Privée 常務董事 Vey-Sern Ling 認為,中國模型正逐步接近美國領先系統的水準。他表示:「許多投資人因美國晶片限制或普遍的懷疑態度,持續低估中國 AI 模型。實際上,差距可能要小得多,而且正在快速縮小。阿里巴巴的 Qwen 3.8 是繼 Kimi K3 之後的另一個佐證。」

兩國之間的技術競爭在近幾個月持續加劇。美國政府先前將 Anthropic 的 Fable 5 和 Mythos 5 模型的海外存取列入黑名單,作為預防性措施暫時限制使用,以防止中國當局可能繞過安全限制。Anthropic 隨後在華盛頓的命令下,恢復了海外使用者群體的存取權限,同時表示正在實施更強有力的安全防護措施,並已向政府作出技術保護方面的承諾。

最近,Anthropic 指控中國開發者進行蒸餾攻擊。在一封致兩位美國國會議員的信函中,這家總部位於舊金山的公司表示,與阿里巴巴有關的操作者使用了數千個虛假帳號,對 Claude 進行了近 2,900 萬次交換——將其描述為該公司遭遇過最大規模的提取行動。蒸餾攻擊是指系統性地查詢模型以提取其輸出結果,並利用這些結果訓練競爭模型,從而在未經授權的情況下複製目標系統的功能。Anthropic 敦促國會議員追究這些攻擊背後的實體責任,並加強防止美國技術遭未經授權挪用的措施。

根據 Anthropic 的說法,該操作具有高度針對性,特別聚焦於 Claude 在管理複雜專案和高階推理方面的能力。該公司表示:「蒸餾攻擊將美國數千億美元的投資和[研發]轉化為對我國地緣政治競爭對手的大規模補貼。」