阿里巴巴Qwen團隊發布Qwen3.8-Flash,AI訓練成本大減89%
重點速覽
- •阿里巴巴發表Qwen3.8-Flash,這是一款針對程式設計與辦公生產力任務的多模態AI模型。
- •該公司表示,此模型的訓練成本約為Qwen3.7-Plus的11%,而在程式設計與生產力基準測試中的表現均有提升。
- •Qwen3.8-Flash預設上下文視窗為262,144個token,並可擴充至最多處理100萬個token。
- •阿里巴巴在Hugging Face與ModelScope上發布開放權重模型Qwen3.8-Flash-Next,作為Qwen4架構的早期預覽。
- •此次發布延續阿里巴巴800億港元的AI發展股權融資計畫,以及馬雲、蔡崇信與吳泳銘近期的增持股份行動。

重點摘要
- Qwen3.8-Flash問世,具備更強的多模態能力,在程式設計與生產力應用上表現出色
- 訓練費用降至Qwen3.7-Plus成本的約11%
- 預設處理容量為262,144個token,可擴充至100萬個token以支援大規模應用
- Qwen3.8-Flash-Next以開源形式發布,提前揭示Qwen4架構設計
- 此次發布適逢阿里巴巴800億港元募資,以及馬雲增持超過6億港元股票
週三,阿里巴巴(BABA)發表了由旗下Qwen AI團隊開發的新人工智慧模型Qwen3.8-Flash。此次發布以強化程式設計任務與辦公生產力應用能力為核心,凸顯該公司正推動AI深入實際企業工作流程,而非僅止於研究展示。
Qwen3.8-Flash的成本效益代表一項重大突破。訓練成本僅約為Qwen3.7-Plus的11%——降幅達89%——但阿里巴巴表示,該模型在程式設計基準測試與辦公生產力情境中均繳出更優異的成果。API定價為每百萬輸入token收費0.16美元、每百萬輸出token收費0.47美元。對中國市場用戶而言,這相當於每百萬輸入token收費1元人民幣、每百萬輸出token收費3元人民幣。
Meet Qwen3.8-Flash, a multimodal MoE and an early preview of the Qwen4 architecture, now open-weight! The production version Qwen3.8-Flash will be available soon via QwenCloud API at just $ 0.16/1M input tokens and $ 0.47/1M output tokens. 125B parameters + 51B N-gram… pic.twitter.com/SScnmzWS7O — Qwen (@Alibaba_Qwen) August 26, 2026
https://x.com/Alibaba_Qwen/status/2092591393424515114?ref_src=twsrc%5Etfw
該模型具備262,144個token的基準上下文視窗,並可擴充至處理最多100萬個token。對於需要處理長篇報告、大型程式碼庫或長時間多輪對話的客戶而言,這樣的規模至關重要,因為上下文視窗較短的模型往往較難有效發揮作用。
Qwen3.8-Flash建構於多模態混合專家架構之上,以1,250億個參數運作。根據阿里巴巴的基準測試,其能力可與Anthropic的Opus 4.6及DeepSeek的V4-Flash模型匹敵。
開發者取用與Qwen4預覽
在商業化部署之際,阿里巴巴同步透過Hugging Face與ModelScope平台公開發布Qwen3.8-Flash-Next模型權重,讓獨立開發者能在私有基礎設施上部署並自訂該模型。
Qwen3.8-Flash-Next同時是即將推出的Qwen4系列之架構藍圖。這項策略性預覽顯示,阿里巴巴正以相當積極的時程推進下一世代旗艦模型的推出。
該公司本月持續維持快速的模型發布節奏。本週稍早,阿里巴巴發表了升級版的AI影片生成平台Wan3.0。
大規模資金注入推動AI擴張
這些產品發布延續阿里巴巴近期宣布的800億港元股權融資計畫,該資金將專用於AI發展,支援全面性的基礎設施建置與先進AI能力開發。
共同創辦人馬雲在近幾個交易日買進超過6億港元的香港上市股票。執行主席蔡崇信與執行長吳泳銘也同樣增加持股,展現領導層對AI策略的信心。
在電商事業營收成長趨緩之際,人工智慧已成為阿里巴巴的主要擴張引擎。Qwen模型生態系位居中國最多人採用的平台之列,並在競爭日趨激烈的國內AI市場中運作。
Qwen3.8-Flash的正式版部署目前已可透過QwenCloud使用,API整合預定於近期推出。