阿里巴巴(BABA)Qwen团队发布Qwen3.8-Flash,AI训练成本削减89%
要点速览
- •阿里巴巴发布了 Qwen3.8-Flash,这是一款面向编程和办公生产力任务的多模态 AI 模型。
- •公司称该模型的训练成本约为 Qwen3.7-Plus 的 11%,同时在代码和生产力基准测试中表现提升。
- •Qwen3.8-Flash 的默认上下文窗口为 262,144 个 token,最高可扩展至 100 万个 token。
- •阿里巴巴在 Hugging Face 和 ModelScope 上发布了 Qwen3.8-Flash-Next,作为开源模型以及 Qwen4 架构的早期预览。
- •此次发布发生在阿里巴巴推进 HK$80 billion AI 融资计划,以及 Jack Ma、Joe Tsai 和 Eddie Wu 近期增持之后。

要点摘要
- Qwen3.8-Flash 以增强的多模态能力亮相,擅长编程和生产力应用
- 训练开支降至 Qwen3.7-Plus 成本的约 11%
- 默认处理容量为 262,144 个 token,可扩展至 100 万个 token,以支持更大规模应用
- Qwen3.8-Flash-Next 以开源形式发布,为 Qwen4 架构设计提供早期线索
- 此次发布与阿里巴巴 HK$80 billion 的融资以及 Jack Ma 超过 HK$600 million 的内部买入相呼应
周三,阿里巴巴(BABA)推出了 Qwen3.8-Flash,这是由其 Qwen AI 团队开发的新人工智能模型。此次发布的重点是增强编程任务和办公生产力应用能力,显示公司正将 AI 更深入地引入实际企业工作流程,而不仅仅停留在研究演示层面。
Qwen3.8-Flash 的经济性构成了重要突破。训练成本约为 Qwen3.7-Plus 所需的 11%——相当于降低了 89%——而阿里巴巴表示,该模型在代码基准测试和办公生产力场景中的表现更优。API 定价为每 100 万个输入 token 0.16 美元、每 100 万个输出 token 0.47 美元。对于中国市场用户,这相当于每 100 万个 token 的输入收费 1 元、输出收费 3 元。
Meet Qwen3.8-Flash, a multimodal MoE and an early preview of the Qwen4 architecture, now open-weight! The production version Qwen3.8-Flash will be available soon via QwenCloud API at just $ 0.16/1M input tokens and $ 0.47/1M output tokens. 125B parameters + 51B N-gram… pic.twitter.com/SScnmzWS7O — Qwen (@Alibaba_Qwen) August 26, 2026
https://x.com/Alibaba_Qwen/status/2092591393424515114?ref_src=twsrc%5Etfw
该模型的基础上下文窗口为 262,144 个 token,并可扩展至处理 100 万个 token。这一容量足以处理长篇文档、长时间对话,以及数据密集型研究应用。
Qwen3.8-Flash 基于多模态专家混合(MoE)框架构建,拥有 1250 亿个参数。根据阿里巴巴的基准测试,该模型的能力可与 Anthropic 的 Opus 4.6 和 DeepSeek 的 V4-Flash 模型相媲美。
开发者访问与 Qwen4 预览
与商业部署同步,阿里巴巴通过 Hugging Face 和 ModelScope 平台公开了 Qwen3.8-Flash-Next 的模型权重。这使独立开发者能够在私有基础设施上部署并定制该模型。
Qwen3.8-Flash-Next 也作为即将推出的 Qwen4 系列的架构蓝图。这一战略性预览表明,阿里巴巴正以积极的节奏推进下一代旗舰模型的发布。
就在本周早些时候,公司还发布了 Wan3.0,即其增强版 AI 视频生成平台。阿里巴巴本月一直保持着密集的模型发布节奏。
大规模资本注入推动 AI 扩张
这些产品发布紧随阿里巴巴近期宣布的 HK$80 billion 股权融资计划,该计划专门用于 AI 发展。这笔资金将支持全面基础设施建设以及先进 AI 能力开发。
联合创始人 Jack Ma 在近期交易中购入了超过 HK$600 million 的港股。执行董事长 Joe Tsai 和首席执行官 Eddie Wu 也同样增持了持股,显示管理层对 AI 战略的信心。
在电子商务收入增长放缓之际,人工智能已成为阿里巴巴主要的扩张引擎。Qwen 模型生态系统是中国最广泛采用的平台之一,并在竞争日益激烈的国内 AI 领域中运作。
Qwen3.8-Flash 的生产部署目前可通过 QwenCloud 使用,API 集成预计将很快推出。