阿里巴巴 Qwen 3.8-27B 鎖定筆記型電腦上的邊緣 AI
重點速覽
- •阿里巴巴雲端於週末發布了採用 Apache 2.0 授權條款的 Qwen 3.8-27B。
- •該模型針對軟體工程、推理與長程任務進行最佳化,並讓使用者能控制推理深度與上下文的保留與否。
- •27B 版本設計為可在筆記型電腦上本機執行,突顯了朝向邊緣 AI 部署發展的趨勢。
- •產業分析師指出,本機執行可協助企業更妥善管理 AI 營運成本與 token 支出。
- •阿里巴巴的邊緣策略也有助於其為在中國銷售的 Apple 裝置導入 AI 功能的計畫。

阿里巴巴雲端發布了旗下旗艦模型的最新版本 Qwen 3.8-27B,再次顯示中美模型開發商在開放模型領域的競爭持續升溫。
這款開放權重模型於週末釋出,採用 Apache 2.0 授權條款,針對軟體工程、推理與長程任務進行最佳化。阿里巴巴表示,該模型可提供更強大的自主規劃能力與對推理的彈性控制,讓使用者能決定模型推理的深度,以及用於輔助推理的上下文要保留還是刪除。
此次發布距離美國廠商 Meta 與 Nvidia 推出各自的新開放模型僅數天,也突顯了將 AI 帶往邊緣裝置的持續趨勢——對需要在效能、隱私與成本之間取得平衡的組織而言,本機執行可能相當重要。與 Meta Muse Glimmer 和 Nvidia 的 Nemotron 3.5 Lightning 一樣,Qwen 較小的 27B 版本也設計為可在筆記型電腦上本機執行。阿里巴巴最強大的模型 Qwen 3.8-Max 擁有 2.4 兆個參數,規模是 Qwen 3.8 的 88 倍。
朝向邊緣部署發展的趨勢,反映出業者日益關注企業的 AI 成本,以及降低成本的各種努力。
Futurum Group 分析師 Bradley Shimmin 表示:「許多公司希望更清楚了解自身的 token 支出、實際從模型中獲得了什麼,以及其中的價值主張。」
邊緣運算的核心是成本
Shimmin 表示,許多企業難以理解透過 API 存取前沿模型的成本。他指出,在本機執行模型可讓組織更妥善地掌控模型營運成本。
Shimmin 說:「這其實是一種應用 FinOps 的方式,也就是將 AI 財務營運化的概念。由於對可觀測性與 FinOps 的關注再度升溫,我們看到這些公司正在微調自身的支出。」
阿里巴巴布局邊緣 AI 市場的另一個原因,是與 Apple 的合作夥伴關係。阿里巴巴將為在中國銷售的 Apple 裝置帶來 AI 功能,而能在邊緣裝置上執行的模型,有助於阿里巴巴觸及當地的 Apple 用戶。
Informa TechTarget 旗下 Omdia 的分析師 Lian Jye Su 表示:「中國所有的 Apple 用戶未來很可能都會使用 Qwen 而非 Gemini,因此 Qwen 鎖定這個市場是有好處的,因為它擁有龐大的既有用戶基礎。」
AI 開源之戰
Su 表示,阿里巴巴在開放模型領域與 Meta 直接競爭並不令人意外,因為 Meta 先前的開放模型相當成功,包括 Llama 系列——該系列自 2023 年推出後,成為最受歡迎的開放模型產品線之一。
Su 說:「有一種論點認為,Meta 確實有能力做出優秀的開放權重模型。對阿里巴巴而言,Qwen 是他們行銷自身非常重要的方式。他們希望繼續扛起開源的大旗。」
Shimmin 表示,過去一年來,阿里巴巴與其他中國業者已成為推動開源的主要力量。
他補充說,多款中國開放模型的釋出,促使 Meta 逆轉了僅發布開放模型的政策,使 AI 市場重新回歸開放模型與封閉專有模型之間的原始平衡——後者長期由美國 AI 實驗室 Anthropic 與 OpenAI 主導。
Shimmin 說:「AI 產業是建立在開源技術的基礎之上。開源的理想是整個生態系的協同合作,而不是被鎖進對使用者不透明的智慧財產權容器中,讓使用者連最基本的問題都難以理解——例如模型為什麼會給出這樣的回答,或他們的支出是如何被運用的。」