DeepSeek 推出實驗性視覺模型,內部測試顯示表現接近 Anthropic 的 Opus 4.8
重點速覽
- •DeepSeek 於 2026 年 8 月 21 日發表 DeepSeek-V4-Flash-Vision-Exp,首度為其 V4 Flash 模型家族加入影像與螢幕截圖處理能力。
- •這款實驗性模型保留了 DeepSeek-V4-Flash 的文字、推理、代理與一般知識能力,開發者可透過 DeepSeek 的 API 使用。
- •DeepSeek 自行的內部評估顯示,新模型在多模態代理測試中的表現與 Anthropic 的 Opus 4.8 相近,但仍需第三方基準測試來驗證這些說法。
- •此次發布正值中美 AI 競爭升溫之際,包括美國對中國開發商的審視,以及中國延續至 2030 年的國家 AI 投資計畫。
- •據報導,Anthropic 正為可能的首次公開發行(IPO)做準備,最快本月提出申請,據稱 Morgan Stanley、Goldman Sachs 與 JPMorgan 均參與籌備。

中國的 DeepSeek 發表了一款能夠處理影像與螢幕截圖的實驗性多模態 AI 模型,持續擴展其 V4 模型家族;與此同時,全球主要人工智慧開發商——橫跨中國與美國兩地——之間的競爭持續升溫。
這項於 2026 年 8 月 21 日宣布的發布,首度為 V4 系列加入視覺處理能力,而既有的文字系統仍予以保留,並未被取代。影像輸入已成為 OpenAI、Google 與 Anthropic 等前沿模型的標準能力,此次新增也讓 DeepSeek 最新的模型家族跟上這項基準。
DeepSeek 為 V4 Flash 加入視覺能力
DeepSeek 發表了 DeepSeek-V4-Flash-Vision-Exp,這是一款為其 V4 Flash 平台加入視覺處理能力的實驗性模型。使用者可以上傳影像與螢幕截圖,然後要求模型分析內容,或根據所見內容完成任務。
該公司表示,新模型保留了 DeepSeek-V4-Flash 的文字能力,包括推理、代理任務與一般知識。DeepSeek 將這次發布描述為其較新模型家族的多模態擴展,而非取代既有的文字系統。
DeepSeek 表示:「這款實驗性多模態模型在文字能力上與 DeepSeek-V4-Flash 相當——包括代理、推理與世界知識。」
該模型可透過 DeepSeek 的應用程式介面(API)使用,讓開發者能將影像相關功能——例如分析上傳的螢幕截圖——加入自家產品與服務,並在該平台上打造視覺 AI 應用程式。
Walter Bloomberg(@DeItaone)在 X 上分享了這項發布的消息:
DEEPSEEK CHALLENGES ANTHROPIC WITH NEW AI MODEL
DeepSeek has unveiled an experimental multimodal AI model capable of analyzing images, screenshots and text while performing autonomous tasks.
Called DeepSeek-V4-Flash-Vision-Exp, the model reportedly approaches Anthropic's Opus…
— Walter Bloomberg (@DeItaone) August 21, 2026
DeepSeek 將新模型與 Anthropic Opus 4.8 相互比較
DeepSeek 表示,內部評估顯示其新模型在多模態代理測試中的表現,已達到與 Anthropic 的 Opus 4.8 相近的水準。這類測試衡量 AI 系統如何處理同時需要視覺輸入與少量人工指導的任務。這項比較使該實驗性模型直接與 Anthropic 較高階的系統之一正面交鋒。
Anthropic 一向重視其 Claude 系列的代理能力,包括 2024 年底推出的電腦操作(computer-use)功能,該功能讓模型能夠解讀螢幕上顯示的內容,並在應用程式內執行任務——這與 DeepSeek 新模型專為處理的螢幕截圖驅動任務有所重疊。
然而,DeepSeek 的說法是基於其自行進行的測試,仍需更廣泛的第三方基準測試,才能比較不同工作負載下的表現。
DeepSeek 先前已透過 DeepSeek-VL 系列開發視覺語言模型,該系列是較早推出、結合影像理解與語言處理的模型產品線。最新發布將類似的視覺功能帶入較新的 V4 系列,擴大了該平台可處理的任務範圍。這家公司是由中國量化對沖基金 High-Flyer(幻方量化)支持的 AI 實驗室,於 2025 年 1 月因其 R1 推理模型以遠低於美國領先系統所報告的訓練成本,繳出足以與之抗衡的成果,首度引起全球關注。
中美 AI 競爭持續升溫
此次發布之際,中國 AI 公司持續擴展橫跨文字、視覺與代理能力的模型研發。中國也已提出一項延續至 2030 年的國家計畫,呼籲加大對 AI 晶片、大型運算系統、多模態模型、自主代理與區塊鏈技術的投資。
中國開發商也面臨美國官員在先進 AI 競爭上日益升高的審視。近期的討論包括對智慧財產權、模型訓練方法,以及訓練大型模型所需高階運算硬體取得管道的疑慮。
與此同時,據報導 Anthropic 正為可能的首次公開發行(IPO)做準備。該公司最快可能於本月提出申請,據稱 Morgan Stanley、Goldman Sachs 與 JPMorgan 均參與籌備工作。
在 SpaceX 完成 IPO、含超額配售在內募資約 862 億美元之後,這項潛在上市案也受到關注。由於 Anthropic 尚未公布最終發行條件或確認估值,兩家公司之間的比較仍屬推測性質。
DeepSeek 的新模型正是在這樣的競爭環境中登場;與此同時,中國與美國的開發商持續擴展多模態 AI 系統——即結合文字、影像與自主任務執行的模型——以同時滿足消費性與企業用途。