DeepSeek 发布实验性视觉模型,称内部测试性能接近 Anthropic 的 Opus 4.8
要点速览
- •DeepSeek 于 2026 年 8 月 21 日发布 DeepSeek-V4-Flash-Vision-Exp,首次为其 V4 Flash 模型家族加入图像和截图处理能力。
- •这款实验性模型保留了 DeepSeek-V4-Flash 的文本、推理、智能体和通用知识能力,开发者可通过 DeepSeek 的 API 使用。
- •DeepSeek 自身的内部评估显示,该模型在多模态智能体测试中的表现与 Anthropic 的 Opus 4.8 相近,但仍需要第三方基准测试来验证这些说法。
- •此次发布正值中美人工智能竞争升级之际,包括美国对中国开发商的审视以及中国面向 2030 年的国家人工智能投资规划。
- •据报道,Anthropic 正在筹备可能的首次公开募股(IPO),最早可能于本月提交申请,据称摩根士丹利、高盛和摩根大通参与了筹备工作。

中国的 DeepSeek 推出了一款能够处理图像和截图的实验性多模态人工智能模型,扩展了其 V4 模型家族。与此同时,全球主要人工智能开发者——包括中国和美国的企业——之间的竞争持续加剧。
此次发布于 2026 年 8 月 21 日公布,首次为 V4 系列加入视觉处理能力,而现有文本系统仍继续保留,并未被取代。图像输入已成为 OpenAI、Google 和 Anthropic 等前沿模型的标准能力,此次升级使 DeepSeek 的最新模型家族达到了这一基准。
DeepSeek 为 V4 Flash 增加视觉能力
DeepSeek 发布了 DeepSeek-V4-Flash-Vision-Exp,这是一款为其 V4 Flash 平台增加视觉处理能力的实验性模型。用户可以上传图片和截图,然后让模型分析内容或根据所见完成任务。
该公司表示,新模型保留了 DeepSeek-V4-Flash 的文本能力,包括推理、智能体任务和通用知识。DeepSeek 将此次发布描述为其较新模型家族的多模态扩展,而非对现有文本系统的替代。
DeepSeek 表示:“这款实验性多模态模型在文本能力上与 DeepSeek-V4-Flash 相当——包括智能体、推理和世界知识。”
该模型可通过 DeepSeek 的应用程序编程接口(API)使用,开发者可以借此在自己的产品和服务中加入基于图像的功能——例如分析上传的截图——并在该平台之上构建视觉 AI 应用。
该发布的消息由 Walter Bloomberg(@DeItaone)在 X 上分享:
DEEPSEEK CHALLENGES ANTHROPIC WITH NEW AI MODEL
DeepSeek has unveiled an experimental multimodal AI model capable of analyzing images, screenshots and text while performing autonomous tasks.
Called DeepSeek-V4-Flash-Vision-Exp, the model reportedly approaches Anthropic's Opus…
— Walter Bloomberg (@DeItaone) August 21, 2026
DeepSeek 将新模型与 Anthropic Opus 4.8 进行对比
DeepSeek 表示,内部评估显示其新模型在多模态智能体测试中的表现与 Anthropic 的 Opus 4.8 处于相近水平。这类测试衡量人工智能系统如何处理既需要视觉输入、又只需有限人工指导的任务。这一对比使该实验性模型直接与 Anthropic 的高端系统之一展开较量。
Anthropic 一直强调其 Claude 系列的智能体能力,包括 2024 年底推出的“计算机使用”(computer-use)功能,该功能使模型能够解读屏幕上显示的内容并在应用程序内执行任务——这与 DeepSeek 新模型旨在执行的截图驱动任务存在重叠。
不过,DeepSeek 的说法基于其自身的测试,仍需要更广泛的第三方基准测试来比较不同工作负载下的性能。
DeepSeek 此前已通过 DeepSeek-VL 系列开发视觉语言模型,这是一个较早的模型系列,将图像理解与语言处理相结合。最新发布将类似的视觉功能引入较新的 V4 系列,扩展了该平台可处理的任务范围。该公司是由中国量化对冲基金幻方(High-Flyer)支持的 AI 实验室,于 2025 年 1 月首次引起全球关注,当时其 R1 推理模型以仅相当于美国领先系统所报道训练成本一小部分的成本,实现了与之竞争的结果。
中美人工智能竞争持续升温
此次发布之际,中国人工智能企业正继续在文本、视觉和智能体能力方面扩展模型研发。中国还出台了一项面向 2030 年的国家规划,呼吁加大对 AI 芯片、大型计算系统、多模态模型、自主智能体和区块链技术的投资。
中国开发商在先进人工智能领域还面临着美国官员日益严格的审视。近期的讨论涉及对知识产权、模型训练方法以及训练大型模型所需高端计算硬件获取渠道的担忧。
与此同时,据报道 Anthropic 正在筹备可能的首次公开募股(IPO)。该公司最早可能于本月提交申请,据称摩根士丹利、高盛和摩根大通参与了筹备工作。
在 SpaceX 完成一轮募资约 862 亿美元(含超额配售)的 IPO 之后,这一潜在的上市计划备受关注。由于 Anthropic 尚未公布最终发行条款或确认估值,两家公司之间的比较仍属推测。
DeepSeek 的新模型正是在这一竞争环境中问世,中国和美国的开发者正继续扩展多模态人工智能系统——即结合文本、图像与自主任务执行的模型——以服务于消费级和企业级应用。