新闻宏观经济DeepSeek-V4-Flash-High以近乎零成本跻身前端代码竞技场第七名

DeepSeek-V4-Flash-High以近乎零成本跻身前端代码竞技场第七名

作者: CryptoBriefing·

要点速览

  • DeepSeek-V4-Flash-High在前端代码竞技场Pareto Frontier中获得1586分,总排名第七,在开源权重模型中排名第三。
  • 该模型采用混合专家设计,总参数量2840亿,推理时仅有130亿参数处于活跃状态。
  • 定价为每百万输入token $0.14、每百万输出token $0.28,比同等基准测试表现的主要闭源替代方案低数个数量级。
  • DeepSeek的V4-Flash API公开测试版于2026年7月31日上线,与基准测试结果发布同步。
  • 另一款中国AI模型Kimi-K3目前以约1679至1682分位居前端代码竞技场排行榜首位。
DeepSeek-V4-Flash-High以近乎零成本跻身前端代码竞技场第七名

DeepSeek再次证明,构建顶级编程模型并非必须依赖闭源模式。该公司的V4-Flash-High变体在arena.ai前端代码竞技场Pareto Frontier中得分1586,总排名第七,在开源权重模型中排名第三。这一成绩较之前的DeepSeek V4-Pro-Preview提升了154分。

基准测试细节与架构

前端代码竞技场由arena.ai托管,旨在评估AI模型生成功能性前端代码的能力——这一任务不仅要求语法正确,还需保证视觉渲染的准确性,是对模型实际编程能力的更严格测试之一。Pareto Frontier得分专门衡量性能与成本之间的权衡,这意味着模型不能仅凭能力取胜,而必须在相应价格水平上交付强劲的成果。

DeepSeek-V4-Flash-High基于混合专家架构构建,总参数量达2840亿,但每次推理仅有130亿参数处于活跃状态。这种稀疏激活模式与开源权重生态中其他领先模型的做法类似,使模型能够在保持庞大知识库的同时,将推理计算需求控制在接近更小规模网络的水平。定价为每百万输入token $0.14、每百万输出token $0.28——比同等基准测试表现的主要闭源提供商低数个数量级。该模型还提供100万token的上下文窗口,能够一次性处理和推理大型代码库——这一能力对于智能体编程工作流尤为重要,因为AI需要在修改代码之前理解整个项目。

另一款中国AI模型Kimi-K3目前以约1679至1682分位居总排行榜首位。

更广泛的AI格局与去中心化计算

此次发布对Akash、Render和io.net等去中心化计算网络具有重要意义,这些网络专门提供GPU资源来运行此类模型。一款强大的开源权重模型以每百万token $0.14的价格发布,进一步验证了AI推理可以商品化的论点——而这正是去中心化计算协议正在积极开拓的市场。

DeepSeek-V4-Flash-High还在消费产品应用类别中排名前四,在数据与分析、游戏以及品牌与营销类别中均位列前七。

包括DeepSeek、Kimi和Z.ai在内的中国AI实验室正在集体推进开源权重模型的能力边界,从质量和成本两个维度不断缩小与美国闭源领先者的差距。

API可用性

DeepSeek的V4-Flash API公开测试版于2026年7月31日上线,与基准测试结果的发布同步进行。