新闻宏观经济OpenAI 与 Anthropic 大幅降价,强势挤压开源 AI 模型

OpenAI 与 Anthropic 大幅降价,强势挤压开源 AI 模型

作者: CryptoBriefing·

要点速览

  • •OpenAI 于 7 月 30 日将 GPT-5.6 Luna 价格下调 80%,降至每百万输入 token 0.20 美元、每百万输出 token 1.20 美元,同时将 GPT-5.6 Terra 下调 20% 至 2 美元/12 美元。
  • •Anthropic 于 8 月 10 日将 Claude Sonnet 5 的 introductory 定价转为永久,即每百万输入 token 2 美元、每百万输出 token 10 美元。
  • •9 月 22 日,OpenAI 推出 GPT-6 Sol 和 GPT-6 Luna,定价比上一代低约 50%;Anthropic 则以 4 美元/20 美元 list 价的 Claude Opus 5.5 予以回应,加上相当于约 40% 实际节省的效率提升。
  • •来自中国的 DeepSeek V4 Flash 定价低至约每百万 token 0.14 美元/0.28 美元,一些中国模型以低五到九倍的成本接近美国中端模型的能力。
  • •专有模型的大幅降价缩小了自托管开源模型赖以成立的成本差距,而两家公司备受期待的 IPO 招股文件将显示折扣 token 是否能转化为规模化收入。
OpenAI 与 Anthropic 大幅降价,强势挤压开源 AI 模型

AI 价格战已进入新阶段。2026 年全年,OpenAI 与 Anthropic 系统性地下调其中端模型价格,降幅之大足以促使开发者重新审视:开源替代方案是否仍值得承担自托管的繁琐开销。由于按 token 计费的费用是团队在生产环境中运行 AI 功能的主要经常性成本,如此规模的降价会直接波及整个行业的自建与采购决策。

价格战背后的数字

7 月 30 日,OpenAI 将 GPT-5.6 Luna 的价格下调 80%,降至每百万输入 token 0.20 美元、每百万输出 token 1.20 美元。该公司更高端的 GPT-5.6 Terra 也被下调 20%,至每百万 token 输入 2 美元、输出 12 美元。

Anthropic 随后于 8 月 10 日将 Claude Sonnet 5 的 introductory 定价转为永久,即每百万 token 2 美元/10 美元。

9 月 22 日迎来第二波降价。OpenAI 推出 GPT-6 Sol 和 GPT-6 Luna,定价分别为 2 美元/10 美元和 0.10 美元/0.50 美元,比上一代定价低约 50%。Anthropic 则以 4 美元/20 美元 list 价的 Claude Opus 5.5 予以回应,尽管其内置的效率提升可为用户带来约 40% 的实际节省。

对于刚接触这些定价表的读者:API 定价按每百万 token 计量——token 是模型处理的字词与字符片段——输入(模型接收的文本)的价格通常低于输出(模型生成的文本)。

开源为何承压

自托管开放权重模型虽然不产生按 token 计费的费用,但会将成本转移到 GPU 硬件、工程时间和全天候运维上。专有模型每次官价下调,都在缩小自托管赖以证明其开销合理性的差距。

企业正日益将工作负载分层。廉价的专有模型处理摘要、分类和基础客户交互等日常任务,而高端模型则保留给性能差异真正重要的专用工作负载。

开源仍然占据可观的用量份额,尤其是在 OpenRouter 这类平台上,开发者可以通过单一集成混搭多种模型。

中国因素

中国 AI 公司一直在设定极低的价格基准,使即便下调后的美国定价也显得昂贵。DeepSeek V4 Flash 的定价低至约每百万 token 0.14 美元/0.28 美元,大幅低于美国同行。在高用量场景下,这样的差距会迅速累积为大规模工作负载下截然不同的月度账单。

性能差距也在缩小。一些中国模型现在的成本仅为美国的五分之一到九分之一,却能接近美国中端模型的能力。

IPO 算术与利润率压力

市场普遍预期 OpenAI 与 Anthropic 都将寻求 IPO。激进降价可提升采用率和用量指标,但也会压缩利润率。他们的赌注是:更低的价格带来更高的用量,而更高的用量最终能弥补每次 API 调用上更薄的利润率。

在上市前夕,这种取舍显得尤为重要,因为投资者通常会同时审视增长与盈利能力。作为私营公司,两家公司目前均未公布经审计的财务数据,因此其最终的 IPO 招股文件将让业界首次得以确切了解,折扣 token 是否正在转化为规模化收入。