新闻宏观经济AI 模型路由引发关于用户实际获得内容的法律问题

AI 模型路由引发关于用户实际获得内容的法律问题

作者: MarkTechPost·

要点速览

  • AI 提供商和聚合平台越来越多地将用户请求路由到替代模型或量化权重,以降低推理成本并管理网络安全。
  • 模型身份的精确性受到三类不同工程问题的影响:模型替代、通过量化造成的降级,以及静默权重漂移。
  • 在路由层替换 AI 模型会给商业合同带来歧义:买方购买的究竟是特定模型名称,还是一种通用能力。
  • 在法律程序中,AI 路由会扰乱监管链,可能导致当事方无法认证某段文本究竟由哪一个 AI 模型生成。
  • 专家建议使用加密签名,为每个 API 响应所使用的确切模型、权重和精度建立不可伪造的记录。
AI 模型路由引发关于用户实际获得内容的法律问题

响应对象中标明的模型

用户调用一个 API,并传入 model: “claude-fable-5”。响应返回一段补全内容、一个 token 计数,以及一个字段,内容为 “model”: “claude-opus-4-8”

没有抛出错误,也没有发生重试。在生成开始之前,请求已被分类,匹配到一个敏感类别,并被路由到一组完全不同的权重。Anthropic 在 7 月 1 日重新上线 Fable 5 时记录了这一流程:被阻止的请求会改由 Opus 4.8 处理,并通知用户。替代发生在 API 层,响应对象会标明实际生成输出的模型。

这是透明的版本。它似乎也是少数已广泛部署、能够在响应链路内告知用户实际运行模型的做法之一。随着更大模型推高推理成本,请求级路由变得更加常见,促使提供商和中介平台将每个查询匹配给能够处理它的最低成本模型。

两周后,Cursor 推出了 Router,这是一个基于超过 600,000 条实时请求训练的分类器。Router 会读取每个查询的上下文、复杂度和领域,然后将请求发送给其判断最合适的模型。Cursor 表示,三个早期访问账户报告称,与将所有请求都路由到 Opus 4.8 相比,节省了 30–50% 的成本。Cursor 公布了其路由规则,但没有为每种任务类型指定具体模型。

在聚合层,OpenRouter 警告称,一些提供商会以更低价格提供量化权重。它还表示,输出可能不同于全精度权重本应生成的结果,而且用户日志不会显示这种情况曾经发生。

这三个产品对“什么是模型”这一问题给出了三种不同答案。尚无法院裁定法律会接受哪一种答案。

模型名称失去精确性的三种方式

模型身份正沿着三个相互独立的轴线分裂,而这些问题常常被混为一谈。

替代发生在分类器将请求分发给不同架构、不同权重或不同能力画像时。例如,Fable 5 被路由到 Opus 4.8,或者 Cursor Auto 将请求发送给其路由器在该轮选择的任意模型。

降级发生在同一个模型以降低精度的方式提供服务时。OpenRouter 暴露 quantizations 参数,是因为量化端点在某些提示词上的表现可能更差。默认情况下,请求会在按价格排序的提供商之间进行负载均衡。请求中可能显示同一个模型名称,但另一端使用的计算精度可能不同。

漂移发生在同一个名称指向被静默更新的权重时。生产环境中的 -latest 别名是一种未版本化依赖,类似于没有固定版本的包清单。模型提供商通常会同时使用带日期的快照标识符和别名,但除非供应商发布相关信息,否则别名本身并不包含弃用或变更日志。

工程师通常将替代、降级和漂移视为可靠性问题。它们也是身份问题,而身份正是合同、担保、披露和证据规则的核心。

用户实际购买了什么?

商法问题首先要看:描述是否构成交易条款。

如果 API 调用被视为货物买卖,这个问题会相对直接。UCC §2-313(1)(b) 规定,任何构成交易基础一部分的货物描述,都会成为明示担保,即货物将符合该描述。印度《1930 年货物销售法》第 §15 条通过按描述销售原则发挥类似作用。

然而,推理 API 不太可能被视为货物。法院通常将托管软件定性为服务,这会使问题脱离担保法框架,进入普通法合同领域。当一项交易同时包含货物和服务时,美国法院会适用主要目的测试,考察交易实质而非其标签。在这一框架下,答案取决于文档如何表述,以及买方议价时有多具体。歧义正是在这里出现。企业协议按模型定价。模型卡针对具体模型。合规材料标明模型版本。然而,路由层可能将模型名称视为提示,而非固定指令。

从软件角度看,利害关系最清楚:如果代码固定的是模型 ID,而不是表达能力要求,那么行为可能发生实质变化,却不会触发任何错误。以同样方式起草的合同也存在同样缺陷。如果买方议价购买的是一个名称,替代可能构成违约。如果买方议价购买的是一种能力,替代可能是允许的——但这时各方就需要一个经得起审查的“前沿质量”定义。

目前并不存在已确立的定义。Cursor 的 Router 展示了这一问题。它通过线上 A/B 测试进行评估,并将用户满意度作为奖励信号进行优化。这可能是合理的工程选择,但作为合同衡量标准则很棘手。满意度并不等同于符合约定。用户没有注意到模型被替换,可能说明路由器运行良好,但并不证明交付了指定产品。

披露梯度

根据 FTC 欺骗性行为原则,如果一项陈述具有重大性,并且可能误导理性消费者,就可能构成可追责行为。客观性能声明在发布前还需要具备合理依据。这两个概念都与 AI 路由有关。

这三个产品处在披露光谱上的不同位置。Anthropic 会通知用户,并在响应中返回实际提供服务的模型。Cursor 公布路由规则,但不披露每类任务对应的模型分配。OpenRouter 在文档中披露量化差异,并允许用户通过参数进行控制,但该设置是选择退出式,默认路径是低成本路线。

如果披露信息位于文档中,并且默认设置不利于用户,这类似于监管机构在其他消费市场中称为暗黑模式的事实情形。

在论证依据方面,法律风险附着于声明,而不是路由机制本身。评论人士已经指出,类似“便宜 60%,质量无损”的声明需要公布方法论来支撑。Anthropic 自身的披露显示了坦诚的代价:它明确表示,重新训练的分类器在日常编码和调试过程中会更频繁地标记良性请求。这句话起到了责任防护的作用。未能提供类似具体说明的供应商可能会面临更严格审查。

2024 年 8 月生效的《欧盟 AI 法案》增加了一条平行的透明度路径。其关于通用 AI 模型的条款要求提供商发布技术文档并保持更新,同时与下游部署方合作,使其能够理解模型的能力和限制。这些义务如何适用于可能按请求替换模型的路由层,尚未经过检验。

这里还存在竞争法问题。关于推理市场纵向封锁的工作论文已经提出了围绕路由透明度、服务质量平等和类似 FRAND 的非歧视原则建立行为框架。由第一方模型供应商运营的路由器,可能成为一种以成本优化为名的自我优待机制。

认证可能成为核心争议

最重要的法律问题可能不是计费,而是认证。

《联邦证据规则》901(b)(9) 通过描述产生输出的流程或系统,并证明该流程能够产生准确结果,来认证输出。FRE 902(13) 和 902(14) 更进一步,允许由电子系统生成的记录或通过哈希验证的数据,通过认证实现自我认证。印度《Bharatiya Sakshya Adhiniyam, 2023》第 §63 条发挥类似作用,将电子记录的可采性建立在一份证书之上,该证书需识别记录及其生成方式。

这些条款都假设系统是可以被命名的。

设想一种情形:一名律师提交了一份包含虚构引文的法律文书,制裁程序随即启动。法院询问是哪一个模型生成了这段文本。律所日志显示是 Fable 5。提供商日志显示分类器被触发,Opus 4.8 作出了回答。另一种可能是,请求经过了一个 IDE 路由器,该路由器选择了律所无法重建的模型,使用了律所从未指定的精度,并且该版本后来已被停用。

在这种情况下,监管链在路由器处断裂——不是在模型处,而是在分发器处。断裂会双向产生影响。试图认证自身输出的一方可能无法做到,而质疑对方输出的一方则获得了一个独立的可靠性论点,专家可能难以反驳。

证据开示又增加了另一个问题。根据美国民事诉讼程序,保存潜在相关信息的义务在可合理预见诉讼时即产生,而不是在传票到达时才产生。路由决策可能成为具有决定意义的事实。这使得路由器分类器日志、逐请求模型分配和精度元数据,可能成为目前未必有义务保留这些数据的供应商需要披露的材料。

拟议的修复方式是签名,而不仅仅是合同条款

仅靠合同可能无法解决问题,因为争议中的陈述涉及运行时事件,而合同是静态文件。

法律体系最终可能要求可证明的模型身份:每个响应都返回一份签名断言,将补全内容绑定到一个元组,其中包括实际服务的模型标识符、权重哈希、精度和系统提示词哈希。该断言将由植根于硬件认证的密钥签名,而 NVIDIA Hopper 架构及其 Confidential Computing 功能等机密计算 GPU 平台已经支持这种能力。

部分基础机制已经存在。响应对象可以携带实际服务模型的名称。缺失的是使该信息具有法律用途的属性:断言必须不可伪造,并且买方必须能够在不信任卖方的情况下验证它。响应头中的哈希可以为模型身份发挥类似 FRE 902(14) 已经为复制数据发挥的作用:将一个有争议的事实问题转化为证书。

路由可以是合理的工程实践。但在当前,它也可能构成对用户以为自己选择之物的未记录、未签名、不可验证的替代。模型 ID 已悄然成为法律标识符,而尚未解决的问题是,它究竟标识什么。

来源

Cursor,“Introducing Cursor Router”(22 July 2026)—

MarkTechPost,“Cursor Releases Cursor Router: A Request-Level Classifier Delivering Frontier Coding Quality at 30–50% Lower Cost”(22 July 2026)— https://www.marktechpost.com/2026/07/22/cursor-releases-cursor-router-a-request-level-classifier/

Anthropic,“Redeploying Claude Fable 5”(30 June 2026)—

Espressio,“Claude Fable 5 Safeguards: The Opus 4.8 Fallback Explained”(22 June 2026)—

Digital Applied,“Why Claude Just Got More Cautious About Your Code”(2026)—

OpenRouter,“Provider Routing — Provider Selection”(docs)—

OpenRouter,“Lowest-Cost LLM Inference: The Complete OpenRouter Guide”(12 June 2026)—

OpenRouter,“How OpenRouter Model Routing Works”(12 June 2026)—