Anthropic报告详述人工智能在网络犯罪、影响力行动和国家行动中的应用
要点速览
- •该报告涵盖俄罗斯、中国、伊朗及其他地区发现并被阻止的高端滥用案例,而非衡量典型滥用活动的发生频率。
- •威胁行为者利用多代理系统自动执行网络行动,包括网络钓鱼、恶意软件开发、凭据窃取和数据外泄。
- •Anthropic在记录的活动中发现了影响力行动、监控项目、武器项目和双重用途生物研究。
- •该公司指控多家中国实验室秘密提取Claude的输出和推理痕迹,以训练竞争模型;部分中转活动据称暴露了敏感数据。
- •Anthropic表示,除一起与蒸馏有关的事件外,其他案件均未涉及其能力最强的Fable或Mythos模型。

AI研究公司Anthropic发布了最新的威胁情报报告《检测和应对AI滥用:2026年9月》,详细介绍了恶意行为者试图将其Claude模型武器化,用于网络行动、影响力行动、监控、生物研究、武器开发、欺诈和模型蒸馏。
该报告涵盖了2025年12月至2026年8月期间被发现并予以阻止的活动。这些案件涉及疑似国家支持的团体、以经济利益为动机的犯罪分子、商业间谍软件供应商以及在俄罗斯、中国、伊朗和其他地区开展活动的宣传机构。
Anthropic表示,除蒸馏部分描述的一起案件外,其他记录在案的滥用事件均未涉及其能力最强的Fable或Mythos级模型。该公司还强调,披露的事件并不代表典型的滥用情况,而是从迄今发现的活动中选取的最复杂、最具新颖性的威胁。这意味着,该报告记录的是已被记录的高端滥用活动,而不是衡量这些活动发生的频率。Anthropic表示,在每起案件中,公司都封禁了相关账户,根据调查结果加强了安全防护措施,并与有关部门及行业合作伙伴共享了情报。
We're publishing our most detailed threat intelligence report to date. It covers how people tried to misuse Claude—for cyberattacks, influence operations, surveillance, biology, and building weapons—and how we found and stopped them. We disrupted every operation in the report,… — Anthropic (@AnthropicAI) September 10, 2026
https://x.com/AnthropicAI/status/2098097512544444447?ref_src=twsrc%5Etfw
从助手到协调者:关键发现
报告的核心结论是,AI在网络犯罪中的角色已经从提供建议的工具转变为行动协调者。在所调查的大多数行动中,威胁行为者部署了多代理框架,自动执行侦察、漏洞利用、凭据窃取和数据外泄等任务。人类参与者主要负责选择目标并审查结果。
一个值得注意的案例是GTG-20006,该行动与俄罗斯国家关联团体Midnight Blizzard有关。该团体使用AI驱动的工作流程开展网络钓鱼、恶意软件开发和规避检测,并在安全产品发现其工具包后自动重建工具。另据了解,疑似与ShinyHunters有关联的成员利用AI将凭据窃取规模化,通过反编译1.8 million个Android应用程序来寻找机密信息,并在短至两到三小时内完成入侵。
在网络行动之外,Anthropic还记录了针对摩尔多瓦、肯尼亚、马来西亚和孟加拉国选举及公众舆论的影响力行动。报告还描述了在中国、伊朗和马里开展的与国家立场一致的监控活动,其中包括一个旨在监控约25 million名移动用户的平台。
报告还确认了武器开发活动,包括也门的制导火箭项目和俄罗斯的自主无人机群项目。关于生物领域的滥用,报告列出了五起双重用途研究案例,包括涉及基孔肯雅病毒的功能获得研究以及禽流感适应性研究。Anthropic表示,其分类器在很大程度上遏制了这些活动。
报告还详细介绍了被归因于中国实验室的非法蒸馏行动,其中包括Alibaba、DeepSeek、Moonshot AI、Xiaomi和Zhipu。Anthropic指控这些实验室秘密将用户查询转发给Claude,收集推理痕迹,并利用生成的输出训练竞争模型。在数起案件中,这种中转据称在用户不知情的情况下,将敏感的企业和政府数据暴露给了第三方。
Anthropic将这次披露描述为警告和路线图。该公司表示,随着AI模型能力不断增强,AI行业和各国政府开展协调一致的检测与防御工作,对于领先于持续存在的对手至关重要。