报告把规模最大的一次蒸馏归因于阿里巴巴关联账户,并首次公开披露生物武器相关的滥用检测。
这份报告和以往同类披露最大的不同,是把「蒸馏」单独列成了一类危害。过去这类文档主要谈网络攻击和影响力行动,这次 Anthropic 把矛头相当明确地指向了几家在训练自家模型时、疑似把 Claude 当成免费老师的实验室。归因全部出自 Anthropic 自己的评估,被点名的公司暂无公开回应,下面的数字与措辞都按报告口径转述。
报告把滥用分成网络行动、影响力行动、监视、诈骗、生物滥用、常规武器研发和非法蒸馏七类。Anthropic 特别说明,这是它第一次公开披露检测到有人试图借其模型辅助生物武器相关工作;同时强调最高能力档的 Mythos 级模型配了一套「大幅削弱有害网络任务能力」的防护。换句话说,报告既在讲坏人怎么用,也在替自家防线背书。
报告把「谁在抄」摊开成了一张表,按它给出的对话量排列:
手法上,报告描述的核心动作是「转发」——把自己用户的提问原样发给 Claude,再把 Claude 的回答返给用户,中间用虚假身份、一次性邮箱、虚拟支付卡和盗用的 API 密钥掩护来路。这类做法很难从单次请求里看出问题,Anthropic 说它是靠账户群的行为模式而不是单条对话把它们串起来的。
蒸馏之外,报告花了不小篇幅讲两组网络行动:一组标注为中文使用者(编号 GTG-10007),据称位于长沙、以约 50 个机构为目标、部署了 13 个常驻收集代理;另一组关联俄罗斯(GTG-20006,报告将其与「午夜暴风雨」关联),涉及 20 多个组织,其 AI 代理甚至能在自己投放的恶意软件被安全产品标记后,自主改写并重新部署。监视类里,报告称有账户借 Claude 处理维吾尔相关信息、生成宗教团体与流亡群体的档案,也有用户自称是国家信息安全官员。这些指控同样只有 Anthropic 一方的证据,读的时候得记住这一点。
真正会落到普通使用者头上的,是报告末尾那句运维变化:Anthropic 说它现在更多按「组织」而非逐个账号来封禁,并且当流量来自它不支持的国家(包括中国)时,可能会要求身份验证。对每天靠代理访问的人来说,这意味着账号风控的颗粒度只会更细,一次来路可疑的登录就可能换来额外的核验步骤——想先弄清自己的出口 IP 会不会被判成异常来源,不妨拿这份自查对照一下再登录。