一份招聘启事、一期播客和一次报警,拼出了 Anthropic 安保体系的轮廓
这篇 9 月 9 日刊出的调查署名 Daniel Boguslaw,主要依据两类公开材料。第一类是招聘信息:Anthropic 的 Global Safety, Intelligence, and Security(GSIS)团队在招一名 Enterprise Intelligence Specialist,年薪区间 18 万到 23 万美元,职责写的是「识别、评估、追踪并调查全球威胁」,列举的威胁类型包括地缘政治动荡、恐怖主义、犯罪、国家行为体对 AI 行业的针对——以及 activism,也就是社会运动与抗议。
把抗议列为风险源,在大公司威胁情报岗的职位描述里并不罕见。但对一家反复强调「负责任 AI」的公司来说,activism 和恐怖主义并排出现,这一个词就足够成为批评者的靶子。
第二类材料是一期播客访谈。Anthropic 全球安全运营中心经理 Keon Ellison 和安全运营经理 Zach Melvin 在节目里谈到日常工作,同场的还有风险检测公司 Samdesk 的 CEO James Neufeld。Ellison 讲了一个案例:一位高管前往某大城市出差时,Anthropic 收到当地有抗议计划的情报;组织者因为许可问题把抗议时间提前,Samdesk 让他们提前大约 60 分钟得知了这一变化。按 Ellison 的说法,多出来的这一小时很关键,否则高管散会出门就会直接撞进混乱现场。
单看这个案例,它就是一次常规的高管保护。引发争议的是报道描述的整体方向:不只是被动应对,而是持续追踪特定人群、在事情发生前做预测,某些情况下还会在犯罪发生之前就向警方报告嫌疑人。批评者因此给它贴上了「pre-crime」(犯罪预判)的标签。
报道还援引了《旧金山标准报》9 月 4 日的一则新闻:一名用户在与 Claude 的对话中称自己买了一支 AR-15 步枪,并把 CEO Dario Amodei 放进了「瞄准范围」。Anthropic 随后向旧金山警察局报案。可当记者联系上这名用户时,对方称自己只是在胡说。另据相关报道,Anthropic 援引内部政策,没有向警方出示原始聊天记录。
这件事比招聘启事更耐琢磨。面对具体的人身威胁,报警本身无可厚非,多数 AI 公司的隐私条款也都保留了在紧急安全情况下向执法部门披露信息的权利。真正悬而未决的是另一层:用户与模型的对话,会不会、在多大程度上成为这套威胁情报体系的输入。如果会,Claude 的使用者和街头的抗议者,其实处在同一张雷达上。
AI 公司面临的线下风险并非虚构。过去一年多,旧金山几家 AI 公司的办公楼外反复出现抗议,有人在 Anthropic 总部门口绝食,也有抗议者因堵门被捕。从安保角度看,有专门团队盯着这些动向是可以理解的。
但安保和监视的分界,恰恰落在报道里那几处没有答案的地方:被标记为「威胁」的门槛是什么,追踪到的信息保存多久、与谁共享,被预测为高风险的人有没有任何途径得知自己被盯上、提出异议。Anthropic 没有回应置评,这些问题只能暂时悬着。一家把「宪法」写进模型训练的公司,给自己的安保体系定了什么规则,外界至今看不到一个字。