从一条辞职帖到电视演播室,两天里这段警告的措辞一路加码;而它真正的分量,来自说话的人此前站在哪儿。
时间线很短。据多家外媒报道,Coxon 在 9 月 8 日离开 Anthropic,公开理由是他认为这个行业正在「拿我们所有人的命下注」。他此前在 OpenAI 和 Anthropic 都做过研究岗,这层履历让那段话传得比一般的离职声明远得多——报道称他那条帖子一夜之间接近 7600 万次浏览,华尔街日报、彭博、金融时报、Axios、Politico、CNBC 与纽约时报随后陆续跟进。
到出现在福克斯新闻的访谈里时,措辞已经从「行业在赌博」推进到了具体类比:他说人类知道怎么控制核武器,但还不知道怎么控制 AI,并把 AI 称为可能是人类造过最危险的技术。CNBC 的报道中还转述了一个更刺眼的数字——他给出的「杀死全人类」概率高于 10%。这类数字无法被证伪,但它由当事人自己抛出,不是媒体加工出来的。
把细节剥掉,Coxon 的核心指控只有一句:造这些系统的人私下相信它可能在这个十年内杀死所有人,公开场合却用另一套克制得多的措辞。这句话的杀伤力不在末日预测本身——那在 AI 安全圈是老话题了——而在于它指向可信度。如果内部风险评估与对外表态长期不一致,外界读到的任何一份安全承诺都得打折扣。
他给的解法顺着同一条逻辑:既然公司管不住彼此的竞速,就需要外部监管,而且必须是国际层面的,因为一国单独收紧只会把算力和人推去别处。他说国际军备竞赛会是灾难,全球协作是唯一出路。
核控制之所以能做,是因为它有物理抓手:裂变材料稀缺、可计量、可核查,浓缩设施藏不住,核查机构能派人上门数东西。模型权重没有一样对得上——它是可无限复制的文件;训练算力虽然集中,用途却难以区分;能力提升也不像当量那样有清晰刻度。所以「像管核武器一样管 AI」在直觉上成立,在执行层面缺的恰恰是让核体系跑起来的那几件东西。
这不等于监管无从下手,而是说抓手大概率不在「禁止」那一端,而在算力申报、模型评测公开、事故披露这些更琐碎的地方。Coxon 把话讲到「需要国际合作」为止,再往下的机制设计他没有给,采访也没有追问。
同一段警告,从不同公司出来分量不一样。Anthropic 对外的叙事一直建立在「我们是更在意安全的那家实验室」之上,一名安全方向研究员的离职声明因此天生更响:不是外部批评者在喊,而是被这套叙事雇来的人不认了。这才是这条消息能在两天内滚上主流电视台的原因,而不是那 7600 万次浏览。
最后这条是整件事的注脚。一个人用一次辞职换来了两天的议程设置权,但这份影响力有没有超出这两天,连百科编者都拿不准。真正值得盯的不是他这周说了什么,而是三个月后有没有第二个、第三个人从同一批公司里走出来说同样的话——一个人辞职是个人选择,一批人辞职才是证据。