目前只圈住闭源前沿模型的那套自愿框架,未来数月可能把开放权重也拉进来。而框架本身,外界至今没看到过一个字。
据 Axios 报道,白宫在 8 月 3 日以闭门方式敲定了一套针对前沿 AI 模型的评估框架,次日把 OpenAI、Anthropic、微软、英伟达、Meta 以及一批规模更小的公司叫到一起走了一遍流程。Fortune 的报道提到,这套框架的核心机制是给美国政府一个提前审阅的窗口:模型公开发布之前,最多可有 30 天供政府一侧查看评估结果。它不是法规,参不参加由企业自己决定。
现在传出的变化是覆盖面。据外媒报道,特朗普政府官员向业界透露,未来数月可能把开放权重模型也纳入同一套流程,判定标准仍然落在能力上——够得上"前沿"这条线,就要走发布前测试这一关。
闭源模型的监管抓手其实很多:接口可以限流,账号可以停,危险请求能在服务端后置拦截,真出了事还能回滚版本。开放权重没有这些后手。权重一旦传到公开仓库,被镜像、被微调、被打包进各种本地客户端,撤回就只剩名义上的意义。所以对开源模型而言,能真正施加影响的时间点几乎只剩发布之前那一段,"发布前测试"成了唯一现实的抓手。
难点也恰恰在这里。发布前审阅要求开发者把还没公开的权重先交给政府一侧评估,这对企业实验室是个流程问题,对以"做完就放出来"为节奏的开源团队和个人研究者却是模式冲突。30 天窗口在政府内部也不是没有争议:据报道,有官员担心这个时长会拖慢美国公司的发布节奏,反而削弱竞争力。
更微妙的是框架自身的处境。据 Fortune 报道,白宫决定不把这份评估框架的内容向公众发布。于是形成了一个双重空转:没有强制力,企业可以不参加;不公开内容,外界也无从判断这套测试究竟测了什么、门槛设在哪里、通过又意味着什么。特朗普方面的立场是正式监管只会帮中国追赶美国,因此框架保持自愿;但自愿与保密叠在一起,"通过了白宫评估"这句话既约束不了企业,也没法给公众提供任何可核验的信号。
把开源拉进来只会放大这个问题。闭源公司至少是长期玩家,有维护关系的动机去配合一套没有牙齿的流程;开放权重的发布者数量多、动机杂,相当一部分根本不在美国管辖范围内,自愿框架对他们的实际约束接近于零。真要覆盖到位,压力多半会转嫁到模型托管平台那一层,而不是落在模型作者身上。
Anthropic 是最早被框架覆盖的公司之一,也出席了 8 月 4 日那场会议。值得一提的是,7 月底它刚公开澄清过自己并不反对开放权重模型,回应的正是"闭源大厂借安全叙事挤压开源"的质疑。如果开源真被拉进同一套发布前测试,这类表态会被重新拿出来对照:同一道门槛下,闭源厂商是熟悉流程的常客,开源一侧才是新增成本的承担方,谁受益谁吃亏,比声明本身更能说明问题。
对普通使用者来说,这一步短期内不会改变任何一个模型能不能用。真正值得盯的是"前沿能力"这条线怎么画:画得高,等于什么都没管;画得低,一大批社区微调模型会被动进入需要报备的区间。而这条线目前写在一份谁都看不到的文件里。