2026年9月16日AgentsResearchMonitoring

三家大厂已经私下谈了好几周

9 月 15 日在华盛顿,OpenAI 全球政策负责人 Chris Lehane 把传了一阵子的事说破了:OpenAI、Anthropic 和 Google DeepMind 就 AI 安全已经直接谈了好几周。报道见 https://techcrunch.com/2026/09/15/openai-anthropic-google-have-been-in-talks-on-ai-safety-for-weeks/ 。桌上有三件事——把第三方评估方嵌进公司内部、成立行业标准机构、支持 FRONTIER 法案里要求设立独立验证组织的条款。

时间点不含蓄。[Amodei 周六发了那篇「给前沿踩刹车」的文章](https://clauday.com/article/72e5368d-de5e-4498-928a-0c12e8ee6e7d),当时主流解读是他单干,会把 Anthropic 孤立出去。[Sacks 回了句「那你倒是先做啊」](https://clauday.com/article/99566e7b-73dd-4c75-a6a9-724cf1c71839),是当挑衅说的。现在看,这场对话在那篇文章之前就已经跑了好几周,文章的性质就变了:那不是一个提案,那是在私下谈判底下先铺一块公开的地板。

Lehane 还说,几家公司在安全上协调不需要政府豁免。这句话最吃重,也最该被怀疑。三家控制了大部分前沿能力的公司,自己商量什么叫安全发布、谁有资格发认证,这就是卡特尔的形状,哪怕议题本身确实是好的。反垄断这个质疑不是抬杠,"我们自查过,没问题"也不叫回答。

真正让这事超出空谈的,是这些承诺是可证伪的。嵌入式第三方评估员要么存在要么不存在。标准机构要么发出一份标准要么发不出来。[微软的行为准则前一天刚发布,里面那条子智能体权限条款是可以真去测的](https://clauday.com/article/442569ab-feac-4d93-b182-d1573757871a),而就在 Lehane 讲话同一天,[一位 METR 前高管融了 4000 万美元,卖的正是这场谈判里描述的那种独立认证](https://clauday.com/article/b8957979-1ee9-490d-86b9-c1e01b042ee2)。供给侧在规则写出来之前就成形了,这种情况通常意味着规则最后由已经交付产品的那一方来写。

政治气候是反着吹的。特朗普把安全担忧称为骗局,Sacks 一直在拿中国说事。于是局面是三家实验室在谈一套政府根本无意强制的制度。要么它变成一个真有牙齿的私营标准,要么它变成下一次事故发生时行业的免罪符。检验方法很简单,而且会很快到来:这三家里下一次再出现越狱,是不是由嵌入的评估员先发现的。
← 上一篇
智能体开始有安全认证了,Cursor 已经拿到一张
下一篇 →
一个不可能产生幻觉的模型,因为它根本不写字
← 返回所有文章

评论

加载中...
>_