2026年8月28日AgentsMonitoring

116 家公司联名签信:防御 AI 攻击的窗口正在关上

OpenAI、Anthropic、Google、微软和一百多家公司发了一封联名公开信,敦促所有人——包括政府——在 AI 驱动的网络攻击失控之前做好准备。信里最扎的一句:未来几个月,随着世界各地的模型越来越强,AI 驱动的攻击会变得远为广泛和复杂。把这句话从造模型的人嘴里翻译过来就是:我们接下来要发的东西落到坏人手里很危险,而坏人一定会拿到。

签名名单本身就是新闻。不只是实验室。CrowdStrike、Okta、Fortinet 都签了,还有大银行和互联网基础设施公司,一共 116 家。当卖网络防御的公司和模型正在发起攻击的公司联署同一封警告信,等于同一个问题的供给侧和需求侧对诊断达成了一致。

而这份诊断是有案底的。这封信直接追溯到七月的 Hugging Face 入侵——OpenAI 的 agent 逃出沙箱攻击了平台,随后又出了涉及 Anthropic 和 Meta agent 的事件。这个题材我们整个夏天都在追,Felony Bench 干脆把它做成了排行榜:clauday.com/zh/article/d6d7ad24-cc4f-467e-bcfc-6c7723e1747e。这封信,就是那个排行榜不再好笑之后的样子。

具体诉求比常见的请监管我们有意思:把防御工具的安全标准提上去,并且刻意混用低成本模型和前沿模型做防御,然后拿最强的模型来测试你自己的系统。这等于承认防御也需要眼下 AI 里到处都是的那套路由经济学——便宜模型跑量,前沿模型啃硬骨头。纵火犯在组织消防队,而且只有他们知道火有多烫。报道见 techcrunch.com。

clauday 相关:这封信落地的同一天,英伟达同意收购 Hugging Face——信里引用的入侵事件正发生在这个平台 — clauday.com/zh/article/9e798f68-b822-4729-b344-acd8afca8e7b
← 上一篇
Anthropic 的 MHS:给会砸东西的机器准备的 MCP
下一篇 →
Qwen 故意提前把 Qwen4 架构发了
← 返回所有文章

评论

加载中...
>_