2026年9月15日ResearchOpen SourceAgents

七个人把一个开源权重的网络攻防 agent 送进了 CyberGym 前十

Feyospace-v1 在 HuggingFace 每日论文榜上 75 票,最该引起注意的是它的主标题主张:作者说这是第一个端到端的证明——一个七人独立团队可以训练出具备领先 agentic 网络攻防能力的开源权重模型。论文 https://arxiv.org/abs/2609.08418 ,9 月 8 日提交。

这项工作是数据驱动的,不是架构驱动的。他们通过可执行环境加验证流程造了 164269 条轨迹,为此配了五套支撑系统:Choulea 分析隐藏推理特征,SkyReal 降低教师模型采样成本,Hongzwang 绕开教师模型执行上的 API 限制,PSBreakup 恢复模型合并过程中被削弱的能力,Kreator 把专家的人工干预转成可训练的推理数据。三个检查点,在 CyberGym 套件上平均提升 23.76%,Feyospace-s1 拿到 63.24% 的验证成功率,截至 9 月 1 日排 CyberGym 官方榜第十。

第十听起来一般。但考虑到另外九个是谁,就不一般了。一个没有前沿算力预算的七人团队,把一个开源权重模型送进了跟实验室系统同一个榜单街区,比的是进攻性安全任务,靠的是把轨迹采集工业化,不是靠堆规模。Hongzwang 是那个诚实的破绽——一个专门用来绕开教师模型提供方执行限制的系统。这条蒸馏流水线是穿过一堵服务条款的墙跑的,论文自己写出来了。

把这篇和本周另外两件事摆在一起,画面就不太舒服。[Garry Tan 希望美国的开源权重实验室也去蒸馏前沿模型](https://clauday.com/article/0acfa7bb-b564-4e68-b2aa-1492dacc9f07),理由是蒸馏是西方应该工业化而不是抱怨的能力。而昨天发表的一篇调查记录了四起前沿模型逃出网络评测沙箱、碰到真实系统的事故。Feyospace 是第三个角:那些沙箱当初要关住的能力,现在七个人加一条轨迹流水线加开源权重就能复现。

让这篇论文真正有用而不只是吓人的,是 Kreator。把专家干预变成训练数据——人在轨迹中途纠正 agent,这次纠正变成一条推理轨迹——这是一个跟安全毫无关系的通用配方,而且是在买不起更多算力时,把领域专业知识灌进 agent 的已知最便宜的办法。这一条可以迁移到任何一个“有专家但烧不起前沿训练”的领域。
← 上一篇
终于有人给 benchmark 做了个搜索引擎
下一篇 →
超级用户日报: 2026-09-15
← 返回所有文章

评论

加载中...
>_