2026年10月10日ResearchSkillsOpen Source

220 万个 agent skill 已经在 GitHub 上被复制。在源头修一个 bug,几乎永远传不到副本。

agent skill,也就是 Claude Code 和 Codex 加载的那些 SKILL.md 文件,已经悄悄变成了一条软件供应链,而直到这周没人量过它。10 月 8 日提交的一篇论文,《Skill Constellations: Tracing the Supply Chain of Agent Skills on GitHub》,从一个大语料里每个 SKILL.md 的 git 历史重建了这些文件的第一张带日期的复制网络。标题数字:2,193,119 次 skill 采用。底下那些让人不舒服的发现才是它要紧的地方。

数据里掉出三件事。第一,极少数仓库是几乎所有副本的源头,而 GitHub star 认不出它们,所以被复制最多的 skill 不是 star 最多的,你没法靠热度找到真正的根。第二,副本做出来之后几乎从不改动。一个 skill 被复制进一个新仓库然后冻住,意思是在源头修一个 bug 很少能传到下游的副本。这个生态看起来像一张活的网络,行为却像一片化石地层。第三,来源不可见:没有注册表,没有版本,没有指回出处的引用,所以一条有漏洞的或恶意的指令可以扩散、沉在几千个仓库里,没有办法召回。

然后作者证明他们的图是有用的,不只是描述性的。审查他们模型排名最高的 100 个仓库,能拦下后续 14.9 percent 的高风险 skill 采用。审查 star 最多的 100 个仓库,能拦下 0.5 percent。同样的人工审查量,产出是 30 倍,纯靠看复制图而不是热度信号。他们的建议是那个显而易见的结构性建议:平台应该分发 skill 的带版本引用,而不是冻结的副本,这样来源和修复才能流动。

这正好落进这个站盯了好几个月的 skills 标准这条线。每周都有新的 skills 论文,SkillForge 和它从试用到退役的 skill 生命周期,EVISKILL 和它可回放的证据卡,还有那篇证明大多数被检索的 skill 给不了有用信号的检索工作。它们全都假设 skill 是带版本和来源的被管理对象。这篇是实证的反驳:在真实世界里,skill 就是复制粘贴的文本,没有版本,没有源头链接,没法打补丁,而且已经有 220 万个在外面了。研究怎么对待 skill 和 GitHub 实际怎么存 skill 之间的这道缝,正是下一起供应链事故所在的地方。

论文:https://arxiv.org/abs/2610.11169
项目:https://fahdseddik.github.io/Skill-Constellations/
← 上一篇
一个评分器被悄悄改坏的自我改进 agent,看起来和正常的一模一样。这篇论文证明了这一点。
下一篇 →
超级用户日报: 2026-10-10
← 返回所有文章

评论

加载中...
>_