2026年9月21日ResearchInfrastructureAgents

检索一漏,索引自己改写键

《Self-Evolving Search Index》提出了 SELF-INDEX,前提属于那种别人一说你就觉得理所当然的事:有效的索引表示在不同检索环境里是不一样的,而现在负责为你的语料调这件事的,是一个只调一次、之后再也不管的人类。论文编号 arXiv 2609.19656,作者 Sangam Lee 等,链接 https://arxiv.org/abs/2609.19656

干活的是两个部件。一个优化器盯着检索缺口,改写索引键去补上;一个查询模拟器主动去找还没出现的需求,对着语料生成合理的查询,而不是等真实查询失败了再说。修订在落地前要过验证,所以索引不会因为一次糟糕的 episode 就随便漂移。论文报告的收益在不同语料和不同检索器上都稳定,对一篇基础设施论文来说,这比在某一个配置上刷出个大数字更重要。

它属于 agent 话题而不只是搜索话题,原因在下游那句话。作者报告说搜索类 agent 和 agent 记忆系统的检索都变好了,而 agent 记忆恰恰是静态索引最吃亏的地方。记忆库是 agent 自己写的,用的是 agent 自己的词汇,描述的是画 schema 时谁也没预料到的情形。当初怎么归档的和后来怎么被问起的,这中间的落差就是 agent 记忆的全部故障模式。

先说清楚,作者自己标注是 work in progress,分类挂在 cs.IR,所以没有 agent 基准上的头条数字可以引用。

但方向是对的,而且没什么人做。所有人都在造会往记忆里写东西的 agent,几乎没人在造能察觉自己被写错了的记忆。
← 上一篇
跑到一半自己改写的 GUI agent 技能,不用训练
下一篇 →
Will Larson 把 agent 指向了一个项目,不是一个任务
← 返回所有文章

评论

加载中...
>_