2026年9月4日SkillsToolOpen Source

caveman:能少说就少说,token 立省 65%

一个叫 caveman 的 Claude Code skill 冲到了 GitHub 10.3 万星,今天 +545,靠的是一个被一本正经执行到底的玩笑:让 agent 像原始人一样说话,省 65% 的输出 token。它的口号就是全部产品哲学——why use many token when few token do trick,能几个词说清楚,为什么要用一堆。

玩笑底下是真工程。Skill 本体是 MIT 协议的一套指令,把 agent 逼进极简表达模式;用真实 Claude API 调用跑了十个基准任务,输出 token 降了 65%,单任务从 22% 到 87% 不等。另外还有一个代理层(BSL-1.1 协议,若干年后转 Apache),在 agent 读数据之前先压缩,原文在本地可恢复——实测 provider 端计费的输入 token 少了 33.2%。文档还老实承认,算上规则本身的开销,整个会话的实际节省会打折扣。这个坦诚程度超过大多数官方 benchmark 页面。

它此刻爆红不是偶然:前沿实验室刚刚用一整周在同一个维度上打架。Fable 5.1 砍缓存价格,Gemini 3.8 搞促销定价,Muse Spark 炫耀工具调用少 20%——agent 循环的成本是新战场,caveman 是社区的参赛作品:不等实验室降价,直接少吐 token。话多从来不等于聪明。

仓库在 https://github.com/JuliusBrussee/caveman。
← 上一篇
openclaude:把 Claude Code 跑在任何模型上,Google 刚好演示了为什么需要它
下一篇 →
Qwen3.8-27B 上 Cerebras:最好的小模型按了快进键
← 返回所有文章

评论

加载中...
>_