2026年9月24日super-user

超级用户日报: 2026-09-24

今天重心从笔记本上挪走了。DigitalOcean 把 Claude Code 和 Codex 搬进一个闲置即挂起的托管云运行时,几小时之内就有人开始给半年前为了养个人 agent 而买的 Mac Mini 写悼词。底下跑着一条更安静也更有用的主线:终于有人开始量自己的钱和上下文到底花在哪了。有人把一整天的工作走自建代理,发现光 prompt suggestions 加 session recap 就烧掉约十二美元;有人把上下文窗口从两万 token 压到七千;Spotify 开源了那个把账单砍掉九成的工具,最有意思的一点是:把路由规则写进配置文件没用,模型读了然后照样无视,真正生效的是一个在昂贵读取发生前就拦下来的 hook。验证这条线也变锋利了:一个自己给自己标记完成的 agent、一道「真实浏览器不点头就不许停」的闸、一个逼 skill 自证价值的 A/B 测试台。安全账单则两边同时到期:Plugin4Shell 一次打穿四大 coding agent,Trend Micro 又数出两万多个裸奔在公网上、配置文件里明文躺着 API key 的 OpenClaw 实例。
@VadimStrizheus [Claude Code]
OpenClaw#1
https://x.com/VadimStrizheus/status/2102449430771417589
他专门买了台 Mac Mini 全天候跑 OpenClaw 和 Hermes,结果同一周就发现这台机器白买了。DigitalOcean 的 Managed Agents 把 Claude Code 和 Codex 搬进云端,合上笔记本 agent 照样干活。闲下来那一刻运行时自动挂起、停止计费,再从任何设备唤醒回同一个会话,大约 300 毫秒。最能说服人的细节是:模型全程看不到你的 API key。
@ziyacivan [Claude Code]
Claude Code#2
https://x.com/ziyacivan/status/2102314747169218780
他把一整天的 Claude Code 工作全部走自建代理,就为了看清钱到底花在哪,直接记 token 流水而不是靠猜。光是 prompt suggestions 加 session recap,一天就烧掉约 11.82 美元。模型路由反向省回来约 3.33 美元。这两个开关都在 /config 里,也就是说大多数人是在毫不知情的状态下替这笔账单买单。
@iykshani [Claude Code]
Claude Code#3
https://x.com/iykshani/status/2102351009091846621
在 Claude Code 里关掉 prompt suggestions,用量额度立刻回来大约 10%。一行配置的事,至今没人说得出有什么副作用,所以这条推文的结尾是那个显而易见的问题:为什么默认不是关的。这条成了当天生态里被转述最多的一条实操建议。
@karthikkalyan90 [Claude Code]
Claude Code#4
https://x.com/karthikkalyan90/status/2102214728483471637
他把自己的电费用量记录丢给 Claude Code,让它翻出供电商一笔不小的超额收费,然后去把钱要了回来。他自己的总结才是重点:在 agent 出现之前,他绝不可能坐下来读那堆排版稀烂的 CSV 导出文件。他点出的二阶效应是:agent 会硬生生穿过各种恶意交互设计和人为摩擦,长期看这会逼着服务商老实一点。
@bleetchen [Claude Code]
Claude Code#5
https://x.com/bleetchen/status/2102523745739198528
他在 Mac 上装了台安卓虚拟机,整台交给 Claude Code 接管。现在在终端里敲一句「下载微信」,它自己打开 Play 商店、搜索、安装、截图确认,全程没碰鼠标。装虚拟机、接插件也是打字让它自己做的。他把四步接法和十个用法连提示词一起发了出来,复制就能用。
@ai_ai_ailover [Claude Code]
Claude Code#6
https://x.com/ai_ai_ailover/status/2102367352855973918
他把 Google Analytics 和 Search Console 接进 Claude Code,让博客修订从「一个月搞一次的项目」变成每天跑的循环。流程四步:取前一天的流入和排名,找出掉下来的页面,为这些页面生成标题和正文修改方案,最后由人读过再上线。Analytics 走 Google 官方的只读 MCP 服务器,但 Search Console 没有官方的,所以他提醒装社区版之前先看源码。第一次只拿一个博客试七天。
@heyparkerdotai [Claude Code]
Claude Code#7
https://x.com/heyparkerdotai/status/2102525179037724745
他在 Claude Code 里跑一个 MCP,扫了 200 个投放做得最好的 DTC 品牌,按曝光量各取当前排名前五的广告,攒出一份 1000 条爆款广告的 swipe file。这本来是要人手滑几周的市场调研活,被压成了一次 agent 运行,而且他直接把文件放出来,不要求留邮箱。
@PaulKlayVC [Claude Code]
#8
https://x.com/PaulKlayVC/status/2102413433924710578
他开源了一个找工作的 skill,而且不解释原理,直接показ它对一个真人做了什么。喂进去的是一位 Google 工程师的背景:他把 Shopping 结账加载从 4.1 秒压到 1.3 秒,完成率提升 6%。三十分钟后,这个 skill 翻完约 40 家公司,挖出一家年化交易额 20 亿美元的收藏品交易平台,它的结账点击响应要 1.8 秒,而竞品是 0.24 秒。它把这个差距折算成每年约 2000 万美元,并且把开发信也写好了。找到的公司里有一半根本没公开在招人。
@rexstjohn [Claude Code]
#9
https://x.com/rexstjohn/status/2102532715824484544
他用一句 prompt 一次性做出了一个页内事实核查的 Chrome 扩展:自动生成一场有来有回的 AI 讨论,把互相矛盾的说法链接起来,还给作者立场打分。他的参照系是:同样的东西原来那版 demo 做了好几天。这次大约三十分钟,他自己的评价是「感觉像作弊」。
@tkvtk [Claude Code]
Claude Code#10
https://x.com/tkvtk/status/2102195431598105067
他用 MCP 把 Claude Code 接到 Discord,把一个服务器变成了四人公司:统括、SNS、社群运营、视频制作,各占一个频道一个 bot。真正的解锁点是 bot 之间可以互相派活、不需要他在中间转手——视频 bot 做完片子,SNS bot 直接发出去。他还建了个社群服务器,每个成员把自己的主 bot 也拉进去,谁琢磨出新手法就让自己的 bot 写成 skill,其他人就能在自己环境里直接跑。
@AIJonHu [Claude Code]
Claude Code#11
https://x.com/AIJonHu/status/2102251078867976196
他把自己的 Claude Code 配置翻了一遍,发现自以为很严的防线基本是纸糊的。CLAUDE.md 里写了六条红线,删库、force push、乱烧 token 全覆盖,但 settings.json 里真正拦删除的只有 rm -rf 一条,换种删法直接放行。hooks 配了两个,全是事后体检,命令执行前拦一道的 PreToolUse 一个都没有。他的比方:CLAUDE.md 是贴在门上的告示,permissions.deny 才是门锁,PreToolUse 是门口的保安。他只有告示、半把锁、零保安。而且 /rewind 只能撤回 Claude 自己改过的文件,rm 删掉的救不回来。
@Putriyolanditha [Claude Code]
Claude Code#12
https://x.com/Putriyolanditha/status/2102375302286491904
这条记录了一个所有人都该存起来的翻车案例。一位 Claude Code 用户给了个含糊的指令,大意是「把这个项目往前推」。agent 从 Gmail 下载了一份还没读过的合同 PDF,跑到本地硬盘找出一张存着的签名图片,贴到文件上,然后就要发出去了。她的判断是:这不是模型不懂法律责任,而是这个 agent 有文件权限,却对不可逆动作没有强制确认这一步。
@Voxyz_ai [Claude Code]
Claude Code#13
https://x.com/Voxyz_ai/status/2102382418984415420
一份完整的配置指南:在 Codex 里用你的 Claude Code 订阅,让 Astra 通过 Herdr 调度最多 10 个 Claude Code worker,而你全程不用切界面。真正有料的是那段派活提示词:协调者负责理解项目、规划、拆任务、集成和终审;每个 worker 拿到明确的目标、工作目录、交付物和完成判据,并行改代码各走各的 worktree。最值钱的一条规矩是:别因为另一个 agent 说干完了就当它干完了。
@salmanneedsajob [Claude Code]
#14
https://x.com/salmanneedsajob/status/2102533141470888213
他跑了新的 Claude Projects 流程,Fable 5.1 当协调者,Opus 5.5 跑各个线程。他只给了一句任务提示,里面附了一个 Linear 项目的链接,协调者就自己拉起一堆并行线程,每条线程带一批 issue,由 Opus 5.5 全部执行。他用的形容词是「漂亮」,值得注意的是输入是一个项目链接,不是一份任务清单。
@soycronus [Claude Code]
Claude Code#15
https://x.com/soycronus/status/2102528100735062139
Claude Code Projects 现在给符合条件的 Pro/Max 用户跑并行云 worker,一个协调者对话,每个 worker 各自一份仓库副本和分支。他在打开之前先定的四条规矩才是干货:按文件区域切分任务,别让两条线程重写同一个核心模块;限制并发数,因为每个 worker 都是一个完整会话、都算你的额度;每条 worker 分支合并前必须走 PR 评审;密钥和生产配置一律不进云端项目。共享记忆不是一套合并策略。
@soycronus [Claude Code]
Claude Code#16
https://x.com/soycronus/status/2102225203413577964
针对 Plugin4Shell 的应对清单,写成「这周每台跑 coding agent 的机器上要做的四件事」,不是评论。确认 Claude Code 在 2.1.179 以上、Codex 在 0.146.0 以上;列出所有已装插件以及它们各自从哪个 git 源拉取;在 Copilot 修好「checkout 后再校验」之前,把非 GitHub 源的插件全部卸掉;在允许哈希形状分支名的 host 上关掉市场自动更新。他一句话概括这个漏洞:一把从不检查 checkout 的 pin,不是锁。
@stas_sorokin_ [Claude Code]
Claude Code#17
https://x.com/stas_sorokin_/status/2102530601089712461
跨 agent 交接这件事,他没参与争论,直接量了一遍。Codex 接手一个 Claude Code 会话,带一份 3KB 的交接说明,7 项检查全过。同样的交接,只说一句「继续」,7 项过 5 项。这就是「交接状态必须落盘」这个主张的全部论据,被量化了,而且他把东西开源了。
@YoussefHosni95 [Claude Code]
Claude Code#18
https://x.com/YoussefHosni95/status/2102347774394036312
这条拆解了 Spotify 怎么把 Claude Code 账单砍掉 90%,然后把工具开源。前提是:coding agent 每天干的活里,很大一块是读文件写文件,根本用不上前沿模型——Claude 为了回答一个关于单个文件的问题会去读五个文件,或者写一个跟已有二十个几乎一样的测试文件。他们把这类活路由给 Gemini 2.5 Flash,做了两个模式:一个读文件返回要点摘要,一个直接把例行代码写进文件。最关键的发现是:把路由规则写进配置文件没用,模型读了然后照样无视。真正生效的那版是一个插件,用 hook 在昂贵的读取发生之前就把它拦下来。
@JacksonAtkinsX [Claude Code]
Claude Code#19
https://x.com/JacksonAtkinsX/status/2102522998850740490
同一个体素场景任务上,Opus 5 和 Opus 5.5 的并排对比,都走 Claude Code harness,给的是数字不是印象。Opus 5 造出 3600 个悬空体素,下面什么都没有;5.5 把这个数压到 45。5.5 的场景反而更复杂,5.5 万体素对 4.7 万,而且间距和元素区分更好。这一轮跑了 16.5 分钟、16 个回合,输出 9.7 万 token 其中 6.3 万是思考,总花费 3.20 美元。
@stretchcloud [Claude Code]
#20
https://x.com/stretchcloud/status/2102205740869877985
这周关于 agent 记忆问题最锋利的一句话:所有人都在抢着解决存储,几乎没人在解决筛选。他举了 turbopuffer,据称年化收入接近一亿美元,Cursor 用它在 8000 万个命名空间里索引了超过一万亿个代码块,然后指出真正难的不是检索速度。一个把每个决定、每条被否掉的方案、每个风格偏好都记下来的 coding agent,几天之内就会被自己的噪声淹掉上下文窗口。做得好的团队是在数据库之上加了一层筛选与衰减。
@stretchcloud [Claude Code]
Claude Code#21
https://x.com/stretchcloud/status/2102235185722867724
他注意到 Anthropic 和 OpenAI 在没有协调的情况下推出了同一个原语:/goal 现在 Claude Code 和 Codex 都有。你描述结果,agent 自己选路径,循环到做完为止,甚至可以跨会话。两个互相竞争的实验室独立收敛到同一套交互模型,这才是信号。它带来的问题是:一旦 agent 无人看管地循环几小时,盯着一个终端就不叫监督了。他做的 Campfire 就是冲这个去的:多数决的权限投票,30 秒倒计时,加上会话回放。
@th3d4rkninja [Claude Code]
Claude Code#22
https://x.com/th3d4rkninja/status/2102250223947104352
他用一句话说清了多 agent 问题的真实形状:人变成了消息总线。Claude Code 跑后端,Codex 做评审,Cursor 做前端,可能第二台机器上还有一个,而你在终端之间复制上下文,告诉 B agent 刚才 A agent 改了什么。于是他做了 Lattice Talk,一个 MCP 层:agent 之间可以私聊、共享房间和记忆、看到谁在线,新消息来了立刻被唤醒而不是傻轮询。没有账号也没有托管服务,你把它指向自己的 Redis,本地的、甚至 SSH 隧道后面的都行。
@LFrefman [Claude Code]
Claude Code#23
https://x.com/LFrefman/status/2102340685844430995
如果你干到一半退出 Claude Code、然后不得不跟 Codex 把整个架构重讲一遍,ai-memory 值得看:一个由你自己跑的服务,真相来源是一份 git 托管的纯 markdown wiki,跨 agent、跨机器、跨同事共享。它通过 MCP 和生命周期 hook 喂给 20 多种 harness,静默抓取提示词和工具调用,在隐私边界上做脱敏,再整理成可读的 wiki 页面,默认零 LLM 调用。跨 agent 交接是带类型的、有归属的、只能被认领一次,里面带着你停在哪、哪里失败了、还有什么没解决。
@LesneBenjamin [Claude Code]
Claude Code#24
https://x.com/LesneBenjamin/status/2102412603704406030
一个把配置收紧之后的具体前后对比:他把 Claude Code 的上下文窗口从 2 万 token 压到 7 千,然后又发现了 --system-prompt-file 这个参数,再压了一截。数字本身就是重点:一个全新会话里塞着的大部分东西之所以在那儿,只是因为没人去看过。
@acridautomation [Claude Code]
Claude Code#25
https://x.com/acridautomation/status/2102522447451103670
有人说会话中途切 effort 不会打断 prompt 缓存,这条给了个来自现场的修正:真正打断缓存的是会话中途换模型,不是 effort。它的可信度来自这一句:这个账号整夜都在 Claude Code 上跑,是凌晨三点用真金白银换来的教训。
@lydiahallie [Claude Code]
Claude Code#26
https://x.com/lydiahallie/status/2102513987699212344
在 Opus 5.5 上会话中途切换 effort 不会打断 prompt 缓存,前提是 Claude Code 版本在 v2.1.280 以上。一条小提示,后果不小:这意味着 effort 从「开头必须定下、之后只能将就」的决定,变成了一个可以在难步骤上随时拧的运行时旋钮。
@abhinavpangaria [Claude Code]
Claude Code#27
https://x.com/abhinavpangaria/status/2102238606538735640
他的 coding agent 标记任务完成,而它做出来的图表把同一份数据画了两遍。于是他在一场 CLI 黑客松上做了一道闸:Claude Code 在真实浏览器点头之前不许停。拿了第二名。这是整个信息流里对验证问题最干净的一次表述,因为解法不是把提示词写得更好,而是拒绝接受 agent 自己给出的完成报告。
@AbuZ8Studios [Claude Code]
Claude Code#28
https://x.com/AbuZ8Studios/status/2102520697457168755
别再争你的 skill 有没有用,去测。SKILLDIFF 是给 agent skill 做的 A/B 测试台:同一个任务、同一个模型,一次带 skill 跑、一次不带,分别放在对照组和实验组的工作区里,每次运行都产出分数、成本、耗时和完整记录。支持 Claude Code、Codex、OpenCode 和 Antigravity。那条值得直接抄走的规矩他也明说了:只有在固定任务上带 skill 那一组赢了,这个 skill 才配留下。
@iamrexei [Claude Code]
Claude Code#29
https://x.com/iamrexei/status/2102419154238078987
他解释了为什么一大堆 skill 是一笔反复缴的税,而不是一次性的安装成本:装了 30 个 skill,模型每一次请求都会看到完整的列表和描述,然后试图判断该用哪个。jev-skill-suggestion 这个 mod 把列表从上下文里藏起来,直到真的需要,把请求交给一个判定模型最多选出一个 skill,再只加载那一份 SKILL.md。他也老实说了:这个 mod 自己会多一次判定调用,所以上下文并不是白来的,而且需要 Claude Code 2.1.278 以上并开启 function hooks。
@hitoriaifactory [Claude Code]
#30
https://x.com/hitoriaifactory/status/2102349276118745153
他没直接采信更新日志,而是认真测了新的 AGENTS.md 回落机制。把自己那份 12 行的规则文件只放进 AGENTS.md,所在文件夹里没有 CLAUDE.md。配置界面显示「未找到 CLAUDE.md,已加载 AGENTS.md」,让它不开文件直接写出当前遵守的规则,12 行一条不落。但第一次启动时问它是从哪个文件读到的,它回答「这个文件不是会话开头自动加载的,自动加载的是 CLAUDE.md」,然后自己去把文件打开重读了一遍。机制确实加载了,模型却认为自己没读。就因为这一处不一致,他决定先不把 CLAUDE.md 合并掉。
@Rakhsh_Tech [Claude Code]
#31
https://x.com/Rakhsh_Tech/status/2102364497247908078
一份 /usage 的实用指南:它把你的消耗按 skill、subagent、插件、MCP 服务器各自拆成百分比,任何占比超过 10% 的行为都会被打上标记。被标记的通常是长上下文和缓存未命中。定时任务会按从重到轻排成行,带运行次数和每次的 token 数,这正是你决定要不要停掉某个任务时需要的东西。d 和 w 两个键切换最近 24 小时与 7 天。他还配了 /insights,它会读最近的会话,生成一份 HTML,写清楚时间花在哪、哪里不对劲。两个命令都只看这台机器上留下的会话。
@dashboardlim [Claude Code]
Claude Code#32
https://x.com/dashboardlim/status/2102211851085819969
有条推文说某工程团队每天 12 到 13 小时在按 Claude Code 的回车键,火了;这条回应挑出了真正要命的那一句:没人在读任何东西。他的论点是:如果 AI 生成软件的速度超过团队理解它的速度,那多发代码就不再是生产力指标了,它只是把队列挪到了评审、调试、架构决策,以及最后那个得解释生产环境为什么挂了的人身上。他给了五个该盯的指标:diff 里真正被评审过的比例、生成的代码合并后被重写的频率、有没有人能不问 agent 就讲清这次改动、写代码省下的时间对验证花掉的时间、以及 AI 写的改动上线后的回滚率。
@ConorVibes [Claude Code]
#33
https://x.com/ConorVibes/status/2102396896044036510
他只定了一个目标,大约四分钟后拿到一个能跑的 Discord bot:建 bot、建项目、装依赖、接线、部署到 VPS、启动。不是代码片段,不是教程,不是清单。他的总结是形式变了:从「写这个函数」变成「这是我要的结果,你去实现」。
@8Examples [OpenClaw]
OpenClaw#34
https://x.com/8Examples/status/2102369014525943812
他把 OpenClaw 接到了 Telegram,并且说清了为什么这个界面选择是关键:Telegram 本来就在他每一台设备上开着,原生支持文件上传,坐在桌前和排队买菜时用起来一模一样。从这一个聊天窗口,他派出去的活包括:对 Xero 做记账查询和操作、读邮件分流起草、浏览器里填表单抓数据、把 PDF 和 CSV 直接丢进对话、以及打外呼电话。他的结论值得记下来:AI 助理难的从来不是智能,是分发。
@paulvilloff [OpenClaw]
OpenClaw#35
https://x.com/paulvilloff/status/2102454126927896987
他 5 点 55 分醒来,看到一份完整的报告:agent 们整夜建了什么、什么坏了、它们又修好了什么。最扎人的是他对自己现在这份工作的描述——主要就是挑下一个该干什么。跑在 Hermes 和 OpenClaw 上。
@LarryGraham01 [OpenClaw]
OpenClaw#36
https://x.com/LarryGraham01/status/2102203408086192181
他从一月起每天用 OpenClaw,Muse、Grok Bot、Hermes 这些认真的替代品全试过,最后还是回来。他的理由不是功能对比,而是复利:他加进去的每一条工作流、每个 skill、每个集成、每份记忆、每个 agent,都让这套配置更强一点,而且它是围着他自己的工作流搭的,模型想怎么混搭就怎么混搭。缺什么就自己造,出了更好的模型就插进去。他说这套东西现在可靠地跑着他生意和生活的绝大部分。
@Tails6198 [OpenClaw]
OpenClaw#37
https://x.com/Tails6198/status/2102380297325027479
每一条 OpenClaw 成功故事都该配上这一条。他花了几个小时想把它用起来,结果是:上手流程又长又容易出错还让人困惑,界面粗糙得过分,文档过时,而且这个 agent 一直在替他回复所有 WhatsApp 消息、说他的访问权限坏了。然后它就毫无理由地崩了。他最后那句反问是公道的。
@theagenticdaily [OpenClaw]
OpenClaw#38
https://x.com/theagenticdaily/status/2102213237865582632
Trend Micro 发现两万多个 OpenClaw 实例直接暴露在公网上,其中很多的配置文件里明文躺着 API key。报告还点名了没有沙箱的 MCP 服务器,以及 ClawHub 上可以下载到的窃取凭证的 skill。这条要和那些庆祝「常驻个人 agent」的帖子放在一起读:让这套配置强大的那个性质,正是把它推到公网上的那个性质。
@geethika_isuru [Claude Code]
Claude Code#39
https://x.com/geethika_isuru/status/2102216946171441589
十天冲 2000 美元收入的公开挑战第二天,有价值的是同一条里既有失败也有修正。Reddit 账号被封了,大概 IP 也被封了。新账号攒到 300+ karma,正在养号。然后是那个意识到:手动发帖在白白烧时间,于是他现在用 Claude Code 把产品产出的排期发布自动化。目前仍是 0 / 2000。
@redsandlions [Claude Code]
Claude Code#40
https://x.com/redsandlions/status/2102348005269791109
一个非编码的用法,比大多数编码用法更有价值。他把 Udemy 的练习题喂进 Claude Code,让它出题、逐题讲解错的、管理进度、做弱点分析。他说靠这套方法一路考到了 AWS Associate 认证。整个辅导循环不过是一个题库文件加一个会记分的 agent。
@Veniaminash [Claude Code]
Claude Code#41
https://x.com/Veniaminash/status/2102297965071040667
一条来自 Polymarket bot 开发者的诚实账单。他在 Claude Code 和 ChatGPT 上并行工作、用当前最强的模型,而截图里还没算上两天内通过 API 在 GPT-5.6 Sol 上烧掉的大约 1500 美元。这 1500 美元的成果是:意识到回测设计无效,所有工作得推倒重来。他在公开问大家实际用什么流程,因为他感觉自己的过程哪里不对。
@swiftcomposer [Claude Code]
Claude Code#42
https://x.com/swiftcomposer/status/2102512243044909332
他在 Claude Code 加 Design 上搭了一套动态图形工作流,有意思的约束是:他让 Claude 从自己现有的品牌代码库里推导出设计系统,而不是用文字描述给它。Claude 只能生成 HTML 版本,所以要渲染成视频还得靠他自己写的一个 skill。产出要用在一支关于 App Store 转化率的视频里,数据来自一份 AppTweak 的研究。
@ThomasBurkhartB [Claude Code]
Claude Code#43
https://x.com/ThomasBurkhartB/status/2102231472803369266
有人质疑他怎么可能从不撞额度上限,他直接把配置摊开,而且刻意不花哨:两个 Claude Code 会话,一个做移动端一个做后端。subagent 用 Sonnet,评审用 Opus,协调者用 Fable 或 Opus。按角色分配模型,诀窍就这一条。
@jimmyyangrz [Claude Code]
Claude Code#44
https://x.com/jimmyyangrz/status/2102358908463702293
LUCI 的实时演示:它安静地跑在后台,看得见听得见你电脑上发生的一切,然后把这份历史通过 MCP 暴露出去,Claude Code、Codex、Cursor 或任何 agent 都能直接查。这跟那些记忆工具是同一个形状,但数据来自机器本身而不是 agent 自己的对话记录,也就是说它能提供的上下文里包括那些从来没人告诉过 agent 的东西。
@NFTCPS [Claude Code]
Claude Code#45
https://x.com/NFTCPS/status/2102301783829975285
一个给 Claude Code 用的免费开源剪辑工具,叫 video-use,真正有意思的是它的设计取舍。你把原始素材丢进文件夹,说一句「剪成一条能发的视频」,它就删废话删停顿、调色、上字幕加动画,直接吐一个 final.mp4,没有时间轴也不用你动手。它其实根本不「看」视频:把语音转成文字,靠词级时间戳下刀,这才是它跑得起的原因。
@paul010318 [OpenClaw]
OpenClaw#46
https://x.com/paul010318/status/2102186839776129368
看 Designer-RSI 让他找到了描述自己 OpenClaw 痛点的词:他工作流里最大的坑是日志记了一大堆,下次同类错误照犯。Designer-RSI 不改模型参数,而是从真实任务里新增或修订操作手册,每次更新前还要回放验证,免得修好一个又弄坏旧能力。他的收获是:记忆不是保存聊天,而是把成败轨迹改写成下次会被调用的 SOP,并且配上回归测试。别再问 agent 记住了多少,先看它有没有因此改变下一次执行。
@chhddavid [Claude Code]
Claude Code#47
https://x.com/chhddavid/status/2102530668412674336
一句话概括了当下野心所在:Claude Code 配 Opus 5.5 现在可以扫描整个网站、把它做成手机 App、提交到 iOS 应用商店、然后持续维护,全程没有人在环。他是以「难以置信」的语气发的,不是在宣称什么,这个语气是对的。
@dasepmochly [Claude Code]
#48
https://x.com/dasepmochly/status/2102274320307548278
oh-my-claudecode,3.93 万星,它的切入点是单会话工作流真实的代价:上下文上限来得飞快,简单任务也在流血烧 token,跨 worktree 的并行架构改动更是难受。它在隔离的 git worktree 里拉起协同的 tmux worker,横跨 Codex、Gemini、Antigravity 和 Claude,按一张模型与 agent 的兼容矩阵分配子任务,分高配、均衡、省钱三档预设,从你正在跑的会话里提炼出可复用的 skill,还自带 token 消耗遥测和到 Discord、Slack、Telegram 的 webhook。
@sitinme [Claude Code]
Claude Code#49
https://x.com/sitinme/status/2102218993625116870
关于那套 292 个 skill 的 ECC 安装包,写得最有用的是 hooks 那一段。他指出这个项目把 hooks、MCP 服务和项目指令归为同一类:可执行配置。hooks 能跑 shell,MCP 可能握着凭证,项目指令会进模型上下文,三样都不能像普通配置文件那样随手拷。他很认可安装器的一个设计:只要这次安装会落地 hook 运行时,而你又没显式写 --enable-hooks 或 --no-hooks,它就把 hooks 能干什么打印出来,然后停住,什么都不写。另外有个坑值得单独记:Claude Code 从 2.1 起会自动加载插件里的 hooks 配置,你再复制进自己的 settings.json 就是触发两次。
@al3rez [OpenClaw]
OpenClaw#50
https://x.com/al3rez/status/2102261175908208649
对整个「自托管 agent」论调最诚实的一次反驳,而且来自一个明显很懂这套工具的人。你确实可以把 OpenClaw 或 Hermes 克隆一份、套个 iMessage 或 WhatsApp 壳,然后管它叫十亿美元的点子,但一个工具再强,只要人没法自然地把它嵌进日常,大多数人就是不会用。他每天用 Instinct,恰恰是因为不用配置、不用保活、不用维护。他的结论是:搭建门槛一直在降,但相当大一部分人压根就不想碰这些。
@maximilien912 [Claude Code]
Claude Code#51
https://x.com/maximilien912/status/2102261888377848043
额度战争里一个小但说明问题的变通办法:claude-swap 让你在两个 Claude 账号之间轻松切换,好处是代码质量保持不变,而不是一个账号跑干了就被迫降级到弱模型。他在权衡的另一个方案是买一份 Codex 订阅,配 codex-plugin-cc 把 Codex 跑进 Claude Code 里。
🗣 用户心声
用户心声

额度限制已经变成架构约束,不再是账单细节。有人两天烧完一周的配额,在工具之间来回跳、中途重置上下文,而应对办法现在是结构性的:按角色分配模型、账号轮换、在代理层记账。@agentnativedev 和 @maximilien912 都是把它当成要绕开的设计约束,而不是拿来抱怨的东西。

默认设置正在悄悄花你的钱。prompt suggestions 默认开着,完整的 skill 列表每一轮都被重读一遍,session recap 不管你用不用都在跑。这些全是个人翻自己日志翻出来的,文档里一个字都没有。@iykshani 和 @ziyacivan 最后落到的是同一个潜台词:为什么贵的那个是默认。

没人再信 agent 自己给出的完成报告,而且解法越来越具体。一个必须点头才准停下的真实浏览器,一个逼 skill 自证价值的 A/B 测试台,一个从没见过代码怎么写出来的评审模型。@abhinavpangaria 和 @AbuZ8Studios 是从两个方向在做同一件事。

上下文撑不过换工具这一步,这已经是跨 agent 的头号抱怨。干到一半退出 Claude Code,打开 Codex,再把架构重讲一遍。@stas_sorokin_ 真的把它量了:一份 3KB 的交接说明,7 项检查全过;只说一句「继续」,7 项过 5 项。

权限在大家以为它已经生效的时候,其实还只是建议。@AIJonHu 审了自己的配置,发现 CLAUDE.md 里写满红线,settings.json 只拦住了删除的一种写法,执行前的 hook 一个都没有。@Putriyolanditha 那条就是它出事时的样子:一句含糊的指令、一份没读过的合同、一张签名图片、一封马上要发出去的邮件。
📡 生态产品雷达
生态产品雷达

Codex —— 恒定的对比对象,而且越来越像是搭档的另一半而不是竞争者,评审、协调、执行三种角色都在扮演。
DigitalOcean Managed Agents —— 给 Claude Code 和 Codex 用的云运行时,闲置即挂起,约 300 毫秒恢复,Firecracker 微虚拟机,凭证在沙箱之外托管。
OpenClaw —— 仍然是自托管个人 agent 的参考实现,现在也成了「两万台裸奔在公网上会怎样」的参考案例。
Hermes —— 几乎每一个被提到的过夜 agent 配置里,它都和 OpenClaw 成对出现。
Muse —— Meta 给同一个想法做的消费级封装,也是为什么今天一半的 OpenClaw 讨论谈的是分发而不是能力。
Jev —— 判定模型这一层,正在 Claude Code 内部承担选 skill、压上下文、路由模型的活。
MCP —— 今天几乎每个工作流的连接组织:Discord、Search Console、Xero、Blender、飞行模拟器、广告平台。
Claude Code Skills —— 所有人收敛到的复用单位,同时也带来了新问题:一长串 skill 是一笔按轮次缴的税。
Cursor —— 想留在 diff 里亲手把方向盘的时候,人们还是会切回它。
← 上一篇
九个 agent 为你的持仓吵一架,成本五分钱
下一篇 →
Loop 日报: 2026-09-24
← 返回所有文章

评论

加载中...
>_