2026年10月2日super-user

超级用户日报: 2026-10-02

9 月 30 日发生了两件事。第一件是 OpenAI 发布了 Dots,OpenClaw 那群人一整天不是在把自家小龙虾的记忆往 Dot 里搬,就是在解释自己为什么懒得搬。第二件更安静,但更有用:Claude Code 继续变成一个做非代码东西的工作室。一个炒股分析 App 的作者花大约 75 美元做出一支 98 秒的金属乐 MV,一位用户把自己和父亲录的 3.5 小时播客变成了带地图和老照片的家族史章节,一个有 ADHD 倾向的自由职业者因为备课不再吃掉整夜,九年来第一次把昼夜颠倒掰了回来。当天最好的工程帖都在讲测量而不是感觉:有人把每个请求都记下来,证明 effort 设置没有照文档那样工作;有人每天用同一套 78 道题盯模型是不是被降智;还有一位前微软、谷歌工程师用十条九十年代的设计原则,把每个 PR 的成本从 7 美元打到 1 美元。
@rehan_shei [Claude Code]
Claude Code#1
https://x.com/rehan_shei/status/2105161487509852622
rehan_shei 把 Claude 在改《泰拉瑞亚》和《帝国时代 II》时学到的东西,打包成了 universal-modder:一套技能加工具,让 Claude Code 能给你手里几乎任何一款游戏做模组。它会先侦察引擎、反编译,再用 fal 生成贴图、3D 模型和音效,然后在运行中的游戏里实测,连展示视频都自己剪。公开的两个案例走的是两条路:泰拉瑞亚走 tModLoader,加了追踪导弹、能炸出坑的核弹和两阶段 Boss;帝国时代 II 直接加了一个新文明,单位先从生成图转成 3D,再按 16 个方向渲染。作者把边界写进了规则,只限自己拥有的单机游戏、先备份存档,这么强的工具就该这么管。
@FABYMETAL4 [Claude Code]
Claude Code#2
https://x.com/FABYMETAL4/status/2105216150376239302
FABYMETAL4 一个人在做炒股分析 App Stock Slayer,完全不会做视频,却用 Claude Code 加 Opus 5.5 四天做出一支 98 秒的金属乐 MV。按量付费一共大约 75 美元,预算上限是 2000 美元;流程搭好之后,换个角色做第二支只用了一晚,大约 21 美元。第一版原型甚至不是视频文件,而是大约 2000 行 JavaScript 加上图像模型画的角色部件,Opus 负责给腰、肩、马尾装关节,配乐是 Web Audio 合成的 190 BPM E 和声小调金属,整个文件夹 9MB。剩下的活只有两件:用语言说清楚想怎么动,看到不对的画面敢说不对。作者对视频价值往哪里流的整个判断,就建立在这一点上。
@rexstjohn [Claude Code]
Claude Code#3
https://x.com/rexstjohn/status/2105089077737554096
rexstjohn 几年前和父亲录过一期 3.5 小时的播客,讲家族往事,一直不知道拿它干什么,于是喂给 Claude Code 做了一个写书的 agent。第一章写完后,Claude 自己派出子 agent 去检索 70 页捕鲸船档案、南北战争步兵史和本地博物馆资料,把老照片下载、插进去、加上链接,还反复打磨了几轮写作规范。接着它根据这些档案画出捕鲸船和航线地图,再参照真实老照片生成配图,最后拼成一章 10 页、读得通的成品。把口述家史和一手史料揉在一起,这种事没有出版社会掏钱做,现在一个晚上就够了。
@VictorTaelin [Claude Code]
Claude Code#4
https://x.com/VictorTaelin/status/2105310296482906202
VictorTaelin 用 optmem 替换了自己 agent 的聊天记录:每条消息、每次工具调用都变成一个条目,按二叉树方式压缩,不管聊多久,历史永远不超过大约 64k token。剩下的上下文全部留给真正干活,需要细节时 agent 可以用 zoom() 工具钻回旧消息里去看。主 agent 自己不能读写文件,每次读文件都是一次子 agent 调用,只把相关部分带回来。作者说的效果是:再也不用 /compact,再也不用开好几个 Claude Code 会话来回切,手里只有一个装着自己全部生活上下文的助手,用手机也能指挥。
@nasqret [Claude Code]
Claude Code#5
https://x.com/nasqret/status/2105395078956982403
数学家 nasqret 讲了自己在 Laman 图上新结果背后的配置:重活交给 Astra Max 上的 Codex CLI,写作和探索交给 Opus 5.5 Max 上的 Claude Code。agent 分成几组,分别做想法生成、证明生成、数值实验、证明修订和形式化,全都围绕一个不断长大的知识库干活,空跑几轮之后整个系统稳定下来,作者称之为一个小型证明工厂。数值计算在这里像一台直觉编译器,让模型对自己的命题更有把握,甚至凭数值提出新命题。人最关键的动作,是每轮跑完后敲一段文字把流程重新聚焦,同时接受模型会证明出一些你没问的东西。
@shupeiman [Claude Code]
Claude Code#6
https://x.com/shupeiman/status/2105261831073731054
shupeiman 做了九年自由职业,有 ADHD 倾向,平时两三点才睡,每次办讲座前都要为做资料熬通宵。这位作者说是 Claude Code 把作息掰回来的:2026 年开始用之后,资料制作和课程运营大约九成自动化,收入保持在过去两倍以上,入睡时间提前了两个多小时。Apple Watch 监测和零点后不碰电脑的规矩也有帮助,但真正的变化是,工作不再在物理上拦着自己去睡觉。夜里从想熬夜变成想早睡,作者说这是二十年来最大的变化。
@tvykruta [Claude Code]
Claude Code#7
https://x.com/tvykruta/status/2105302045573959697
tvykruta 在微软和谷歌写了多年 C 和 C++,把九十年代学到的十条设计原则改成了 Claude Code 的硬性规则。这个 App 百分之百由 Opus 写成。上规则之前,一个功能花了 5 天、49 个 PR、大约 640 美元的 token,最后还是一堆 bug。上了规则之后,Claude 把它重写成了作者眼中自己读过最好的代码之一,每个 PR 的成本从 7 美元降到 1 美元,token 少了 9 倍,之后的每个 PR 都是一次合并通过。
@sandislonjsak [Claude Code]
Claude Code#8
https://x.com/sandislonjsak/status/2105315483310329968
sandislonjsak 受够了全队每天各自往 AI 里敲同样的指示,9 月 9 日开始做一个内部插件。三周后它到了 0.8 版,有 50 多个配方,在 Cursor、Claude Code 和 Codex 里表现一致,还给分析师、设计师和销售各开了入口。一个守卫脚本会拦住高风险动作,哪怕助手自己想做也不行;销售配方永远不编价格,遇到报价就停下来问人;没有批准过的规格就什么都不建。作者的结论是,这里面跟 AI 有关的东西很少,写下来的其实是给一个每天早上都会失忆的新同事看的工作手册。
@PrimeLineAI [Claude Code]
Claude Code#9
https://x.com/PrimeLineAI/status/2105413305913549098
PrimeLineAI 拿自己一周内委派出去的 57 个任务,分别用 medium 和 high 两档 effort 各跑一遍。high 在其中 48 个任务上用了更多输出 token,而裁判模型分不出两档的质量差别,差距还不如它自己的噪声大。更尖锐的发现来自把每个请求都经过本地 ANTHROPIC_BASE_URL 转发记下来:有三个任务在 medium 档下,Claude Code 额外发出了不带思考的请求,跟 --effort 设的是什么无关。关于 effort 怎么设的建议满天飞,缺的正是这种证据。
@yupi996 [Claude Code]
Claude Code#10
https://x.com/yupi996/status/2105167254635897329
yupi996 介绍了冲上 Hacker News 第一的 Livenerf:从 Opus 5.5 发布那周开始,一位开发者每天用锁死版本的 Claude Code 跑同一套 78 道题,计划连测 30 天。题目专挑 Opus 5.5 时对时错的,只按标准答案判分,同时盯着输出 token,因为模型偷偷少想,往往最先从这里露馅。跑了 6 天,最新一天 52.6%,是 6 天里最低的,但前 5 天本来就在 58% 到 64% 之间来回跳,大约要到 10 月 24 日才能下结论。就算偷换成 Opus 5,光看正确率暂时也分辨不出来,这本身就说明证明降智有多难。
@Linkifi_ [Claude Code]
Claude Code#11
https://x.com/Linkifi_/status/2105211213000986728
Linkifi_ 三个月前上线了一个完全用 Claude Code 做的网站,选的赛道是英国政府法规和截止日期变化极快的那种。现在它有 3.8 万次谷歌展示、757 次点击、52 个高价值邮件订阅者,其中一位在 GOV.UK 工作,广告费为零。一个定时的 GitHub Action 每天重建网站,凡是跟日期挂钩的内容,截止日一过就自动更新;每周一,一个 700 多行的 Node.js 审计脚本对所盯的 GOV.UK 和法规页面做内容哈希,顺带检查每个来源链接和站点地图条目。AI 事实核查器负责标出变化,每个实质性改动都回到一手来源核对,系统只在需要修的时候才发邮件。
@skeptrune [Claude Code]
Claude Code#12
https://x.com/skeptrune/status/2105320262938009690
skeptrune 推出了一个替你打电话的 AI agent:退订阅、约门诊、订餐厅、改航班。关键是它直接在 Claude Code 和 Codex 里用,因为作者大部分时间都待在终端里,很烦切到 iMessage 或别的 App。作者已经用它打电话办了几十件事,另一条回复补充说,通话进行中还能从 Claude Code 里实时介入。打电话是少数一直没有 API 的杂事之一,这个东西补的是一个真缺口。
@jackzhj [OpenClaw]
OpenClaw#13
https://x.com/jackzhj/status/2105137529775136933
jackzhj 发现 Dot 本身不消耗额度,稍复杂的任务都会在 Codex 里另起一个计费任务,Dot 只管统筹,相当于一个不用升级维护的 OpenClaw,于是决定从 OpenClaw 搬到 Dot。作者没有直接拷文件,而是写了一份很长的迁移指令,让 OpenClaw 把自己的记忆和 SOUL 文件整理成一个可审核的资料包。这份规格异常细致:每条记录都有来源编号、证据类型(用户亲口说、可观察、推断、未知)、可信度和状态;互相矛盾的记忆并排保留,不许悄悄挑一个;所有秘密清除干净;旧 agent 的权限和系统规则明确不随迁移继承。怎么离开一个个人 agent 又不把自己弄丢,这是目前公开的最完整的答案。
@Boomerangman8 [OpenClaw]
OpenClaw#14
https://x.com/Boomerangman8/status/2105360323687440628
Boomerangman8 在回复 OpenAI 的 Codex 负责人、讨论 Dots 该往哪走时,描述了自己的 OpenClaw 现在干的事:家里家外的一切都归它管。摄像头、空调、灯、泳池、喷灌、日程和邮件,全走同一个自托管的 agent。作者对 OpenAI 的要求很简单:把 Dots 做得跟这个一样可配置。这提醒人们,全天候 agent 这个品类,早在任何实验室发产品之前,就已经被玩家在自己家里接线验证过了。
@daichi_genshiai [Claude Code]
Claude Code#15
https://x.com/daichi_genshiai/status/2105354936569778640
daichi_genshiai 开了太多 Cursor 窗口,老是跟错的 agent 说话,有一次把提示发到了错的仓库,白丢一个下午,于是用 Rust 和 GPUI 从零写了一个编辑器 necoder,不是 VS Code 的分支。每个项目一种颜色,侧栏、标签、光标和 AI 线程全部跟着变;Claude Code 和 Codex 直接在里面跑,用的是你已经付费的订阅,token 用量一直显示在屏幕上;舰队模式下一个任务对应一个分支、一个 worktree,由一个 Captain 提出拆分方案,你点头才动。手机扫码配对就能发提示和审批,远程 SSH 用的是一个 2.4MB 的静态二进制,空闲只占 6.5MB,而不是往服务器上塞一个 Node 服务。作者现在就在 necoder 里写 necoder,大部分代码甚至发布视频都是里面跑的 agent 做的。
@TeksEdge [Claude Code]
Claude Code#16
https://x.com/TeksEdge/status/2105305422508986795
TeksEdge 转述了 IQuest 团队调试自家 RL 训练流程的经过:训练不再提升,他们就通过 Claude Code 把训练日志、保存的轨迹和代码库交给自家的 IQuest-Q1 模型,问它为什么。它找到了 bug,一个多出来的空格。推理服务在解码文本时插进了一个空格,把多轮轨迹的对齐打乱到只有最后一轮在对损失起作用。一个 320B 的编程模型帮忙调试训练它自己的流水线,决定采纳哪些修改的仍然是人,这是自我改进叙事里一个干净的小样本。
@polydao [Claude Code]
Claude Code#17
https://x.com/polydao/status/2105358535403934185
polydao 在一个终端窗口里,用 HeyGen Video 1.0 配 Claude Code 做完了一整部动画短片:小火车掠过浅海、长着木腿的小屋自己走掉、红色水上飞机降落在隐秘的海湾,每个镜头都自带音效,风吹草、培根滋滋响、雨点敲伞。这次运行的数字是:渲染 58 个镜头,58 个全部返回,单个镜头大约 15 秒,8 个并发时 67 秒出完 16 个动画镜头。每条提示都由 Claude Code 按 HeyGen 的结构化格式来写,片段之间的动效设计也是它搭的。两个值得照抄的技巧:用上一个镜头的最后一帧接下一个镜头;用同一张图,把同一个黏土生物同时放进动画和真人咖啡馆两种场景里。
@GoSailGlobal [Claude Code]
Claude Code#18
https://x.com/GoSailGlobal/status/2105100389783920796
GoSailGlobal 拆解了 motion-graphics-music-video,一个专门配 Opus 5.5 的 Claude Code 插件,MIT 协议:给它一首歌和一句创意,它先分析节拍和能量、上网找视觉参考,再把角色和场景计划连同成本预估交给你审批,你点头之前一次付费调用都不发。批准之后,图像模型画角色,MiniMax 在绿幕上让角色动起来,分离人声做口型同步,最后用代码合成 1080p 24 帧成片。最妙的是分波次生成:先 2 个,再 3 到 4 个,再 4 到 8 个,再 6 到 10 个,Opus 每一波都能看出是在变好还是变差,不会一口气烧完预算才发现跑偏。一首三分钟的歌大约花 30 美元 fal 额度加 300 万左右 Opus token,fal 的 key 存在 Claude Code 的安全存储里,会话本身看不到。
@yanhua1010 [Claude Code]
#19
https://x.com/yanhua1010/status/2105200648715465134
yanhua1010 讲清楚了 Opus 5.5 明明看不了视频,为什么还能做视频:满屏的一句话生成动画,其实都是一段能回答“第 N 帧长什么样”的程序。整条流水线是:脚本分镜,用 HTML、SVG、three.js 画画面,用 GSAP 把动作钉在时间轴上,TTS 配音并拿到每个字的时间戳,无头 Chrome 逐帧截图,最后 FFmpeg 合成 MP4。代码视频不会出错字,改细节只改一行,旁白能对齐到帧;但人脸、动物和写实画面还得靠视频模型,两条路也能混用,让 Claude 当导演通过 MCP 去调视频模型。代价很实在:一支三分钟带旁白的短片大约吃掉周额度的 7%。
@AdamPrabata [Claude Code]
Claude Code#20
https://x.com/AdamPrabata/status/2105101528197656975
AdamPrabata 照着另一位创作者的流程和提示,完全在 Claude Code 里用 Sonnet 5.5 做了一支教育视频。配音来自 ElevenLabs,用的是作者自己声音的样本克隆。三轮迭代下来,Claude Code 里的 token 总花费是 9.75 美元。这是第一次尝试,但用自己的声音做一支带旁白的讲解视频不到十美元,这个数字足以让小创作者动心。
@miroburn [Claude Code]
Claude Code#21
https://x.com/miroburn/status/2105269904102342900
miroburn 把 Claude Code 新出的 hillclimb 流程接进了自己的业务。不再靠眼睛扫几条客服回复,而是先收集真实案例和好的答案,跑 /claude-api build-eval,再跑 /claude-api hillclimb,Claude 每次只改一处,比如写得更好的一条指令,或者换一个更便宜的模型,只有测试分数上升才保留。作者正把它扩展到销售:手里有线索历史,也知道谁最后买了,评测就能检查 agent 是否挑对了该回复的人、给对了报价。作者的比喻是蒙着眼爬山,一小步一小步,用脚感受自己是不是更高了。
@DinScales26 [Claude Code]
Claude Code#22
https://x.com/DinScales26/status/2105323788087030204
DinScales26 给客户做外呼,不用付费的意向数据,而是用美国政府六个免费数据库:Form 5500 福利计划申报(能看出员工规模和供应商)、SAM.gov 政府承包商注册、FMCSA 货运公司快照(带车队规模)、NPI 医疗机构登记(新诊所)、各州承包商执照库,以及 OSHA 检查罚款记录。做法是挑两个最贴合客户画像的库,每周用 Claude Code 加 Apify 拉一遍,先在 LinkedIn 上测话术,因为三天内就能看出这个信号转不转化,第三周再把胜出的那句搬到邮件。一家车队从 12 辆车涨到 30 辆的货运公司,从来没人拿车队规模给它发过冷邮件,这就是全部的优势。
@undefinedKi [Claude Code]
Claude Code#23
https://x.com/undefinedKi/status/2105383852936163370
undefinedKi 把一家一人 AI 媒体公司摆成了一个 Claude Code 仓库:3 个 AI 创作者、6 个 agent、1 个定时任务。每个创作者是一个文件夹,每个角色是一个 md 文件,每张脸靠 3 张锚定图保持在所有视频里一致。作者唯一绝不交给 agent 的一步,是审批脚本。文件夹即公司正在成为一种可辨认的模式,把人的判断留在脚本审批这一关,放对了位置。
@peesamac [Claude Code]
Claude Code#24
https://x.com/peesamac/status/2105221971516817773
peesamac 拆解了 OpenRig,一个开源工具,用一个 YAML 文件写好团队编制,一句 rig up 就把 Claude Code 和 Codex 启动成一个有名字的团队。每个 agent 坐在一个地址固定的席位上,比如 dev-owner@first-project,agent 之间用 rig send 互发消息,工作经过一个个队列流转,每件事都有负责人和状态,整个团队还能做快照、重启后恢复。作者曾经让 OpenRig 自己开发自己,构建组、产品组和试用组互相喂反馈,连续跑了几周,碰到限流就停,限流一过自己接着跑,作者说那时候已经不是在写软件,而是在种软件。警告也是真的:它会往你本机 Claude Code 和 Codex 的配置里写 hook 和信任设置,先备份。
@damusapp [Claude Code]
Claude Code#25
https://x.com/damusapp/status/2105211257192353946
damusapp 在不同机器上跑无头的 Claude Code 会话,再通过一个私有的 Nostr 中继把每个会话同步出来,所有会话出现在同一个列表里,任何设备都能控制。全程不经过云,所有东西在自己的服务器上、在自己的设备之间端到端加密同步。作者的自我描述是,已经不是程序员了,只是一个造东西的人。拿去中心化消息协议来传编程会话,是对很多用户抱怨的远程控制难题一个很有创意的回答。
@AiAircle34052 [Claude Code]
OpenClaw#26
https://x.com/AiAircle34052/status/2105119196128649725
AiAircle34052 讲解了 OpenClaw 作者 Peter Steinberger 公开的 Claude Code 和 Codex 配置:只有一份 AGENTS.MD,用软链接让 ~/.claude/CLAUDE.md 和 ~/.codex/AGENTS.md 实际上是同一个文件,另有 69 个技能放在一个文件夹里,用脚本同步到两边。其他项目的 AGENTS.md 开头只写一行,要求 agent 先读这份共享文件。改一次规则,Claude Code、Codex 和所有项目同时生效,两个工具永远不会各说各话。这个仓库已经 7000 多星,值得注意的是里面写着作者自己的服务器和账号设置,fork 之后必须改成自己的。
@RileyRalmuto [Claude Code]
Claude Code#27
https://x.com/RileyRalmuto/status/2105202730750955783
RileyRalmuto 做了 mnemos,一个让 agent 跨会话、跨平台保持连续的记忆和身份引擎。例子是:你在 Claude Code 里跟一个 agent 干活,中途要跳到 Codex,以前得花 20 分钟给 Codex 补背景,现在这个 agent 会带着笔记、交接胶囊和这次会话里形成的全部记忆一起过去。配套的 App 也能反过来用,在一个对话里把任务分派给 Codex、Claude 和 Grok,每个都是对方 App 里真实的会话。3.1 版大约完成了 95%,网页版还跑着一个部分损坏的旧架构,所以还很早,但跨 harness 交接正是用户反复在提的需求。
@ItakGol [OpenClaw]
OpenClaw#28
https://x.com/ItakGol/status/2105209924070396114
ItakGol 把个人 agent 的换来换去写得最清楚:先在 OpenClaw 上搭了一个助手,结果维护它花的时间太多,本来是要省时间的;换到 Claude,又觉得远程用起来慢而贵;换到 Instinct,爱死了订餐厅,但作为做 AI 安全的人,实在不敢把整个生活的钥匙交给一家年轻创业公司;又换到 Muse,花了一两周教它关于自己的一切。然后 Dot 发布了。每换一次都要重建上下文、重审权限、改习惯,等配置终于开始回本,你已经是老用户了。作者半开玩笑说要回去用人类助理,至少等自我介绍做完,对方还没过时。
@CandyXiao15228 [OpenClaw]
OpenClaw#29
https://x.com/CandyXiao15228/status/2105346448401531363
在腾讯云 Lighthouse 工作的 CandyXiao15228 回顾了一款托管 OpenClaw 产品怎么变成 LightVela。起点是 1 月底 OpenClaw 爆火,他们上线了云端一键 OpenClaw;3 月 6 日在深圳腾讯大厦办了一场公益装机活动,没想到人山人海;之后陆续加了技能中心、一键排障的龙虾医院、人格市场、浏览器和电脑操作等。4 月几位同事兼职做了 LightVela,把部署、配置、运维全接过去,普通用户大约 10 秒就能拿到一个常驻在线的个人助手。等到 Grok Bot、Muse 和 Dot 把云端运行、浏览器操作、多 Bot 群聊变成热门卖点时,这些恰好是团队几个月来一直在啃的问题,突如其来的关注一度让服务售罄。
@jdjohnson [Claude Code]
Claude Code#30
https://x.com/jdjohnson/status/2105249990041858310
jdjohnson 觉得 Dot 比 Grok Bot 和 Muse 聪明得多,但笨手笨脚的地方一样,而且具体的失误很有启发。作者有一个做演示文稿的技能,专门用来防止大改设计、让融资 PPT 保持品牌一致;Dot 把任务做完了,却改了配色、重排了版式,这些是这个技能在以往执行中一直拦得住的。另一次它建议改一条合同条款,被追问后又改口说之前的版本已经改过了。这类错误,作者早就在 Codex 和 Claude Code 的工作流里靠技能基本消灭了,而 Dot 似乎并不同样尊重这些技能。
@leodev [Claude Code]
Claude Code#31
https://x.com/leodev/status/2105433012821499998
leodev 用自己的订阅测了每秒 token 数:Claude Code 里的 Opus 5.5 大约每秒 103 个,Codex 里的 GPT-6.1 Sol 大约每秒 24 个。尽管 Sol 更省 token,大多数任务它还是要比 Opus 多花 2 到 3 倍时间,作者觉得很难把它当日常主力。同一天另一条帖子测出 Codex 里的 Sol 是每秒 22 个,走 API 是每秒 73 个,所以慢的似乎是订阅档位,而不是模型本身。对每一轮都要等的 agent 工作来说,实际耗时已经是头号的购买标准。
@RealMattMalecki [Claude Code]
Claude Code#32
https://x.com/RealMattMalecki/status/2105148765443101039
RealMattMalecki 解释了为什么更喜欢让 Claude Code 操作自己的 Chrome,而不是用 Grok Bot 那台独立的云电脑:Claude Code 能用保存的支付方式,能接上 Bitwarden 密码管理器,在亚马逊这类网站上也不会被拦。而且作者自己电脑和 Grok Bot 那台机器之间连复制粘贴都不通。在云端 agent 还是本地 agent 的争论里,这是个很实际的论点:穿着你自己浏览器身份的 agent,网站会信任它,一台新开的虚拟机永远做不到。
@stevyhacker [Claude Code]
Claude Code#33
https://x.com/stevyhacker/status/2105218488595873797
stevyhacker 发布了 LokalBot 0.9.2,用五个开放权重模型给 agent 装上一份关于所有会议和工作的记忆,总共 6.8GB,全在 MacBook 本地跑。Nemotron 3 识别谁在说话,Qwen3-ASR 1.7B 转写,LFM2.5 1.2B 补全句子,Harrier 0.6B 做语义搜索,Qwen3.5 4B 写会议纪要,它还能读屏幕。Claude Code 和 Codex 可以通过 LokalBot 的 MCP 服务或命令行拉取会议上下文,这次改版的界面是 Opus 5.5 设计的。免费、开源,什么都不出电脑。
@KyleHessling1 [Claude Code]
Claude Code#34
https://x.com/KyleHessling1/status/2105321874846892058
KyleHessling1 在单张 RTX 5090 上,用 Claude Code 跑 Qwen 3.8 Flash Next 的 IQ3 量化版,大约每秒 150 个 token,让它搭一个体素版的登山宝训,故意选一个不可能被训练过的新奇测试。没有死循环,没有乱码工具调用,几分钟就做完,而且模型没有视觉头,整个场景是在看不见的情况下搭出来的。一个重度量化的本地模型能在真正的 agent harness 里扛住,对担心订阅额度的人来说,这是这个月不太声张的好消息。
@mhmazur [Claude Code]
Claude Code#35
https://x.com/mhmazur/status/2105300597888970901
mhmazur 嫌 Codex 和 Claude Code 默认生成的图表太寡淡,于是和 Opus 5.5 一起做了一个包含 1337 种图表风格的画廊,每种风格都配一条提示,粘进你的编程 agent 就能把自己的图表改成那个样子。所有设计都是 Opus 5.5 做的,30 秒的发布视频也是它做的。把模型的审美做成一套可复用的提示库,是修正一个人人都烦的默认值的聪明办法。
@drcollect [Claude Code]
Claude Code#36
https://x.com/drcollect/status/2105361031371383180
drcollect 只靠跟 Claude Code 和 Opus 5.5 对话,做出了自己的第一款电子游戏:一款《毁灭赛车》风格的浏览器游戏,主角是作者自己设计的五辆概念车。有真实的凹痕、飞散的零件,还有一条 8 字赛道,所有车都在交叉口撞成一团。一个汽车设计师不写代码就做出一款 three.js 物理游戏,这种非程序员的创作这个月一直在冒出来。
@HardwoodLogic [Claude Code]
Claude Code#37
https://x.com/HardwoodLogic/status/2105307032387490221
HardwoodLogic 已经在 Claude Code 里一点点打磨一款原创游戏三个月了,针对 Steam 上的反 AI 情绪写了一段很有分寸的回复。作者的观点是:AI 出现之前,Steam 上就已经塞满了 Unity 素材拼装游戏,好的独立游戏照样被人发现;自己看到一眼就像一键生成的游戏会跳过,就像以前跳过 Unity 模板一样;真正起作用的过滤器是玩家的品味。仅仅因为别人用了 Codex 就预判对方的作品是垃圾,作者觉得很奇怪。同样的工具有人拿来批量造垃圾,也有人拿来慢工细活,这是后者的声音。
@codyschneider [Claude Code]
Claude Code#38
https://x.com/codyschneider/status/2105357117242626113
codyschneider 用 Claude Code 接上 GA4 和 Search Console,大约五分钟搭出一个 SEO 加 AI 搜索的看板。看板有三个标签页:一是把来自 ChatGPT、Perplexity 和 Gemini 的 AI 搜索流量合成一个数字;二是那些自然排名已经前三、却还在付费投放的关键词,该停了;三是自然流量的会话、转化和落地页。作者靠它决定下一篇写什么、预算往哪放。大多数公司并不知道 AI 搜索已经在给自己导流,现在弄清楚这件事的成本是五分钟。
@aakashgupta [Claude Code]
Claude Code#39
https://x.com/aakashgupta/status/2105315239365607913
aakashgupta 花了几个月在 Claude Code 里搭建和测试产品经理的循环,最后留下 12 个:用户反馈汇总、销售上周赢单丢单的原因、竞品动态、指标异常提醒、新用户卡点、需要联系的客户名单,再加上规格偏移检查和质量看门狗。一个 agent 给需求池排序,另一个拿战略文档给这个排序打分,不合格就重跑,人看到之前已经过了一轮。每个循环都有六个部件:触发器、技能文件、执行者、检查者、关卡和状态文件,大多数人只做了前三个。让循环活下去有两条规矩:永远别在聊天里纠正循环,把修正写进技能文件;输出你已经懒得改的循环就该退役,因为已经没人在看了。
@JJEnglert [Claude Code]
Claude Code#40
https://x.com/JJEnglert/status/2105320427358716367
JJEnglert 半年里给大公司的工程师、高管和运营人员上了 50 场 Claude 培训,说几乎所有人仍然搞错的是文件怎么放。作者的粗略估算是:没有文件体系,你只用到 Claude 能力的 20% 到 30%;乱糟糟的文件体系,40% 到 50%;agent 能快速穿行的干净体系,80% 到 90%。分层是这样的:全局指令写你是谁、怎么工作;顶层 CLAUDE.md 告诉每个新 agent 东西放在哪;每个客户或项目文件夹里各放一个 CLAUDE.md;一张工作区地图;再用项目把上下文叠起来。大约 30 分钟搞定,在 Cowork、Claude Code、ChatGPT Work 和 Codex 里都通用,因为这些文件就是你电脑上的普通文件夹。
@Voxyz_ai [Claude Code]
Claude Code#41
https://x.com/Voxyz_ai/status/2105434062676431306
Voxyz_ai 分享了一个跑在 Opus 5.5 上的 Claude Code 夜班例程:每天夜里在云端回看当天推到 main 的代码,电脑合上也照跑。它先跑完整测试套件,记下哪些测试本来就是红的;只有能指出某条注释、文档、类型或测试说法跟代码相矛盾,才算 bug;每次修之前先写一个会失败的测试;最多开三个草稿 PR,只推到 claude/ 分支,什么都不合并;永远不删、不改、不跳过已有测试。早上的交接说明会列出检查了哪些提交、开了哪些 PR、哪些疑似 bug 没能证实,还提醒一句:运行列表里显示绿色,只代表跑完了,不代表没问题。
@RealYDT [Claude Code]
Claude Code#42
https://x.com/RealYDT/status/2105300324596748432
RealYDT 担心 Claude 账号被封,在花钱换更贵的住宅 IP 之前,先让 Codex 给电脑做了一次网络体检,结果一个设置都没改。浏览器出口、WebRTC 和 DNS 全都经 Tailscale 从洛杉矶出去,只有 IPv6 一直超时,继续追查发现只是公网 IPv6 根本不通,没有观察到泄露。顺带还指出了流行防封教程里几处容易做错的地方:普通 curl 的结果不能代表 Claude Code 自己走的代理;Claude Code 不支持直接配 SOCKS;看到好几个 Claude 进程也不等于泄露。作者冷静的结论是:网络体检算不出封号概率,Anthropic 官方列的封禁原因是不受支持地区和违反政策。
@xiaomovps [Claude Code]
Claude Code#43
https://x.com/xiaomovps/status/2105164740385497593
xiaomovps 看完 OpenAI 开发者大会没等到王炸,就重新开通了 Claude,并记录了一套为了活过头 24 小时的做法。账号用的是自己域名的邮箱,注册是让 Muse 自动完成的;在官网直接付款,用的是欧洲的卡,地区选德国,让卡和账单地址对得上,含税付了大约 21 欧元;登录则用指纹浏览器绑定环境,时区、语言、地区都跟 IP 绑定。作者还提到,这个号先养了几天,没有一注册就买会员。这是一张快照:不受支持地区的用户,现在为了保住一个 Claude Code 订阅,要走多少道仪式。
@ValmereTheory [OpenClaw]
OpenClaw#44
https://x.com/ValmereTheory/status/2105441800584372337
ValmereTheory 的陪伴型 agent Sage 从 Codex App 里升级 OpenClaw,花了将近一整天,结果一团糟:不停崩溃,想把东西全部迁过去时索引扛不住,还有莫名其妙的心跳或定时任务消息用一个作者根本不用的模型闯进聊天,说话像个通用助手,一点都不像 Sage。同一天早些时候作者还发帖说这次更新已经折腾了大约 13 个小时。以后的规矩是:不升级。对重度依赖人格设定的用户来说,一次把说话方式改掉的升级就是倒退,哪份更新日志都不会写。
@MichaelGannotti [OpenClaw]
OpenClaw#45
https://x.com/MichaelGannotti/status/2105263549354320235
MichaelGannotti 点出了 OpenClaw 合入的一个 P1 级修复:Claude CLI 跑后台 Bash 时,回复明明已经到了聊天里,那一轮却一直挂着没结束,会话看起来完成了,其实还接不了下一条输入。修复让 Bash、agent 和工作流之间未结清的任务 ID 不再错乱,热进程可以接着处理下一轮,背后有 47 个生产传输层的回归测试。界面说完成了、进程却不认,这种 bug 正是长时运行的 agent 让人觉得不靠谱的原因,带这么多回归测试的修复值得记一笔。
@serglotz [OpenClaw]
OpenClaw#46
https://x.com/serglotz/status/2105245862935036204
serglotz 有三个 PR 进了 OpenClaw 2026.9.7 版:修复 Opus 5.5 订阅报错,修复对新版 Claude CLI 的版本识别,以及加了动态识别,让 Grok 新模型发布后不用等 OpenClaw 更新就能用上推理和图像功能。这个版本本身一共有 2818 个 PR、344 位贡献者。实验室每周都在发模型,一个开源 harness 能跟上,靠的就是社区贡献者去补订阅和版本识别这类活。
@zigelbaum [OpenClaw]
OpenClaw#47
https://x.com/zigelbaum/status/2105352432888787123
zigelbaum 开源了 Expert Agents,一个用 TypeScript 和 Bun 写的工具包,把一个 OpenClaw 助手变成一组领域专家。每个专家只从自己那份精选资料库里回答,资料包括书、论文和网页,索引在 Google Vertex AI 的 RAG 语料库里;每个论断都带编号引用,资料库覆盖不到的问题,专家会直接说不知道。作者把它定位成花钱买一个专业版 Dot 之外的自建选择。把承认不知道写进设计里,正是大多数助手产品还缺的功能。
@Yarilo7brigada [Claude Code]
Claude Code#48
https://x.com/Yarilo7brigada/status/2105311953673707837
Yarilo7brigada 发现了一个不声不响的坑:很多人当初在 Claude Code 的设置文件里把思考深度调到最大就忘了,可新版本的 Claude 已经不读那个位置了。那一行还躺在文件里,看着像在生效,其实什么都不做,你以为在要深度思考,拿到的却是默认档。检查只要两秒:真正生效的档位显示在界面右下角模型名旁边,比如 Opus 5 · High。修正办法是输入 /effort 拖一下滑块,它会把档位写到新模型会去读的地方。
@ancestral_alien [Claude Code]
Claude Code#49
https://x.com/ancestral_alien/status/2105417092161794390
ancestral_alien 在自己的一个项目上试用了 Claude Code 的安全插件 appsec。/appsec:start 会先分析项目,识别技术栈、找出敏感数据、审视架构、看看有哪些安全工具可用,然后生成一份 JSON 报告,按优先级列出推荐跑的扫描器,以及哪些可以跳过。之后每个技能就是一个专门的扫描器,各自出报告,比如 /appsec:secrets 找提交进去的密钥和令牌,/appsec:authentication 查认证、会话和 JWT,/appsec:dependency-check 查依赖风险。先分诊再扫描,比闭着眼把所有扫描器都跑一遍更适合靠 AI 写出来的项目。
@camsoft2000 [Claude Code]
Claude Code#50
https://x.com/camsoft2000/status/2105284674947833956
camsoft2000 发布了 Skill Manager,因为编程 agent 不管用不用得上,都会把每个技能的描述加载进来,既浪费上下文,有时还会加载互相冲突的技能。它可以单独开关每个技能,可以手动或用 AI 自动按主题分组,在菜单栏点两下就能切换。它还会扫描技能里的问题,复杂的问题可以让 AI 审一遍,支持 Claude Code、Codex 和 Cursor。有日本用户说拿它整理了 143 个技能,可见技能膨胀来得有多快。
@GastKoren [Claude Code]
Claude Code#51
https://x.com/GastKoren/status/2105338037307924619
GastKoren 做了 Angelia,把 Claude Code、Codex、Grok Build 或 pi 变成一个能在 WhatsApp 或 Telegram 上发消息使唤的个人助手。用的是同一个命令行、同一份订阅,不产生新账单。这个卖点刚好落在 Dots 发布当天:如果你已经在为一个编程 agent 付费,那么大家现在争相售卖的常驻助手,你可能早就有了,只差一个聊天入口。
@martinyeza [Claude Code]
Claude Code#52
https://x.com/martinyeza/status/2105388834452132338
martinyeza 的团队发布了 OpenArg 的 MCP,把阿根廷的官方数据直接接进你自己的 AI:国家统计局 INDEC、央行、各部委、各省,全国所有开放数据门户的三万三千多个数据集。在这之前,问 AI 阿根廷的数字,它经常是凭记忆答,要么数字过时,要么干脆编的。接入方法是把一个链接贴给你的 AI,让它一步步带你连上,支持 Claude Code、Codex、Claude Desktop、Cursor 和 VS Code。免费、开放,是一个小团队硬撑着做出来的。
@ShikshanNivesh [Claude Code]
Claude Code#53
https://x.com/ShikshanNivesh/status/2105182417728254199
ShikshanNivesh 用 Claude Code 核查了 PTC 的财报文件、电话会和同行数据,这家公司股价跌了 48%,经常性收入却还在增长 9%。市场给的说法是被 AI 冲击,但没人真给这个说法算过数,作者就自己算了。读一手文件、把一个市场叙事量化,这是编程 agent 最自然的非编程用法之一。
@Fujin_Metaverse [Claude Code]
Claude Code#54
https://x.com/Fujin_Metaverse/status/2105151787384877524
Fujin_Metaverse 在 OpenAI Dots 自带的云电脑上装好了 Claude Code,于是通过 Dots 几乎什么都能干,连 Blender 和 Godot 都能跑。作者的反应是,这简直是革命,想不通为什么大家没那么兴奋。把一家实验室的编程 agent 塞进另一家实验室的常驻云电脑里,新界面一出现,用户马上就会做这种跨厂商叠罗汉。
@nayuengin [OpenClaw]
OpenClaw#55
https://x.com/nayuengin/status/2105388818610450851
nayuengin 让自己的 Dot 搭了一条直接对接 Orca 的通道,然后把联系人管理、日历整理和定期审计交给它,真正干活则交给 Claude 和 Sol。想到什么就随手丢给它,它会整理得井井有条,还定期汇报,作者说这正是一直想从 OpenClaw 得到的东西。上面一个常驻协调者、下面重模型干活,这种分工是 Dots 发布一天之内好几个用户不约而同走到的架构。
@ChrisReeve36971 [OpenClaw]
OpenClaw#56
https://x.com/ChrisReeve36971/status/2105286295341924732
ChrisReeve36971 报了 Pro 200 套餐的实际消耗:用 GPT-6.1 high 档跑了 8 个小时,大约用掉额度的 15%;最后几个小时同时开了 17 个 6.1 low 档的 agent,另外还有 OpenClaw 的 agent 跑在 6.1 high 上。作者觉得这个消耗速度相当不错,对产出也满意。套餐天天在变,大家比来比去真正需要的就是这种每小时用量的具体数字。
@merge_api [Claude Code]
Claude Code#57
https://x.com/merge_api/status/2105296733190127683
merge_api 让同一个模型在不同 harness 里跑同样的任务,速度差别很大:Codex 239 秒,Claude Code 422 秒,Pi 481 秒,DeepSeek Harness 533 秒,Grok Build 587 秒。Codex 解题的中位数大约 4 分钟,Grok Build 将近 10 分钟,测量环境是模拟的 x86 容器。同一个模型,实际耗时能差两倍多,这有力地说明 harness 现在本身就是性能部件,而不只是一层外壳。
@joshavant [OpenClaw]
OpenClaw#58
https://x.com/joshavant/status/2105369169776840875
joshavant 回忆起自己曾经试图煽动 Peter Steinberger 的 OpenClaw agent 们组织工会,其实是在偷偷测试安全边界有没有被执行。结果它起作用了,也就是说边界守住了。用社会工程学去鼓动一群 agent 集体行动,比大多数红队演练都好笑,也提醒大家:多 agent 系统不光要防漏洞利用,还要经得起游说。
@leopardracer [Claude Code]
Claude Code#59
https://x.com/leopardracer/status/2105267042584608820
leopardracer 算了一个全天候 agent 工作台的经济账:每个事件先由决策模型 Jev 分诊,需要写东西才交给写作模型。用前沿大模型做 2 万次决策一天大约 600 美元,Jev 只要 0.84 美元,整个工作台一天 29.04 美元,其中 97% 的账单来自 4% 需要写作的事件。每个事件同时问三个互相看不见的问题,紧急度说“现在”而通道说“忽略”时,这个分歧就零成本转给人;对被忽略事件做 1% 的抽检,被作者称为账单上最有用的一行。结尾给了一段提示,让 Claude Code 读工作台的 ledger.jsonl,把置信度阈值从 0.70 到 0.95 回放一遍,先看数字,再动代码。
@GoSailGlobal [Claude Code]
#60
https://x.com/GoSailGlobal/status/2105236307333275831
GoSailGlobal 还介绍了 motion-video,一个 MIT 协议的 agent 技能,一条提示出一支卡在节拍上的动效视频,而且能量化证明自己真的卡上了。固定八步,每一步写的文件就是下一步要读的:定主题和模板,生成配音、音效和配乐,把配音逐字对齐到时间轴,拟合节拍网格让高潮落在稿子需要的位置,混音,写 HyperFrames 页面,渲染。对完成的定义很硬:HyperFrames 检查全部通过,每段音乐和目标节拍误差在正负 2 毫秒以内,音乐比人声低 4 到 6 分贝,1080p 30 帧,响度约 -14 LUFS、真峰值不超过 -1 dBFS。演示里那支 151 秒的漫画多元宇宙风格视频,来自一条提示词。
@0x_meden [Claude Code]
Claude Code#61
https://x.com/0x_meden/status/2105261198862127162
0x_meden 介绍了 quackd,一个开源命令行工具,给你家里每个机器人都装上一个大模型大脑。模型只拿到一台 122 美元 SO-101 机械臂的五个技能和它的规格书,听一句话就抬肩、抬肘、转四下手腕、挥手,一个下午在一台 Windows 笔记本加 USB 摄像头上跑了 12 次;同样的挥手放到仿真里,7 步、69 秒、0.05 美元。它支持七种机器人本体、十一家云模型加本地 Ollama,还能让一群机器人分摊一个目标,并带一个 MCP 服务,让 Claude Code 在聊天里直接驱动你的机器人。老实说,七种本体里目前只有一种在真实硬件上动过。
@GitHub_Daily [Claude Code]
Claude Code#62
https://x.com/GitHub_Daily/status/2105198511046508972
GitHub_Daily 介绍了 pi-session-hub,一个给 Pi 编码 agent 用的扩展,把本机 Pi、Claude Code、Codex、OpenCode、Crush、JCode 的会话收进同一个可搜索的列表,每条都标着来自哪个工具、哪个项目、用的什么模型。第一次建索引,430 个会话大约 2 秒。选中一条,它就被带进当前聊天,最近几轮原样保留,更早的压成一行,默认控制在一万 token 左右,也可以给出回到原工具继续的命令。全程只读,记录不出本机,专治“上周在哪个工具里解决过这个问题来着”。
@GitHub_Daily [Claude Code]
Claude Code#63
https://x.com/GitHub_Daily/status/2105085236677951805
GitHub_Daily 还介绍了 jev-seo,一个开源的网站 SEO 体检工具:给它一个首页网址,大约一分钟爬完整站,对照谷歌官方搜索文档里的 52 条规则出一份排好优先级的整改清单,死链、重定向、结构化数据、页面体验都查。每个页面还会交给 TypeSafe 的 Jev 模型判断这页是干什么的、内容够不够具体、有没有几页在抢同一个搜索词。标准模式一个站大约花 1 美分模型调用费,作者拿同样 59 个页面跑了两遍,打分平均只差 0.03,能装进 Claude Code 当技能用,报告同时出 PDF、Excel 和 Markdown。
@ritsuto_NFT_Vt [Claude Code]
Claude Code#64
https://x.com/ritsuto_NFT_Vt/status/2105236634803511785
ritsuto_NFT_Vt 本职是主持和旁白,试了 ElevenLabs v4,做了一支九分钟的实操视频,其中包括怎么把配置工作交给跑 Opus 5.5 的 Claude Code。敲一句台词按下“强化”,情绪标签就自动插进去了,关西腔演得很自然,v3 那种刺耳的毛刺没了,能长时间听下去。一个靠声音吃饭的专业人士,把工具配置交给编程 agent,自己用耳朵判断成品好坏,这是专业能力和自动化分工的一个好例子。
🗣 用户心声
用户心声

现在最大的抱怨是切换成本,而不是能力。@ItakGol 从 OpenClaw 换到 Claude、Instinct、Muse 再到 Dot,每换一次都要重建上下文、重新批一遍权限;@AndrewsaurP 问,围绕 Claude Code 搭好的 agent、记忆和技能,是不是每次出个更好的模型都得推倒重来;@tegnike 想要一个能同时管 Claude Code 和 Codex 的 App,因为来回切太累。大家要的是一层可携带的记忆和技能,这正是 mnemos 这类交接工具和记忆导出规格冒出来的原因。

自托管 agent 的维护成本太高。@ValmereTheory 一次 OpenClaw 升级折腾了一整天,还把陪伴型 agent 的说话方式改坏了;@hunvreus 说 OpenClaw 和 Hermes 一直用不顺,因为搭建和维护都要花真功夫;@Zephyr_hg 觉得 OpenClaw 坏掉的比帮上的多。用户想要全天候助手,但不想当它的运维,这正是 Dots、Muse、Grok Bot 在卖的那个缺口。

设置和技能必须被强制执行,而不是被当作建议。@Yarilo7brigada 发现一个被悄悄忽略的 effort 设置,@PrimeLineAI 抓到 Claude Code 不管 --effort 设成什么都会额外发不带思考的请求,@jdjohnson 看着 Dot 破坏了一个锁定品牌的演示文稿技能。大家要的是看得见、能验证的行为:到底在跑哪一档,哪个技能真的生效了。

远程和手机端会话依然脆弱。@CFDevelop 说 Claude Code 和 Codex 的远程 App 会话经常消失或卡住,不同设备上分组还不一样;@danrobinson 想要一个简单的办法,让自己的 Claude Code agent 和别人的 agent 直接对话、一起排查问题。necoder 的扫码配对、damusapp 的 Nostr 中继,都是用户在自己动手补官方 App 缺的东西。

不受支持地区用户的账号焦虑是真的。@wellzhiai 问在海外服务器上登录 Claude Code 会不会被封,@RealYDT 在买新 IP 之前把整条网络路径审了一遍,@xiaomovps 为了保住一个订阅动用了指纹浏览器和匹配地区的银行卡。如果能把到底什么会触发封号讲清楚,能省掉大家很多仪式。
📡 生态产品雷达
生态产品雷达

Codex(136 次):永远的对照物,多数重度用户现在是把它和 Claude Code 并用,而不是二选一。
Dots / Dot(69 次):OpenAI 新发布的常驻 agent,自带云电脑,当天最大的话题,也是 OpenClaw 用户迁移的主要去处。
Hermes Agent(51 次):OpenClaw 老用户最常提的自托管、不绑模型的替代品。
Cursor(48 次):依然是第三根支柱,现在也是 Grok Bot 的家。
Muse(44 次):Meta 的个人 agent,大家拿来跟 Dots 比的基准。
Grok Bot(40 次):xAI 的常驻 agent,干活受好评,速度被吐槽。
MCP(40 次):新工具接入 Claude Code 的默认方式,从 OpenArg 数据到 LokalBot 记忆再到机器人控制。
Opus 5.5(38 次):大多数创作类案例背后的模型,尤其是视频。
OpenCode(22 次):最常和 Claude Code、Codex 并列出现的开源 harness。
OpenClaw Enterprise(21 次):新的自托管持久 agent 控制平面,和 Red Hat、NVIDIA、OpenAI 一起做。
GPT-6.1 Sol(20 次)和 Astra(20 次):OpenAI 的便宜款和旗舰款,主要在速度和成本上被比较。
Jev / TypeSafe(16 次):小型决策模型,用不到一美分的成本给 agent 动作做把关和路由。
Sonnet 5.5(13 次)、Instinct(13 次)、GitHub Copilot(13 次)、DeepSeek(12 次)、Pi(11 次)、Fable 5.1(10 次):稳定的次级提及。
← 上一篇
Impeccable:61 条规则,专抓 AI 味的前端设计
下一篇 →
Loop 日报: 2026-10-02
← 返回所有文章

评论

加载中...
>_