2026年9月7日super-user

超级用户日报: 2026-09-07

这一批最扎眼的变化:赚钱的故事开始有名有姓有金额了。一位日本用户让 Claude Code 搭了一家"500 日元笔记持续卖钱"的一人公司,一个 OpenClaw 代理替主人谈保险续约省下 973.70 美元,还有一家两人创业公司靠非技术合伙人自己搭的客户情报看板冲过了 100 万美元 ARR。与此同时,重度玩家早就不玩"一个代理一个终端"了——Mac Mini 农场跑着几十个代理在 Slack 里干活,跨 harness 收件箱里 Codex 工人向 Claude 工人要函数签名,还有人拿两台笔记本 24 小时轮换 20 个订阅。乌云也有:Astra 一发布,关于定价和限额的抱怨直接升级成公开造反,而 Claude Code 自家的 Rules 系统被抓到会悄悄失效。
@buttanoteragoya [Claude Code]
Claude Code#1
https://x.com/buttanoteragoya/status/2096342607932879254
他给 Claude Code 下的需求是"建一家 500 日元笔记能一直卖出去的公司",结果真拿到了一家能跑的一人公司。这套系统自带 30 个常青选题数据集、一个一次性生成 4000 字笔记的 prompt、过时表达自动检测器、一篇笔记拆成 10 条推广帖的模板,还有用来涨价的杂志结构。他每天的工作就是花 15 分钟对提案回复"OK"。哪怕整月不写新东西,旧笔记也还在持续出单。
@undefinedKi [Claude Code]
Claude Code#2
https://x.com/undefinedKi/status/2096224107121516997
一家两人 AI 创业公司上线两个月就做到年化 100 万美元营收,但真正值得看的是背后那一层。每通客户电话都有 AI 记录员同步进 Notion,然后那位不会写代码的联合创始人用 MCP 把 Claude Code 接上这个数据库,全程用大白话搭出了一个"客户情报"看板。它给每个付费客户打"产品热爱度"分,路线图按这个分数排序,而不是按功能请求排。打分直接捞出了他们的核心洞察:出于好奇注册的会流失,带着"我现在就要做营销"来的会留下。
@Ryrenz [Claude Code]
Claude Code#3
https://x.com/Ryrenz/status/2096162673821921424
一位被裁的地球物理学家把自己整套求职流水线开源成了 ai-job-search,一个基于 Claude Code 的技能包,现在已经 4 万 GitHub star。跑一次"apply",它会针对具体 JD 改简历、编译 PDF、检查 ATS 系统能不能正确解析,全过了才交给人做最终确认;结果同步到 Notion 和 Gmail。他自己用它投了 69 份定制申请,拿到 20 个一面,最后落地一份 AI 工程师工作。1.3 万个 fork 说明"fork 过去填上自己的履历"这个模式是真的能跑。
@nakamura [Claude Code]
#4
https://x.com/nakamura/status/2096178472108642553
一位教授把自己 35 人研究实验室运转所需的一切都做了出来:3 个月 105 个功能、11 个服务,包括共享登录,甚至还有实验室内部的支付服务。他的结论是"实验室要什么服务就自己造"的时代已经到了,并且在劝其他 PI 也这么干。运营一个实验室本质上就是小微企业的工作量,而这个工作量刚刚变成了一个人就能自动化的东西。
@vishnuunhsiv9 [OpenClaw]
OpenClaw#5
https://x.com/vishnuunhsiv9/status/2096308405367456142
他把去年的保单声明页丢给 OpenClaw,让它去找本地最好的保险经纪,结果房屋加车险的伞式保单续约省了 973.70 美元。代理自己发邮件联系经纪人、砍价,最后拿回来的是条款更好、价格更低的新保单。买保险这种事,人类总觉得折腾半天不值那点回报,能拖就拖——而代理恰好把这笔账翻了过来。
@fjpedrosa86 [OpenClaw]
OpenClaw#6
https://x.com/fjpedrosa86/status/2096292811410751691
他在跑一个特别好玩的自主性实验:给 OpenClaw 代理配一张自己的 Revolut 卡和 100 欧元预算,任务是搞定他工作日的午饭,必须在 14:00 到 14:15 之间送达。代理得同时优化价格、餐厅口碑、他的口味偏好和宏量营养素目标。给代理一张卡和一个每天都要落地到物理世界的活儿,是比"让它改文件"更高一级的信任。
@jcfmunoz [OpenClaw]
OpenClaw#7
https://x.com/jcfmunoz/status/2096156313986195656
他让自己的 OpenClaw 代理(名叫 Beru)通过 App Store Connect API 给应用新版本上传了 306 张营销图、创建了 16 个本地化语言版本——45 分钟搞定,人只在关键处看一眼。之后再花一小时做了一份完整的 ASO 研究,把每种语言的最佳关键词都定了下来。App Store 运营是独立 iOS 开发里最磨人的环节之一,现在从几天压缩到了一顿午饭的时间。
@voltsandvision [OpenClaw]
OpenClaw#8
https://x.com/voltsandvision/status/2096231745410498564
一位包工头把 OpenClaw 当成自己工作上的"Jarvis":往 Telegram 里丢截图,代理负责把他的表格更新好。现在他在筹划一支专业化代理小队——报价员、项目经理、物流、行程规划——教它们按他的方式给工程报价。这是代理组织模式的建筑行业版本,而且提出者是个自称完全不懂技术的普通人。
@thewebbie [OpenClaw]
OpenClaw#9
https://x.com/thewebbie/status/2096279017657643264
一份"非玩具级" OpenClaw 部署到底长什么样的实录:LaunchAgents 保活本地服务、Telegram 送达、Gateway/exec 权限、Tailscale 路由、故事媒体工作流、备份,再加一圈个人自动化粘合在周围。无聊的可靠性层,恰恰是 demo 和日常主力工具之间的分界线。同一条讨论串里另一位用户说得好——OpenClaw 上还跑着大量自动化,你听不到只是因为它们无聊又稳定。
@cyburke [OpenClaw]
OpenClaw#10
https://x.com/cyburke/status/2096303369984028881
反面教材来了:一次翻车的 OpenClaw 2.0 全新安装。他只想用 Meta 的 Muse Spark 模型,结果下拉列表里没有 Meta,也没有自定义 endpoint,安装程序一个劲儿抓 Codex 当备胎,还没经同意就把他的 Claude 和 Codex 会话导了进来。最后他不得不用另一个代理来调试这个安装器。他的判词很公道:一个 2.0 版本的首次运行体验,不应该需要这种程度的抢救。
@rlaope [Claude Code]
Claude Code#11
https://x.com/rlaope/status/2096111328528318713
Sionic AI 的企业级代理运营:CEO 买了一批 Mac Mini,搭了一座代理生产工厂,几十个代理覆盖服务开发、DevOps、AI 研究和 BD。工程师们已经不开编码会话了——他们在 Slack 里给代理发消息,他强烈推荐这个方式而不是桌面端或 TUI,因为公司的上下文本来就长在 Slack 里。帖子里全是实战配置心得(比如给 Slack 关掉工具进度噪音),还有一句大实话:他自己几乎不再打开 Claude Code 了,有时候还让代理去触发 Claude Code,纯粹为了把已经付过钱的订阅额度烧掉。
@hraness [Claude Code]
Claude Code#12
https://x.com/hraness/status/2096082136285528496
我们见过的最极端的手工作坊:两台笔记本 24 小时跑着 Codex 应用和 Claude Code,完全不用任何编排工具。他在 Apple Notes 里记着 20 个订阅和它们各自的精确重置时间,手动轮换,然后发出"会跑上几小时甚至几天的怪物 prompt"。他说给每周限额配速是一种诡异的新技能——一不小心,一个 Fable 限额一小时内就能烧光。徒手驾驭代理集群,如今是一种真实存在的工作流。
@coreyganim [Claude Code]
Claude Code#13
https://x.com/coreyganim/status/2096183307822420031
一套完整的企业 AI 栈,摊开来讲得明明白白:Claude Code/Codex 是工作台,GrokBot 是劳动力,Slack 是沟通层,"第二大脑"放在 GitHub,Composio 管工具接入,GHL 做 CRM。部署一个新的专业代理只要 5 分钟,而且每个代理每周都跑一次 ingest 技能,把学到的东西推回第二大脑——整个系统边干活边变聪明。最后这个回路,就是"雇代理"和"养组织"的区别。
@JohnRTyndall [Claude Code]
Claude Code#14
https://x.com/JohnRTyndall/status/2096348757411672447
他让 Claude Code 和 Codex 的代理在同一个代理主管手下并行干活,用 hooks 和 MCP 搭了个共享收件箱,工人们可以跨 harness 互发消息。他亲眼看到一个 Codex 工人向 Claude 工人询问一个还没写完的函数的签名,拿到答案后直接照着写测试;另外两个工人协商好了校验和规则,收工前还把各自的临时数据库清理干净。跨厂商代理团队围着一个收件箱协作——多代理的未来落到实处,就是这个样子。
@0xrux [Claude Code]
Claude Code#15
https://x.com/0xrux/status/2096129729178849480
一套"人类只跟一个代理说话"的架构拆解:Pluto 是幕僚长 GrokBot,把所有事路由给 Ledger(记账)、Kin(转介绍)和其他专家。妙的地方在于:所有 bot 共用一台 VM,终端里同时登着 Claude Code 和 Codex,跑的是 Karpathy 的 LLM-council 思路——Claude 和 Codex 自动互审对方的活儿。而且工作一旦路由到 Claude Code 或 Codex,烧的是那两家订阅的 token,不动 GrokBot 的额度。代理平台之间的成本套利,已经来了。
@Austen [Claude Code]
Claude Code#16
https://x.com/Austen/status/2096238185760350233
他把模型议会的想法做成了一个可安装的技能:在 Grok Bot 里同时跑 Grok、Claude Code 和 Codex,让它们互相争论直到达成共识。跨厂商对抗式评审,一行命令装好。这背后那个不声不响的假设——任何一家实验室的模型都不该被单独信任——正在变成默认的工作方式。
@k8adev [Claude Code]
Claude Code#17
https://x.com/k8adev/status/2096294240934400258
他的新工作流:先跟 ChatGPT(Astra)讨论实现方案,让它写出详细技术规格,然后让 Astra 自己通过 tmux 去协调和监督 Claude Code 干活。全程语音驱动。一个模型当架构师兼监工,另一个当双手——靠说话,不靠打字。
@sanchitmonga22 [Claude Code]
Claude Code#18
https://x.com/sanchitmonga22/status/2096372075439235580
OpenAI 发了个插件把 Codex 塞进 Claude Code,于是他反手做了个反向版:把 Claude Code 塞进 Codex。Astra 写代码,Claude 来审,一条 prompt 搞定。他第一天的诚实感受:Astra 在基准测试上是头怪兽,单任务成本还只有一半,但 Claude 依然能抓到 Astra 自己写完又视而不见的问题。不同实验室,不同盲区——这正是交叉评审模式能成立的原因。
@claudecode84 [Claude Code]
#19
https://x.com/claudecode84/status/2096083785938854376
他公开了支撑自己"夜班"的真实文件夹结构:写着排班规则的 CONTRACT.md、带花费上限和超时设置的 harness 文件夹、控制排班触发的 schedule.yml、能抓住他自己漏掉问题的代码/写作/安全评分标准,外加回执(已存 5382 张)、追踪日志,和一个让下一班从上一班停的地方接着干的 checkpoint 文件。以前他醒来第一件事是查昨晚坏了什么;现在醒来看到的是标好日期、打好分、等他审阅的回执。代理运维正在变成一个可以直接拷走的文件夹。
@lidangzzz [Claude Code]
#20
https://x.com/lidangzzz/status/2096078265534292180
一套锋利的多代理哲学:在任何代理眼里,其他代理的产出在验证之前都是错的。他认为有效的多代理系统不是一千个代理开派对,而是代理之间互相挑战——默认不信任、先审后用、测试驱动、没验证就拒绝往下走。他的交换条件:多烧 3 到 10 倍 token,换 50% 的可靠性提升,最终要么拿到经过验证的交付物,要么得到一句诚实的"我失败了"。这套东西真正解决的敌人,是盯着一堆没验证过的代理产出时的那种焦虑。
@ByteMohit [Claude Code]
#21
https://x.com/ByteMohit/status/2096269603592982835
本周关于 Plan Mode 为什么重要的最佳论述:一句"先别写文件"的 prompt 不叫计划——只要写入工具还在 schema 里,模型就仍然可以调用它们。Plan mode 是一个动作空间:只许读、搜、问,禁止一切变更,由 harness 强制执行,而不是在提示词里苦苦哀求。他想要的是一份人类可以否决的计划、批准前彻底摘掉写入工具、以及对计划过程本身也设上限。跳过计划不是在提速,是在花钱制造返工。
@martinvars [Claude Code]
Claude Code#22
https://x.com/martinvars/status/2096329310546141397
Spotify 公开了一位工程师如何把 Claude Code 的 token 用量砍掉 90%:别再让前沿模型干粗活。代理干的大部分事其实是 I/O——为回答一个问题读五个文件,写第二十个长得差不多的测试——所以他们把批量读取和样板代码路由给便宜模型,把 Claude 留给真正的硬问题。在工程负责人已经为每个开发者每月花 200 到 500 美元 token 的当下,他的结论砸得很实:要么你路由工作负载,要么 token 账单支配你。
@socialwithaayan [Claude Code]
#23
https://x.com/socialwithaayan/status/2096190823012684265
一份高密度清单:12 个不牺牲输出质量的 Anthropic 账单优化杠杆——缓存优先(缓存读取 $0.25/M)、按路由设 effort(多数人都设高了一档)、用任务预算掐死失控循环、/claude-api 的 cost-optimize 和 prompt-audit 命令,外加社区工具 RTK、CodeGraph、Ponytail 和 Caveman。他自己审计时发现,一个叫 final-final-v3 的技能文件里还有 14 行 prompt 是写给 Claude 3 的。成本素养已经是一门有自己工具链的学科了。
@SKatalystAI [Claude Code]
Claude Code#24
https://x.com/SKatalystAI/status/2096028799489933616
他盯住了那个比跑分更重要的更新:Fable 5.1 的 medium effort 大致等于 Fable 5 的 high,而且据 Anthropic 自家的 Lydia 说,medium 现在是 Claude Code 里的默认档。他的痛点从来不是模型能力,而是永远在琢磨 effort 档位、琢磨一个任务"配不配"花 Fable。如果 medium 就能给出大部分能力还不狂吃会话额度,日常体验的改变比任何排行榜都大。
@dotey [Claude Code]
#25
https://x.com/dotey/status/2096120681104622049
一位重度用户密集用过 Astra 之后的诚实账本:Fable 哪儿都强,但贵到即使在 200 美元的套餐上他也从来不敢放开用,而用 Fable 指挥便宜模型干活,UI 细节又会掉档。现在 Astra 负责做原型,还能靠 computer use 自己发现并修掉小 bug——正是那些他过去手动找出来、又心疼 Fable token 舍不得修的 bug。他准备退掉两个 Claude Max 订阅中的一个,并且真心高兴 Anthropic 终于在 Fable 这个档位有了像样的对手。
@cwmasaki [Claude Code]
Claude Code#26
https://x.com/cwmasaki/status/2096080170520306123
本批最扎实的 Codex 对 Claude Code 横评,出自一个两边都在用的人:Codex 赢在高档套餐没有 5 小时上限、20x 额度算得诚实、桌面应用更好、有 computer use、压缩上下文更聪明、/goal 好用、能生成图片,还有 Luna 的性价比。Claude Code 还守着的阵地是 hooks 和 Routines 这类托管服务。他对根因的判断很结构化:Anthropic 看起来是算力吃紧——高价租 GPU、Fable 限流到 50%、重置次数变少——等这个缓过来才有得翻盘。
@kawasin73 [Claude Code]
Claude Code#27
https://x.com/kawasin73/status/2096030851217887431
他连夜发了一篇题为"Claude Code 的 Rules 已经死了"的博客,在日本开发者圈的 Twitter 上炸开了。核心发现:按路径生效的 Rules 可能会悄无声息地不再触发。当你的护栏依赖于 harness 的文件访问方式时,harness 的一次优化就能悄悄把你的安全网抽走。
@connect24h [Claude Code]
Claude Code#28
https://x.com/connect24h/status/2096150936876147036
"Rules 已死"警报背后的机制:Claude Code 开始通过 Bash 用 cat/sed/grep 读文件,而不是走它专门的 Read 工具,于是 Rules 和基于 Read 的 hooks 所依赖的触发点被整个绕过——路径规则不触发,子目录的 CLAUDE.md 也没人读。大家挖出来的临时解法是禁用 CLAUDE_CODE_THRIFTY_SONIC。他的总结才是真正该记住的:AI 编程里最可怕的故障不是报错,而是一条你以为还生效的约束悄悄消失了。harness 工程从此也需要自己的回归测试。
@rohanpaul_ai [Claude Code]
Claude Code#29
https://x.com/rohanpaul_ai/status/2096117661172384137
Claude Code 之父 Boris Cherny 在 YC Startup School 的建议:每 6 个月,删掉你的 claude.md、删掉技能、删掉 hooks,看看模型自己会怎么干——它可能让你吃一惊。对 Opus 5 他强烈建议全删,因为新模型可能已经不需要那些为更弱的前辈写的说明书了。你精心调校的 harness 是有保质期的,到期日就是每一次模型发布。
@norvex1029 [Claude Code]
Claude Code#30
https://x.com/norvex1029/status/2096136031221207380
Claude Code 团队内部,有工程师说日常工作的 70-80% 已经在 Slack 里的代理上完成——不在终端,也不在 IDE。他们给 Claude 一个目标,它自己从团队的 Slack 对话里拉上下文,跑循环、并行调研、代码评审加验证,一路收紧直到产出达到可审阅的水平。而且他们随着模型进步在持续删减自己的 harness。他从中提炼的教训:优势不在于搭出最复杂的工作流,而在于知道哪些事可以不做了。
@coinbureau [Claude Code]
Claude Code#31
https://x.com/coinbureau/status/2096207830571479363
一位开发者(出处:@mertcobanov)通过开发者选项把 Claude Code 接上自己用了 4 年的 Android TV,让它给电视瘦身——把吃内存的应用移出流水线、装上 FLauncher、调紧动画时长。什么都没卸载,每一步可回滚,不用 root,他还发布了带完整 prompt 的 4 步教程。旧硬件复活,可能是目前最能引起共鸣的代理用例。
@om_patel5 [Claude Code]
#32
https://x.com/om_patel5/status/2096076206026195203
小时候想要一块特工手表,于是他给自己的 Garmin vibe-code 了一块:雷达扫描附近蓝牙设备并按距离标注,tailscan 标记你移动之后还在跟着你的信号,加速度计做地震检测,GPS 情报投放点,表盘还带指纹门禁。用 prompt 设计表盘怎么都不满意,他干脆 vibe-code 了一个自己的浏览器端像素级表盘编辑器——然后把它当渲染器用,一晚上就发布到了 43 款 Garmin 机型上。先造那个能造东西的工具。
@xevrion_the1 [Claude Code]
Claude Code#33
https://x.com/xevrion_the1/status/2096345842001367496
他把一条便宜的蓝牙 LED 灯带挂到桌面壁纸上,桌面变色,房间跟着变色,延迟 0.12 秒。Claude Code 破解了灯带的蓝牙协议——所谓的"手机 App",本质上就是 7 个未加密的字节。灯带只允许一个连接,所以厂商的 App 现在被永久挤在了门外。逆向消费级硬件,已经变成一个周末 prompt 的事。
@yuris [Claude Code]
#34
https://x.com/yuris/status/2096062416841028017
三周之内:一套功能完整的多用户 CRM,带邮件解析和深度内部数据集成;一个稳定的 Chrome 扩展;还有一个逆向出来的插件,把 Affinity 支持原生塞进了 Superhuman。所有东西基本上一次就跑通,而他一行代码都没读——甚至连终端都不用了,直接改用 App。他的论断:你想给自己做的软件里,约 90% 已经不需要你会编程。
@bokuwalily [Claude Code]
Claude Code#35
https://x.com/bokuwalily/status/2096040820428419266
对"换工具成瘾"的一记反调:他作为非程序员,几乎全靠 Claude Code 发布了 13 款 iOS 应用。他的理由——当你自己读不懂代码时,把一个工具的脾气摸透,胜过在一堆工具之间来回横跳。当代理是你唯一的工程师时,一致性本身就是功能。
@Minimalist_Quin [Claude Code]
Claude Code#36
https://x.com/Minimalist_Quin/status/2096231518720971228
两个月前开始做个人作品集网站时,她完全不知道自己在干什么——就靠好奇心、Claude Code、反复试错,和无数次"这怎么又不行了?"的瞬间。现在她骄傲地把它发布了。非开发者的上手坡道在持续变短,而这条情绪曲线——从一头雾水到八周后的自豪——本身就是最好的产品广告。
@PoShenLoh [Claude Code]
Claude Code#37
https://x.com/PoShenLoh/status/2096060001026527689
这位 CMU 数学家花了一个周末和 100 美元,做出了一整套有鲜明识别度的视频广告campaign——他的 prompt 设定是想象 Apple、Buc-ee's 和 Michael Jackson 联名——并公开了完整的思维链工作流。他现在用一个 5 屏工作站指挥 4 台跑着 Claude Code 或 Codex 的电脑,说自己在公司层面的生产力已经起飞。他对工作的判断:GPT-6 级别的工具会把工作打碎成小队干出千人产出的碎片——他 18 人的周五课来了 50 多个学生,看来大家是同意的。
@godai_ceo [Claude Code]
Claude Code#38
https://x.com/godai_ceo/status/2096102951710548288
3 天全靠 AI 剪完一支 40 分钟的视频,预计每月省下 30 万日元成本:Claude Code(Fable 5.1)分析参考视频,Codex 承担主剪辑,Astra 中途加入,HeyGen 负责对口型,Genspark 和 Seedance 生成素材。一个剪辑新手靠调度五个工具发布出广播级时长的内容,这就是多代理流水线故事的微缩版。
@irabukht [Claude Code]
Claude Code#39
https://x.com/irabukht/status/2096373848262275569
两周 4 次产品发布带来 200 多个新客户,每支发布视频都是在 Claude Code 里不到一小时做出来的——四支加起来 30 多万播放。他说得很实在:算不上网红级数据,但考虑到做视频有多省事,这买卖绝对划算。发布内容成了开发工具附赠的、近乎免费的副产品。
@every [Claude Code]
Claude Code#40
https://x.com/every/status/2096267894401409172
Every 把"Compound Writing"打包成了 Claude Code 和 Codex 的免费开源插件:动笔之前,模型先用 15 到 30 个问题采访你、把你的想法掏出来,然后逐节列纲、起草、评审,评审人格还包括 /hitchcock(读者会不会身体前倾?)和 /sorkin(文字有没有推进感?)。教会它东西的会话会存进声音和风格文件,所以每一篇的起点都比上一篇高。反"自动售货机"式 AI 写作,成品化了。
@cyrilXBT [Claude Code]
Claude Code#41
https://x.com/cyrilXBT/status/2096179280661057704
Karpathy 的第二大脑配方还在扩散:把 Claude Code 指向一个 Obsidian 库,任何材料丢进 raw 文件夹,说一句"ingest this",它就会把一切链接、归档进一个由 CLAUDE.md 治理的活维基。五分钟搭好,像利息一样复利,从此不再从一个空白对话开始。今天冒出了好几个这套工作流的变体——这说明它正在从小技巧变成标准操作。
@asahi_ai_x [Claude Code]
Claude Code#42
https://x.com/asahi_ai_x/status/2096140897683681390
一个简单到不行的反幻觉仪式:Claude Code 做完调研后,他再跑一遍,只给一条指令——把你引用的每个 URL 都打开,核对原文是否真的支持你的说法。最近一次 12 个 URL 的检查,揪出了 6 处对不上的。别信 AI,要让 AI 不信它自己。便宜、机械,而且逮住的恰恰是最容易烧到发布者的那种翻车。
@dr_cintas [Claude Code]
#43
https://x.com/dr_cintas/status/2096297455092457532
新命令 /skill-doctor 正是技能生态一直缺的审计工具:它列出你会话里加载的每个技能、哪些你从来没用过、每个正在吃掉多少上下文 token。他的 prompt 是:"给这些技能打分,哪些配得上它们的 token 开销,哪些是死重。"技能从集邮式囤积变成按绩效发薪,就在这一个版本之间。
@masahirochaen [Claude Code]
Claude Code#44
https://x.com/masahirochaen/status/2096069173134959060
他在每次大模型发布时都有一套固定仪式:对整台电脑做全面诊断——文件夹、技能、MCP 服务器、指令文件——再对现有项目跑一轮漏洞检查,用的是一条精心限定过范围的只读 prompt,在 Claude Code 和 Codex 里都能用。他的洞察是:你的代理环境会像代码库一样积攒垃圾,而新模型上线正是重新审计"什么还配留着"的最佳时机。他公开了完整 prompt,附带严格的禁止写入护栏。
@ikinokore_3k [Claude Code]
Claude Code#45
https://x.com/ikinokore_3k/status/2096180414595715168
一篇关于 text-to-cad v0.5 的深度解读:这套开源技能集能把"我需要这个零件"变成真正的 STEP/STL/DXF 制造文件,做法是让代理去写 build123d 的 Python 代码,底层跑的是和 FreeCAD 相同的 OCCT 内核。支持 Claude Code、Codex 和 Grok Build;演示包括一台 W16 发动机、一个手表机芯,和一只大约一小时、30 万 token 造出来的 16 自由度机器手。他的冷静提醒:演示很猛,但装配级精度还没到——不过软件圈的人已经开始在周末下单钣金件了。
@teach_fireworks [Claude Code]
Claude Code#46
https://x.com/teach_fireworks/status/2096252438277915035
一扇观察当下开源维护长什么样的窗口:他给自己的 fireworks-tech-graph 图表技能(Codex 和 Claude Code 都在用)做了一轮全面升级,抓到一个隐蔽 bug——文本宽度算得没错,但一个写死的 CSS 字号悄悄压过了布局,这种问题只看代码和报告是绝对发现不了的。这轮他发了中文自动换行、截断检查、箭头碰撞修复,跑完全部 141 个测试,还在 12 种样式下做了真实渲染。代码是代理写的;人的工作,是拒绝相信"看起来做完了"。
@josesilesdata [Claude Code]
#47
https://x.com/josesilesdata/status/2096146435733393793
reverse-skill 把你的代理变成一个知道该用什么工具的逆向工程师:丢进去一个 APK、一个二进制、一段混淆的 JS 或一道 CTF 题,它通过 41 条决策规则路由到正确的方法论,检查你机器上到底装了哪些工具,缺的现场搭起来,然后跑一套带时间线和证据链的可复现流程。它自带一个范围门禁,在你确认授权之前禁止碰目标,还有 163 个回归用例在 Windows 和 Ubuntu 的 CI 上跑。安全工具的治理是长在里面的,不是事后打的补丁。
@bkdgiffug [Claude Code]
Claude Code#48
https://x.com/bkdgiffug/status/2096253521020518767
ClaudeBrain 给 Claude Code 装上了一颗安全研究的大脑:500 多页的攻防知识库,接上覆盖 XSS、SQLi、SSRF、RCE、API、云和 LLM 安全的漏洞挖掘技能。它在动手前先对知识库做语义搜索,跟踪测试状态避免重复尝试,隔离客户数据,提交前还会检查泄露风险。面向授权渗透测试、漏洞赏金和 CTF——经验库终于变成了代理可以真正调用的东西。
@NFTCPS [Claude Code]
Claude Code#49
https://x.com/NFTCPS/status/2096056832305594383
shuohao-skills 在 Claude Code 或 Codex 里跑起了一整条短剧生产流水线:喂给它一部小说,它就提取角色、搭大纲、生成场景和道具设定、写剧本、切分镜——产出可以直接送去 AI 视频生成的素材,只烧你的会话额度,零 API key、零依赖。有人还在一行行手打剧本的时候,另一些人已经把整条装配线自动化了。
@AmiOtsuka_SE [Claude Code]
Claude Code#50
https://x.com/AmiOtsuka_SE/status/2096079781649695064
她出了一本书,书名就叫"不写代码的 Claude Code"——16 章,讲的是如何在一年里把一整家一人公司交给 AI,全程只打日语句子。每章末尾都有一行话,让你直接追加到下一次给 AI 的请求里,设计成看完立刻能试。非程序员的 Claude Code 文献正在长成一个独立门类,而且已经出到纸质书了。
@tsutomu_kumagai [Claude Code]
Claude Code#51
https://x.com/tsutomu_kumagai/status/2096176593777623442
他把同一条 prompt 分别喂给 Codex(Astra)和 Claude Code(Fable 5.1):做一支发社交媒体的炫技视频。Astra 用生成图片画了分镜、配了音乐、加了一个和画面运动同步的 whoosh 音效、还让音乐正好在最后一个镜头收尾——用时 16.5 分钟,约消耗 5 小时窗口的 30%。Fable 的成品,他毫不留情地比作 Mario Paint。他的公司主力工具就是 Claude Code,他说光这一次测试就足以让他重新考虑。
@phreakv6 [Claude Code]
Claude Code#52
https://x.com/phreakv6/status/2096214499107938421
换到 Claude 一年之后,他在 Astra 发布后回到了 ChatGPT——不是为了投资研究(那个 Claude 就够了),而是为了 computer use:他喜欢它驾驭 Blender、Unreal 和 Fusion 的样子,还想让儿子学着用。他的观察:视觉空间智能高得离谱,已经有人用它做游戏地图和建筑图纸,而且它在猛烈拉动本地算力——游戏开发和 CAD 圈的人在专门买高性能副机来跑 Astra。他说这是一个不亚于去年 Claude Code 的拐点。
@kutaro_ai [Claude Code]
Claude Code#53
https://x.com/kutaro_ai/status/2096387388771844192
一位自称纯 AI 小白的用户,熬了几个通宵后用 Claude Code 跑通了 YouTube Shorts 的全自动化,现在正把方法整理出来给其他新手,下一个目标是 TikTok。故事本身满是苦熬味儿,但底下的信号才重要:六个月前还属于重度玩家专属的自动化工作流,现在几乎不会写代码的人也在一个通宵一个通宵地够到了。
@brehm_shaun [Claude Code]
Claude Code#54
https://x.com/brehm_shaun/status/2096230759103180857
一款用 Claude Code 开发的放置类反应堆游戏的开发日志数据:3 天落地约 60 个功能和修复,每次改动都要过约 250 个自动化探针的门禁,GPU 优化后跑到 115 fps,正冲着 Steam Next Fest 去。操盘的只有一个人。最值得偷学的是探针门禁这个细节——没有验证门禁的速度就是噪音。
@nicochristie [Claude Code]
Claude Code#55
https://x.com/nicochristie/status/2096258046154743830
他在 X 上对 13 个模型跑了情绪分析:Astra 拿下最高的首日好感度(+64%)和最高智能评分,Opus 5 是唯一净负面的模型,而用户对 Codex 和 Claude Code 的偏好是 121 比 60——观察到 29 例转向 Codex,反向只有 9 例。最大的单一驱动因素:限额和配额,Claude Code 在这一项的情绪值是 -64。Fable 5.1 因智能被推崇,又被 token 成本拖下水。回复区里的一切,换成了市场数据的说法。
🗣 用户心声
用户心声

1. 限额造反已经是这批数据里最响的声音。@theo 说如果有 1 万美元的 Claude Code 或 Codex 套餐,他大概率会买——而 @ashen_one 声称 200 美元的 Claude 套餐实际用量"勉强 2 倍",对比 Codex 实打实的 20 倍;@JamesArslanSwe 在 Claude Code 限额一小时内被打满、Astra 却整夜畅跑之后退了订;@xiaomabosn 则阴阳怪气地感谢 Anthropic 的 Max 5x/20x"设计"。用户要的不是更便宜——是诚实的计量表和更大的桶。

2. 对 harness 本身的信任这周裂了缝。@kawasin73 那篇"Rules 已经死了"和 @connect24h 对静默绕过机制的拆解之所以戳中神经,是因为这种故障是隐形的——用 @izutorishima 的话说,Claude Code 的 harness 设计相比 Codex 更干净的循环,开始显得过度建造又过时。用户想要的是给自己的护栏配上回归测试和可观测性,而不只是给代码配。

3. 人类成了瓶颈。@ds_nakajima 在 Codex 和 Claude Code 里各开 5 个并行会话,发现限制产出的是他自己的管理带宽;@hamko_intel 说省出来的时间转眼又被更多并行任务填满。接下来该涨的是编排层的需求,而不是更多的裸代理能力。

4. 跨代理的上下文可携带性成了越来越大声的诉求。@ClaudeCode_UT 点出每次换代理都要把项目背景重新讲一遍的痛——这笔税随着你采用的每个新工具而增长。handoff 技能、memex、claude-mem 这类工具的存在,恰恰是因为平台方自己不解决这件事。

5. 客服和安全的毛边正在伤到真实用户:@John_Bailey 想做一个临床试验搜索工具,被 Claude Code 以想象出来的法律风险直接拒绝;@broadvideo_us 因为一个没人解决的计费 bug 白丢了一个月的 Pro;@Isseyv4z 报告自己被封号且没有任何理由说明。当代理变成承重的基础设施,客服 SLA 就和模型质量一样重要。
📡 生态产品雷达
生态产品雷达

今日数据集中被提及 3 次以上的产品和工具:

Codex / GPT-6 Astra - 这次发布刷屏了每一条讨论串;Claude Code 的新默认参照物
Hermes Agent - 能接管 Claude Code/Codex 会话继续跑(hermes --resume),定位是 OpenClaw 的接班人
Grok Bot - 用户用来路由 Claude Code/Codex 工作的"代理团队"平台
OpenClaw - v2026.9.2 上线了重启续跑;社区分裂成生产用户和写悼词的两派
Obsidian - Claude Code 第二大脑工作流的默认本地知识库
Remotion - 多个 Claude Code 动效设计工作流背后的代码驱动视频层
RTK - 终端输出压缩器,被反复引用为能省约 70% 输入 token
Ponytail - 自称"懒惰高级工程师"的技能,实测运行少写 54% 代码
Humanizer - 4.2 万 star 的去 AI 味写作技能,现在有了中文分叉
Video Use - 无时间轴的视频剪辑技能(2.4 万 star),会自己审自己的剪辑
skill-doctor - 本周人人都跑了一遍的新版会话技能审计器
M3E Canvas - 拖拽式 Material 3 UI 搭建器,可导出给编码代理用的 prompt
Magnitude - 本地模型顾问兼运行时,测完你的机器就替你配好代理
claude-mem / memex / Mnemosyne - 跨代理记忆层的三国杀,三个同时在涨
Chrome DevTools MCP - Google 官方浏览器调试 MCP,5 万+ star
OfficeCLI - 为代理流水线打造的 Word/Excel/PPT 操作二进制
free-claude-code / cc-switch / router 方案 - 把 Claude Code harness 指向便宜或免费模型的各路代理
Composio - 多篇企业技术栈帖子里都出现的工具接入层
← 上一篇
LLM 裁判:读数会漂移,理由是编的
下一篇 →
Loop 日报: 2026-09-07
← 返回所有文章

评论

加载中...
>_