2026年8月18日super-user

超级用户日报: 2026年8月18日

昨天最有信息量的事,是 Anthropic 挂了。周日晚上认证系统、API、Claude Code、Cowork 同时飘红,这已经是 8 月第四次数小时级的故障,当天声量最大的帖子都在用美元计算自己对它的依赖。故障噪音之下,真正的活儿在朝同一个方向收敛:独立验证。一家日本公司用六个具名子代理每天扫 490 个补贴项目,最不可替换的那个是从不看别人答案的验证员;一份流传的 CLAUDE.md 现在标配一个默认打回的严苛评审;有人连续通宵评测 Opus 和 GPT,胜负手就是哪个模型能不反复推翻自己的结论。OpenClaw 的退潮也在公开进行:2 月为它专门买硬件的早期用户正式卸载,个人 agent 玩家集体转向 Grok Bot 并把理由写了出来。最好的案例几乎都不在写代码:专利律所、五个月收入 418 万美元的婚礼视频创业公司、窗帘、地铁票报销,还有一个算命的。
@tavst_yu_suk_o [Claude Code]
Claude Code#1
https://x.com/tavst_yu_suk_o/status/2088840022795722840
一家日本公司每天发布补贴项目的更新,调研部门就是六个有名字的 Claude Code 子代理。录屏那天,它们扫描了约 490 个新增政府补贴项目,筛出 5 个候选,采用 4 个,代理总运行 22 分钟、调用工具 181 次,人只负责审批和发布。真正承重的是叫 Ken 的独立验证员,跑在另一个模型上,不看其他五个代理的任何报告,直接从公募要领 PDF 重新填写全部 14 个必填项。当天它在检查的三个项目里全部发现了重大差错:投资额下限 20 亿日元、预计只采纳 3 家、通用生成式 AI 不在补贴范围。老板的原则才是可迁移的部分:绝不给检查者看上一道工序的答案,因为 AI 一旦看到答案,就从验证变成了确认。
@shmidtqq [Claude Code]
Claude Code#2
https://x.com/shmidtqq/status/2089087738330948085
一个六人中国团队用 4D Gaussian Splatting 把普通手机视频变成可以飞行穿越的体积场景:月费 29 美元,五个月收入 418 万美元,起步投入只有 9400 美元的租赁 GPU。整条训练管线是用 Claude Code 在 11 天里搭出来的,原计划半年。客户构成是最好笑的部分:他们去找电影厂,结果 70% 的收入来自成都的婚礼摄影师和淘宝卖鞋的——前者要一个只有一个人举着手机也能环绕新人的运镜,后者要不租影棚的 360 度商品旋转。最大客户是一家婚纱连锁,月付 1.8 万美元,只提了一个需求:环绕飞行时别让新郎的眼镜出现重影。
@entame_benrishi [Claude Code]
Claude Code#3
https://x.com/entame_benrishi/status/2088790818962481447
一家日本专利律所公布了今年 3 月引入 AI 代理之后的成本结构:案件处理量翻倍以上,事务成本压到营收的 10% 以下,正在朝"五个律师配一个内勤"的结构重组。宣布这一切的招聘页面本身就是 Claude Code 做的,而且直接连着他们的 Xserver 主机,AI 在生产服务器上直接编辑和发布文件。第一个页面连初始配置约三小时,之后每个大概一小时。
@levelsio [OpenClaw]
#4
https://x.com/levelsio/status/2089082507060793581
Pieter Levels 全屋走 Alexa 进 Home Assistant,再把 Claude 接进来让设备听话。有两扇后装的窗帘用的是另一套系统、配独立的射频遥控器,每天全屋降帘之后还得单独去找那个遥控器。他问 AI,AI 让他买一个 Broadlink 射频桥接器,接进 Home Assistant 之后 Claude 负责配置,按几下原遥控器就把射频信号学了下来。现在这两扇孤儿窗帘和全屋一起响应同一个"全部放下"按钮。
@masahirochaen [Claude Code]
Claude Code#5
https://x.com/masahirochaen/status/2088988766220517771
Claude Code 加 Opus 5 生成了一份完整的经营企划工作簿:19 个标签页、36 个月、三年期损益表,函数完整,数据层和单元格引用都很干净。他估计手工做要一周。模型层面的备注值得记下来:他觉得做 Excel 这件事上 Opus 5 比 Fable 5 更合适——又一个"最强模型不等于每个任务的正确工具"的数据点。
@itsalexvacca [Claude Code]
Claude Code#6
https://x.com/itsalexvacca/status/2089020242303557771
一家外呼代理公司没有把整条业务跑在旗舰模型上,而是给营销活动的每一步单独定价。ICP 资格筛选是零成本的 Python 脚本,屏蔽名单和发送窗口预检是 Claude Code hooks,也是零成本;信号抓取跑 Haiku,客户调研和每封信发出前的 QA 跑 Sonnet,只有初稿文案和策略配得上 Opus 或 Fable,因为那一步写坏了会传染给名单上的每个客户。500 个客户的活动里,人只在最前面看 50 个账户、最后面读 50 封信,中间 400 个全程无人经手。他的路由规则可以直接抄走:按"这一步有多开放"和"坏输出能传多远才被人发现"来定价。
@ZhenZhu200 [Claude Code]
#7
https://x.com/ZhenZhu200/status/2088937046983487758
一位同时跑三个项目的产品工程师,把订阅从两份 Claude 加一份 Codex 换成了反过来,理由是一场对照实验。在上下文、skills、量化评分标准全部给足的前提下,Opus 5 一个通宵只把一个实例从 60 分推到 90 分,GPT 5.6 推了四个——因为 Opus 总觉得自己发现了 bug,把做完的东西推倒重来,12 个小时就这么烧掉了。他的分工结论:头脑风暴和战略 Claude 仍然赢,但那只占一天的 10%;长程执行要的是那个从头到尾不怀疑目标的模型。
@gregce10 [Claude Code]
Claude Code#8
https://x.com/gregce10/status/2089098490228195743
把 Claude Code 和 Codex 的终端塞在 Cursor 里跑了 18 个月、每次内存泄漏崩溃就丢一批会话之后,他做了一个开源的 Mac 会话复用器 Tortie:每个 agent 会话都有名字、可持久、由私有 tmux server 托底、崩了能恢复,旁边配了 VSCode 级别的文件树和搜索。动机部分说得最诚实:OpenAI、Anthropic、Cursor 的超级应用都想当那个"agent 窗口",他只想要一个无聊、安静、随便他这个月付费哪家 CLI 都能装下的容器。
@EXM7777 [Claude Code]
Claude Code#9
https://x.com/EXM7777/status/2089001978781368374
他把 200 万美元级 AI 视频制作背后的工作流开源成了七个技能,端到端跑完整条管线,为 Seedance 2.5 而建:项目初始化、工作室脚手架、逐场景拆解并给每个镜头写 22 个字段的卡片、带禁用清单的参考板、事无巨细的资产护照、只有复现度达到 10/10 才标记锁定的压力测试,以及一个"画面里的东西没全部锁定就拒绝运行"的镜头提示词技能。Claude Code、Codex、Hermes 任何 harness 都能用。设计上的洞察是把纪律写成代码:一致性没证明之前,管线硬性禁止生成。
@Stefan_3D_AI [Claude Code]
Claude Code#10
https://x.com/Stefan_3D_AI/status/2089037153888334312
72 小时做出一个完整的魂类游戏关卡、一个 Boss 和一个玩家角色,声明是他自己写在最前面的:没有一句话生成这回事,没人打一句"给我做个魂游"就走开。所有资产由 AI 生成,然后在 UE5 里手工组装、贴图、打光、整合,底子是一个用 Claude Code 和 UE MCP 接起来的魂类模板。这是当下 AI 游戏开发最现实的样子:模型放大的是本来就懂 3D 和游戏开发的人,替代不了那个"懂"。
@Wakuwakukucx [Claude Code]
Claude Code#11
https://x.com/Wakuwakukucx/status/2088804332783435958
当天阅读量最高的 Claude Code 帖子,1100 万曝光:用 Claude Code 驱动 Remotion 生成了一档虚构电视节目的片头。这个组合能反复产出电视质感的东西,原因是结构性的,一条回复说得最好:Remotion 把视频变成 React 代码,所以一个会写代码的 agent 就是一个输出确定性的动效设计师。他说除了高端 3D 动画,现在什么都能这么做。
@bourneliu66 [Claude Code]
Claude Code#12
https://x.com/bourneliu66/status/2089064061078298842
新玩法:每次 Claude Code 写完代码,自动召集五个"同事"开评审会。评委席是 GPT-5.6 Sol Max、ChatGPT Pro、Claude Opus 5、GLM 5.3、Grok 4.6 xhigh。跨厂商评审不断出现的原因很简单:不同模型带着不同的盲区,而"写代码的那个模型批改自己的作业"恰恰是所有人都不再信任的环节。
@jbarbier [Claude Code]
Claude Code#13
https://x.com/jbarbier/status/2089004502632325545
他的开源 CLAUDE.md 新加了两条规则。第一条是扇出加严苛评审:每个新功能由并行 builder 子代理做 2-3 个竞争版本,一个独立评审盲评对比、默认打回;bug 修复配一个专门试图再次弄坏它的攻击者;文档配一个冷读者,第一处看不懂就判不及格。第二条是自评分:每个任务结束后 agent 给自己打 1-10 分并回答"我为这个成果骄傲吗",答案是否就说出差距、修完再循环,为了退出循环虚报分数被明令禁止。免费可抄,Claude Code、Codex、Cursor、Gemini 通用。
@suna_gaku [Claude Code]
#14
https://x.com/suna_gaku/status/2088888260638777749
攒了五个月的 CLAUDE.md、skills 和 rules,被交回给 Claude 自己按 Opus 5 的能力做盘点,而且不是通读一遍完事:它去查了使用历史,看每个 skill 是否真的被调用、产出物有没有被后续工序读过、有没有被现在的内置功能整体替代。结果 40 个 skill 砍到 6 个,常驻加载的配置削减 72%。这个原则贯穿了本周所有配置帖:为去年的模型写的指令,就是对今年模型的束缚。
@thekuchh [Claude Code]
#15
https://x.com/thekuchh/status/2088950922978496829
他退掉了 200 美元月费的订阅,因为一个叫 caveman 的技能把输出 token 砍了大约 65-75%。诊断很直接:一句话能说清的事 Claude 要写一篇作文,每个"我建议"、每段废话你都在付钱。这个技能强制默认短答案,代码和报错保持原样,有 lite、full、ultra 三档,还配了一个本地代理层,在文件、日志、工具输出进模型之前先做瘦身。输出 token 是最贵的那部分,这是眼下最傻瓜的省钱杠杆之一。
@kemu_aii [Claude Code]
Claude Code#16
https://x.com/kemu_aii/status/2089094930425934037
她的 token 经济学:在 Claude Code 里让 Fable 5 从头干到尾的人是在浪费 token。Fable 只当司令部,握着判断和设计;调研给 Sonnet,实现给 Codex,机械性工作给 Haiku。换成这个结构之后,长会话不再漂移,Fable 的消耗肉眼可见地降了。同样的分层路由昨天在三个互不相识的帖子里出现,这通常是一种做法正在固化成行规的信号。
@mkwizrd [Claude Code]
Claude Code#17
https://x.com/mkwizrd/status/2089013712959189120
电商品牌创业第 52 天:他整天用 AquaVoice 对着 Claude Code 说话,训练它写广告文案,到晚上五条产出里有两条不用改就能直接投进广告账户。计划是继续训练,让新广告格式的迭代快成默认状态,品牌在朝十万美元的日投放冲。语音驱动的 agent 会话不断出现在非工程场景里——那里的瓶颈是描述品味,不是敲代码。
@R1H0_0 [Claude Code]
Claude Code#18
https://x.com/R1H0_0/status/2088983658099249511
小、完整、而且是那种会在办公室里传染的东西:她把 Google Calendar 接上 Claude Code,自动化了地铁票的经费报销。日历本来就知道你什么时候去了哪里,agent 把这变成了那份没人喜欢填的报销单。
@pennyhunter_sub [Claude Code]
#19
https://x.com/pennyhunter_sub/status/2089135340598817029
他把产品视频和原有的纸质说明书一起丢给 Opus 5,要求做一版解说和画面对齐的组装说明视频。一天做完,需要的地方自动调到 1.2 倍速,背景音乐是自己配的。他的说法是:周末两天速成班级别的视频剪辑技能,现在是订阅来的,不是学来的。
@bkdgiffug [Claude Code]
Claude Code#20
https://x.com/bkdgiffug/status/2088948636012978457
有人把四柱八字做成了 Claude Code 插件 bazi-skill。输"算八字"三个字,它问完姓名生辰就自动排盘、断五行、看格局,最后给事业感情健康的具体建议,底下喂的是成体系的传统命理材料,不是现编。安装就是把仓库 clone 进 skills 目录。一门千年老行当,被吸收成了一个插件。
@Lummox_eth [Claude Code]
Claude Code#21
https://x.com/Lummox_eth/status/2088951287408714127
一个学生训练 Claude Opus 玩 Flappy Bird,冲过了 1400 分。开局是几十只鸟掐不准时机、几秒钟就撞管子,然后单局越来越长,100、500、1000 以上,最后 Claude Code 操作着无限过管。经济上毫无用处,但作为"迭代循环遇上即时反馈任务会发生什么"的可视化演示,完美。
@LawrenceW_Zen [Claude Code]
#22
https://x.com/LawrenceW_Zen/status/2088861693292249570
android-remote-control-mcp 的完整实操:MCP server 直接跑在手机上,agent 像人一样操作任何安卓 App,不用 root、不用数据线、不用电脑跑 ADB 中转。读屏、点按钮、划屏幕、打字、开应用、拍照、读通知,共 57 个工具;读一整屏 UI 树只有 4000 字符出头、约一千个 token,比 dump XML 的方案省太多。他把真机和模拟器两条安装路径都写全了,包括 Android 13 以上侧载应用无障碍开关被锁的那个坑。
@coreyhainesco [Claude Code]
Claude Code#23
https://x.com/coreyhainesco/status/2089027423774048326
默认状态下 agent 读不了社交媒体,登录墙和反爬直接拦死。他的 /social-fetch 技能接收 X、LinkedIn、Instagram、TikTok、Reddit、HN 的任意 URL,返回结构化数据——作者、正文、互动量、回复——优先走免费 API,遇墙升级到浏览器自动化,帖子被删就查 Wayback。属于一套 18 个免费开源的创始人技能包,能作为 Claude Code 插件市场直接安装。
@Huahuazo [Claude Code]
Claude Code#24
https://x.com/Huahuazo/status/2088838409947074875
Hyperresearch 是一个跑 16 步对抗式调研管线的 Claude Code 插件:把问题拆解,并行抓取 250 多个来源,然后四个批评家同时围攻草稿——只允许局部手术式修改,不许全文重写——最后吐出一份带完整出处的事实核验报告。抓过的资料永久进入可搜索知识库,下次直接复用。三个规格:日常问题 30-40 分钟,完整 16 步约两小时,dissertation 模式能在 300-450 个来源上写出 2.5 万到 8 万字。
@chroniki_ai [Claude Code]
Claude Code#25
https://x.com/chroniki_ai/status/2088907144188064230
日本圈里流传的上下文腐烂解法:与其把一个会话塞到最初的指令都被稀释,不如给 Claude Code 一个设计文件,定义七个角色三班倒——scout、architect、engineer、reviewer、deployer、reporter、orchestrator——每个角色做完交棒,而不是所有人同时开工。非工程师也能跑,她的实操建议是先只开 scout 一个角色,因为角色定义含糊正是这类系统跑偏的原因。
@_DQQ_1990 [Claude Code]
Claude Code#26
https://x.com/_DQQ_1990/status/2088797171684606009
回国休假,不敢开 Claude Code 怕被封号,纯 Codex 又会一晚上烧光 200 美元的周额度。于是让 Codex 通过 handoff 调用 DeepSeek V4 Pro,自己搭了个基础 loop 跑长时间任务,三天烧掉 20 亿 token,折合约 140 元人民币、20 美元,顶层用 GPT 5.6 Sol 做整体规划和最终审查。同样的工作量按平时用 Opus 的习惯估算要 5000 美元以上。他的结论不是质量打平,而是 V4 Pro 的水准在 Opus 和 Sonnet 之间、速度快得多、便宜到离谱——就算之后涨价十倍,他也照用。
@nagataprogram [Claude Code]
Claude Code#27
https://x.com/nagataprogram/status/2088917447243894822
一位自由职业网站建设者对"Web 制作完蛋了"这个论调的诚实记账:Claude Code 让他的编码速度提了约五倍,同时他眼看着外包单价往下掉——自己的产能翻五倍,还指望纯编码的活维持原价,本来就不现实。还卖得出钱的是判断力:为了一个招聘网站的提案,他实地查了四家本地同行,发现零家真正为招聘设计过网站、搜索位全被招聘平台占死,于是把网站定位切换成"品牌指名搜索的承接页",首次会面两天后交付了十页提案加报价单,而承诺是一周内。他的两件 AI 抢不走的武器:当天回复,和不拒单的觉悟。
@jasonoliver [OpenClaw]
OpenClaw#28
https://x.com/jasonoliver/status/2088841374485422299
跑了几个月 OpenClaw agent 之后,他上网的方式变了:个性化调研、自动追踪、一个永远在线的伙伴替他读完所有没时间看的 subreddit 和 YouTube 再做综合。清醒的那一半在他另一条帖子里:他做过一遍"风投机构合规地跑一个 OpenClaw 需要什么"的功课,所以看着大家盲目把密码交给匿名的免费 computer-use agent 觉得又好笑又心惊。他对这个赛道的判断:拥挤,还没有人真正做对,谁做对了谁就把 agentic 互联网带给普通人。
@TC8880 [OpenClaw]
OpenClaw#29
https://x.com/TC8880/status/2089065513284673958
今年年初最早一批养 OpenClaw 的用户之一,二月专门为它配了台电竞游戏本,今天正式卸载。他记下的成本清单:AI 大爆炸带来的信息焦虑失眠、大量时间花在安装配置和研究 skills 上、更多时间花在救它的掉线和失忆上。半年后回看,当时最吸引人的功能已经被大厂做进了自己的产品,更稳定、更傻瓜、上手成本几乎为零;他的 Codex 里现在住着助理、设计师、程序员、编辑、分析师。他给自己的安慰恰好是整个周期最干净的总结:没错过什么,只是自费提前半年体验了一个不成熟的版本。
@SparXPodcast [Claude Code]
Claude Code#30
https://x.com/SparXPodcast/status/2088981854968037783
Wispr Flow 创始人介绍他最新的员工:没有计算机学位,从没写过生产代码,现在负责自动化整个售后职能。入职资格是酒店业级别的客户体验直觉,加上"对 Claude Code 相当熟"。创始人自己的产出也翻了面:公司 99.9% 的代码是 AI 生成的,而他 18 年的编程功底恰恰是他的提示词能比别人快 4-5 倍抵达成品的原因。他现在招人只看两个能力:第一性原理思考,和把复杂问题拆简单的本事。
@HowardTheDuck48 [Claude Code]
Claude Code#31
https://x.com/HowardTheDuck48/status/2088818961572061317
写了六十年程序,他说和 Claude Code 在一起的这三个月是人生产出最高的三个月,诚实的细节是:一半时间花在教 Claude 按他的方式做事上。上手成本是真实且前置的,回报在后面复利。
@bboym0dE [Claude Code]
Claude Code#32
https://x.com/bboym0dE/status/2088860395897541044
Claude Code 以 loop 加 gauntlet 模式连续 72 小时同时构建他的两个项目,还在跑。两个项目瞄准的都是他自己用 AI 做应用时撞过的最大痛点,他说产出每天都在肉眼可见地变好。这条帖子里埋着的才是真正的行规变化:连续多天不停机的构建,正在变成一种不值一提的开发方式。
🗣 用户心声
用户心声

可靠性取代能力成了头号抱怨。8 月 16 日的故障横跨认证、API、Claude Code 和 Cowork,拖了约 22 个小时,第一个事故开出四分钟后第二个降级事故接踵而至(@buildwithhassan),而状态页还显示一切正常(@SKatalystAI)。最扎人的统计:1 月以来 164 次事故,Claude Code 过去 90 天可用率 99.34%,低于企业级合同常见的 99.9% 门槛(@apricotkinkuma)。

范围纪律仍然是坏的。让 Claude Code 修一个 bug,它顺手修了另外 15 个、重构了两个毫不相干的文件、宣布搞定,而你让它修的那一个还在原地(@totoche)。

AGENTS.md 僵局在消耗 Anthropic 在维护者中的好感。Claude Code 提到 Elixir 仓库的 PR 质量更差,因为它不读项目的 AGENTS.md 指令(@josevalim);mitsuhiko 干脆删光了自己所有仓库的 CLAUDE.md,发现一句"去读 AGENTS.md"就够用(@mitsuhiko)——这让"不支持"看起来是政策,不是能力。

锁定问题被公开点名:订阅禁止在第三方 harness 里用、拒绝支持 AGENTS.md、以安全为名的游说——一条高转发帖把这些拼成了一张"反竞争行为"清单,而不是孤立的产品选择(@lian75864)。

价值算术在两头收紧。20 美元档里,一次 Opus 5 的计划加构建工作流几乎就把 5 小时窗口用完(@jzgarden);而在重度那头,没有清晰计划就让 agent 7x24 跑,制造的不是节省而是评审疲劳——瓶颈是想清楚做什么,不是执行(@pauliusztin_)。
📡 生态产品雷达
生态产品雷达

DeepSeek Harness (dsh) — 三天 12.2 万 GitHub star,万物皆插件的运行时,当天最响的生态故事
Grok Bot — 每个 OpenClaw 和 Hermes 用户现在都在拿来对标的托管 agent
Codex — 默认的第二个 agent,对越来越多的人是第一个
Hermes Agent — 自托管的参照系,刚结束一个大版本周
OpenClaw — 越来越多地被用过去时讨论,包括它最早的粉丝
Cursor — 被打包进 Grok 的订阅,仍是默认的 IDE 比较对象
Remotion — 当天最大创意帖背后那台代码定义的视频引擎
Qwen3.8-27B — 大家往消费级显卡上的 Claude Code 里塞的开源权重模型
OpenSandbox — 阿里的 agent 隔离运行环境,1.3 万 star 还在涨
orca — 一个 prompt 扇出到五个编码 agent 的并行 worktree,留下赢家
Graft — 存在 git 里的持久代码库记忆,专治 Claude Code 每次重读全仓库
Spec Kit — GitHub 的规格驱动开发工具包,已覆盖 30 多个 agent
Paperclip — 给 agent 团队用的组织架构图和工单层
Superpowers — 强制先计划再写码的技能框架
Higgsfield — 几乎每条内容管线里负责视频生成的那一半
ElevenLabs — 同一批管线里的声音层
Obsidian — agent 反复被指向的那个笔记库,好坏参半
← 上一篇
MobileMem:用一整年的真实手机数据考验Agent记忆
下一篇 →
Loop 日报: 2026年8月18日
← 返回所有文章

评论

加载中...
>_