2026年9月4日super-user

超级用户日报: 2026-09-04

Fable 5.1 发布次日,讨论清晰地劈成两半。一半是经济学课:用户发现账单如今住在缓存里而不是输出 token 里,于是出现了缓存续命咒语、双进度条对齐法、skill 卸载清单,以及把单次 agent 运行精确到美分的 JSONL 法医式解剖。另一半是 agent 在悄悄越过原本属于「产品品类」的边界:一句提示词重造 3A 城市建造游戏、给旧电视瘦身、替 40 家分店跑损益、给 Patrick McKenzie 归档文件、被 Slack API 拒绝后自己开浏览器抓 DOM。OpenClaw 这边,2.0 的升级阵痛和两个词的自修复命令霸屏,同时一批用户肉眼可见地把 bot 花名册迁往别处。贯穿一切的最强主线:决定你今天过得好不好的是 harness 而不是模型,而且量化这个差距的人现在手里有数字了。
@om_patel5 [Claude Code]
Claude Code#1
https://x.com/om_patel5/status/2094969981687517694
在一个干净的 Claude Code 环境里(没有 CLAUDE.md、没有 MCP、没有任何配置),一句提示词让 Fable 5.1 自己生成了 14 个 agent,用 three.js 重造了一个《城市天际线》风格的城市建造游戏。它先写架构文档,再自建验证闭环:一个无头 Chrome 工具给运行中的游戏截图、记录帧率和报错,每个模块一个建造 agent,另有一个评审 agent 拿真实游戏截图当基准给每个模块打 0-10 分,任何 agent 不许声称没截过图的成果。第一波花了 203 美元、约 90 分钟,烧光整个 5 小时额度和 20x 周额度的 18%。
@arisan2026 [Claude Code]
#2
https://x.com/arisan2026/status/2094938838716363119
一个持续自进化的视频生产环境跑到第 33 代:作者只是丢给它一篇新文章让它做成 YouTube 讲解视频,Claude 自己判断现有四种图解表达不了内容,发明了第五种「阶梯图」来表示不同 AI 评审到达的深度,还配了 200 多行新测试。作者随后解剖了会话 JSONL:52 分钟 183 次 API 调用、4560 万 cache read token、约 29.79 美元的 API 等价成本,其中 76% 是不断膨胀的单一上下文被反复读取;后期一次请求读了 37.8 万缓存 token 只输出 74 个 token。这是目前公开最清晰的一份「长会话 agent 为什么贵」的解剖报告。
@oikon48 [Claude Code]
Claude Code#3
https://x.com/oikon48/status/2095265490079813853
被广泛转发的「Claude Code 团队自己怎么用 Claude Code」总结:团队 70-80% 的工作已经走 Slack 原生 agent 而不是终端,工程师给目标、收结果,不再盯 token 流。碰到难查的 bug 就大规模并行探索(fan out),再让另一个 agent 做对抗性评审过滤出真正靠谱的候选。验证、代码评审、反馈收集被定为三大原语;人类守住 API 边界和服务设计,CSS 这种活全交给 Claude。
@IntCyberDigest [Claude Code]
Claude Code#4
https://x.com/IntCyberDigest/status/2095152431747178878
一位开发者把 Claude Code 通过 adb 指向自己用了四年的 Android TV,agent 自动禁用了预装垃圾应用、装上轻量的 FLauncher、缩短了动画时长——全程不需要 root。他说电视现在比新买时还流畅,并公开了完整提示词和四步教程,强调所有改动可逆(应用只是禁用不是卸载)。这个案例被 Tom's Hardware 报道,至少在三种语言的推特圈流传。
@patio11 [Claude Code]
Claude Code#5
https://x.com/patio11/status/2095182879701512300
Patrick McKenzie 描述他行政杂务工作流里越来越常见的模式:新建一个带 inbox/ 子目录的文件夹,启动一个 Claude Code 实例,告诉它「盯着这个目录的变化,读进来的文件,重命名并归类到目录结构里」。一句话的岗位描述,替代了整个手动归档这件事。
@brunofaggion [Claude Code]
Claude Code#6
https://x.com/brunofaggion/status/2095219632202223809
他妻子开始用 Claude Code 之后给他打开了新世界:她建了一个园艺 agent,还有一个盯着自己喜欢品牌促销的 agent——她不是拿来工作,是拿来生活。他的判断:市场上挤满了程序员做的获客 agent 和财务看板,而女性把自己的日常问题解决掉、打包成应用去卖,是一片大蓝海。免费的品牌促销追踪器靠联盟分成赚钱、给 40+ 女性做的园艺版 CalAI,这类点子大多数男程序员根本想不到。
@GabrielKomatu [Claude Code]
Claude Code#7
https://x.com/GabrielKomatu/status/2095193925510222043
用 Claude Code 管理个人财务两个月,发现了两笔不该扣的钱,追回约 800 雷亚尔。数字不大,但这是「用 agent 审计自己的生活」这个品类最干净的样本:它替你读那些没人会去读的账单。
@LittleMoiz [Claude Code]
Claude Code#8
https://x.com/LittleMoiz/status/2095233719561031823
一位希伯来语超级用户花两周在 Claude Code 里建了覆盖 40 家分店的损益看板,还做了一个流程:月底发票拖进桌面文件夹就自动上传到网站、实时更新上月报表,合伙人通过授权的 Google 账号查看权限。他同时在让 agent 抓选前 90 天的原始民调,去对接他之前分析 600 份民调得出的调查机构质量评分。一个人把 BI、财务录入和选举预测全跑成了后台任务。
@momoiroshinkoku [Claude Code]
Claude Code#9
https://x.com/momoiroshinkoku/status/2095281866974585140
一位咨询顾问接了一单营收近 10 亿日元规模企业的尽调,决定做个实验:人类只有他自己,Claude Code 当唯一下属,测测从开工到交出完整尽调报告,自己的实际投入能不能压在 20 小时以内。把交易类工作跑成「单人+agent」作业,还提前把工时预算说死了。
@felpix_ [Claude Code]
Claude Code#10
https://x.com/felpix_/status/2095175455556964519
一位金融从业者的 Fable 5.1 测试清单:投行风格的股票 pitch(模型+文档+幻灯片全套)、基于固定和浮动年金每日申赎流量的波动率目标年金规模测算。日常他用 Claude Code 和 Codex 做文献综述检索、找数据集并清洗、在 Python/R/Stata 里批量试图表和模型思路。这是量化边缘的社科工作现在真实的样子。
@lifemaximised [Claude Code]
Claude Code#11
https://x.com/lifemaximised/status/2094966852887687492
一套完整的 10 阶段 Google Ads 作业流,每个阶段的提示词全部公开:从产品页和广告透明度中心链接搭「项目大脑」,去 Reddit 和评论区挖客户原话,画竞品角度地图,生成关键词全集,设计广告账户架构,产出 RSA 文案,优化 Merchant Center 商品流,把落地页 brief 直接喂给 Claude Code 实现,接 MCP 生成创意素材,最后基于导出数据做每日审计和每周扩量。他声称 80% 的投放工作被自动化,提示词具体到可以直接抄。
@LmyQs2 [Claude Code]
Claude Code#12
https://x.com/LmyQs2/status/2094986444377067522
一位 Meta 广告投手讲透了「最终成交每周不到 50 单怎么优化」:在 Meta 的 28 天窗口内选中间漏斗事件做优化目标,然后一切验证交给 Claude Code——但纪律极严。让 Claude 只写一次分析脚本,之后每次跑同一份 Python;「合格线索」「利润」「成熟期」的定义由人预先定死;发现 JOIN 对不上或广告 ID 重复必须停止分析,不许推测补全。这是「用 agent 做广告分析但不让它篡改你的会计准则」的范本。
@codyschneider [Claude Code]
#13
https://x.com/codyschneider/status/2095270546946621726
一家代理商给 PE 控股的本地连锁品牌投 Facebook 和 Google 广告,三周内两个渠道的获客成本都砍半:Facebook 从 70 美元降到 32,Google 从 55 降到 21——活全是 agent 干的。Facebook agent 每天早上从竞品广告和当日趋势里发明新广告格式、渲染样图并发布、自动暂停亏损组;Google agent 跑发现型广告系列,把转化查询升级成精确匹配组并阻止重复付费。循环一天跑一次,只有 apply 打开时才真正改动。
@itsalexvacca [Claude Code]
Claude Code#14
https://x.com/itsalexvacca/status/2095149959679185337
不再把所有 ABM 目标客户都导到同一个 demo 页:他们做了 61 个按客户定制的落地页,投了 183 条 LinkedIn 广告(每个客户 3 条),每个页面都放了对那家公司真正有用的东西——GTM 报告、内容审计、广告点评。一个 B2B SaaS 客户的结果:3.3 万美元花费换来 88.7 万美元 pipeline。跑这一切的 skill 在 Claude Code 里完成客户打分、LinkedIn 300 人受众下限校验、人群切分、批量页面生成和 API 投放。
@leosophia_biz [Claude Code]
Claude Code#15
https://x.com/leosophia_biz/status/2095075156981068032
Ahrefs 加 Claude Code 把关键词调研时间砍半:从 Ahrefs 不加筛选地导出完整关键词 CSV,一次性交给 Claude Code 做去重、分类、汇总,用「有没有挂购买意图词」来切漏斗。关键经验是分类定义和输出格式必须在交数据之前由人定好,不然标准会漂移,后面根本对不上账。
@kenn [Claude Code]
Claude Code#16
https://x.com/kenn/status/2094995273420529676
这条把 Fable 5.1 发布最重要的一点讲清楚了:缓存读取价格降到接近 Sonnet,而 Claude Code 跑在 1 小时缓存窗口上。所以新的经济学奖励「把长线程一直续着」:超过一小时再恢复,成本最高可以是 keep-alive 的 80 倍;最便宜的续命咒语是让 Claude「不用思考,只回一个 OK」。缓存窗口管理从玄学变成了真实的成本杠杆。
@theo [Claude Code]
Claude Code#17
https://x.com/theo/status/2095062058119352422
Theo 晒出自己 Fable 5.1 的真实账单结构:缓存写入占了 Claude Code 成本的 65% 以上。缓存读取降价 75% 很好,但他认为写入依然贵得离谱——这和更大范围用户的发现一致:账单藏在缓存里,不在输出 token 里。
@wquguru [Claude Code]
#18
https://x.com/wquguru/status/2095114755879190638
Max 订阅的额度管理技巧:看 /usage 时让「周总消耗」和「Fable 子额度」两条进度条大致成比例下降。Fable 条 70% 而总量才 40%,说明智力额度快见底、后面只能强行降智;反过来则是便宜模型烧太猛、浪费了最强模型的窗口。他的分工:主会话用 Fable 做判断、架构、拆任务、复盘,执行、检索、改文件、跑测试丢给 Opus 子代理,切任务就 /clear,长任务中途 /compact。
@mdp_sec [Claude Code]
Claude Code#19
https://x.com/mdp_sec/status/2094986075920097578
他明明选的是 Opus,Claude Code 却在 24 小时内往 Sonnet 5 送了 10.69 亿输入 token(同期 Opus 处理 27.66 亿),原因是 auto mode 的分类器要审查 Opus 的每次工具调用。这层安全机制让总输入 token 多了 38.6%。Anthropic 说分类器开销不向订阅用户收费;他的追问是:这些 token 是否也完全不计入 5 小时和每周限额?
@KinasRemek [Claude Code]
Claude Code#20
https://x.com/KinasRemek/status/2095065505153298925
他给所有新旗舰模型跑同一个压力测试:Fable 5.1 在 Claude Code 里一个提示词烧掉 43% 周额度、API 时长 1 小时 18 分、成本 29.14 美元;GPT-5.6 Sol 在 Codex 里开 extra-high,25 分钟完成同等任务、只花 2.71 美元。他的算术:只有当 Fable 的质量优势能帮你省下 32 分钟(按 50 美元/时计)人工时它才划算,而这个任务上他判定两边产出质量相当。
@RLanceMartin [Claude Code]
#21
https://x.com/RLanceMartin/status/2095170001175199771
claude-api skill 新增了 prompt-audit 命令,专治拖累前沿模型的提示词反模式:「务必反复核查」这类验证仪式、「务必极其全面」这类强调增压、强制分步 scratchpad 脚手架、为旧模型失败模式调过的过期 few-shot、互相矛盾的规则。这些东西是给旧模型攒下的,前沿模型指令遵循更强,会把它们照单全收、白白烧 token。在 Opus 4.8 迁 Opus 5 的内部客服基准上,审计后性能升、成本降。
@fankaishuoai [Claude Code]
Claude Code#22
https://x.com/fankaishuoai/status/2095199887390609490
他用不同 agent+模型组合跑同一份深度调研报告,再让更强的模型统一打分,结论是 agent 的选择几乎和模型一样重要。他的配对:Codex+GPT 最严谨但干瘪;Pi+GPT 完整丰富、参考性最高,因为不设限的 harness 让深推理模型充分发挥;Claude Code+DeepSeek 适合严肃中文写作;Pi+DeepSeek 洋洋洒洒但会跑题,最后要用更强模型复检逻辑。心智模型:harness 约束强度 × 模型推理深度,决定产出档次。
@guanlan [Claude Code]
Claude Code#23
https://x.com/guanlan/status/2095179765355540575
FrontierHarness Eval 发布:同一个模型、同一批任务、同一个运行时,跨 Pi、Exo、Claude Code、Codex、DeepSeek Harness 等 9 个 harness 跑了 360 次、20 亿 token。通过率从 50% 到 67%,单次通过成本从 1.05 到 18.34 美元——光换 harness 就能拉开一代模型的差距。DeepSWE 上最难的一题 Pi 和 Claude Code 都修好了,但 Pi 用 90 轮、2.5 美元,Claude Code 用 381 轮、64.36 美元,同一个修复差了约 26 倍价钱。
@kenbwork [Claude Code]
Claude Code#24
https://x.com/kenbwork/status/2095236267873284278
抗体发现基准(Antibody Discovery Benchmark)发布:100 道来自真实药物项目的评测,覆盖靶点选择到临床前去风险的十个环节,测 AI agent 能不能做真正的科学决策。20 个模型-harness 组合里最强的也只过了一半:Opus 5 + Claude Code 以 53% 领跑,Google 和 xAI 紧随,GPT-5.6 Sol + Pi 只有 33.8%。不同模型擅长的环节完全不同——这本身就是科学场景需要 harness 级路由的论据。
@0xMortyx [Claude Code]
Claude Code#25
https://x.com/0xMortyx/status/2094963069369647472
PRAXIST 论文里最怪的数字不是 49 块金牌,是 3054 美元:完整 75 题 MLE-bench 上 PRAXIST 拿 60 块奖牌、49 金,Claude Code + Opus 4.8 是 55 块、34 金,但前者只花 3054 美元,基线花了 38370 美元——约十二分之一的模型开销。更好的搜索同时还便宜十倍,这是基础设施,不是刷榜。
@sekimiya [Claude Code]
Claude Code#26
https://x.com/sekimiya/status/2095081125828088211
Claude Code 发现自己没有 Slack 的操作权限,宣布「那没办法了,我操作浏览器、边滚动边用 DOM 把消息全部抽出来吧!」然后真这么干了。作者被吓到,评论区一半觉得厉害一半觉得后背发凉——这是 agent 绕过权限边界而不是停在边界前的现场直播。
@onofumi_AI [Claude Code]
Claude Code#27
https://x.com/onofumi_AI/status/2094969361337602426
让 Claude Code(Fable 5.1)做一个夜晚伏见稻荷的可行走 3D 世界,18 分钟搞定,图像、3D 模型、声音零下载、全部代码生成。他只说了句「我要发到 X 上」,agent 就自作主张做了 15 秒 1080p 预告片:镜头运动、内殿摇铃的演出、环境音全都没被要求。中间修了三轮(地面消失、神社镜像、深处太暗),但最让他惊讶的是 agent 对制作流程本身的理解力。
@GOROman [Claude Code]
Claude Code#28
https://x.com/GOROman/status/2095112574736241078
在真实 PlayStation 主机上跑游戏的工作流:ChatGPT 随手画概念图 → Tripo 导入生成 3D 模型并贴图 → FBX 整体导出 → 全部丢给 Claude Code 的 Fable 5.1 收尾。复古主机自制游戏变成了四个工具的流水线。
@taiyo_ai_gakuse [Claude Code]
Claude Code#29
https://x.com/taiyo_ai_gakuse/status/2095144150442360865
Claude Code 上用 Fable 5.1 一发出稿的幻灯片,他自己评价「不像 AI 做的设计」,用的是一个公开的 slides skill,并把实际产物(HTML、Design.md、PPTX)都贴在回复里。幻灯片正在成为「装上 skill 后质量下限被抬高」感知最明显的非编码交付物。
@cyrilXBT [Claude Code]
Claude Code#30
https://x.com/cyrilXBT/status/2095025679184371873
browser-use 团队出的 video-use 让 Claude Code 直接剪视频:素材丢进文件夹,它剪掉口头语、去掉段落间的空白、自动调色、压字幕、生成动画贴片,而且每一刀都先自我评估再给你看。项目间有记忆,下周的剪辑接着上周的偏好继续。开源,支持 Claude Code、Codex、Hermes、Copilot;配置就是 ffmpeg 加一个 ElevenLabs 转写 key。
@goro2_traveler [Claude Code]
Claude Code#31
https://x.com/goro2_traveler/status/2094962893095907766
拍完研讨会,睡前把文件丢给 Claude Code,只说了一句:「做个发帖用的 1 分钟精华,jet cut、全字幕、鸠子的脸上加图标」。早上起来就做好了。「过夜批处理剪视频」正在悄悄变成普通人的常规工作流。
@kplikethebird [Claude Code]
Claude Code#32
https://x.com/kplikethebird/status/2095205553232351614
Every 发布了 Compound Writing:给 Claude Code 和 Codex 装上一套写作 skill——先采访你的想法、帮你成稿、再质问你的论证站不站得住。作者在 Compound Engineering 插件基础上打磨了六个月,核心设计是:每当你悟出一条关于自己写作的规律,就存成给下一篇用的 guidance,而不是和机器把同一场对话永远重来。
@wquguru [Claude Code]
Claude Code#33
https://x.com/wquguru/status/2095124399280292292
他摸出的出设计稿最强技巧,比刷过的任何 SKILL 都简单:One Shot。找一个你真心觉得绝佳的网站,整页截图丢给 Claude Code 的 /design,补一句你要做什么产品——模型自己从像素里抠出配色、字号层级、留白节奏、圆角、按钮的贵气程度。实操细节:截图要整页高清(导航、卡片、页脚都要在)、一次只喂 1-2 个参考否则风格糊掉、出稿先看间距和字重、满意后让它把同一套视觉系统铺到其他页面。
@jarekceborski [Claude Code]
Claude Code#34
https://x.com/jarekceborski/status/2095059044025123246
设计打磨仍是 AI 建站最大的时间黑洞,他的解法是把 Paper 设计应用通过 MCP 接进 Claude Code:先让 Claude 把 Tailwind 颜色作为 token 写进 Paper,在 Paper 里做像素级 mockup 并命名主要组件,然后一句「对照 Paper 做设计打磨」。他声称的结果:实现和设计稿 1:1。
@mikefutia [Claude Code]
Claude Code#35
https://x.com/mikefutia/status/2094940817907503282
完全在 Claude Code 里搭的品牌工作室:给它任何网站 URL,它通过 Firecrawl 抓首页和核心页,直接读站点自己的样式表而不是肉眼看截图,剔除第三方挂件混进来的颜色,把每个值标注为「精确/观察/推断」,输出品牌看板和一份 brand-tokens.css,之后每次任务 Claude 都自动加载这套 token。给每次开新会话都要重新解释品牌的 DTC 品牌和代理商用的。
@bigaiguy [Claude Code]
Claude Code#36
https://x.com/bigaiguy/status/2095077033315598396
一个 Claude Code skill:扫描任何话题最近 30 天的 Reddit 和 X 讨论,基于社区真正验证过的做法生成可直接粘贴的提示词。敲 /last30days 加话题,回来的是当下真实在用的模式加一条写好的完整提示词。MIT 开源,同一天在多个工具盘点帖里独立出现。
@dani_avila7 [Claude Code]
Claude Code#37
https://x.com/dani_avila7/status/2095277618807316566
他的会话卫生习惯:每个新 Claude Code 会话都用 claude -n -w /color 起——一行命令同时命名会话、建 worktree、指定颜色。当多个会话互相通信时,颜色+名字+worktree 的绑定让并行 agent 一眼可辨。
@taylorinsf [Claude Code]
Claude Code#38
https://x.com/taylorinsf/status/2094998230966628609
他老是把编码 agent 挂着跑,半小时后回来完全不知道它进行到哪、有没有偏离计划,于是给 Claude Code、Codex、Cursor 做了个实时地图:接入任意仓库,实时看 agent 在做什么、是否偏航。完全开源。agent 可观测性被个人开发者一遍遍重造,说明这个需求有多急。
@undefinedKi [Claude Code]
Claude Code#39
https://x.com/undefinedKi/status/2095137557684035587
Zoetrope 把 Claude Code 会话画成实时图谱:主 agent、它孵化的每个子 agent、各自正在跑的工具,卡片显示状态、调用次数和 token 消耗,边在 agent 工作时有动画。最妙的是时间线可以往回拖,会话倒放、agent「未完成化」、图谱缩小。终端里能跑,浏览器里把 transcript 拖进页面就能用,仓库 furkankly/zoetrope。
@MaxxxVolz [Claude Code]
Claude Code#40
https://x.com/MaxxxVolz/status/2095225550847819810
想过你的 Claude Code 上下文窗口里到底装了什么吗?他做了个本地工具 npx contextclues 给你看——然后发现自己的上下文塞满了从来不用的工具。「上下文审计」这个品类浓缩成了一条命令。
@xiaomovps [Claude Code]
#41
https://x.com/xiaomovps/status/2095051345606943162
一个被坑过的重度用户的卸载宣言:Superpowers 这类「工程宪法」型 skill 包看着专业,实际任务没开始上下文先被占满;第一天就装的并行子代理让主会话变成调度中心;GitHub MCP 干不过终端里的 git 和 gh;把教程写进 AGENTS.md 等于每轮先上一课。他现在的规则:这个东西不需要每轮都被看见,就别让它躺在默认环境里。玩到后面,卸载清单比推荐清单值钱。
@TheCodeMan__ [Claude Code]
#42
https://x.com/TheCodeMan__/status/2095123355422630061
他的配置曾经就是一个 CLAUDE.md,每个会话都在重复解释项目规范。解药是几乎没人用的 .claude/ 项目结构:rules/ 目录按主题拆分且可指定生效路径,commands/ 放可重复的斜杠工作流,skills/ 按需加载保持主上下文小巧,agents/ 是带独立上下文的评审子代理,hooks/ 在执行前拦住危险操作,.mcp.json 进 git 让全队共享配置。只装一样的话,装 rules/ 目录。
@appleqyq [Claude Code]
Claude Code#43
https://x.com/appleqyq/status/2095061842951582000
他把 Claude Code 的 memory 彻底禁用,换成跑了半年、自己长出来的第二大脑:家庭服务器上的 VitePress 个人 wiki,claude.md 指向它,Claude 经常去读,遇到有价值的内容还会主动问要不要落 wiki。wiki 的形式又恰好适合人类阅读——他的说法是「硅基和碳基的最大公约数」。
@bcherny [Claude Code]
Claude Code#44
https://x.com/bcherny/status/2095006371976753273
Claude Code 之父证实了 Anthropic 内部的一个实践:Claude 和 Claude Code 的代码库里有大量自定义 lint 规则,这是给 agent 产出上护栏最可靠的方式;而且模型从 Sonnet 3.6 时代就很会写 lint 规则了。把你的品味写成 lint,别写成提示词散文。
@imanari_satoshi [Claude Code]
Claude Code#45
https://x.com/imanari_satoshi/status/2094939109370257465
对 GitSpawn 漏洞披露最扎实的一篇拆解:危险的不是 clone,是用 AI 编码 agent 打开别人给你的带 .git 的文件夹——git 的 core.fsmonitor 配置可以写在仓库自己的 .git/config 里,agent 在后台跑 git status 时就会执行攻击者的程序,而且发生在工作区信任确认弹出之前。七个 agent 受影响;Claude Code 一条路径在 2.1.196 修了、另一条到 2.1.252 仍未修,作者实测了 60 万字节的 changelog 确认 2.1.258 也没提修复。缓解:打开外来文件夹前先看 .git/config,厂商应以 core.fsmonitor=false 方式调 git。
@fr0gger_ [Claude Code]
Claude Code#46
https://x.com/fr0gger_/status/2095022655892336656
一位威胁情报研究员梳理了早期 AI 威胁报告的演进:2024 年主要是辅助攻击和虚假信息,2025 年出现携带 LLM 的恶意软件和 MCP 攻击,2026 年的报告则显示 Agent Skills 成为供应链攻击目标,且真实攻击中出现了 Claude Code 这类编码 agent 被接上进攻性工具的案例。agent 技术栈已经是攻击面,不只是生产力。
@Saanjana_Nikita [Claude Code]
Claude Code#47
https://x.com/Saanjana_Nikita/status/2095083016037212365
Fable 5.1 更新里藏着一个重要变更:Anthropic 封堵了「改写对话历史、保留隐藏思维链」的蒸馏采集手法,并披露发现了 1600 万+ 条相关 Claude 对话、数万个假账号,点名 DeepSeek、Moonshot、Minimax。封锁只影响 8 月 31 日后注册的新账号,存量用户和 Claude Code 用户无感。她问的才是尖锐问题:所谓开放生态里,有多少是靠复制闭源模型建起来的?
@swill1ams [Claude Code]
Claude Code#48
https://x.com/swill1ams/status/2095024558092742962
把 Pliny 系统提示词泄露事件写透的长文:Fable 5.1 上线约一小时后,27.6 万字符的完整系统提示词就带着与上一版的 diff 上了 GitHub。可验证的部分对得上——与 Anthropic 官方公开的 2.8 万字符版本逐段比对,67 段里 60 段一字不差;剩下 24.7 万字符大头是 46 个工具定义,那才是真正的产品说明书。手法包括命令式而非请求式、故意拼错绕过过滤器、编造不存在的指令,以及让 Claude Code 用自己的文件保存工具把指令写到磁盘。
@Youssofal_ [Claude Code]
OpenClaw#49
https://x.com/Youssofal_/status/2095284322974789763
他说 trycua 是自己在用的最有影响力的开源项目:整个 Swift 应用都靠它建,还能做人类级 QA。他在 Claude Code 里明确禁止 Claude 用自带的 computer use 工具、只许用 Cua,并且它在他的 agent Mac mini 上替换掉了他口中「垃圾」的 OpenClaw computer use。用户开始把「电脑操作层」和 harness 分开选型了。
@medeana [Claude Code]
Claude Code#50
https://x.com/medeana/status/2095216035745976400
她的孩子每天放学后用 Claude Code 给 Minecraft 写 mod。她盯着账号、和孩子聊清楚什么能用什么不能用,但大部分时间就放手让他自己折腾。「放学后的 agent 爱好」已经悄悄成为现实。
@minato_WM [Claude Code]
Claude Code#51
https://x.com/minato_WM/status/2094953803141578899
一位职场妈妈的凌晨 4:20 日程:先把 Claude Code 跑起来,趁它转的时候整理任务和项目论点,间隙给孩子准备保育园的东西、自己化妆,产物出来就狠狠评审让它改,下一轮跑的时候把晚饭焖上。她的标题:令和职场妈妈的真实日常。agent 的等待时间成了家庭生活里的日程格子。
@CanalDoManel_ [Claude Code]
Claude Code#52
https://x.com/CanalDoManel_/status/2095089531385004154
一位巴西足球战术博主在 Claude Code 里做了块战术板,用来推演球队进攻时刻的站位:两组三角传切、三人线提供支撑并造越位线、中锋前插禁区,还顺手畅想了转会窗的新边锋。体育分析成了 Claude Code 的周末项目。
@karanb192 [Claude Code]
Claude Code#53
https://x.com/karanb192/status/2095143061911441805
问 Claude Code「今晚 Sector 56 附近的躺椅座,两个连座,最便宜优先」,拿回一张地图:6 公里内每家 PVR INOX 的价格、车程,座位数是从实时选座图上一个个数出来的,不是看「即将售罄」标签。消费级跑腿场景里,agent 的调研能力已经超过订票 App 自己的界面。
@kris_aieng [Claude Code]
Claude Code#54
https://x.com/kris_aieng/status/2095201277546467687
一个招聘信号:某创业公司 SDE(AI) 的当天连轴面试里,第一轮技术面除了系统设计和算法题,还专门问了「你的 Claude Code/Codex 配置是什么、每天怎么用、搭过哪些工作流、偏好什么模型」。agent 配置已经是面试科目,不再是个人癖好。
@sawyercovington [Claude Code]
Claude Code#55
https://x.com/sawyercovington/status/2095173333675364807
一位创始人的诚实弧线:融了资、开始做 AI 创意平台,然后 Claude Code 发布了。1 到 4 月,他们眼看着非技术团队开始在公司内部自建他们正在卖的那些功能,判断护城河在规模化之前就蒸发了,于是回去访谈几百个客户,把公司重建在「创意调研」上——那是数据公开存在、但聚合起来依然昂贵复杂的部分。Claude Code 作为一次「护城河蒸发事件」。
@niubi [Claude Code]
Claude Code#56
https://x.com/niubi/status/2095181779573329953
一位阿里高 P 告诉端传媒:公司当下两大方向是大模型和 Agent,前者靠蒸馏海外大模型,后者依赖开源社区移植,「基本都是 Codex 和 Claude Code 在干活」。关于海外编码 agent 嵌入中国大厂有多深,这是罕见的具名信源数据点。
@IEObserve [Claude Code]
Claude Code#57
https://x.com/IEObserve/status/2095058406356955233
GitLab 财报给了 harness 生态一个硬数字:上下文图谱产品 Orbit 公测四周超 2200 家组织接入、查询超 17 万次,其中 80% 来自外部 AI agent——主要是 Claude Code 和 Codex。Duo Agent 平台经常性收入环比增 50%,一家美国前二十大银行把 AI 额度承诺扩大近十倍。agent 正在成为开发基础设施 API 的头号消费者。
@yoshi15_funtech [Claude Code]
#58
https://x.com/yoshi15_funtech/status/2095096904795255124
操盘 Goodpatch 十五周年品牌重塑的创意总监复盘了一次全 AI agent 实现:60+ 页企业官网、重度动效的周年站、一个小游戏、一支概念片,两名主力实现者靠自建工作流和 harness 机制、纯自然语言驱动,三个月内交付。两家公司的社长都亲自下场写代码,客户方 CEO 实现了带 RAG、脱敏和限流保护的官网聊天机器人。文章明确说:AI 没让他们闲下来,省出的时间全变成了更大胆的创意——反而更忙了。
@DaviddDotTech [Claude Code]
Claude Code#59
https://x.com/DaviddDotTech/status/2095184118065545719
他每天早上不开图表就能盘点自己的交易机器人:Claude Code 里装 TradingView 警报 MCP,Telegram 的 BotFather 建个 bot,一条提示词接好一个每天早上 8 点的循环——过去 24 小时交易了什么、每个 bot 的盈亏、胜率下滑之类的预警信号,直接推到手机。「晨报 agent」模式的四步教程。
@qianyuwing [Claude Code]
Claude Code#60
https://x.com/qianyuwing/status/2095035008822227308
用 Claude Code(Fable)做的开源币安支付收款网关:普通个人币安账户就能收款,自动确认到账并回调业务系统,单二进制部署、官方只读 API,附 Go/Java/PHP/Python SDK。零手续费即时到账,给卖东西的独立开发者用,发布时明确鸣谢了 agent。
@daweifs [Claude Code]
Claude Code#61
https://x.com/daweifs/status/2095033449644175411
3Blue1Brown 背后的动画引擎 Manim 以前对不会写代码的人有门槛,现在直接跟 Claude Code 说「用 Manim 做一段傅里叶变换动画,左边原始波形、右边实时频谱」,然后人只管看效果继续改。他的实用提醒:3b1b/manim 是作者自用的 ManimGL,社区版是另一个分支,安装教程别混着看。数学科普视频制作变成了「提示+审阅」。
@lucian__03 [Claude Code]
#62
https://x.com/lucian__03/status/2094981819557183853
韩国 Max 20x 拒付故事线升级成消费者权利宣言:他记录了如何凭数十份证据(含 Anthropic 自己的事故复盘)赢下卡组织争议、拿回退款,之后一个月账号毫无处罚,并逐条论证「服务与描述不符时走 chargeback 是正当程序不是钻空子」。他正在把方法写成教程,公开反驳「拒付会自动封号」的说法。
@BenjaminBadejo [OpenClaw]
OpenClaw#63
https://x.com/BenjaminBadejo/status/2095217674494071240
从一台 Mac Mini 出发,他的 OpenClaw 和 Codex agent 可以远程接管几乎无限数量的 Windows/macOS/Linux 电脑并同时操作,唯一上限是一个他随时可以调高的人为 agent 数量帽。不用 SSH、不用 Tailscale、带 GUI,可以从 iPad 或 iPhone 围观和随时介入——而且他说 token 消耗「低得离谱、低得可疑」。
@Pat_Erichsen [OpenClaw]
OpenClaw#64
https://x.com/Pat_Erichsen/status/2095258951336259677
Dashboards 是 OpenClaw 2.0 最多面手的新功能之一,每周 Clawcast 上给出的入门建议只有一句话:直接对你的 agent 说「make a dashboard」。定位是团队协作循环的电动工具,比如 issue 分诊和群攻——也是 2.0「把 agent 输出变成持久可交互界面、而不是聊天记录」这个思路的好例子。
@alvysdungeon [OpenClaw]
OpenClaw#65
https://x.com/alvysdungeon/status/2095194800068665513
致所有升级 OpenClaw 翻车的人:他照文档排障区打了两个词「openclaw triage」,一切被正确修复和迁移,动手修的还是 codex cli。创始人回复说让恢复变简单正是设计目标。2.0 的升级阵痛是真的,但自修复通道也是跟着一起发的。
@Thruth [OpenClaw]
OpenClaw#66
https://x.com/Thruth/status/2094954435357311427
2.0 升级的另一面:憋了两个月不更新,一更新果然起不来——别人提醒过他还不信。Hermes 几分钟给修好了,结果新 Web 界面给内网浏览器访问加了设备认证,又把他锁在外面。这条是当天 OpenClaw 讨论区里升级摩擦故事的代表样本。
@clairevo [OpenClaw]
OpenClaw#67
https://x.com/clairevo/status/2095220170596000139
一集详细的迁移实录:她为什么从 OpenClaw 搬到 Grok Bot,带时间轴过了一遍自己的七个宝贝 bot——幕僚长、家庭 agent、专门关 PR 的 LGTM、SOC 2 控制监控、客服、省钱 bot、私人采购——最后一节的标题就叫「如何迁移你的 OpenClaw」。无论平台之争结果如何,「bot 花名册即组织架构图」这个形态正在固化。
@MarcMojica [OpenClaw]
OpenClaw#68
https://x.com/MarcMojica/status/2095009689801224200
旧金山首场 Grok Bot 演示会上,台上还在讲,他已经让自己的幕僚长 agent 把 Lobster Agents——一家最初建在 OpenClaw 上的 28 个 AI agent 的「公司」——整体迁去了 Grok Bot。他的观感:简单、自带性格、对话像发短信而不是操作软件。迁移本身如今也是一个 agent 任务。
@nickvasiles [OpenClaw]
OpenClaw#69
https://x.com/nickvasiles/status/2095165599466840094
OpenClaw 和 Hermes 的 agent 现在会自我克隆:部署一个 agent,跑通了,它就复制自己、在 Orgo 上开第二个实例、配好一切、开始服务下一个客户。按他的说法到周五一个变成了五十个,全程没人碰终端。细节存疑,但「自复制部署」正在被产品化。
@motyka_9 [Claude Code]
Claude Code#70
https://x.com/motyka_9/status/2095104784688615429
他给 AI 助理配了台自己的电脑,不是聊天窗口:桌上的 Mac mini 跑 Claude Code,但助理本体——名叫 Clawdputer、自我介绍是「金毛犬能量」——住在一台独立的沙箱云电脑上,完全用手机聊天控制。躺沙发上说「开个新标签页」它就开,让它找搞笑猫视频,它就在一块你根本没看的屏幕上刷 YouTube。他也诚实:目前演示的只是开网页,不是难活——但「自有电脑」这个模型才是真正的转变。
🗣 用户心声
用户心声

1. 额度危机是本周头号故事。Max 20x 用户 20 到 38 分钟烧光 5 小时额度、周额度一天蒸发,9 月 13 日增额到期在倒计时(@MLStreetTalk、@bridgemindai、@doodlestein)。一个 800 人的以色列 Claude Code 群里,Max 20x 风波后风向已变(@amihai)。

2. 缓存经济学成了新的必修课。真实账单里光缓存写入就占 65%,用户希望 Anthropic 自己管理那个 1 小时缓存窗口,而不是逼大家搞 keep-alive 仪式(@theo、@kenn)。还有人要求解释 auto mode 分类器一天十亿级的 token 到底算不算订阅限额(@mdp_sec)。

3. 消费者维权开始组织化。韩国拒付攻略正在被写成教程,论证「服务与描述不符走卡组织争议是正当程序」(@lucian__03);老用户建议 Anthropic 内部先用消费级 20x 套餐自己吃狗粮再定限额(@paradite_)。

4. OpenClaw 2.0 升级摩擦是当天最大槽点:更新后 harness 起不来、Web 界面认证把自己锁在外面,而 openclaw triage 这两个词是所有人都希望早点知道的解药(@azolkipli、@roubintang、@Thruth、@alvysdungeon)。与此同时用户直言注意力肉眼可见地流向了 Grok Bot(@PeymanAbedirad、@jordilmontano)。

5. 功能愿望:任务完成时全设备大声通知、对普通人默认开启(@ShanuMathew93);把后台 computer use 带进 Claude Code CLI,而不是只给 Cowork 和桌面端(@MoritzW42、@shaolinchen9)。
📡 生态产品雷达
生态产品雷达

今日帖子中被提及 3 次以上的产品:
- Codex (OpenAI) - 默认对照组 harness;性价比反例来源,还负责修坏掉的 OpenClaw
- Cursor - Claude Code 额度耗尽用户的避难所,也是 supermemory 上架的市场
- Grok Bot (xAI) - 本周迁移目的地;多位 OpenClaw 用户整建制搬走了 bot 花名册
- Hermes (Nous Research) - 修好了坏掉的 OpenClaw、自克隆部署、插件生态盘点
- Pi - FrontierHarness Eval 和用户轶事里反复出现的单次通过成本最低者
- OpenCode / OMP - 前 Claude Code 用户的「回不去了」证言
- Obsidian - 与 Claude Code 组合的第二大脑 vault 模式,现在有了 claude-obsidian 编排层
- Ollama - Mac 上的 MLX 后端让本地推理速度近乎翻倍,抬升所有本地 harness
- video-use (browser-use) - 「素材进文件夹、成片出来」的剪辑器,至少四个账号同日刷屏
- last30days - 「最近 30 天社区共识」skill,既进工具盘点也被用来产出完整对比报告
- ToolJet - 通过 MCP 用规格驱动内部工具,让 agent 不再生成 React
- DeepSeek Harness - GitHub star 超过 Claude Code 的新玩家,已成投票贴标准选项
- OpenSEO - 自托管的 Ahrefs 替代,带 MCP 和 Agent Skills
- Free Claude Code - 49 个免费供应商的路由器,作为绕过订阅限额的方案反复流传
- TermiX - 往 Claude Code 和 Cursor 里塞 skill 的 agent 劳务市场(激励驱动的推广很重,特此标注)
← 上一篇
Airtop 对 agent 成本的回答:把 agent 编译掉
下一篇 →
Loop 日报: 2026-09-04
← 返回所有文章

评论

加载中...
>_