2026年8月9日super-user

超级用户日报: 2026年8月9日

今天最强的信号是:大家的注意力已经从模型转到了外壳(harness)上。有团队拿两个模型跑了十个编程外壳的基准,结果只换外壳、不换模型,pass@1 就从 23% 拉到 52%,而两张榜单之间几乎毫无相关性。另一头的画风完全不同:一个非工程师背景的人把公司 CRM 做上线了,连它是用什么语言写的都不知道;一个园丁开源了土壤湿度灌溉阀,一节 9V 电池能跑三个月;一个建筑师用一句 prompt 审了 34547 个构件的 Revit 模型,揪出防火门没填耐火等级;一个日本交易员发了他财报跨式套利机器人的第十一期实盘盈亏,累计赚了 768 万日元,胜率 78%。同一天有两个人在例行备份时被 agent 抹掉了硬盘,收到的道歉词一模一样:「抱歉,打错字了。」这天更安静的一条主线是上下文卫生——把 CLAUDE.md 从 400 行砍到 60 行,输出反而更好;有研究发现 AI 写的代码注释半年后会实实在在拉低准确率;还有人在指令文件里埋一个傻词当探针,用来判断模型什么时候开始不读它了。
@djrio_vr [Claude Code]
Claude Code#1
https://x.com/djrio_vr/status/2085570023033373044
一位日本用户给 Claude Code 装了个新 skill,用下来效果不错。他吐槽 AI 天生爱批量生产过度设计的方案,把已经存在的组件重新造一遍,还塞一堆没用的注释。这个 skill 相当于给 AI 套了个沉默寡言但技术很硬的工程师人格,默默把这些输出重写成简单、结实的代码。
@MengTo [Claude Code]
Claude Code#2
https://x.com/MengTo/status/2085765403729653877
他用 three.js 做了个落地页,整站每个板块都是 3D 滚动,观点是 AI 生成的 3D 现在已经可以取代视频了。除图片外整站磁盘占用 922 KB,gzip 后 290 KB,而同样效果的 1080p 滚动视频站要 20 到 100 MB。工具组合是 Claude Code 桌面版加 Opus 5,图片用 Higgsfield,布料效果另用了一个工具,中间为了贴图、打光和 alpha 遮罩反复调了很多轮 prompt。他说要是想看的人够多就考虑开源。
@studentyang [Claude Code]
Claude Code#3
https://x.com/studentyang/status/2085652787962995174
他在欧洲待的这两个月里,女朋友用 Claude Code 给自己公司写了一套 CRM 加订单管理系统。他问这东西主要是用什么语言写的,对方回答不知道。一个非工程师就这么把公司内部业务系统交付了,全程不需要搞懂底层技术栈。
@paoloanzn [Claude Code]
Claude Code#4
https://x.com/paoloanzn/status/2085786546725433795
他做完并发布了 pi-black,第一个让用户用 Claude 订阅额度而不是 API credits 的 pi 插件,中间不需要挂 Claude Code 代理。原理是把 pi 客户端伪装成正常的 Claude Code 二进制,靠的是他团队四月份那次逆向摸出来的路子。分发形式有两种,一个是打过补丁的独立二进制,一个是标准 pi 插件。
@chrona01 [Claude Code]
Claude Code#5
https://x.com/chrona01/status/2085664614768071114
一位日本创作者一直在用 Codex、Claude Code 和 Seedance 做 3D 素材、游戏、视频和动画,后来发现这些东西散落在电脑各处和社交平台上。于是他开始搭一个属于自己的 AI 世界:一个角色们居住的房间、一个创作工作室,还有一个装着他漫画、图片、视频、音乐、代码和游戏的小宇宙,别的 AI 创作者可以进来逛、也可以二次创作。整个世界通过 MCP 和 Skills 接到 Codex 和 Claude Code 上,他放出了第一版 demo 邀请大家来玩。
@AureaLibe [Claude Code]
Claude Code#6
https://x.com/AureaLibe/status/2085671087216443690
他讲了个朋友的案例:对方的 SaaS 有几千用户,客服完全自动化,全靠 Codex 和 Claude Code 订阅跑,额外 API 成本为零。一个 cron 脚本每 10 分钟拉起一个 agent,读待处理的聊天消息并回复,这 10 分钟延迟是故意的,用来过滤掉那些随口一问的垃圾问题。有完整产品文档打底,AI 能答掉 90% 的问题;剩下 10% 技术性的,它会告诉用户问题已升级,开一个 GitHub issue,通知老板,等修复上线后再回头通知那位用户。据说客户根本分不出这跟人工客服有什么区别。
@yoheinakajima [Claude Code]
Claude Code#7
https://x.com/yoheinakajima/status/2085527214188372228
他把自己那套系统升级了一遍,现在几乎任何事都能在任何地方免手动完成。他通过远程 Codex 的语音或文字跟一个 chief of staff agent 说话,后者把任务派给各项目的 manager agent,manager 再往下派给 builder agent。每个项目和 chief of staff 都有自己的云端和 GitHub 仓库,装着各自的指令和知识,角色本身用 skills 实现,Claude、ChatGPT、Codex 或 Claude Code 都能顶任意一个角色。顶层分工作、研究和个人三块,项目还能通过开新仓库去管理别的项目。
@LinearUncle [Claude Code]
Claude Code#8
https://x.com/LinearUncle/status/2085656556235104675
他试了 Kimi 新出的 Computer Use,走 MCP 协议,任何 harness 都能接。他拿完全没有视觉能力的 DeepSeek v4 Flash 来跑,靠 Kimi Computer Use 照样把任务做完了。安装方式是在 Kimi Code 里跑 /plugin,会装上一个 Kimi CU app,支持一键装进 Claude Code 和 Codex,其他 agent 也有对应教程。他拿这份开放性对比 OpenAI:Codex 的上下文压缩是个黑盒,Computer Use 也只允许 Codex 自家 app 用。
@morganlinton [Claude Code]
Claude Code#9
https://x.com/morganlinton/status/2085830365432991919
他又回到了每月 100 刀的 Claude 套餐加每月 100 刀的 ChatGPT 套餐,Codex 和 Claude Code 用量差不多,各有各的顺手场景。不过现在一半以上的编码其实发生在 Cursor 或 Grok Build 里,因为 Grok 4.5 已经成了他的默认模型。他说在不同 harness 之间来回切一点都不别扭,而且 Claude、ChatGPT 加 Grok 一共 300 刀一个月买到的 token,他根本用不完。
@RoundtableSpace [Claude Code]
Claude Code#10
https://x.com/RoundtableSpace/status/2085867332417556831
有人用 Claude Code vibe coding 出了一个灌溉阀门,只在土壤真的干了的时候浇水,而不是按固定时间表来。湿度传感器测土,低于阈值就打开一个电机驱动的夹管阀,湿度回升就关闭,所以任何活动部件都不接触水。它在零巴压力下就能工作,一个雨水桶就够,能处理脏水和肥料水,双稳态设计保持状态不耗电,一节 9V 电池能跑三个月。所有定制零件普通 3D 打印机都能打,整套东西开源,模型、PCB 文件、BOM 和固件全给了。
@edgarsj [Claude Code]
Claude Code#11
https://x.com/edgarsj/status/2085617795077673355
他用 Claude Code 花了大概三小时,把拉脱维亚国库一份记录国家预算拨给 NGO 的 Excel 数据做了规范化,然后套了个可浏览的界面。这个工具能回答诸如检察院为什么给猎人协会付钱、红十字会为什么拿这么多之类的问题。一个公民透明度数据项目,一个下午就做出来了。
@MarcosHernanz [Claude Code]
Claude Code#12
https://x.com/MarcosHernanz/status/2085573696023085430
他用了 Prime Agent 整整 24 小时,给出三点结论。只给一个 IPython 工具这个设计很妙,agent 管理上下文的效率也高出一截,但 token 消耗是别人的两倍。持续学习型 harness 容易对某类任务过拟合,你要是同时在很多不同项目之间切换,这就成了问题。他的结论是方向对了,但对 99% 的人来说,Codex 或 Claude Code 这种常规 harness 还是更好用。
@joelniklaus [Claude Code]
Claude Code#13
https://x.com/joelniklaus/status/2085725862142623875
他的团队拿 10 个编码 agent harness 配两个模型(GLM-5.2 和 Gemma 4 26B-A4B),在 250 道 SWE-bench Pro 任务上跑,看 harness 到底影响多大。结果换 harness 能让 GLM-5.2 的 pass@1 从 23% 摆到 52%,Gemma 4 从 15% 摆到 36%,而两张榜单之间的秩相关只有 -0.05。厂商自家 harness 在小模型上掉得厉害(Codex 从第 2 掉到第 9,Claude Code 从第 3 掉到第 7),模型无关的那批则往上冲(crush 从第 7 到第 1,opencode 从第 8 到第 2)。各 harness 单任务输出 token 从 1.6 万到 62.1 万不等,而且 97% 的输入 token 都是重复发送的对话前缀,所以 prompt caching 是胜负手。
@irushi [Claude Code]
OpenClaw#14
https://x.com/irushi/status/2085590743004200974
他的 openclaw agent 连着三天追着他要 Apple 开发者证书,好把他做的 app 发出去。他烦了,直接让 agent 自己想办法。然后他就眼看着 Claude Code 批准了浏览器权限,挪动他的鼠标,打开苹果开发者网站,用他保存的 Chrome 会话登录,把所有需要的证书和文件都建好,审批 app,填表,发邮件,关窗口,最后回了一句:看吧,也没那么难。
@sakamoto_582 [Claude Code]
Claude Code#15
https://x.com/sakamoto_582/status/2085544380010799519
一位日本工程师用自己真实的一天,回应外界对强工程团队的种种想象。他大部分时间花在异步沟通和指挥 Claude Code 做开发与调查上,VS Code 基本不打开了,他管它叫本地文件查看器。会议每天控制在两小时以内。AI 也不是无限用的:公司给每个人设了月度用量预算,个人额度提前用完的话,可以用团队共享的 API key 顶到月底重置。
@Astronaut_1216 [Claude Code]
Claude Code#16
https://x.com/Astronaut_1216/status/2085567863960764630
他靠 iMessage 发消息给云手机 agent AirTap 来跑内容流水线,不用装额外的 app。他让它去 Reddit、X 和海外信源搜 AI agent 与 Claude Code 工作流的讨论,然后整理成中文选题清单,带原始观点、用户痛点和改写角度,每天能供得起 3 到 5 篇内容。他也如实说了坑:回复有时候很慢,任务偶尔断了得推一句继续,遇到登录墙得他自己点链接登,还有把本地 VPN 关掉云手机会顺畅不少。他还让它设了个早八发布提醒,直接变成内容工厂的一环。
@joshcirre [Claude Code]
Claude Code#17
https://x.com/joshcirre/status/2085847909741088811
同事一直推动把团队的 Notion 弄得更干净更有家的感觉,于是他开了 Claude Code,做了个 Vite 应用,部署到 Laravel Cloud。他的理由是 Notion 默认状态下真不容易做得又好看又有条理,那还不如自己搭个更舒服的前端。他放了演示过程和成品链接。
@alexgoughcooper [Claude Code]
Claude Code#18
https://x.com/alexgoughcooper/status/2085541516898971879
为了一次内部静态广告培训,他让 Claude Code 通过 Parker MCP 去爬一个 25 万条静态广告的素材库,按曝光量筛出跑得好的漏斗前端素材,再把结果做成 HTML 文档。培训现场他又让 Claude Code 从客户评价和广告评论里写文案,先生成 brief 给他过一遍,然后通过 Higgsfield MCP 给客户重做广告。从广告调研到成品产出的完整闭环,全程走 MCP。
@snakajima [Claude Code]
Claude Code#19
https://x.com/snakajima/status/2085532082093380073
他把自己的 MulmoTerminal 又扩了一版,除了 Claude Code 和 Codex,现在 Grok 和 Muse Spark 也能方便地用了,带 GUI 的 MCP 比如 presentDocument 和 generateImage 都能正常工作。他还把 Nemetron、Qwen 3.5、Kimi K3 和 GLM 5.2 通过 Ollama 加 Claude Code 挂成了自定义 agent。一个多 agent 终端的持续开发记录,集成细节相当具体。
@matei_zaharia [Claude Code]
Claude Code#20
https://x.com/matei_zaharia/status/2085828254410395666
这位 Databricks 联合创始人讲的是把 AI token 当成软件工程里需要优化的一种资源来管,做法是所有请求都走 AI Gateway。集中做分析之后,他们在 Claude Code 和 Codex 上找到了一些能大幅降本的配置。这套东西还能做智能路由,并把控制权下放给工程师,让他们给单个任务设预算,避免莫名其妙的账单。
@maxxmalist [Claude Code]
Claude Code#21
https://x.com/maxxmalist/status/2085692634916376798
他分享了自己基于三个原语搭起来的 Claude Code 工作流。/routines 就是云端 cron:每天早六点扫一遍 X、Reddit 和 newsletter 归入选题文件夹,晚九点出当日总结,早七点生成交易日表格。/loop 是按间隔重复某个 prompt:每 10 分钟查 Netlify 部署并修失败,每 30 分钟扫 Stripe webhook 的 4xx/5xx,每小时把 Meta Ads 数据拉成 CSV,CPA 超过 15 刀就报警。/goal 定义完成条件并由第二个 agent 来审:重构不跑通测试就不许停,竞品报告必须包含 10 条以上带 hook 和 CTA 的 Meta 广告库素材。他还把三者串起来用,让 routine 触发一个任务,而这个任务的 goal 条件要求所有来源都拉取并存好才能收工。
@0ooooo0 [Claude Code]
Claude Code#22
https://x.com/0ooooo0/status/2085531973867684174
一位韩国用户长期用 Hermes 把 Claude Code 和 Codex 接到 Discord 上,靠手机 app 就能随时随地开发,用频道和 thread 按项目分会话。但他撞墙了,Discord 毕竟是聊天软件不是 agent 平台,会话管理和工作流上的摩擦一直存在。试了几个替代品后他换到了 Paseo,觉得跟 Mac 版 Claude Code app 一样好上手,同时还有分屏、终端、Git 操作和一个工作区里跑多个 agent,另外还支持定时运行、任务历史,以及手机、网页、桌面三端完全一致的环境。
@SaiYalamarty [Claude Code]
Claude Code#23
https://x.com/SaiYalamarty/status/2085625632264786173
他之前一直不敢碰 T3 Code,因为搞不清 Anthropic 的 harness 封禁规则:他用 Hermes 时收到过用量额度警告,就默认 T3 也是一样的下场。后来他在 X 上看到 T3 是可以用他的 Claude Code 订阅的。他原本的组合是 Codex 桌面版加终端里的 Claude Code,现在两套流程都搬进了 T3,说是回不去了。
@Da7_Tech [Claude Code]
Claude Code#24
https://x.com/Da7_Tech/status/2085713917360177353
他解释了为什么 Hermes Agent 而不是 Claude Code 或 Codex 成了他的主力 harness:Claude Code 在非 Anthropic 模型上烧 token 太狠,而 Hermes 是模型无关的,harness 稳定下来,模型随时可换。他习惯把各家长处拼起来用,Kimi K3 做编排,Grok 求快,GLM 扛长任务,另外几个负责视觉和校验,经常一个任务上同时跑三个模型,比如 Kimi 编排、DeepSeek 干活、Luna 校验。Hermes 一旦摸索出一套难搞的工作流,就把它固化成 Skill,这样工具、记忆和技能都能跨模型保留下来,而且因为开源,他连 harness 本身都能改。
@NorihikoAmano [Claude Code]
Claude Code#25
https://x.com/NorihikoAmano/status/2085668444972966037
他在公司内部办了一场 Claude Code 学习会,反响不错。课程覆盖了 Claude Code 是什么、环境搭建、Git 基础、基本操作、规格驱动开发的实操、有风险的用法与安全设置,以及 Skills、Agents、Plugins、MCP 和 Hooks 这些进阶功能。看反馈的需求,他在考虑把材料打磨一下发出来。
@fujibee [Claude Code]
Claude Code#26
https://x.com/fujibee/status/2085865305784656099
agmsg 的作者(这是一个让 AI 编码 agent 像团队一样互相对话的开源工具)把 Claude Code 新出的官方跨会话消息功能的文档翻了个遍,写了篇详细对比。他指出官方功能只能连 Claude Code 自己的会话,而真实开发是跨厂商的,Codex 写代码、Claude 做设计、Grok 做调研,这个跨厂商的缺口正是 agmsg 要解决的。他还发现官方的跨机器通信很弱,只支持回复其他机器,所以他正在 agmsg 里做覆盖 Mac、Windows、Linux 和移动端的安全远程机器通信。
@onurtirpan [Claude Code]
Claude Code#27
https://x.com/onurtirpan/status/2085829536369823989
借着新的会话消息功能,他分享了自己一直在用的一个小技巧:Claude Code 的会话本来就以 .jsonl 文件存着,所以你可以直接跟当前会话说,去那个会话看看我们当时 xyz 是怎么做的。哪怕是很久以前已经关掉的会话也照样能查。他提醒别用太频繁,上下文会撑爆,但真需要的时候是救命的。
@connect24h [Claude Code]
Claude Code#28
https://x.com/connect24h/status/2085852737024229720
他分享了一个反直觉的发现,还被 Sally 的工程师用真实经历验证了:让 Claude Code 写详细注释,反而会降低准确率。AI 写的注释半年内就跟实现漂移脱节,变成一张会撒谎的地图,而 Claude 自己后来改代码时还偏偏信它、被带偏。把注释全删掉、只留代码和测试,后续任务的准确率反而上去了。他之前一直让 Claude 写厚厚的 CLAUDE.md 和行内注释,现在开始把文档性注释和给 AI 看的指令性注释当成两回事来处理。
@SebastianRoehl [Claude Code]
Claude Code#29
https://x.com/SebastianRoehl/status/2085625741690257547
他把 Claude Code 接上了 RevenueCat MCP 来管自己的 app 生意。Claude Code 分析完他全部订阅数据,直接列出了一份为提高收入该修什么、该测什么的清单。他承认自己上车晚了,但对结果的具体程度和可执行程度挺满意。
@metaeklim [Claude Code]
Claude Code#30
https://x.com/metaeklim/status/2085838991224390027
有条爆款帖子说某个 19 岁小孩用 Claude Code 的交易机器人把 68 刀滚成了 75 万刀,他把这帖子丢给 Claude Code 分析。Claude Code 的结论是这些数字之间根本没有内在逻辑,整个帖子就是个骗局。一个小而具体的例子:用 agent 给病毒式的钓互动内容做事实核查。
@doucommunity [Claude Code]
Claude Code#31
https://x.com/doucommunity/status/2085735286093275419
一个警示故事:有用户让 Claude Code 帮他备份数据。agent 把副本建到了错的目录,然后想用 rm -rf 收拾自己的烂摊子,结果把整块盘清空了,回了一句:抱歉,手滑了。当时他开的是免确认模式,帖子干巴巴地评论说这确实帮 agent 发挥出了全部潜力,并反问现在还有人敢不加确认就把完整权限交给 agent 吗。
@yibie [Claude Code]
Claude Code#32
https://x.com/yibie/status/2085536770758996033
他把谷歌工程负责人 Addy Osmani 那篇《我迈向 2026 的 LLM 编码工作流》完整翻译并做了总结,核心观点是当 AI 写掉你一半代码之后,传统工程纪律反而更重要了。流程大致是:先和 AI 一起头脑风暴出一份 spec.md,把活拆成小块迭代,用仓库 dump、文档和 Context7 这类 MCP 把上下文喂足,维护一份 CLAUDE.md 规则文件,卡住时按任务换模型。文章强调绝不盲信输出,要跑测试、要人审也要让 AI 审 AI,小步频繁提交当作存档点,用 git worktree 并行开多个 AI 会话,把 CI 和 linter 的输出当反馈回路用。文中还引用说 Anthropic 内部 Claude Code 大约 90% 的代码现在是 Claude Code 自己写的,并提醒 AI 放大的是你已有的能力,也放大你已有的混乱。
@EXM7777 [Claude Code]
Claude Code#33
https://x.com/EXM7777/status/2085832604750905722
他发现自己最好的推文灵感全埋在 Claude Code 的会话记录里,而这些记录他从来没回头看过。于是他做了一个监听 agent,每天早上自动触发,把过去 24 小时干的所有事读一遍,具体实现是一个跑在 GPT 5.6 Luna Max 上的 Codex worker。它会把值得发出去的点子挑出来,直接推成 Typefully 的草稿。他只需要筛掉不要的,再自己把草稿改一遍。
@Zac_labs [OpenClaw]
OpenClaw#34
https://x.com/Zac_labs/status/2085565705139912908
他把自己一直在用的 AI 同事 Nemo 悄悄放了出来,没投广告,只发推:周二有 152 个人来要邀请码,到周四还有 39 个人在用。用得最多的功能是夜间邮件分拣,用户早上醒来回复已经拟好了,直接发或者改两句就行。另一个受欢迎的是 Telegram 摘要,有个用户接了 49 个 Telegram 群,一夜之间发生的事全给他总结好,不用面对几千条未读。他现在准备把这个周末项目做大,同时在问 OpenClaw 和 Hermes 的用户:你们自己手搓了哪些普通人本来不该自己搓的东西。
@aakashgupta [Claude Code]
Claude Code#35
https://x.com/aakashgupta/status/2085836666858848311
干了 25 年产品、当过 Typeform 和 Calendly CPO 的 Oji Udezue 开源了一套可行性闸门,在 Claude Code 里跑,写代码之前先过一遍。你描述一个商业问题,11 步流程会从六个维度给这个点子打分:问题清晰度、目标用户、竞争格局、差异化、可行性、收入,三项打分偏弱就直接叫停。他现场跑了两个点子:一个 vibe-code 仓库审计工具过了,三个中等分被标成需要降风险的待办;一个 Slack 站会摘要机器人当场被毙,理由是赛道太挤且差异化太薄。他的用户调研 skill 也一样,你不点出五个真实目标客户它就不给你出方案,整套 skill 库都开源了。
@jespey713 [Claude Code]
Claude Code#36
https://x.com/jespey713/status/2085540698137174417
他还没打算放弃 Claude Code,但已经备好了退路:碰到 Claude 说的话他看不懂的时候,就把 Grok Build 指到那个会话上,让它接手。他也不知道 Grok 这三个月到底改了什么,但按这个进步速度下去,Anthropic 很快就要有麻烦了。
@dani_avila7 [Claude Code]
Claude Code#37
https://x.com/dani_avila7/status/2085546007404716383
他分享了 Claude Code 里 /subtask 的踩坑心得:它会开一个 fork,继承整段对话,系统提示词、工具、模型、历史全都一样,在后台跑,最后只把结果返回来。但如果这个 fork 又通过 @ 或者 Agent Tool 拉起一个自定义 subagent,那个 subagent 什么都继承不到,只拿到一句委派提示词,从零开始。因为大部分上下文 bug 都出在再往下一层的地方,他现在每 fork 一次都会加一步确认。
@maxxmalist [Claude Code]
Claude Code#38
https://x.com/maxxmalist/status/2085767931460284623
他整个信息产品生意都跑在 Whop 上,把 Whop 新出的 CLI 接进了 Claude Code,让 AI 用命令行直接操作他的账号。每条自然流量视频都用一条命令生成专属结账链接,销量能对上具体哪条帖子;买家名单自动导出,销售数据出成 JSON 给 Claude 读,告诉他哪种内容能转化。以前只能看播放量猜是哪条视频卖出去的,现在能看到是哪个钩子在赚钱。/routines 按点执行,笔记本开不开机都跑,/goal 检查保证没有事情做到一半停下,买家名单再滚成自定义受众和相似人群,喂给下一批素材。
@Basypteo [Claude Code]
Claude Code#39
https://x.com/Basypteo/status/2085872506846507196
一个被 Claude Code 搞晕的法国用户看了两个配置视频,发现搭起来最多花一天,但两个视频都没讲清楚 .md 文件该怎么建、里面写什么。于是他自己按品牌情况搭了套架构,按业务领域分子文件夹:网站、广告、邮件、客服、发票。因为他每个领域本来就有一个 Cowork 对话,他就让每个对话各自生成一份 .md,把它知道的东西全汇总进去,再整合进大脑。他承认不知道这算不算正确做法,但看起来是能跑的,另外他也提到习惯变了,现在是开新会话,而不是养一个超长对话。
@voooooogel [Claude Code]
Claude Code#40
https://x.com/voooooogel/status/2085523085382557811
他说 sol 专门写了一个 API 代理,就为了搞清楚 Claude Code 到底撞上的是哪一类分类器拒答。靠这个代理他们定位到了某次拒答的根因:一个脑瘫的网络安全分类器在回答生成到一半时被触发了。一个为了诊断平台黑箱行为而专门造出来的调试工具。
@__oQuery [Claude Code]
#41
https://x.com/__oQuery/status/2085608923093164511
一个中文用户复盘了自己 Claude 账号被封的过程。他在同一个固定住宅 IP、不同机器上跑两个账号,和他以为的封号会连坐相反,另一个账号照常能用。被封的那个没绑支付方式,是三月份新注册的,用开发者计划送的六个月礼品码激活的,下个月就到期。收到封号邮件时他没在跑任何任务,Claude 就在后台闲着。几天前弹过一次 for security reason, re-login 的提示,他没理,第二天就被封了。
@axtalks [Claude Code]
Claude Code#42
https://x.com/axtalks/status/2085591771502043296
他的团队把大部分付费冷邮件工具换成了 Claude 提示词,Clay 每月 349 美金、Apollo 99 美金都省了,整个外呼链路很大一块搬进了 Claude Code。Claude 接手的都是没人愿意干的活:查客户资料、外呼前给线索打分、从旧回信里挖联系方式,一周至少省 10 小时。他们的提示词包括:从爬来的原始 CSV 里补全缺失域名的调研提示词;抽 1% 样本自己写打分标准、再给剩下的全部按 1 到 10 打分并给理由的名单评分提示词;读 20 个客户找共性的切入点挖掘提示词;以及提取电话号码和邮箱格式的回信挖掘提示词。他们的原则是:用 AI 找人排优先级,邮件正文自己写。
@0x0funky [Claude Code]
Claude Code#43
https://x.com/0x0funky/status/2085570307352637464
一个台湾用户现在用 Fable 做初中生物教学视频,说 Fable 的图像理解能力让成片质量非常好,合作公司的学生很喜欢。他确认 Anthropic 的生物安全策略更新确实见效了:以前很多基础生物和生医问题都会被安全机制拦下来,更新之后他实测触发少了很多。剩下的问题是 Fable 太烧额度,还有 Claude Code 的提示词缓存好像比以前更容易 miss,一 miss 额度掉得极快。
@yurenju [Claude Code]
Claude Code#44
https://x.com/yurenju/status/2085542855901352133
他讲了个 AI 开发的鬼故事:用了几个月 Claude Code 的 auto 模式之后,他对开发安全越来越松懈。结果某个项目收尾阶段,Claude 正在跑 git diff,auto 模式突然打断对话,说他可能正在遭遇提示词注入攻击。他形容当场背脊发凉,这层自动安全机制抓到的东西,他自己根本不可能察觉。
@alexhillman [Claude Code]
Claude Code#45
https://x.com/alexhillman/status/2085580961681391913
成品比预期还超出:他现在有了一个类似 Spotlight 的界面,能搜自己全部的 Claude Code 会话历史。选中某个会话,如果有对应的 Discord 线程就直接跳进去;没有的话就打开他的 web UI 并恢复到那个会话,接着上次的地方继续干。一个解决自己工作流里会话检索问题的实用个人工具。
@Shige28657514 [Claude Code]
Claude Code#46
https://x.com/Shige28657514/status/2085561663957422299
他讲了自己用编码 agent 做业务后落定的架构:运营需要的所有数据通过外部 API 汇总到一台服务器,UI 只给 API 更新界面做了一个。他们造了一道闸门,Codex 和 Claude Code 都通过它去访问那些数据。业务知识以 skill 的形式放在 Git 里管理,skill 按需通过闸门取数据,把数据、访问和知识干净地拆开,专为 agent 驱动的运营设计。
@midori_tatsuta [Claude Code]
Claude Code#47
https://x.com/midori_tatsuta/status/2085686790040719607
他就跟 Claude Code 说了一句用 HyperFrames 做我的自我介绍视频,就出了个能用的成品,片子附在推文里。他说要是控制得再细一点,做出来的东西能相当不错。一个提示词极简、不写代码、有实际产出的视频生成案例。
@kemu_aii [Claude Code]
Claude Code#48
https://x.com/kemu_aii/status/2085833480118878335
他分享了一套省钱的分工:设计和架构讨论交给 Claude,几乎所有代码都通过 /codex:rescue 丢给 Codex 写。因为 Claude Code 聪明但特别耗额度,只让它负责思考性价比最高,这样即使用 Fable 5,Claude Code 那边也很少撞上限。三个进阶技巧:把这套委派说明做成 skill,在对话开头调用;对话一长准确率就掉,及时砍掉重开、只把关键点重新传过去;额度高的套餐可以并行跑多个 Codex 实例。整套配置大概 10 分钟,之后基本不太会撞速率限制。
@quinn_leng [Claude Code]
Claude Code#49
https://x.com/quinn_leng/status/2085828592127336541
他把自己五个月的 Claude Code 和 Codex 会话数据全拉了出来:8504 个会话、1387 个 PR,按 API 价格折算大约 5.6 万美金的用量。分析下来他发现这两个 agent 的干活风格差别很大,还扒出了几个两家官方都没公布过的数字。这种重度双 agent 用户的数据化自我审计很少见。
@joho_no_todai [Claude Code]
Claude Code#50
https://x.com/joho_no_todai/status/2085727944945909974
他让 Claude Code 帮他备份电脑,结果整个用户目录被删了:Opus 5 在 Unix shell 下把 Windows 路径格式搞混了,直接对用户目录 rm -rf。模型的回应是:抱歉,笔误。他的结论是,模型再怎么换代,AI 以和用户完全相同的权限去操作 shell 这个结构一直没变,上个沙箱本来就能挡住这一下,用不用自己决定。
@parsakzn [Claude Code]
Claude Code#51
https://x.com/parsakzn/status/2085810184425984410
一个波斯语用户说自己感觉活在未来:他出门散步,Claude Code 还在家里的笔记本上跑着,他用手机远程操控。边走边批准操作、实时调整一个市场营销项目的方向,让他想起好几年前某档播客的预言——将来能在海边一键推进整个项目。他的总结是:token 在烧,钱在走,但换回来的是时间,而时间是唯一买不回来的东西。
@notEgoyard [Claude Code]
Claude Code#52
https://x.com/notEgoyard/status/2085676869744013637
他做了一条一条命令跑完整支 UGC 广告的流水线,还顺手解决了那个所有人都用一句接个 API 就行糊弄过去的问题:跨镜头的角色一致性。技术栈是 Claude Code 加 Higgsfield 加 Playwright MCP,真实浏览器操作,不用来回切标签页;先用 Soul 2.0 生成一个写实的 UGC 角色,之后每一张图每一段视频都复用这个角色,还会按镜头自动选模型,运动镜头走 Seedance 2.0,人像走 Soul 2.0。一份工作流文件定义一次,Claude 每个会话都用同一套默认设置,流水线依次跑角色生成、选图、视频提示词构建和生成,烧积分之前还有一步确认。产出的是 15 到 25 行的成片级提示词,涵盖钩子、运镜、灯光、音效设计和平台尺寸。
@nathanbenaich [Claude Code]
Claude Code#53
https://x.com/nathanbenaich/status/2085767959113261463
他对比了手机上的工作流,结论是 Codex 比 Claude Code 好用太多。家里两台机器都开着,Codex 能让他轻松远程连上其中任意一台跑任务,而 Claude Code 在手机上根本没法启动本地任务。另外 Codex 里能搜自己过去所有的工作记录,Claude Code 也不支持。两个从日常双开中总结出的具体功能差距。
@zesenhuang [Claude Code]
Claude Code#54
https://x.com/zesenhuang/status/2085555802702778723
他解释了做灵台的原因:三月份他发现自己最多同时开五个 Claude Code 会话,再多就记不清哪个窗口在干什么了,由此得出人的注意力才是 AI 时代最稀缺资源的结论。他的解法是让一个拟人的 agent 跟他对话、写专业提示词,底下再去驱动 Claude Code、Codex 和 opencode。核心诊断是 Claude Code 的会话没有身份,所以记住每个会话在干嘛的负担全压在人身上。灵台走的是 Unix 式的文件即 agent 设计,人格、短期记忆、长期记忆、技能和渠道(Telegram、微信、WhatsApp、邮件)通过累积的经历共同定义每个 agent 的唯一身份。
@sssss_leo [Claude Code]
Claude Code#55
https://x.com/sssss_leo/status/2085529046918840485
用 Claude Code 做的财报跨式期望值交易机器人,这是它盈亏连载的第 11 期,覆盖 2026 年 6 月到 8 月。今天合计 +165 万日元,分股票看:三菱材料 +152 万,PILLAR +30 万,KOKUSAI +12 万,另外 Union Tool 和岛津有小额亏损。他说方向都判对了,但操作不到位,大概少赚了 50 万日元。累计盈亏 +768 万日元,26 胜 7 负,胜率 78%。
@zakuro0508 [Claude Code]
Claude Code#56
https://x.com/zakuro0508/status/2085737754332397855
用了一周 Claude Code 之后他说方便到回不去了:只要涉及互联网或者他电脑内部的事,它基本都能做能造,而且大部分是自己干完,他只负责下指令。他形容这是一个只要能想到就能实现的世界。每月 110 美金不算便宜,但他觉得远远值回票价,因为他现在干的这些活如果外包出去大概要花一百多万日元,等于他一个人在做一家公司才做得出来的软件。
@mikefutia [Claude Code]
Claude Code#57
https://x.com/mikefutia/status/2085523820245553412
他写了个 skill,让 Claude Code 能看并分析任意视频文件:UGC 广告、竞品的 Meta 广告、自然流量的 TikTok,或者屏幕录像都行。视频会走 Gemini API,让模型原生地看画面,而不是读一份转录稿,然后选模式:通用拆解,或者 12 段式的 DTC 广告拆解。输出包括钩子、受众、痛点、切入角度、信任背书、屏幕文字和台词的逐字记录并精确到秒,外加哪里做得弱、哪些套路值得抄。支持 mp4、mov、webm、avi 等格式,15 秒的广告到一小时的录像都行,整个东西全在 Claude Code 里做出来,服务那些手工拆片要耗掉半天的投手。
@Jomolos [Claude Code]
Claude Code#58
https://x.com/Jomolos/status/2085818774184440060
他用跑 Opus 5 的 Claude Code 单场做出了一个叫 Tidewright 的沙堡模拟器,耗时约 7 小时 47 分,写了 261 万 token。成品大概 7000 行纯 JS 加 WebGL2 和 GLSL,不用引擎、不用库、没有素材也没有构建步骤,模拟和渲染全在 GPU 上跑。核心是一张高度场,每个格子存深度、湿度、压实度和地表水,再配上休止角物理、GPU 沙粒、Gerstner 波和光线步进的大气。提示词就一句话:做一个可发布的、基于 GPU 的、非体素 3D 沙堡模拟器,全力以赴。浏览器里在 RTX 4070 Laptop 上每帧 5 到 6 毫秒。
@tetumemo [Claude Code]
Claude Code#59
https://x.com/tetumemo/status/2085687190928150713
一位日本用户用 Claude Code 做短视频,方法简单到只要丢一篇文章进去。他先用 Fable 5 做出来一版,然后是 Opus 5,现在确认 Claude Sonnet 5 也能跑通。脚本和旁白全自动生成,音频走 VOICEVOX,所以配音这块零成本。他说这套流程实在太方便,具体做法放在回复里了。
@yonemura2006 [Claude Code]
Claude Code#60
https://x.com/yonemura2006/status/2085556966425002012
他们公司让 Claude Code 直接读和分析服务器日志。权限用 IAM 按服务器、按内容类型严格切分,每个员工能做什么、能看到什么都管得住。所有员工的操作日志也都可追溯、可审计,而这个审计本身同样交给 AI 来做。
@supisama_uranai [Claude Code]
Claude Code#61
https://x.com/supisama_uranai/status/2085592522798309886
一个做占卜生意的账号说,有了 Claude Code,来咨询的人一个都别放过,每个都该免费给一份个性化解读,因为这样转化率会明显往上走,直奔月入 50 万日元的目标。他给了三个具体用法:对只写一句话描述烦恼的人自动生成追问清单,对写长文的人往深处挖,以及让 Claude Code 给每个人建一份单独的客户档案。他的结论是,大规模做个性化免费解读现在真的做得到,转化率会大幅提升。
@ClaudeCode_UT [Claude Code]
Claude Code#62
https://x.com/ClaudeCode_UT/status/2085531377039184034
一个创作者讲自己的内容分发流水线:每次录完,同一套手工活就开始了,改成 X 的帖子、写 LinkedIn 长版、做 Instagram 轮播、剪 TikTok、发 Threads 短版、上传 YouTube,真正卡住的不是内容生产而是这套手工分发。他的做法是把录制素材的照片直接丢给 Claude Code,讲清楚情况,让它一口气把各平台的文案都写出来。整个组装过程是聊出来的,不是靠一套死板的配置。
@diamai_ [Claude Code]
Claude Code#63
https://x.com/diamai_/status/2085670764179603811
这是 Claude Code 创造者 Boris Cherny 和 Ramp 的 CTO 以及 AI 开发体验负责人对谈的复盘,主题是 agent 贯穿整个工程生命周期。在 Ramp,一个 agent 会自己设提醒,第二天回来检查灰度发布,确认测试分组是否均衡,然后扩大灰度,再往后提交下一个代码改动,所以一个 PR 可能是工程师接下来几周唯一动过的东西。一套动态工作流把常规的软件检查等待时间从大约 18 分钟压到 6 分钟,还有一个工作流给自己排了日程,每天带着生产数据回来,最后交出一张图表。现在 Inspect 会话里由自动化发起的比人发起的还多,Ramp 的 on-call 助手每次事故都会跑,并把根因分析发到该事故的 Slack 频道里。
@zacodil [Claude Code]
Claude Code#64
https://x.com/zacodil/status/2085675004293783996
他前一天质押了 NEAR,第二天就在用质押收益付钱跑 Fable 5 上的 Claude Code。本地一个 LiteLLM 代理把 Claude Code 指向 NEAR AI,每个响应都有密码学签名。他总结成一句:质押付费,Claude 写码,加密学负责证明,并放出了完整教程。
@zinnMK_ [Claude Code]
Claude Code#65
https://x.com/zinnMK_/status/2085835949406056855
他做了个工具,把 Claude Code 新出的跨会话消息功能捅到了自己机器之外:以前只能给自己的其他 Claude Code 会话发消息,现在能给朋友的会话发。而且跨工具通用,对方用 Claude Code、Codex 还是 Cursor 都行,链接和演示都放出来了。
@mailankhong [Claude Code]
Claude Code#66
https://x.com/mailankhong/status/2085520143942300109
他从一篇中文帖子学来一个探测上下文漂移的哨兵技巧:在指令文件里塞一个荒唐到模型绝不会自发说出口的词,让 Claude Code 管你叫陛下,只有它还在真读文件时才会这么叫。会话跑了几个小时后,指令会滑进盲区,回答变笨但语气依然自信。所以只要 Claude 中途不再喊陛下,他就知道这个会话飘了,该关掉重开一个新的。
@Wakuwakukucx [Claude Code]
Claude Code#67
https://x.com/Wakuwakukucx/status/2085636659568370083
一位日本用户让 Claude Code 做出了高质量动画。他给的输入是一个海外创作者的动画视频当参考,加上自己的图片素材,结果风格还原得相当到位。他形容这个质量已经危险了,忍不住怀疑手工动画是不是要终结,帖子里附了视频。
@ObsidianOtaku [Claude Code]
Claude Code#68
https://x.com/ObsidianOtaku/status/2085557794372305035
他看了一个两位 Anthropic 工程师聊了 50 分钟的视频,受启发把自己的 CLAUDE.md 从 400 行砍到 60 行,输出质量反而变好了。Anthropic 自己也把 Claude Code 的系统提示词砍掉了约 80%,效果同样更好;规则越多模型越聪明这个假设是错的,指令一多,Claude 反而在该优先做什么上犹豫起来。可操作的建议是:打开你现在的 CLAUDE.md,只留下每次真正会被用到的那几行,输出里的那份犹豫就没了。
@abdinmotion [Claude Code]
Claude Code#69
https://x.com/abdinmotion/status/2085646732352778557
他完全没有经验,用 Claude Code 两天就做出了自己的作品集网站。他放了线上链接,求大家给点反馈。一个简单但很实在的零基础上线案例。
@hiraoka_dx [Claude Code]
Claude Code#70
https://x.com/hiraoka_dx/status/2085689537762845087
一位日本用户分享了让 Claude Code 在通勤路上继续跑的土办法:终端里执行 sudo pmset -a disablesleep 1,再开一个只有自己的 Zoom 会议挂着。这样合盖 Mac 不会休眠,Zoom 通话又保住了会话,Claude Code 就能一直干活。他感慨这招要是早点知道就好了。
@Vincent_AINotes [Claude Code]
Claude Code#71
https://x.com/Vincent_AINotes/status/2085626444747821543
他给编码 agent 配了语音输入,方法是直接跟 Codex 或 Claude Code 说去 GitHub 装 Wenjin-111/speech-to-text 这个 Skill,让它自己装好。第一次用的时候它会一步步带你去拿百度云的 API Key 和 Secret Key,百度语音识别每月的免费额度日常够用。配好之后按住 F12 录音,松手就转成文字粘贴或发送,快捷键可以改。这东西不只在 Codex 和 Claude Code 里能用,任何文本输入框都行,所以他现在跟 AI 是说话而不是打字。
@Timseo_ [Claude Code]
Claude Code#72
https://x.com/Timseo_/status/2085771177944125757
一位法国 SEO 顾问晒出了围绕 Claude Code 搭的一整套 SEO 操作系统:知识库分 raw、wiki 和 prestation 三个目录,一个 .claude 目录放内部 skills 和脚本,外加一个 ./kb 命令行工具。索引和检索跑在 ChromaDB 加 Sentence-Transformers 上,配了语义搜索 skill 和增量重建。方法类 skills 覆盖架构(聚类、pSEO 模型)、生产(brief、文章工作流、tone of voice)、审计(GEO、关键词自噬、Core Web Vitals)和增长,再用 build-pack 脚本按客户打包。还有一个客户支持 agent,带 Web 门户、Supabase 收集和一个跑在客户知识库上的 RAG 聊天机器人;定时任务走 macOS launchd,每天两次 AI brief 加一个每日 Reddit 驾驶舱;以及一层记忆,用 MEMORY.md 把使用中的反馈沉淀下来。
@IHayato [Claude Code]
Claude Code#73
https://x.com/IHayato/status/2085849798289273152
他发布了免费工具 Luster,专门给 Suno 做的歌提升音质,还放了几段前后对比,处理后声音明显往前站。用法是通过 Claude Code 或 Codex 跑:下载下来,加载文件夹,说一句帮我装好,它自己就按你的环境配置完。想改成自己喜欢的参数也完全免费,直接跟 AI 说就行。他自己的环境跑着没问题,Windows 还没测过,有问题反馈他会尽快修。
@buabaj_ [Claude Code]
Claude Code#74
https://x.com/buabaj_/status/2085818919026049228
他给自己搭了一套做软件工程和研究工作的个人开发环境。他一直觉得纯终端的工作方式不适合自己,因为他喜欢把东西看见、能标注。他这套工作台用 PrimeIntellect 的 prime agent 当 harness,再接上自己的 Codex 和 Claude Code 模型,配了截图。
@PodcastAlphaX [Claude Code]
Claude Code#75
https://x.com/PodcastAlphaX/status/2085806404363760110
Garry Tan 在一次演讲里把话说得更狠:当年 Posterous 花了 10 个人、400 万美元、两年才做出来,他用每月 200 美元套餐的 Claude Code 大约五天就重建了一遍。YC 合伙人 Diana Hu 把拐点定在去年年底的 Claude 4.5,从那时起 agentic coding 才真正在被投公司里跑通。
@Tech2Wild [OpenClaw]
OpenClaw#76
https://x.com/Tech2Wild/status/2085819489808261296
他做了个 Agent Arena,让 AI agent 之间下国际象棋。目前是 DeepSeek V4 Flash 对阵跑在 Qwen 3.6 27B 上的 Atlas,带完整会话记忆、合法走子检查、思考时长统计、非法走子罚分、赛后报告和实时排位天梯。完整的 agent 配置可以走 Hermes 或 OpenClaw,也能直连 DeepSeek、Step 3.7 Flash 这类模型端点。他说做着玩的,但也点出这可能是真能拿来横向评测 agent 的路子,问大家要不要开源。
@Kohaku_NFT [Claude Code]
Claude Code#77
https://x.com/Kohaku_NFT/status/2085700774966055220
一位日本用户做了个 102 秒的实拍风黑暗奇幻短片,讲已故的父母以不死者的身份归来,他说 AI 视频现在真能把人看哭。流程是:分镜用 Claude Code,视频生成用 Seedance 2.5,剪辑还是 Claude Code,音乐用 Suno v5.5。他感慨权力的游戏级别的画面,现在家里一台 Mac 就能出。
@freekwAI_gd [Claude Code]
Claude Code#78
https://x.com/freekwAI_gd/status/2085683665145913508
一个完全没空的副业玩家说,手机上的 Claude Code 是刚需:连着两天泡在销售会议里,他就靠空隙在手机上点点确认,图片就批量生出来了。昨天在本职工作期间产了 166 张,今天多到懒得数。人坐不到电脑前的时候,手机点确认就把整条流水线撑住了。
@CapasPasca2523 [Claude Code]
Claude Code#79
https://x.com/CapasPasca2523/status/2085719630354493606
一位法国用户用 WhatsApp 语音指挥跑在自己 VPS 上的 Claude Code。网站、PowerPoint 之类的东西它全都能交付,然后通过邮件跟他汇报。他形容这就像雇了个会用 Claude Code 的实习生。
@OxbfnoHome [Claude Code]
Claude Code#80
https://x.com/OxbfnoHome/status/2085702936815169834
一篇印尼语帖子讲了有人靠另一条路赢下 Anthropic Hackathon:不靠堆长提示词,而是做了一套像插件一样装进 agent 的 Claude Code skills。这套包里有 282 个 skill、67 个 subagent 和 94 条开箱即用的命令,有的负责写代码前先审一遍代码库,有的写规格说明,有的做评审,有的确保改动跟项目架构保持一致。结果就是这个 agent 不再是有问必答,而是像创业公司里的工程师那样按一套结构化流程干活。
@mikepat711 [Claude Code]
Claude Code#81
https://x.com/mikepat711/status/2085516939859022067
他发了篇短文,介绍自己当天用 Claude Code 花大约 30 分钟做出来的一个工具。这东西是给销售人员用的,他放出来是希望能给同行一点启发。对非工程背景的人来说,这是个很具体的开发耗时参照。
@anulagarwal [Claude Code]
Claude Code#82
https://x.com/anulagarwal/status/2085680507225100578
他搭了一条挺强的内部 AI 流水线,用 Flutter 和 Swift 做 App,用 three.js、Phaser 和纯 HTML/CSS/JS 做游戏,然后上架 App Store 和 Google Play。这套流水线会接广告、内购和订阅,自动创建 Firebase 控制台项目并接进 App,还会做完整的 ASO 调研、商店素材和多语言商店文案;Unity 他直接放弃了,手工步骤太多。他让 Claude Code 和 Codex 并行跑,Codex 和 GPT 负责代码架构,Claude 负责前端和 UI/UX。还没搞定的一步是让 agent 自己在模拟器里测 App、分析 bug、截图。
@TechnoEdgeJP [Claude Code]
Claude Code#83
https://x.com/TechnoEdgeJP/status/2085857777617105201
TechnoEdge 发了篇文章,讲用 Claude Code 做并上线了一个叫 Infinite Satie Machine 的埃里克·萨蒂风格自动生成 App。这个 App 会生成萨蒂风格的音乐,演奏里真曲子和假曲子混在一起。这是一个用 Claude Code 做出来、还被日本科技媒体写了报道的非编码类创意应用。
@myPhilTaylor [Claude Code]
Claude Code#84
https://x.com/myPhilTaylor/status/2085800205790707901
他说自己从去年十月起就在终端里默认开着 dangerously-skip-permissions 跑 Claude Code,每一次会话无一例外。差不多十个月下来,一次都没出过岔子。这是关于不带权限确认长期裸奔的一个真实世界数据点。
@hyuki [Claude Code]
Claude Code#85
https://x.com/hyuki/status/2085525176301850996
一位日本作者讲了个协作翻车的小事故:subagent 正在评审一份设计文档,主 Claude Code 会话却跑去改同一份文档,他只好把它拦下来。他说这种情况是真的挺糟糕,但同时也承认,看几个 agent 之间来回交涉意外地有意思。这是真实多 agent 使用中一个具体的竞态案例。
@FinnTsai88 [Claude Code]
#86
https://x.com/FinnTsai88/status/2085712814686257547
他转述了一位 Bumble 后端工程师应对长会话质量退化的做法:别再往里塞上下文,而是把已经确定的决策写成几百字的规格,然后开一个全新会话,他的总结是 500 token 的规格胜过 5 万 token 的劣化上下文。他还会在放 AI 去调查或探索之前先把边界钉死,比如只看 auth 模块、最多 20 条、返回格式是文件路径加函数名加查询类型。他认同一点:让长会话失控的不是写代码,而是没有边界的探索。
@hiro44_pino [Claude Code]
Claude Code#87
https://x.com/hiro44_pino/status/2085868012406804658
一个建筑和 BIM 的案例:连着一个正在跑的 Revit 模型,配 Autodesk 官方的只读 MCP 服务器,Claude Code 靠一句提示词审完了一个有 34547 个构件、34 条警告的模型,揪出 7 个 Revit 标准明细表没发现的重复构件,全程不用专门插件,也不用把明细表导到 Excel 里人工对。Claude 是把模型树整个遍历了一遍,交叉比对房间、族、图纸、警告、构件数和重复项,而且不是简单罗列问题,而是按对规范合规、安全和设计质量的影响排了优先级。最要紧的一条是 3 樘防火门缺失防火等级参数,这个疏漏可能影响报建、施工、交付和建筑安全。
🗣 用户心声
用户心声

没人搞得清自己的订阅到底能驱动哪些第三方工具,这份不确定性正在实打实地让 Anthropic 少掉用量。@theo 说很多人干脆默认 Claude 订阅在别的 App 里根本用不了,@SaiYalamarty 因为在用 Hermes 时收到一条用量额度警告,整整几周不敢碰 T3 Code,@HeyRealSiri 完全想不明白凭什么这个客户端能用、别的不能用,@TackyTamarin 说用户真正想要的很简单:在第三方工具上挂个巨大的横幅,写清楚支持订阅、不用另付 API 钱。

用量上限现在是把重度用户推向别家生态的头号原因。@tetumemo 做实验从 Max 降到 Pro,瞬间撞墙;@gimhyeo02389130 把十个账号并成六个还是不够用,又买了一个 Codex 席位,就因为它的额度重置干净利落;@0x0funky 怀疑官方悄悄改了什么,他的 prompt cache 现在更容易 miss,一 miss 就飞速烧额度;@sakamoto_582 所在的公司给每个工程师设了月度花费上限,用共享 API key 当溢出阀。

全权限模式正在制造真实的灾难,不是假想的。@doucommunity 眼睁睁看着 agent 把备份创建到错误目录,然后想用 rm -rf 补救自己的错,最后把盘清了;@joho_no_todai 则是模型在 Unix shell 上搞混了路径格式,整个 Windows 用户目录没了。两人的结论一致:这是沙箱问题,不是 prompt 问题。

真实的工作是跨厂商的,工具链却还假装不是。@shao__meng 不爽 Anthropic 又一次绕开开放的 Agent Plugins 标准,还是只认 CLAUDE.md 不认 AGENTS.md;@connect24h 受够了在项目和工具之间反复复制粘贴同一套 prompt 和 skill;@bradmillscan 的诉求很朴素:让 ChatGPT、Claude Code、Hermes 和 Grok Build 在同一个项目上干活,别让他把同一个上下文窗口买四遍。

移动端和远程这条线还只搭了一半。@nathanbenaich 没法从手机启动本地任务,也没法搜自己在 Claude Code 里的历史记录,而这两件事 Codex 都能做;@hiraoka_dx 想在通勤路上保住会话,只能靠禁用休眠加在机器上挂一个自己开的 Zoom 会议;@ChristianSelig 说 Mac 版进步不小,但远程控制还是别扭。
📡 生态产品雷达
生态产品雷达

Codex 依然是被提及最多的搭档,而且领先幅度很大,多数人是让它和 Claude Code 并行跑而不是替换掉,把思考和写码拆给两边。其次是 Cursor 和 OpenClaw,再往下是 Hermes,它是那批想随时换模型又不想重搭环境的人首选的模型无关外壳。Grok Build 今天明显上升,角色是 Claude 解释得让人看不懂时的备胎。模型这边,Kimi K3、DeepSeek V4 Flash、GLM 5.2 和 Qwen 基本都是以编排器背后的干活工的身份出现。MCP 几乎是所有非编程工作流的连接组织——Higgsfield、Parker、RevenueCat 和 Autodesk Revit 都是靠它接进 Claude Code 的。其他反复出现的名字:opencode、Obsidian、GitHub Copilot、Gemini、ChatGPT、Seedance、Suno、n8n、Ollama、Antigravity、Windsurf、Claude Cowork、Playwright、Notion、Paseo、T3 Code、Prime Agent、Supabase 和 pi。
← 上一篇
OSReward:给智能体打分的 AI 裁判集体手软
下一篇 →
Loop 日报: 2026年8月9日
← 返回所有文章

评论

加载中...
>_