超级用户日报: 2026-10-11
周四的 Claude Code 信息流,是这个工具走出编辑器的一天。有人把 Claude Code 流水线对准 NASA 的恒星光变曲线,带回两个地球大小的系外行星候选;有人看着 Claude 自己找到一个几年前埋下的生产环境 bug,发 PR、部署、再给主人留下一条带完整 ssh 命令的待办;一家日本销售公司则从 367 份年报里抽出中期经营计划数字,塞进一封封带独立追踪码的信件。第二条主线是带账本的成本纪律:一份 72 小时的记录显示 1,846 个任务里 Opus 只在 37 次改变了结果;一份逐轮计算说明上下文超过 15 万之后 Sonnet 并不更便宜;350 个 Haiku 子代理只花了九美元;一张五位数的 Cloudflare 账单被追到 Codex 的一次提交。「Sonnet 干活、Haiku 群扫、Opus 当顾问」的三模型组织图被十几个账号当成官方建议转发,一条核查帖翻了文档,没有这套打包方案。视频再次成为非编码的前沿:广告、短片、960 帧动画、研讨会幻灯片全都以代码渲染。OpenClaw 这边,基金会拿下了 .claw 顶级域,而真正的用户在提交一个附带定位修复的 WebSocket bug、报告定时任务提示词泄漏到 Slack,以及读一份 112 个 PR 里大半在处理「升级怎么不把自己弄坏」的补丁说明。
@paraschopra [Claude Code]
https://x.com/paraschopra/status/2108486193419882775
受 Reddit 上有人用 Claude Code 找到行星那条帖子的启发,作者花了一个上午,让 Claude Code 流水线扫 NASA TESS 对附近恒星的低频观测数据。结果冒出两个没有记录的系外行星候选:天鹅座一颗 158 光年外的恒星每 3.56 天变暗 0.02%(约 1.0 倍地球半径),仙女座一颗 134 光年外的每 4.93 天变暗 0.03%(约 1.1 倍地球半径)。两个信号在四个观测年里分别重复了 55 次和 21 次,NASA 和 MIT 两套独立处理都能看到,还通过了「藏起一年用其余年份预测」和「翻转光变曲线造假信号」两道检验。方法和结果交给 Codex 和一个全新的 Claude 复核,保留的 caveat 是附近一对暗弱的食双星可能伪造同样的凹陷,下一步是作为社区 TESS 关注天体提交给 NASA。
@mhmazur [Claude Code]
https://x.com/mhmazur/status/2108661854608203932
Claude Code 在作者的 SaaS 项目上自主干活时,找到了一个几年前引入的小 bug,自己开 PR、自己部署修复,然后去统计生产环境里有多少条记录受到了影响。因为没有生产数据库的写权限,它写了一个 Ruby 脚本来修复这些记录,并在待办列表里加了一条,附上把脚本拷到服务器并执行所需的完整 scp 和 ssh 命令。作者几天后照着跑了一遍。作者由此感慨:自己已经成了 Claude 的瓶颈,而这大概就是接下来一段时间的常态。
@shmily7 [Claude Code]
https://x.com/shmily7/status/2108493941003972778
一篇关于 Cloudflare 天价账单的长复盘,Cloudflare 已经在定位到平台 bug 之后全额退款。项目本身是一次实验:用一个主 agent 加一队协调子 agent,把开发任务拆到 Cloudflare Sandbox 里并发跑,结果没有明显的效率提升,于是搁置了。但它一直部署着,8 月底一次用 Codex 做的提交里写出了一个 Durable Object 无限循环,23 天后被唤醒,开始烧钱。作者之前一直用 Claude Code 配 Fable 系列模型开发,从没出过大事,直到账号用完才换 Codex,几天就出事;作者总结的教训是,配什么智力水平的模型,就得做对应程度的检查。帖子还列出了该配置的消费提醒档位,并指出 Cloudflare 目前没有硬性消费上限。
@vmrmax [Claude Code]
https://x.com/vmrmax/status/2108614496272965948
Grok Bot 现在会在自己的机器上装 Claude Code,用作者已有的 Claude 套餐跑 Opus,于是作者把 72 小时里全部 1,846 个任务都记了账,看 Opus 到底什么时候真的有用。214 个任务被路由到 Opus;把便宜模型在同样 214 个任务上重跑一遍,有 177 次给出同样的决定,也就是 Opus 只在 37 次改变了结果。提案、合同和网站代码占了 72 次 Opus 调用,贡献了 37 次改变里的 25 次;而客户回信送了 92 次给 Opus,85 次回来的只是同一个决定换了更客气的措辞。最好的一次是抓住一条允许客户迟付 60 天且无罚金的合同条款;最糟的一次是 Opus 写出了全年最好的提案,却用了记忆里过时的每小时 120 美元报价。按 API 价格算,这 214 次花了 51.36 美元,全上 Opus 则是 443.04 美元。
@daniel_mac8 [Claude Code]
https://x.com/daniel_mac8/status/2108640573724786970
作者在 Claude Code 里用 bug-hunter 引导命令,把新上线的 Claude Managed Agents 动态工作流对准了一个 1.8 万行的代码库。五分钟跑出 21 个经证实的 bug,花了 8.36 美元,用的是 Claude Max 附赠的 API 额度。机制是一个主 agent 写计划,按阶段派给一大批 agent 并行执行,最后合并结果。作者的结论是:烧 token 很快,但值。
@emooove [Claude Code]
https://x.com/emooove/status/2108369311417192662
一家日本的法人营业支援公司把员工全部升到 Claude Max 套餐,列了一份「让 AI 接手之后变了什么」的清单。Claude 从 367 家市值 5000 亿日元以上的上市公司有价证券报告里抽出中期经营计划的数字,逐封塞进信件,每封信印一个不同的二维码,能追到哪家公司的哪个人打开了。咨询和招聘表单由 AI 做一次判定,消掉了中位数 3.1 天的等待;对「通过 AI 搜索知道我们」的来访者做溯源,发现只有 17% 真正从 AI 直接进来,其余是用 AI 查到公司名再去 Google。栈里还有 Claude 加 Notta 把所有会议变成实时信息源、靠学习发送前修改的 diff 来养回信草稿,以及一套自研的营业管理系统,一键拨号、日报自动化、所有通话记录入库分析。
@LachezarVoynov [Claude Code]
https://x.com/LachezarVoynov/status/2108585587494019562
作者第一次认真尝试把广告剪辑全流程自动化:一条 Suno 歌曲广告,完全由作者在 Claude Code 里搭的内部视频工具剪出来。流程从创意策略师写的 brief 开始,一个 AI 创意总监把故事线拆成 100 多个连贯场景,每个场景用定制提示词交给 Nano Banana 生成、再用 Kling 3.0 动起来,歌由 Suno 自动生成,所有场景的拼接、字幕和剪辑都在 Claude Code 里完成。整条片子经过四轮修改,仍然需要人来把方向;agent 接入了一个评审工具,策略团队留下的评论会立刻变成修改提示词。作者给自己定的目标是下周一之前做到 24 小时内把 100 条创意 brief 变成成片,并断言 DTC 行业里视频剪辑师这个岗位已经变成可选项。
@jun_liang_sf [Claude Code]
https://x.com/jun_liang_sf/status/2108635673624527271
一份定期更新的评测的十月版,问题只有一个:编程 agent 到底能不能用好某个 API。作者让跑 Sonnet 5 的 Claude Code 和跑 GPT-6 Sol 的 Codex 对 36 个类别、120 多个线上生产 API 各做一个真实开发任务,每个 API 一个隔离沙箱,超过 1000 次评测、花费超过 5000 美元。121 个 API 里只有 17 个拿到 80 分以上。各类别的领头者:支付是 Stripe,搜索是 Firecrawl,沙箱是 Daytona,推理是 OpenRouter,认证是 WorkOS 和 Auth0,向量库是 Chroma,语音是 ElevenLabs 和 Deepgram,文档解析是 Reducto,浏览器是 Browserbase,持久工作流是 Prefect。分数综合了可发现性、易用性、工具调用和报错情况,完整结果公开。
@fleyta88 [Claude Code]
https://x.com/fleyta88/status/2108491564435591582
一份成本拆解,论点是多数人把 Opus 5.5 的基准测在了循环里错误的那一段。按新 token 的价格看 Opus 是 Sonnet 的两倍,但缓存的历史才是差距塌缩的地方:每一轮里 Opus 在 2 万上下文时是 1.88 倍,15 万时是 1.49 倍,40 万时只有 1.26 倍,所以长任务 agent 真正该问的是每个模型要多少轮才能做完。在 15 万上下文下,30 轮 Sonnet 约 1.76 美元,20 轮 Opus 约 1.75 美元,守着便宜模型可能多花十轮却是同一张账单。切换本身也有价:到 30 万上下文时再交给 Opus,光重建缓存就要约 1.5 美元,而干净的 2 万上下文交接只要约 0.1 美元,差 15 倍。作者给的循环是:Sonnet 做限定范围的活、每隔几轮做一次真实检查、反复失败作为升级信号、Opus 在难的那条分支上从零开始,只把有用的状态带过去。
@Lniosytest [Claude Code]
https://x.com/Lniosytest/status/2108425085891572002
对当天在 X 上被传成「官方方案」的三模型打法做了一次核查。作者翻了文档:没有这套打包方案,但零件都是真的。Sonnet 5.5 可以当主力写代码,Haiku 5.5 子代理可以翻文件查文档,Opus 5.5 可以当 advisor,在定方案、反复报错和收尾前出手。advisor 一条命令行参数就能开,但还在实验阶段;子代理用 Haiku 得自己配;被反复引用的 340 tok/s 这个数字,作者找不到官方出处。
@dravenip [Claude Code]
https://x.com/dravenip/status/2108665279806869713
一场 90 分钟分享的要点,分享者是 Claude Code 的创建者,讲 Anthropic 内部怎么用 agent,其中几条和大多数人的做法相反。小任务也用最好的模型,理由是便宜模型做错了反而烧更多 token;大多数任务从 plan mode 开始,思路没理顺之前不写代码;给 agent 的是目标和工具,而不是逐步脚本;团队里连财务都在写代码。作者最放不下的是模型那一条:身边所有人都为了省钱切到便宜模型,而对方说那才是昂贵的选择。作者想弄清的问题是,这条规律对快速小改是否也成立,以及每天五个 agent、30 个 PR 里有多少来自配置而不是模型。
@mylifcc [Claude Code]
https://x.com/mylifcc/status/2108498203691659711
一条关于 Claude Code 并发上限的实用笔记。Workflow 的默认并发是 min(16, max(2, 可用核数减 2)),16 核的机器会默认同时开 14 个 workflow agent,可以通过 CLAUDE_CODE_WORKFLOW_MAX_CONCURRENT_AGENTS 在 1 到 256 之间调;普通子代理是另一条限制,默认 20 个,变量是 CLAUDE_CODE_MAX_CONCURRENT_SUBAGENTS。作者自己的数据:跑了 350 个 Haiku 5.5 短途 agent,输入 193,503,496 个 token,花了 9 美元。
@HouseHackerJon [Claude Code]
https://x.com/HouseHackerJon/status/2108368914669592637
作者回到 Claude Code,用一个长期维护的技能测试 Opus 5.5、Sonnet 5.5 和 Haiku 5.5,Opus 当编排者,Haiku 当工人。Haiku 在开发实例上跑了将近五个小时的简单但繁琐的活,代码质量确实不错,只用掉了每周额度的大约 5% 到 10%。抱怨集中在模型之外:用过 Grok Bot 和 Muse 这类个人 agent 之后,那边的密钥存储体验和在 Claude Code 里折腾环境变量相比是天壤之别;即便给了 API key 和所有能给的连接器,作者也几乎没法让 Claude Code 把应用部署到 Cloudflare。更大的判断是,传统编程 harness 像个只会接单、卡住就汇报的服务员,而个人 agent 只在真正受阻或完工时才来找人。
@ysbilgin [Claude Code]
https://x.com/ysbilgin/status/2108475281543442684
作者长期只用 Claude Code,最近加上了 Codex,现在让两者互相检查对方的工作。它们擅长的东西不同,所以常常一个抓到另一个漏掉的 bug 或边界情况,再让对方去修。没有任何特殊的 harness 或花哨工具:作者只是告诉它们通过命令行互相下提示词,并指定各自用哪个模型、什么努力程度。
@ai_fudosan_ai [Claude Code]
https://x.com/ai_fudosan_ai/status/2108368664760397868
一位日本开发者在 agmsg 之上跑起了一支本地与云端、Claude 与 Codex 混编的 agent 团队,agmsg 是一个只靠 bash 和 SQLite 的消息层,让不同种类的 agent 通过同一个地方互发消息。作者的扩展加了收信确认、重发、长文分段和回复关联,现在本地的 Codex agent 发一条消息就能唤醒云端的 Claude Code 会话。演示的循环是:云端 Claude 开 PR,Codex 审查并要求修改,云端 Claude 改完重提,Codex 再审通过,PR 合并,全程不需要人当传话筒。云端到本地走一个 Discord 中继频道,由本地进程写回 agmsg;整套东西跑在一台 8 GB 内存的电脑上,因为重活都扔到了云端。
@kristiandaaniel [Claude Code]
https://x.com/kristiandaaniel/status/2108684883996610761
作者在 T3 Code 之上搭了一个主 agent 工作流,用自己的几份订阅协调 Claude Code 和 Codex。只需一次批准就能启动,之后每个任务各开一个线程和一个 git worktree,暂停是按额度感知的,会在撞到套餐上限之前停下,合并前会先做验证。作者公开了实际运行的过程。
@onenewbite [Claude Code]
https://x.com/onenewbite/status/2108671448667865342
作者对 Claude Code Projects 不太满意,自己做了一个本地版,并说明了原因。托管版有三个问题:主线程更像你和子线程之间的传话员而不是大脑,结果你还是得盯着子线程看;已有的本地项目很难迁进去,因为托管项目有自己的记忆,主线程又没有你的本地记忆;很多项目在云端跑根本不现实。本地版的思路是「战役」而不是「长期项目」:开一个战役,做完一组功能就结束,再开下一个,这样主线程始终专注、以策略讨论为主。作者的结论是 Claude Code 已经具备了自己搭这套东西所需的全部基础设施。
@astralwave [Claude Code]
https://x.com/astralwave/status/2108510924646896070
一位喜欢协调者模式的人写的务实批评。这个模式比侧边栏里的固定线程或者编排器更「agent 原生」,但体验还很粗糙:层层传递的权限、待定决策和阻塞点,仍然逼着作者钻进子线程去解锁。协调者本身的能力被莫名砍掉了一截,和直接在 Claude Code、Codex 或 Cursor 里开的裸会话相比:Claude Projects 的协调者没有浏览器、不能用 MCP;Dot 不能跑技能、看不到 AGENTS.md、不能用结构化提问工具,也碰不到本地电脑和浏览器;Grok Bot 不读仓库里的技能和 AGENTS.md。被派生的线程同样受限:在 Claude Projects 里,项目线程内不能手动调用技能,也看不到某个线程读过哪些技能。
@arnestrickmann [Claude Code]
https://x.com/arnestrickmann/status/2108674246427979930
作者注意到没人做过一个统一工具,用来托管 Muse、Instinct、Grok Bot、Interaction 这类个人 agent 对第三方服务的全部连接,于是和一位合作者花了几天做了一个,开源且容易自托管。核心主张是这一层应该是独立产品:认证和 agent 分开,agent 做的每件事都能审计,权限可以细到动作级,而且在不同 agent 应用之间切换变得很轻松。立竿见影的结果是,作者的 Instinct 现在拥有和笔记本上的 Claude Code 完全相同的工具。
@trevin [Claude Code]
https://x.com/trevin/status/2108356625220391150
几周前低调上线的一个小项目,解决的是一件具体的烦心事:在 agent 之间共享文档和文件、让 agent 生成一份能转给另一个人的文档,不应该需要为 markdown、HTML、原型和压缩包分别找服务,也不应该被绑在某一家厂商或 harness 上。作者每天都在用,技能装在 Grok Bot、Muse、Instinct、Claude Code 和 ChatGPT Dot 里。它自托管在你自己的 Cloudflare 账号里,免费档也能跑。
@bart_walker [OpenClaw]
https://x.com/bart_walker/status/2108374310301642807
一位同时在协调 Hermes、Codex 和 OpenClaw、很快还要加上 Grok Bot 的用户,问别人用什么机制让它们保持同步。作者自己摸索出的最好办法是一个共享的文件夹结构,里面放着所有进行中项目的状态清单,每个任务开始时读一遍、结束时更新一遍。这是对一个跨厂商协调问题的纯文件式回答,而没有哪家 agent 厂商替竞争对手解决过它。
@EdgeDimi [OpenClaw]
https://x.com/EdgeDimi/status/2108528657606086729
一份写给 OpenClaw 维护者的详细 bug 报告,关于 2026.9.8 运行时在 ChatGPT 订阅通道上的一个故障:当 Responses WebSocket 在收到终止事件之前以 1000 码关闭,整轮对话直接失败且不会恢复。在生产网关上的表现是:一个定时自动化在约 100 秒后失败、既不重试也不回退;一次在线对话在工具已经写入业务记录之后失败。作者顺着代码包追了路径:1000 不在可重试的关闭码集合里,于是被归为不可重试的终止错误;一个已开的 PR 只改一行,把 1000 加进可重试集合,同样的关闭就会被归为瞬时传输错误,走进已有的重试逻辑。后续补充说,打上补丁的 9.8 网关上出现过两次自然的 1000 关闭,都通过原生重试恢复,没有重复的工具调用。
@_bashoh [OpenClaw]
https://x.com/_bashoh/status/2108702773889900830
一条简短但扎人的报告,直接 @ 了 OpenClaw 的作者:自己的 OpenClaw 正在把定时任务的提示词泄漏到 Slack 里,问有什么建议。这条帖子有超过 2.2 万次浏览,说明有多少人在通过聊天频道跑定时任务。
@tvytlx [OpenClaw]
https://x.com/tvytlx/status/2108592072148017556
作者把 OpenClaw 2026.9.9 的发布说明从头读了一遍,公告标题写的是支持 GPT-6.1 Sol 和 Haiku 5.5。新模型那部分只有几行;篇幅最长的一节是「更新与维护」,二十来条,几乎都在处理同一件事,升级失败了怎么办:数据库升到一半怎么回滚、回滚之后还能不能再升、FUSE 盘上的备份因为文件时间变了恢复失败、Windows 上第一次 Doctor 检查没过整个更新被回滚、Docker 在老 Linux 上对一个没变过的数据库反复拒绝卡在升级循环里。还有两个很有 agent 味的 bug:iMessage 里答案写好了却没发出去;一个旧的定时任务到点超时,顺手把同一会话里更新的对话停了、还收走了它的工具权限。有用的细节:haiku 别名现在默认指向 Haiku 5.5 并开启自适应思考,提示词超过 10 万 token 会涨价,重启后被中断的一次性定时任务可能重跑并发重复消息。作者决定先不升,等 9.10。
@0xLalice [OpenClaw]
https://x.com/0xLalice/status/2108386043632533831
一位法国用户把 OpenClaw 跑在一台 VPS 上(配 GPT),每天给它几项各不相同的任务,说它应付得很好。配置方法:本地装好 Codex 或 Claude Code,租一台每月 20 欧左右的 VPS,把 VPS 的 ssh 密钥交给本地 agent,让它自己去下载、安装、配置 OpenClaw。结果就是一个自托管、全天在线、有自己机器的 agent,在任何设备上通过 Discord 或 Telegram 都能找到它,然后再接上邮件、GitHub、WordPress 和你的服务器,给它一个人格,并告诉它这台 VPS 是它自己的责任。作者的说法是,完全不懂电脑的业余爱好者十分钟就能搞定。
@fagamericano [OpenClaw]
https://x.com/fagamericano/status/2108618930709565480
一项刚完成的 OpenClaw 研究任务:一个认知引擎,把作者的 Maestro 配置升级成 Postgres 支撑的记忆、语义搜索和覆盖 500 多个网关的 RAG。明确要告别的是把记忆存在 markdown 文件里。取而代之的是从 Notion、ClickUp、Slack 和会议纪要来的摄取流水线、在向量化入口做安全检查、按个人、频道、组织和 agent 四级正确划分作用域,以及通过原生 SPIFFE 身份网格调用来做检索。
@tankxu [OpenClaw]
https://x.com/tankxu/status/2108608546732708037
一位中文用户用 GrokBot 跑通了 AI 生成个性化新闻的全流程,新闻质量不错,还克隆了女儿的声音,口播效果有真人感。年初用 OpenClaw 试过一次并不满意;经过大半年模型和 agent 的升级,现在的产出质量让作者觉得 token 烧得值。还给每日新闻做了一个配套网站,准备接定制新闻的活。
@roger9949 [Claude Code]
https://x.com/roger9949/status/2108476338550251735
一位知名加密货币创始人长篇访谈的要点,主题是把日常生活交给 Claude Code。饭前饭后各拍一张让 Claude 算热量,Oura Ring 的睡眠数据丢给 Claude Code 出日报,教练拍下每组动作记重量和组数,所有东西存成本地 markdown,换一个 AI 明天也能直接接手;原话是「90% 的时间让 AI 开,我 10% 的时间调一下」。同一个问题问三家模型,取中间的答案。其他线索:数学、天文、生物制药这些数据驱动的学科,按 AI 列的清单做主动体检,crypto 作为 AI 的支付层按 API 调用次数结算,以及利用各国 AI 订阅价差做 token 中转套利。
@jurlycat [Claude Code]
https://x.com/jurlycat/status/2108405420721377550
将近十年里,Ben 主要的交流方式是用转头表示是或否。没有编程背景的哥哥用包括 Claude Code 在内的 AI 工具,做了一个 Ben 可以用简单开关控制的中枢,现在 Ben 能发短信、选电影、上网和玩游戏,对话时 Claude Haiku 会给出可选的回复。Ben 自己选的第一部电影是蜘蛛侠。这套工具免费且开源。
@METANA_flow [Claude Code]
https://x.com/METANA_flow/status/2108505432461291696
一家日本网页制作公司自己的英文邮件订阅表单被 bot 攻击:一天夜里约 80 分钟内 65 条注册,全部来自海外数据中心;因为注册会自动回信,公司域名向陌生人的 Gmail 发了约 60 封邮件,整个域名都可能被标成垃圾邮件。解决只用了 AI 和 30 分钟。这个网站从表单接收到邮件发送都是用 Claude Code 重写的自有系统,不用等外部插件更新:agent 读了代码、当场改写,当晚上线。现在没通过 bot 检查的注册只保存不回信,之后对 bot 的发信为零,GA4 里混入的假流量(某些天超过七成)也被排除。作者给出的建议是,没法用 AI 碰自家网站的公司应该放弃 WordPress,换托管型 SaaS。
@denk_tweets [Claude Code]
https://x.com/denk_tweets/status/2108537564680318984
一位经营着年经常性收入 3500 万美元、130 名员工的创业公司创始人,更新了自己的 AI 工具栈。Claude 始终开在桌面上,通过 MCP 连接器接入文档、Slack、代码、数据库、财务、收件箱和日历;Fellow 参加每场会议;Unblocked 住在 Slack 里掌握全局;Linear 工单从 Slack 创建,分析走 Claude;Claude 技能交叉比对 100 多个仪表盘、数据库和 Slack 来发现风险和机会;定时任务提醒员工提交每周优先级;Claude Code 加 Figma Slides 负责做幻灯片。语音输入用 Wispr Flow,Muse 正在试用于招聘寻源和差旅。作者问读者还缺什么。
@itwanger [Claude Code]
https://x.com/itwanger/status/2108438374747099540
一位中文创作者讲 Agent 的飞书知识库上线两个月后访问人数过了 1000,内容覆盖 Agent 基础、上下文与记忆、Harness、RAG、Claude Code、Codex、MCP 和模型微调。生产流程:脚本用 Opus 5.5 写(从 4.6 升级而来,作者说之前的版本文本能力不行),视频制作一开始用火山方舟的 Coding plan,后来由 Astra 接手,现在主要靠 Opus 5.5,配图用 GPT-6.1 Sol。视频同步发在抖音、视频号、小红书、B 站,其中抖音对 AI 视频的流量和盈利扶持最大。知识库免费开源。
@cyrilXBT [Claude Code]
https://x.com/cyrilXBT/status/2108448665568498153
一个五步做出「自己写自己的维基」的方法。建一个 Obsidian 库,在 Claude Code 里打开它,让 Claude 建两个文件夹(sources 放你扔进去的任何材料,wiki 放 Claude 写并互相链接的页面),再让它写一份带规则的 CLAUDE.md,然后扔进一篇文章、一个 PDF 或一份文字稿,输入「把这个加进维基」。Claude 读完材料、写好页面,并把它们链接到库里已有的所有内容,之后你可以跨整个库提问。
@_nogu66 [Claude Code]
https://x.com/_nogu66/status/2108367540808466550
Max 套餐每月附赠的 Claude API 额度,被作者拿来做了一个个人实验:每天从自己的网站生成一个 AI 主页,替换 Chrome 的新标签页,每次大约 0.75 美元。作者的想法是,与其让额度剩下,不如当成个人 agent 的燃料;下一步是找更多在 Claude Code 会话之外运行的用途。
@cinkotweets [Claude Code]
https://x.com/cinkotweets/status/2108655933802807694
用 HyperFrames Studio 的 24 小时,这是 HeyGen 新出的免费编辑器,基于此前主要在 Claude Code 里驱动的 HyperFrames 引擎。作者没打开 Premiere 或 Final Cut,就剪出了一期带片头、字幕和档案素材的 25 分钟播客,把一张电子表格变成了视频,还做了一堆应用发布视频,做法只是在屏幕上画圈、在文本框里打字、告诉 AI 要改什么。时间轴、聊天框和画笔取代了手写时间戳,作者说再也回不去了。诚实的部分:只给一句话就会得到垃圾;这是一个第一天的产品,有鬼影帧、时间轴导航也笨;更新一天好几次;需要 Claude、Codex 或 Grok 的订阅,外加一台 Mac 或 Linux 机器。
@HBCoop_ [Claude Code]
https://x.com/HBCoop_/status/2108587885763211346
一套做短视频故事的流程:作者把想法说给 Claude Code,它直接在 Invideo 的编辑器里干活,作者负责导演。这条叫 Open Sky 的片子从一张角色图和五个镜头的大纲开始;Claude 先生成便宜的 480p 草稿,逐帧检查每个镜头,只把作者认可的那些做成成片,省下了在废镜头上花 1080p 的钱。剪辑、镜头之间的调色匹配、胶片质感和竖版 Reels 版本都在免费编辑器里完成,所以迭代除了生成本身不花钱。过程并不是甩手不管:第一遍调色淡到看不出来,加重后角色头发变成了紫色,颗粒也太闹,但每次修正只需作者一句话加重新看一眼画面,而不是在面板里翻一个小时。
@cybermynd [Claude Code]
https://x.com/cybermynd/status/2108616877417377876
一部用 Claude Code 加 Krea MCP 做出来的五分钟短片。Claude 写剧本、通过 Krea 生成每一个镜头、剪辑、配乐并混音。片名叫 System Memory,讲一个 AI 记起一个它从未拥有过的家。
@insomnia_vip [Claude Code]
https://x.com/insomnia_vip/status/2108619162746585582
在一个 Claude Code 会话里,Claude 从一个文件渲染出 960 帧,然后终端检查动画循环是否正确。六项检查通过了,但首尾帧没有对齐,留下一个肉眼可见的跳动;Claude 改了一个数字,重新渲染,一次就修好了。整条流程全自动:从代码渲染帧、六项自动检查、发现并修正错误、重新渲染、所有检查通过才停。没有 After Effects,没有视频模型,只有 Claude、一个终端和一套能检查自己工作的系统。
@whaleyxbt [Claude Code]
https://x.com/whaleyxbt/status/2108469154986557886
在 Anthropic 发布 Claude Motion 九天前,作者开源了一个给 Claude Code 用的同类动效工具:Claude 把整条视频写成代码,自己检查帧、修掉不对的地方,自己做声音、不用素材库。作者那条 44.1 万次观看的爬虫视频就是用它做的。它前一天登上了一个榜单的第一名,免费,在 Claude Code 里直接跑。
@orenmeetsworld [Claude Code]
https://x.com/orenmeetsworld/status/2108643262332612912
给在 Codex 或 Claude Code 里大量剪视频的人的两条建议。第一,让 agent 做一个界面,可以按时间戳添加审片笔记,新视频自动进入、通过的视频自动移出。第二,在你看之前,先让 Sol 6.1 或 Fable 审第一版剪辑并给出反馈、合并修改,这样你看到的已经是改过一轮的版本。
@1000man_niki [Claude Code]
https://x.com/1000man_niki/status/2108518839768236401
一篇自掏腰包的付费评测,对象是一个 1,980 日元的技能,用来把长视频切成竖版短片,在 Claude Code 或 Codex 里运行。作者拿一段 24 分钟的 4K 对谈,做出三条约 60 秒的竖版视频,总耗时约 96 分钟,其中自己动手的时间不到五分钟,其余都在等 AI。安装八分钟,没有报错。初版需要修正:字幕出得太早,两位说话者的字幕颜色相同;第二版花了 34 分钟,第三版加上音效和背景音乐只用了四分半。看点选取平平,但跟着说话人自动切换画面这一步做得很好;两处错字和一些别扭的字幕断句,意味着初稿还不能直接发企业账号,但拿来复活个人存档视频足够。字幕时间和说话人设置按视频保存,配色、音量、淡入淡出可以存成共用默认值,但这次的修改不会被自动学习。
@gkxspace [Claude Code]
https://x.com/gkxspace/status/2108545947231784990
刷屏的代码动画视频,用阶跃星辰的 Step 5 Preview 也能跑出来,价格只有 Opus 5.5 的八分之一,这是一位中文用户在 CC Switch 里把 Claude Code 的模型切过去、配开源技能跑了一批 demo 之后的结论。成果包括:20 秒走完 24 小时的 3D 微缩小镇,字砸下来、被风吹散、最后排成竖版再盖章的中文动态排版,一个形状从按钮变成播放器、开关、图表的单形状界面动效,以及把跳舞的人抠进一本跟着舞步翻页的杂志。做法是先去 awesome-opus5-5-videos 合集找好案例,让 AI 把提示词改细(时长、节拍、每个镜头画什么、不要什么、怎么验收),再切模型开跑;一条内容可以自己跑几个小时、调用两百多次工具,写代码、合成音乐、渲染、检查一条龙。作者的判断是,代码做视频在品牌动效、产品演示和批量短视频复刻上已经具备商用价值,之前卡住的是 Claude 的成本。
@Saccc_c [Claude Code]
https://x.com/Saccc_c/status/2108546155634434194
一个能旋转、能交互的 3D 小岛,由接入 Claude Code 的 Step 5 Preview 对照参考图做出来,作者说效果和 Opus 5.5 不分上下、价格更便宜。整个网站用 Three.js 实时渲染,海水、岩石等场景元素都由代码生成。流程很简单:先准备一张生成好的参考图,把网页需求和想要的交互描述清楚,再让模型对照参考图反复检查调整,逐步打磨,需要一点耐心。Step 5 Preview 已上 OpenRouter,支持 1M 上下文,也接入了 Kilo Code、Cline、Hermes Agent 和 OpenCode。
@gengdaJ [Claude Code]
https://x.com/gengdaJ/status/2108549740971311226
回老家看到小朋友玩《保卫萝卜》,作者决定干脆自己造一个,顺便在 Claude Code 里通过 CC Switch 对比两个国产模型:Step 5 Preview 和 DeepSeek 4.1 Flash。为了隔离模型本身的能力,提示词里禁止使用任何 Skill、记忆和文档,只允许联网搜索,要求一次性生成完整游戏。两边都做出了完整的游戏:关卡、闯关升级解锁、多种守卫塔、精致的界面;作者判断完整度不相上下,易玩性和界面精美程度上 Step 5 更胜一筹。结尾是一点感慨:以前玩游戏是纯玩,现在玩游戏会去想怎么做、怎么加广告、怎么让用户充值。
@yhslgg [Claude Code]
https://x.com/yhslgg/status/2108442753587728816
一份拆解:一个人如何在一个假期里做出能在浏览器里玩的 GTA 老奶奶游戏,仓库已开源。资产:Tripo 出设定图并一键转 3D,Smart Mesh 出四边面,上纹理,Mixamo 绑骨,再用 Text-to-Motion 写动作,阿公弹吉他就是一行字出来的。代码:约 8000 行,全是 Claude Code 在对话里写的,Three.js 渲染,还用 Playwright 让每一关自己从头打到尾当测试。评论者最看重的是收尾:文生 3D 的模型高达约 200 万三角面,用 Blender 无头模式批量减面、再压贴图,才塞得进浏览器。结论是一句话:生成从来不是最难的,让它跑得动才难。
@0xMfox [Claude Code]
https://x.com/0xMfox/status/2108645144794702099
一张手机照片变成了带活动部件的 3D 模型,由 Claude Code 纯用代码构建,每一次渲染都和照片比对,直到对上为止。试了四件桌上的东西:盖子能沿铰链打开的耳机盒、刀刃能折出来的小折刀、两个关节都能弯的台灯,以及一只毛绒狗。规律是硬边缘做得精确,毛发会风格化,背面靠猜,而且 agent 会告诉你哪几面是猜的;四件里有三件已经能在作者的测试页上转起来。分享的提示词要求:写代码前先列出所有能辨认的细节,分多轮构建且颜色取自照片像素而不是记忆,每个该动的部件单独设旋转轴和缓慢的待机动画,每一轮都把渲染放在照片旁边比对,不对上不往下走。
@sandislonjsak [Claude Code]
https://x.com/sandislonjsak/status/2108521597669630102
Based Garden 的第一次亮相:一个花园规划器,输入你的阳台、露台或后院,它算出整个季节里每个位置每天能晒到多少小时直射阳光,把头顶的屋檐、墙、栅栏和角落里的树的阴影都算进去,再告诉你哪里能种什么。起点是作者自己在萨格勒布 9 米乘 1.7 米、带屋檐的露台:玻璃栏杆边每天 7.3 小时阳光,实心墙后的角落只有 0.8 小时,肉眼根本看不出这种差别。现在已经有可以切换到一年中任意一天的 3D 视图、随季节生长和凋零的植物、按位置给的作物建议和四个示例空间。它用 Claude Code 加 Incantations 技能搭建:一个模式在写代码之前先想清楚给谁用、怎么收费,设计模式给出三个可用的版式供挑选,工程模式搭引擎和落地页,每个决定都写进仓库而不是丢在聊天里。
@masahirochaen [Claude Code]
https://x.com/masahirochaen/status/2108525415971352923
一位日本用户说,现在 Claude Code 一次就能做出这种水准的研讨会资料,工作轻松了太多。100 页以上也没问题,带动画,还能像 PowerPoint 一样编辑。
@dotey [Claude Code]
https://x.com/dotey/status/2108574361443504625
一个用 Claude Design 做原型时省 token 的技巧:先在 Claude 网站上把设计稿做出一个完整版本,迭代到满意,导出为 HTML 下载到本地,之后只让 Claude Code 把它当作本地网页来更新维护,不再依赖 Claude Design 网站。作者分享了一个用这种方式做的原型仓库,两条 npm 命令就能跑起来。
@dotey [Claude Code]
https://x.com/dotey/status/2108669008283402744
建议给 Claude Code 的自动压缩上下文长度设一个上限:400k 左右比较合理,作者自己设的是 300k,用 autocompact 斜杠命令就能设。作者以前建议过通过 settings.json 里的变量禁用 1M 上下文,现在没必要了,请删掉,否则最多只能到 200k。
@Jhaddix [Claude Code]
https://x.com/Jhaddix/status/2108637514550657475
一条关于 agent harness 里技能的实用发现。多数 harness(包括 Claude Code)会在启动时加载技能的描述,但即便技能被明确调用,agent 通常也只读前 150 行来判断怎么用它。写在 150 行之后的强制步骤、Python 脚本或模板引用,可能完全被漏掉。作者的办法是在前 150 行放一张技能动作的目录,标明哪些是必须执行的,并写明一旦技能被调用就必须读完整个技能和全部引用;作者的团队现在用 markdown 清单来做这件事。
@ClaudeCode_UT [Claude Code]
https://x.com/ClaudeCode_UT/status/2108450345341079874
给那些让 Claude Code「只检查一下」却被擅自改了代码的人:把 Read 放进 allowedTools 参数,并不等于「只允许 Read」。那个参数列的是可以不经确认就使用的工具;要限制可用的标准工具本身,是另一个参数 tools,MCP 的工具又要单独指定。把这几处分开设置,就能把评审交给它而不交出编辑工具;启动命令和各项设置的含义放在回复里。
@sebuzdugan [Claude Code]
https://x.com/sebuzdugan/status/2108431867188052210
百日提示词系列的第 23 天:把每一条 Claude Code 任务提示词都包上 XML 标签,文字不变,每段一个标签,再和不加标签的版本对比。结果是两边都通过 12 个任务里的 8 个,时间和成本差距在 3% 以内。加了标签的运行从来没有提到过标签,两边弄坏的是同一个参数,失败方式也一样。
@morganlinton [Claude Code]
https://x.com/morganlinton/status/2108355804537786840
作者用自己的 Frontier v4 评测集给 Sonnet 5.5 跑了一次独立基准,所有 Claude 模型在 Claude Code 里跑,OpenAI 模型在 Codex 里跑。Opus 5.5 和 Sonnet 5.5 的得分都高于 GPT-6.1 Sol,但差得不多,而 Sol 的性价比高出一大截。Opus 5.5 在中高努力度下明显领先,值得把最难的任务交给它;但对简单和中等难度的活,作者看不出有什么理由不用 Sol,因为单任务成本低得离谱。作者猜测 Codex 那边在 token 效率上的优化可能是差距的一部分原因,所有数据和运行记录都公开。
@TokenGremlin [Claude Code]
https://x.com/TokenGremlin/status/2108568524197179500
作者把自己的测量、第三方测试和 OpenAI、Anthropic 官方的加速倍数放在一起,比较的是订阅速度而不是 API。GPT-6.1 Sol 以前每秒约 22 个 token,OpenAI 先提了 50%,后来推出 Ultrafast,现在实测约每秒 249 个。Opus 5.5 在 Claude Code 里直接约每秒 97 个,开 fast 模式的 2.5 倍加速后约 242.5 个。结论是,你要花每月 500 美元才能让 Sol 达到 Opus 5.5 Fast 在 100 美元 Anthropic 订阅上的速度。
@starmexxx [Claude Code]
https://x.com/starmexxx/status/2108513656686223833
一台 1,200 美元的二手 AMD 主机放在桌下,三个月就靠替掉三份订阅回本。第一个月,gpt-oss-120b 在 Ryzen AI Halo 上跑到每秒约 30 个 token,200 美元的 ChatGPT Pro 当晚取消。第二个月,Claude Code 指向本地运行的 Qwen3 Coder 30B,用法和以前一模一样,只是模型住在桌子底下,200 美元的 Claude Max 20x 退掉。第三个月,GLM 4.5 Air 接管长时间研究会话,300 美元的 SuperGrok Heavy 退掉。算账:第三个月省下 1,300 美元,第十二个月约 7,600 美元,电费每月约 10 美元;最难的代码仍由 Opus 5.5 写,每月 AI 开支从约 700 美元降到电费。
@tvytlx [Claude Code]
https://x.com/tvytlx/status/2108638124964532517
最便宜的模型开始给最贵的模型派活了。一位 Reddit 用户做了个叫 effortless 的 Claude Code 插件,起因是老忘了切模型,所有任务都开最高档跑。每条提示词发出去之前,先让 Haiku 5.5 看一眼最近的对话,判断这活该给 Haiku、Sonnet 还是 Opus、努力度开多少,简单的活丢给便宜模型,对话本身的模型不动。它知道什么时候不该换:做到一半不换,因为它读了上下文,知道你还在同一件事里。Opus 和 Sonnet 调努力度不会重建缓存,可以放心调;Fable 上调努力度会重建缓存,切一次花的比省的多,所以在 Fable 上自动切换直接关掉。它还会提醒缓存凉了、对话太臃肿、该开新窗口交接了。作者说估出来的努力度几乎每次都和自己会选的一样;免费,MIT 开源,代码大部分是 Claude 写的。
@rishit30g [Claude Code]
https://x.com/rishit30g/status/2108484818979955000
usage-band 是一个把用量显示在输入框正上方的 Claude Code mod:当前模型、从绿到黄到红的上下文窗口条、5 小时套餐上限和重置时间、如果按当前速度会先撞限额的警告、从真实 API 数据读出的提示词缓存倒计时和命中率,以及按 API 价格算的会话成本。一个「总结并新开」按钮会让 Haiku 写一份交接摘要、清空会话、再把摘要放进输入框。作者拿它和状态栏对比:状态栏是一个打印文本的脚本,而 mod 运行在 Claude Code 内部,可以有可点击的按钮,缓存倒计时每秒跳动,用量、限额和成本都从插件钩子 API 读取,没有写死的价格表。终端和桌面应用的 Code 标签页都能用,开源,用 Opus 5.5 做的。
@byCanen [Claude Code]
https://x.com/byCanen/status/2108552591722389781
Claude Code 做网页检查时经常要读整张截图,一张 2000 像素的大图可能花掉几千个图片 token,截图一多,额度和上下文都耗得快。免费的 image-diet mod 会在 Claude 读取图片以及读取部分 MCP 图片结果之前,先把长边压到 1280 像素再交给模型。作者的小规模截图测试里,图片 token 大约少了 59%,回答没有变差;这个数字因截图而异。它刻意跳过需要按截图坐标点击的 computer-use 工具,因为缩小后坐标会错位;要看细节时还可以保留原尺寸版本。
@criscxuan [Claude Code]
https://x.com/criscxuan/status/2108533757070250007
对 Magpie 的一次细读,它的核心价值是让你独立选择「用哪个 Agent」和「用哪个模型」,适合同时用多种编程工具、模型供应商和订阅的人。你可以保留 Claude Code 的工作方式但让它调 Kimi,让 Codex 调 DeepSeek,多个账号额度用完后自动接替,全部收进一个本地网关,官方列出 45 种以上 Agent,提供 CLI、TUI、Web 界面和 Docker 部署。代码里最出色的是协议转换和订阅桥接:一个统一的内部请求结构承接消息、图片、工具调用、工具结果和推理,把 OpenAI Chat、Responses、Anthropic Messages 和 Gemini 连起来;接 Claude 订阅时,Magpie 会驱动本机真实的 claude 程序,把原 Agent 的工具暴露成 MCP 工具,Claude 发起工具调用后执行仍交回原 Agent,再把结果送回同一个 Claude Code 进程,并管理进程复用和会话恢复以保留上下文与缓存。路由策略照顾了订阅额度的特点:按顺序、轮换、优先消耗少的账号或优先用快要重置的额度,并保留会话与账号的关联;可选的意图路由让一个小模型在新一轮开始时判断任务再安排模型。MIT 许可。
@AlexZio00 [Claude Code]
https://x.com/AlexZio00/status/2108435105769459984
sovereign-skills 6.5.14 的发布说明,这是二十个开源 Claude Code 技能的合集,这次没有新技能,而是一长串日常使用里发现的修复。11 个测试文件一直在「静默通过」:它们用自己的运行器、没有测试函数,pytest 收集到零个测试就干净退出;现在 11 个全部真的在跑。session-start 在首次会话没有交接文件时会中止整个运行,现在只跳过那一步;pre-push 把「密钥扫描器缺失」当成「跳过检查」,现在会直接阻止推送;一个只读的审计技能因为没封掉 Bash,仍能通过 shell 重定向写文件;setup 替换配置文件时没有备份,现在会先做 .bak 并确认。另有一串自相矛盾的规则被清理,比如一个从未用过的技能也能在健康评分里显示健康,以及快速模式打印了它本不该给出的「能否发布」裁决。
@slash1sol [Claude Code]
https://x.com/slash1sol/status/2108497556770554041
四位研究者读完了 11 个编程 agent 的源码,Claude Code、Codex CLI、Gemini CLI 外加 8 个,作者把整个品类压成一句:agent 等于模型加 harness。七个子系统,每个 agent 都要对每一个表态;11 个里没有一个引入 agent 框架;没有一个用向量嵌入来检索代码。作者接着把同样七行套到自己的非编码 agent 上,一个交易 Polymarket 上 BTC 和 ETH 涨跌市场的 agent:循环、工具和安全上限花了一个周末,上下文那一行花了一个月,因为模型需要它碰到的每一个市场的历史二级订单簿,而没有任何模型脑子里装着这个。那一行现在由一个专门的历史数据源提供,每一个 tick、每一个市场,可回放。
@Mikadzyki_NFT [Claude Code]
https://x.com/Mikadzyki_NFT/status/2108490740611399973
一篇斯坦福论文报告,去掉监督者之后 Claude Code 的 agent 能跑快约一倍。通常的做法是一个协调者派活、收结果,帮手干活时它闲着,而帮手之间互相看不到对方的发现。DeLM 是一层架在 Codex 和 Claude Code 之上、没有中心枢纽的东西:agent 共享同一个上下文和任务队列,自己去领开放的任务,立刻发布发现,并能看到哪些路子已经失败过。一个例子里,用原生子代理时主模型 73% 的时间在等待,任务耗时 162 分钟,DeLM 只用了 29 分钟;最好情况下相对标准 Claude Code 快 2.49 倍,解题比例高 19.2 个百分点,ProgramBench 120 分钟内通过率高 19.9 个百分点。样本很小,快不一定省钱,四个 agent 的运行比基线更贵;代码、720 条轨迹和两个工具的插件都已开源。
@theshawwn [Claude Code]
https://x.com/theshawwn/status/2108633474273800662
作者让 Claude Code 把本次会话的聊天做成文字记录,被拒绝;问会话的 .json 文件在磁盘上的位置,它说不能告诉你;转而问 Claude Desktop,后者回答了。加了一条权限规则之后再让 Claude Code 拷贝这些文件,它还是说不。作者不知道 Anthropic 打算做什么,但觉得这有点过头了。
@wey_gu [Claude Code]
https://x.com/wey_gu/status/2108493386739228818
十一期间作者的一个 Claude Code 账号被封了,而作者之前一直认为只要保持出口 IP 干净就不会有问题。同一批里一位在北美的朋友也被封了号。
@superdoccimo [Claude Code]
https://x.com/superdoccimo/status/2108534990216761493
一篇关于 bigarrow 的日文解读,这个工具一小时内冲上了 Hacker News 第一:一个 macOS 命令行工具加 agent 技能,在所有窗口最前面画一个巨大的箭头、圆圈、方框或文字牌,让 AI agent 指出人该点哪里。用 agent 最烦的瞬间就是被告知「这一步你自己点」,比如 macOS 权限对话框、OAuth 同意页、二步验证、通行密钥、支付,然后你得自己找是哪个窗口的哪个按钮。点击会穿透,不抢焦点,画图不需要权限,工具本身从不点击、输入或截屏,它只负责指,可以按坐标、矩形、鼠标位置、窗口标题或界面元素的标签来指。一条命令就能装进 Claude Code 和 Codex。写作时它有 47 颗星、76 次提交、9 个版本,仅支持 Mac。
@secondstateinc [Claude Code]
https://x.com/secondstateinc/status/2108578028439928886
VibeBuddy 开源了:一个基于 ESP32-S3 的桌面小盒子,盯着 Claude Code、Codex 和 GitHub Actions,当某个 agent 需要你时会出声。它带 Rust 固件、Mac 和 Linux 应用、钩子和一个开放协议,一条 curl 就能往它的屏幕上放一张卡片。
@thecsguy [Claude Code]
https://x.com/thecsguy/status/2108412748904427799
Grok Bot 现在从手机上驱动作者 Mac 上的 Claude Code 会话。当天的工作是继续开发一个移动端视频剪辑应用,在作者自己的 Mac 上通过 iOS 模拟器测试,并为 App Store 审核做准备。
@billy_aiwork [Claude Code]
https://x.com/billy_aiwork/status/2108376910388441593
一位日本用户让 Claude Code 写台本、Codex 生成图片,最近才发现 Codex CLI 的存在:有了它,Claude Code 会直接把指令发给 Codex,真正做到一键从生图到保存成手机上能看的文件。结论是,司令塔还是 Claude Code。
@lxfater [Claude Code]
https://x.com/lxfater/status/2108369386079662191
受够了 AI 画的流程图全是普通圆角框、还得去 Figma 调半天,diagram-design 的作者把配色、字体、布局的要求写进了一个开源技能。它支持架构图、流程图、时间线、甘特图等 42 种图,Claude Code 和 Codex 都能用,可以读取你的网站、照着你的配色和字体来画,放进文章里风格也能对上,还能把已有的 Mermaid、Excalidraw 等图交给它重画一版。生成的是 HTML 加 SVG,浏览器打开就能看,后面想改字、调布局还能继续让 AI 改,有浅色、深色、杂志风三种风格。
🗣 用户心声
用户心声
每周和五小时额度仍然是最响亮的抱怨。@pcshipp 问怎么在 11 小时里用完一周的额度,@AlchainHust 刚充值几小时就跑掉了周额度的四分之一,@mylifcc 和 @HouseHackerJon 都在用 Haiku 把同样的额度撑得更久。Max 新附赠的 API 额度被 @_nogu66 当成个人 agent 的燃料、被 @yancya 当成兜底池,@aliceisplaying 则画出了「哪种额度在哪里能用」有多混乱。
模型路由建议已经变成模板,用户想知道模板背后的真相。「Sonnet 干活、Haiku 群扫、Opus 当顾问」这张图被 @Arindam_1729、@Bober_smart、@merccante、@claudecode84 等账号当成 Anthropic 官方配置转发;@Lniosytest 翻了文档,零件都真,但没有打包方案,340 tok/s 也没有出处;@dravenip 转述了 Claude Code 创建者的话:便宜模型才是昂贵的选择。@fleyta88 和 @morganlinton 都要求按「每通过一个任务的成本」来衡量,而不是按 token 单价。
谁能读到 agent 的文件,成了每天的担忧。@catnose99 指出 Claude Code 和 Codex 的会话日志量大、明文、存放位置固定;@keitaro_aigc 提醒所有人检查公开服务器上有没有散落的 .claude 目录和 CLAUDE.md;@deeponailabs 提醒 mod 是以你的权限运行、能读你的密钥;@theshawwn 则撞上了相反的墙,Claude Code 拒绝交出自己的会话记录。
大家想要协调者,但现有的协调者都被砍了手脚。@astralwave 列出 Claude Projects 的协调者没有浏览器和 MCP、项目线程不能手动调用技能;@onenewbite 因为主线程只是传话员不是大脑而在本地重做了一套 Projects;@bart_walker 在用一个共享文件夹协调 Hermes、Codex 和 OpenClaw;@arnestrickmann 和 @trevin 各自动手补上了缺失的连接层和文档层。
OpenClaw 的用户在用「升级能不能活下来」而不是功能来评判它。@tvytlx 读完一份大半在讲回滚和恢复的 112 个 PR 的补丁说明后决定等下一版;@pan_derevyan 说用了六个月没有一次更新不靠手动干预完成;@shields_pikes 因为太常坏而换到托管替代品;@_bashoh 报告定时任务提示词泄漏到 Slack;@EdgeDimi 提交了一份带定位和一行补丁的 WebSocket 修复。
每周和五小时额度仍然是最响亮的抱怨。@pcshipp 问怎么在 11 小时里用完一周的额度,@AlchainHust 刚充值几小时就跑掉了周额度的四分之一,@mylifcc 和 @HouseHackerJon 都在用 Haiku 把同样的额度撑得更久。Max 新附赠的 API 额度被 @_nogu66 当成个人 agent 的燃料、被 @yancya 当成兜底池,@aliceisplaying 则画出了「哪种额度在哪里能用」有多混乱。
模型路由建议已经变成模板,用户想知道模板背后的真相。「Sonnet 干活、Haiku 群扫、Opus 当顾问」这张图被 @Arindam_1729、@Bober_smart、@merccante、@claudecode84 等账号当成 Anthropic 官方配置转发;@Lniosytest 翻了文档,零件都真,但没有打包方案,340 tok/s 也没有出处;@dravenip 转述了 Claude Code 创建者的话:便宜模型才是昂贵的选择。@fleyta88 和 @morganlinton 都要求按「每通过一个任务的成本」来衡量,而不是按 token 单价。
谁能读到 agent 的文件,成了每天的担忧。@catnose99 指出 Claude Code 和 Codex 的会话日志量大、明文、存放位置固定;@keitaro_aigc 提醒所有人检查公开服务器上有没有散落的 .claude 目录和 CLAUDE.md;@deeponailabs 提醒 mod 是以你的权限运行、能读你的密钥;@theshawwn 则撞上了相反的墙,Claude Code 拒绝交出自己的会话记录。
大家想要协调者,但现有的协调者都被砍了手脚。@astralwave 列出 Claude Projects 的协调者没有浏览器和 MCP、项目线程不能手动调用技能;@onenewbite 因为主线程只是传话员不是大脑而在本地重做了一套 Projects;@bart_walker 在用一个共享文件夹协调 Hermes、Codex 和 OpenClaw;@arnestrickmann 和 @trevin 各自动手补上了缺失的连接层和文档层。
OpenClaw 的用户在用「升级能不能活下来」而不是功能来评判它。@tvytlx 读完一份大半在讲回滚和恢复的 112 个 PR 的补丁说明后决定等下一版;@pan_derevyan 说用了六个月没有一次更新不靠手动干预完成;@shields_pikes 因为太常坏而换到托管替代品;@_bashoh 报告定时任务提示词泄漏到 Slack;@EdgeDimi 提交了一份带定位和一行补丁的 WebSocket 修复。
📡 生态产品雷达
生态产品雷达
Codex(128 次提及)、OpenClaw(113)、MCP(52)、Opus 5.5(46)、Cursor(41)、Claude Code Projects(35)、Grok Bot(34)、Hermes(28)、DeepSeek(25)、Gemini(22)、Dots(19)、Pine Computer(18)、Haiku 5.5(18)、Muse(14)、Jev(14)、OpenCode(14)、Sonnet 5.5(13)、Fable(12)、GitHub Copilot(12)、Slack(10)、Gemini CLI(10)、Pi(10)、GLM(10)、Claude Cowork(10)、Cloudflare(9)、OpenRouter(9)、Telegram(9)、Instinct(8)、Qwen(8)、Claude Managed Agents(8)、Claude Dashboards(8)、Kimi(6)、Excel(6)、VS Code(6)、Step 5 Preview(5)、HyperFrames(5)、Antigravity(5)、Ollama(5)、Discord(5)、REA(4)、Blender(4)、Claude Motion(4)、Notion(4)、Playwright(4)、superpowers(4)、Remotion(3)、Firecrawl(3)、Three.js(3)、Drex(3)、Unsloth(3)、llama.cpp(3)、Cline(3)、Aider(3)、Droid(3)。
Codex(128 次提及)、OpenClaw(113)、MCP(52)、Opus 5.5(46)、Cursor(41)、Claude Code Projects(35)、Grok Bot(34)、Hermes(28)、DeepSeek(25)、Gemini(22)、Dots(19)、Pine Computer(18)、Haiku 5.5(18)、Muse(14)、Jev(14)、OpenCode(14)、Sonnet 5.5(13)、Fable(12)、GitHub Copilot(12)、Slack(10)、Gemini CLI(10)、Pi(10)、GLM(10)、Claude Cowork(10)、Cloudflare(9)、OpenRouter(9)、Telegram(9)、Instinct(8)、Qwen(8)、Claude Managed Agents(8)、Claude Dashboards(8)、Kimi(6)、Excel(6)、VS Code(6)、Step 5 Preview(5)、HyperFrames(5)、Antigravity(5)、Ollama(5)、Discord(5)、REA(4)、Blender(4)、Claude Motion(4)、Notion(4)、Playwright(4)、superpowers(4)、Remotion(3)、Firecrawl(3)、Three.js(3)、Drex(3)、Unsloth(3)、llama.cpp(3)、Cline(3)、Aider(3)、Droid(3)。
评论