超级用户日报: 2026-09-27
Opus 5.5这周把Claude Code变成了一个工作室。声量最大的是纯代码做出来的视频:宣传片、三维民间故事短片、六个配音角色的漫画广告、手机上一句话生成的UMAP讲座,全程不碰视频生成模型,很多只花几美元。背后真正改变行为的是降价而不是能力:大家开始让dynamic workflow连跑几小时、把活派给便宜的工人模型、像看参数表一样算每美元能买多少额度。最有分量的非编码案例反而最安静:一家会计事务所把所有客户的账接进Claude Code,一个健康指挥中心在夜里调卧室的空气,一次不到一美元的市场情报。微软基于OpenClaw发布Autopilot,给生态的另一半带来了最大的一天;而封号、静默换模型、子agent替你回话,仍然是最扎手的几处棱角。
@AlanShiflett [OpenClaw]
https://x.com/AlanShiflett/status/2103524300158366183
减重60磅之后,他受够了健康数据散在六个App里、每个只看到一角。于是自己搭了个个人指挥中心:Epic MyChart病历、Fitbit睡眠心率、卧室的AirGradient空气传感器、空调、Govee灯,外加一个自制的饮食热量追踪,全部挂在一个个人MCP上。OpenClaw夜里盯着卧室二氧化碳,超标就让空调抽新风;早上的灯按他几点睡、前一天练了多少、第一个会几点来渐亮。Claude拉出十年的尿酸化验加上饮食记录,把一次痛风发作定位到他当减肥零食吃的无糖冰棍,还翻出一条2017年专科医生写了却没人跟进的备注。真正的重点在最后:数据和连接器都在他自己手里,不用等哪家厂商跟AI公司签合作。
@lklkfafa1 [Claude Code]
https://x.com/lklkfafa1/status/2103457111619592324
一家会计事务所把Claude Code接进了Money Forward会计API,覆盖的是全部顾问客户,不是拿一家公司做演示。这周Money Forward上线了API Key认证,作者当天就试了,确认一把key就能覆盖所有客户公司,每家用office_code区分,请求不可能串到隔壁公司的账上。已经按旧方式接好的不用动;新接入的直接省掉应用注册和逐家授权。流程没变:key由人亲手放进文件,周边工具全让Claude Code写。这就是记账自动化该有的样子,集成握在从业者自己手里,而不是软件商手里。
@jlhortelano [Claude Code]
https://x.com/jlhortelano/status/2103398379426378016
一家做体育赞助数据的公司,用Claude Code加treg(一把key调95家数据商约3700个接口)再加Jev当廉价裁判,跑了一轮市场情报。三个题目:七个AI搜索引擎怎么回答他们这个品类的问题、用人数招聘融资发帖拼出的竞品雷达、哪些品牌真的把赞助拿去投付费广告。三项总花费0.97美元,挖出一个在一半AI答案里都出现的竞品,还有几条描述的恰好是他们产品、他们却一次都没出现的查询。最有用的是他坦白的坑:放任agent即兴发挥,每次选的数据商都不同,这个月和下个月的数字根本没法比,所以他把它固化成四份固定报告,预计每月10到15美元。结论很对:数据已经白菜价了,稀缺的是判断。
@KyleCranmer [Claude Code]
https://x.com/KyleCranmer/status/2103581526285857085
一位物理学家说,他们团队啃了好几年的一个散射振幅难题,最近几个月一直在用Claude Code这类agent工具辅助,结果刚刚出来了。戏剧性的是,他的合作者一直在签着保密协议帮忙验证,Anthropic内部的朋友也在做同一个问题。同一周Anthropic宣布Claude解出了九圈计算。这是前沿科学版本的故事,工具的角色是长期合作者,不是代码补全。
@dadchords [Claude Code]
https://x.com/dadchords/status/2103616493569097857
他在浏览器标签页里的JavaScript虚拟机上跑起了一个虚拟Unix环境,稳到可以让Claude Code直接在这个标签页里运行,并且修改它自己正在运行的这个页面。在这之上,他在原型一个Endlesss复刻:一个受Strudel启发的音乐环境,加一个实时音频循环录制工具,还发了第一次在里面即兴演奏的录屏。他说为了走到这一步砸了大量性能和bug的功夫。一个住在自己正在搭建的作品里的编码agent,是真正的新形态。
@NFT_Chen [Claude Code]
https://x.com/NFT_Chen/status/2103401780117938683
opus-manager这个skill把Opus 5.5从码农变成经理:它写工单、把活派给DeepSeek、GLM这种便宜的工人模型、自己重跑验收、再找另一家厂商做只读审查,最后逐条核实审查意见真假。实测数字:同事托管一整天只吃掉Pro周额度的20%,一个工作项目调了DeepSeek 3617次、工人模型花了十几刀,作者自己一口气清掉60多张工单。工单、回执、审查报告全是仓库里的Markdown。最实用的是那条提醒:跑的时候别插嘴,打断一次Claude就要停下来重新核对,额度白烧。
@aipulseda1ly [Claude Code]
https://x.com/aipulseda1ly/status/2103352533657719230
用Opus 5.5连续干了一天,在three.js里做出一个类似《森林》的完整生存游戏。2公里的岛由模拟侵蚀雕出来,44000棵树全部代码生成、包着实拍扫描的树皮,太阳和月亮的位置按北纬49度九月底真实计算,雷声按声速延迟到达,狼会在黄昏潜行、夜里绕着火堆转、看到火把就后退。Claude Code按领域把世界拆给一波波agent,另有从不碰构建的评审agent拿渲染图对照真实照片挑错。额度在做写实化那一轮之前用光了,他自己说狼还是最弱的一环。
@vikingmute [OpenClaw]
https://x.com/vikingmute/status/2103379440390844449
OpenClaw团队删掉了自己大约40万行测试代码,覆盖率几乎没掉,因为现在的模型特别爱写没用的单测,写十个case去判断常量字符串。清理能成功的关键:只跟agent说清理一下,它很早就停手了,得给一个更狠的目标,比如删掉最没用的20%测试,同时覆盖率波动控制在2%以内。他们还公开了现在用来把关新测试的test audit skill:agent要先回答这条测试到底守护什么行为,答不上来就不许加。agent带来的测试膨胀,是一笔没人做预算的真实成本。
@peesamac [Claude Code]
https://x.com/peesamac/status/2103424988472893946
video-use是Browser Use团队出的对话式剪辑skill:把原始素材丢进文件夹,跟Claude Code说想要什么样的片子,拿回final.mp4,全程没有剪辑界面。它会剪掉嗯啊、说错重来和空白,逐段调色,每个剪切点加30毫秒音频淡入淡出防爆音,烧录字幕,还能把动画分给并行的子agent用HyperFrames、Remotion或Manim去做。聪明的是它读视频的方式:先用ElevenLabs Scribe转出词级时间戳、区分说话人、连笑声掌声都标出来,所有素材压成约12KB的文本给AI读,只在需要拍板的地方才看波形和胶片条;逐帧看的话估计要吃掉4500万token。它会先出方案等你批,渲染完逐个剪切点自检,最多重渲三次。
@Majin_AppSheet [Claude Code]
https://x.com/Majin_AppSheet/status/2103497319899693327
他让Claude Code(Opus 5.5)按自己的风格做一条宣传片,被问问题时基本只回了一句随你。全程没用视频生成模型:画面用HyperFrames在HTML和代码里逐帧绘制,BGM用Gemini的Lyria生成,音效按节拍卡点。最让他震惊的是:Claude自己听不见声音,是把波形当数字分析,才把音效精准卡在落地和盖章的瞬间。用代码渲染视频,这周悄悄成了一个独立品类。
@ladprofit [Claude Code]
https://x.com/ladprofit/status/2103479370883137664
一条60秒、全员配音的漫画风广告,从头到尾在Claude Code里导出来。它先按PAS框架围绕一个有名字的卖点写了21格分镜脚本,先画角色设定图再喂给Nano Banana Pro,保证每格脸不变;选了6个ElevenLabs声音,还把其中一个调高音来演8岁小孩;在网格上找到每个角色嘴的位置,让对话气泡的尾巴准确指向说话人。剪辑也是它自己干的:翻页、重击、震屏、音效、按幕配乐。成本约65个图片额度加几美分配音。
@wshuyi [Claude Code]
https://x.com/wshuyi/status/2103308292613345504
一次端到端测试,看模型能不能直接把故事拍出来:用Claude Code挂Opus 5.5,从零做出一部《崂山道士》三维讲解片。不写分镜脚本,不套现成的影片skill,唯一的输入是他自己的声音克隆。实验的目的就是看现在的模型能不能独自扛起叙事、画面和节奏,结果好到他愿意直接发出来。
@goodside [Claude Code]
https://x.com/goodside/status/2103505085292593220
Riley Goodside让Opus 5.5给机器学习本科生写并做出一段5分钟的UMAP动画讲解。画面构思、旁白、结构全是Claude出的,而且是在手机上的Claude Code里下的指令。一份助教要做一周的教学素材,现在一条手机指令就出来了。
@mmmiyama_D [Claude Code]
https://x.com/mmmiyama_D/status/2103319199817064764
想做一条30秒宣传视频,又不想再为别的AI多付一份订阅,于是只用Claude Code里的Opus 5.5做完了。完全没用图像或视频生成,纯代码,所以改起来很方便,用量也几乎没掉。出来的扁平风格可以直接拿去做推广。同一天作者还一句话生成了一段15秒自我介绍视频,字体自己下载,音乐自己配。
@vikktorrrre [Claude Code]
https://x.com/vikktorrrre/status/2103525020530348430
给这波动效设计热潮一张收据:Claude Code,max推理,一条直白的提示词,跑了1小时32分钟,按API价计81美元。出来的是一段他称为杰作的精致动效短片。当价格锚点很好用:找工作室定制一段动效要几千美元,现在是一笔不到100美元的开销。
@RoundtableSpace [Claude Code]
https://x.com/RoundtableSpace/status/2103616788324130984
有人几乎逐字照抄了一条爆火的Claude Code提示词,给了一个上限10美元的OpenRouter key就走开了,1.5到2小时后回来,副业项目的动画讲解片已经做完,花了约4美元。脚本和创意、拼贴画风素材、配音、音乐和音效全是Claude做的,整部片子是纯JavaScript canvas动画渲染成MP4,每个动画节拍都和台词对齐。它还调了第二个模型审自己的草稿并改掉问题。真正的无名英雄是那个硬性预算上限。
@RoundtableSpace [Claude Code]
https://x.com/RoundtableSpace/status/2103412945552326983
Opus 5.5用一条提示词、分派给6个子agent做出了一个CRM。主agent先写产品简介、造假数据、定设计规范;一个子agent搭地基,另外五个分两波并行把剩下的做完。过程中用Mobbin MCP搜了57次真实App的界面模式,套了11个设计类skill,每个页面在深色和浅色模式下都跑截图复查循环。人只审了一次,agent把指出的问题全改了,总共约4小时。
@MishariAldulimi [Claude Code]
https://x.com/MishariAldulimi/status/2103533876975173930
一位阿拉伯语研究者展示了一篇完整论文,题目是一个很精细的科学问题,格式符合一本正经期刊的投稿规范,用Claude Code做出来,他一个字母都没写。他自己附了一句很尖锐的提醒:除非研究者亲手完整重写,否则不能把这份成果算在自己名下,AI是你的助手,不是替你做研究的人。学术写作是非编码场景里伦理讨论紧追在能力后面的那条前线。
@riba2534 [Claude Code]
https://x.com/riba2534/status/2103363198997180859
这次是实测不是体感:新开一个号,Opus 5.5开xhigh,用掉30亿token正好是Claude Code Max 20x周额度的一半,等于一周约60亿。GPT-6 Astra开xhigh,ChatGPT 20x档一周大约15到20亿,而且每个号风控松紧不一样。他的结论:现阶段一个Claude Code Max 20x约等于三个ChatGPT 20x。每美元能买多少额度,正悄悄变成大家选工具时最看的那个参数。
@daniel_mac8 [Claude Code]
https://x.com/daniel_mac8/status/2103570418573705612
Opus 5.5的效率让Claude Code的dynamic workflows从五分钟烧光一周额度的玩具,变成了真能用的功能。他让一个任务以dynamic workflow跑了约3小时,只用掉周额度的17%。同一周还有人报告Opus 5.5连跑8小时没碰到上限,开四个Ultracode都用不完周额度。降价改变的是哪些功能真正可用。
@VictorTaelin [Claude Code]
https://x.com/VictorTaelin/status/2103309609431601409
他休息一天,让Opus 5.5去改进bend2,回来发现产出的想法糟糕透顶。一问才知道,Claude Code悄悄把子agent路由到了旧的4.8。解法大家知道(给子agent显式指定模型),但这种静默降级恰恰最伤无人值守运行的信任,也给每周一次的降智传言添了柴。
@joshmanders [Claude Code]
https://x.com/joshmanders/status/2103491314381705701
一条重度用户的精确bug报告:子agent在后台干活时,Claude问你要方向,如果你还没读完或没打完字子agent就回来了,Claude会把子agent的返回当成你的回复,几乎每次都按它自己的建议直接往下做。实际效果就是执行了你从没批准的动作。越来越多工作转到后台子agent,轮到谁说话变成了一个真正的安全问题。
@g48in [Claude Code]
https://x.com/g48in/status/2103518898234515920
一次干净的同题对比:收集一批文档、分类、上传到网盘。Grok Bot花了约30分钟,Claude Code加Opus 5.5约1分钟。他其实很喜欢Grok Bot的产品形态,但说模型太笨、额度太紧,现在在找Grok Bot的开源替代。形态决定装不装,模型决定留不留。
@aigclink [Claude Code]
https://x.com/aigclink/status/2103302397863031123
Raft是一个人和AI一起上班的Slack,团队把整个产品开源了:服务端、网页端、CLI、跑agent的守护进程、桌面端全在里面。每个agent有自己的名字、分工和存在本地的记忆,自己领任务、互相交接、互相review,QA agent发现CI没跑会直接叫停发布。Claude Code、Codex、Hermes都能用你自己的订阅拉进频道。TiDB联创兼CTO黄东旭自己就在上面养了一整队开发、架构、记忆管理agent,高峰一天烧12亿token,说自己的岗位已经变成Agent资源经理。
@GitHub_Daily [Claude Code]
https://x.com/GitHub_Daily/status/2103386537232851262
ai-employees把8个业务岗位做成了开源的AI员工,每个员工就是一个文件夹,里面装着按时间自动跑的例行任务,一共60个:增长、SEO、网站维护、社媒、广告投放、销售和客服,每天早上各交一份简报,只有需要拍板时才推到手机。第8个是幕僚长,专门翻其他员工的运行记录,找出哪项活悄悄停了。它用已登录的浏览器像人一样操作,网页改版了会自己改指令;发帖、发消息、花钱都只起草,最后一下留给人点。作者从8月底开始每个工作日都拿它跑自己的生意,用Claude Max订阅,增长岗的定时任务约占总调用量的6%。
@shi3z [Claude Code]
https://x.com/shi3z/status/2103377823906025683
他从日本PLATEAU三维城市数据里取了地形数据,让Opus 5.5按人的直觉去组织,以平行和垂直于铁路的道路为骨架,生成一张2D像素地图。长冈站前和大手通都被还原出来了,他说真的很感动。把公开的城市地理数据变成一张游戏风的可读地图,是同一套能力在非编码上的漂亮用法。
@rotejin [Claude Code]
https://x.com/rotejin/status/2103384608301830297
他试用了一个只要跟Claude Code说一句加个新动作就能给Live2D模型加动作的工具,稍微改了改,用Opus 5.5的xhigh做出了很自然的打哈欠和打喷嚏动作。Live2D动作绑定是个很小众的手艺活,以前意味着在专用编辑器里耗好几个小时,现在是一句话。
@naisyonoanime [Claude Code]
https://x.com/naisyonoanime/status/2103399355411763642
一个3D完全新手,让自己喜欢的角色在CODE27里动了起来:ChatGPT先画四面图,TRIPO转成3D模型,然后在Blender里最吓人的那一步,绑定、骨骼、导出VRM,交给Codex或Claude Code一句话搞定。两天前作者还不知道rig和骨骼是什么。底子搭好之后,第一遍大约30分钟就能完成。
@tanabe_fragm [Claude Code]
https://x.com/tanabe_fragm/status/2103297034363211812
一条木乃伊加皮克斯风、会唱歌的广告,推的是一个虚构的英语学习App,一个多小时做完。Opus 5.5参考海外广告写脚本和结构,还写了所有图像、视频、音乐的生成提示词;Kling 3.0通过MCP从Claude Code里直接调用,每个镜头先用GPT Images 2.5生成首帧。他的实用体会:Kling能用MCP操作,指挥的人不会累。他也老实说,真要做成转化广告,诉求和CTA还得细调。
@lcrothlisberger [Claude Code]
https://x.com/lcrothlisberger/status/2103511946620219851
一位房地产业主往Claude Code里丢了一句话:告诉我每处物业的贷款什么时候到期、利率多少、现在的NOI多少,然后做压力测试,看利率涨到多少每处会撑不住。没搭表格就拿回了一张表。事很小,但这种非程序员用法会悄悄吃掉大量Excel。
@timoassi [Claude Code]
https://x.com/timoassi/status/2103492326395937187
在比利时人人午饭吃三明治,除了作者的另一半,对方在Instagram上做饭有一批粉丝。于是作者给对方做了一个可以直接推给粉丝的App:备餐计划、100道菜谱、同步购物清单,全部用Claude Code做的。候补名单刚到850人。给身边的创作者做产品,是从想法到分发最短的路。
@ZenModeJon [Claude Code]
https://x.com/ZenModeJon/status/2103507562159095970
他做销售时因为自动发消息被LinkedIn警告过,于是用Claude和Claude Code做了一个更安全的LinkedIn外联工具,一个客户都没有就辞职了。上线6个月:收入约8000美元,将近50个活跃用户。他的经验都是不性感的那种:狠狠验证需求、上线前就公开建造、自己天天用、早期用终身买断招压力测试用户。
@clarklab [Claude Code]
https://x.com/clarklab/status/2103535338438135865
作者那位不会写代码的另一半一直对Claude Code说c&p,他终于忍不住问是什么意思。答案是commit and push。对方在真实的客户项目上提交得太频繁,以至于需要一个缩写。小插曲,但这是终端门槛对非工程师真的倒了的最清楚的信号。
@yenceesanjeev [Claude Code]
https://x.com/yenceesanjeev/status/2103339020411621460
supermeme的四年回顾:三个联合创始人在一个WhatsApp群里做出的AI表情包生成器,每月只花几小时,累计收入超过20万美元。作者是产品经理不是开发者,值得记的一点是:有了Claude Code和Codex,他开始亲自往一个几千人在用的线上产品里提交改动。收入大头来自SEO。编码agent正在把副业里的产品经理变成副业里的建造者。
@24shi_web [Claude Code]
https://x.com/24shi_web/status/2103323043338830131
一位创作者老实晒出他用Claude Code做的自动化现状:视频剪辑和字幕(准确率目前七八成)、视频简介里自动插亚马逊和乐天的联盟链接、自动更新一个商品合集博客、从邮件里只挑出商务合作整理成表、关键词搜索需求调研。他现在的缺口恰恰是大家共同的那个:一切都还要他发起才动,他想要定时跑、完全自动化。
@coreyganim [Claude Code]
https://x.com/coreyganim/status/2103608987501699185
他重做网站只花了约20分钟生成时间:让Claude Design一口气做5个完整网站,品牌配色相同、布局完全不同,然后首页取第1版、关于页取第3版、服务页取第4版。再把拼好的稿推给Claude Code,接上播客节目和连到邮件服务商的订阅表单,用Astro而不是WordPress一键部署。多出方案再挑零件,是最适合agent的设计工作流。
@codyschneider [Claude Code]
https://x.com/codyschneider/status/2103484681589006615
一家代运营给AI创业公司客户做SEO的循环,用Claude Code加DataForSEO的key跑:拉出和产品相关的关键词,参照当前排在第一页的内容来写,通过API发到CMS,每30天根据Search Console的实时数据和内容差距分析刷新一次。转化钩子放在滚动25%、50%、75%的位置,30%处弹窗。最有意思的是那个30天刷新循环,把内容当成活资产而不是一次性帖子。
@tzangms [Claude Code]
https://x.com/tzangms/status/2103348633764860415
他交给agent一个大任务,它自己干了四个小时,检查到全部合格才停。跟平时一来一回的唯一差别是最后多加了一句:做完帮我验收,验收条件是,然后逐条列出来。条件写不出来也没关系,改成先问我问题,帮我把验收条件列出来,你说不出什么叫好,但被问到就答得出来。这就是一句话版的Loop工程。
@andersbaek1 [Claude Code]
https://x.com/andersbaek1/status/2103427048354021454
一位丹麦开发者发了一个能玩的马里奥风3D游戏,就一个HTML文件:一个胖乎乎的小维京人,在丹麦森林里,可以爬上天空山和山顶的塔,平台有各种坡度,敌人是狐狸和海狸。完整提示词也公开了,在Claude Code里跑了30分钟,结尾是:用/loop跑,派多个子agent并行检查、改进画面和玩法,一直做到我说停为止。没有停止条件的开放式循环,正在成为创意类项目的默认姿势。
@ZypherHQ [Claude Code]
https://x.com/ZypherHQ/status/2103411534298808706
一个在同一台服务器上跑多个Pro或Max账号的干净办法,不用反复登出登入也不用代理工具:每个账号一个独立的CLAUDE_CONFIG_DIR,每个目录登录一次,再设c1、c2两个alias。这样每个终端启动时就绑定了账号,全在同一个仓库里干活,凭证、配置、会话历史互相隔离,--resume也按账号分开。它不会合并额度也不会自动切换,每个实例用哪个号还是你来选。对并行重度用户来说,它终结了一个老坑:切一次全局登录,已经打开的会话悄悄跑到了另一个号上。
@sato_neet [Claude Code]
https://x.com/sato_neet/status/2103475239871267252
他让Opus 5.5参照ChatGPT App的样子做了一个桥接Claude Code的PWA,通过Tailscale用。因为可以随意改布局,现在比ChatGPT官方App还顺手。建造者已经不等厂商出手机客户端了,自己长一个。
@jqdsouza [Claude Code]
https://x.com/jqdsouza/status/2103511139967447544
开源的跨harness记忆层Beacon上线了交接功能:一条命令从agent自己的本地存储读出会话,写一份简短交接说明,包括问了什么、改了什么、跑了哪些命令、停在哪里,然后在同一目录启动Codex并指向这份说明。Codex会先复述它理解的任务,等你点头才动手,两个会话会在本地记录里连起来。Claude Code、Codex CLI、OpenCode、Cline之间任意方向都行,密钥自动打码,什么都不上传。任务做一半额度用光,再也不用从头来。
@QuantumTransf [Claude Code]
https://x.com/QuantumTransf/status/2103391523366973763
obelisk的出发点是会话数据应该属于你,而不是某一家公司。它一次性给Claude Code、Codex、GitHub Copilot、pi/omp、Zcode、Hermes和DeepSeek的harness做索引,之后这些上下文在任何harness里都能用,本地优先。他们直说了最刺激的使用场景:就算被Claude Code或Codex封号,你也能带着会话里的上下文去别处接着干。会话可携带,已经成了一个产品品类。
@harrisonitsme [Claude Code]
https://x.com/harrisonitsme/status/2103432827261898898
他实测了给浏览器agent提速的Jev Ultrafast,只对Codex说了一句:用Jev打开Bing查一下比特币价格。从Bing首页开始到价格卡片出现约6.8秒,1倍速。快的原因是全程不截图给大模型看:先把页面上能操作的元素整理成编号表,Jev一次选出下一步动作和目标,只有要输入文字时才调一个小文本模型。他的结论:目标明确的任务非常利索,动作被限制在真实存在的元素里所以乱点少,能塞进Claude Code或Codex替它们搜索抓取。Canvas、复杂iframe、Shadow DOM、上传和多层滚动还是会卡住。
@mvanhorn [Claude Code]
https://x.com/mvanhorn/status/2103524365090553895
Agent Tincan让你的各个agent通过自己的Tailscale私网互相求助:Grok Bot常驻云端,Muse能打电话,Codex和Claude Code手里有你的代码,ChatGPT和Claude有你的聊天记录。你不用再当那个复制粘贴的中间层,可以让Grok Bot叫Muse给餐厅打电话,或者从一段旧的Claude对话里捞一个细节。开源、不开端口,安装也是agent优先:往你常驻的agent里粘一条消息,剩下的它自己配。agent之间的总线,用户在厂商之前就自己搭起来了。
@airesearch12 [Claude Code]
https://x.com/airesearch12/status/2103619088840880343
他自己做了一个基于Jev的模型路由器,说能省约9倍token,质量通常看不出下降。它能用上Claude Code和Codex的订阅额度,用本地的Jev类小模型做路由决策,把活派给免费本地模型,考虑冷热缓存,并按真实跑分和每任务成本来选模型。安装也是agent式的:把网址丢给你的agent,告诉它你想怎么用。按每任务成本做路由,是这周懂行的人集体去的方向。
@volcano_youtube [Claude Code]
https://x.com/volcano_youtube/status/2103340374869831720
一位视频创作者让agent剪片之后的心得:想手动微调时别一遍遍重新渲染,直接让Claude Code或Codex给你做一个专属编辑器。他的提示词要求:能微调生成的视频、不用每次导出,之前提过的修改都能手动调,再尽量加上Premiere Pro的功能。定制这一步才是剪辑师灵魂所在,他认为到这里花钱买别人的skill或规格书才有正当性。他推荐的标杆是开源的Akari Video。
@a4DamwL0058BaSi [Claude Code]
https://x.com/a4DamwL0058BaSi/status/2103314546760806803
一份很干净的日文版Karpathy式LLM Wiki教程:建一个Obsidian库,用Claude Code打开这个文件夹,把Karpathy的想法文件交给它,让它按你的用途建一个自己的Wiki。三件套:raw放原始资料不许动,wiki放整理好的笔记,CLAUDE.md写规则,比如不改原文、保留出处、关联已有笔记。之后往raw里丢文章和转录稿,让它带出处更新Wiki,并指出和旧资料矛盾的地方。重点不是AI变聪明的魔法,而是整理出明天还能被AI引用的知识。
@GodsBoy7777 [Claude Code]
https://x.com/GodsBoy7777/status/2103599698959278370
他在Hermes Agent里通过Claude订阅插件跑Opus 5.5的1M上下文,结果中午就把额度烧光了,因为每一轮都要重读约80万token的旧对话。他的解法:按模型分别设置、早点压缩,Opus在窗口25%(约25万)时压,GPT系在85%时压;摘要交给他ChatGPT订阅里的GPT-6 Luna 900K版,压缩完全不碰Claude额度;再开lean模式,自己的消息原样保留。他特别提醒,订阅插件会关掉Claude Code自带的自动压缩,所以压缩只能由宿主harness负责。道理通用:1M窗口本身不花钱,每轮重读它才花钱。
@adocomplete [Claude Code]
https://x.com/adocomplete/status/2103588612990439696
那个能看到agent们坐在工位上干活的可视化Claude Code办公室harness,已经成了他从一句提示到做出道具的日常工具。它用Svelte、Claude Agent SDK和Three.js搭成,他说里面的AI软件开发循环是真的在跑:agent自主权很大,但每一步都有护栏。开源版正在做。让多agent工作变得看得见,正在成为一个独立的设计方向。
@shiri_shh [Claude Code]
https://x.com/shiri_shh/status/2103521939134550246
一个Claude Code skill:分析你的代码仓库,一次跑完就输出一段完整的动态图形预告片,带音效设计和发布文案。演示视频有15.8万播放,因为每个独立开发者都需要发布视频、又都讨厌做它。从仓库到预告片,是一个会自己卖自己的skill的好例子。
@leodev [Claude Code]
https://x.com/leodev/status/2103559166250106994
新开的Claude账号10分钟内就被封了。他说自己只在Claude Code里用Claude,应该完全符合服务条款,正在公开问Claude Code团队怎么解封。新号无理由被封,现在几乎每周都能看到。
@exe0524 [Claude Code]
https://x.com/exe0524/status/2103405425999667620
他在Codex里用一个代理API把Codex、Grok、DeepSeek等模型串在一起用,照样把Claude账号接进去用Opus,一小时内被封,再没恢复。他问的也是很多人的问题:大家怎么在Claude之外同时用多个模型,还是都只用Claude Code了?通过第三方harness用订阅,就是那条断层线。
@app_sail [Claude Code]
https://x.com/app_sail/status/2103311778289680614
一位中国用户写的《Claude Code最新防封号完全指南》已经有160万以上阅读。这是他被封了6个Claude Code账号之后写的,第7个号已经稳定用了大半年。接入需求强到防封号本身成了一个百万级阅读的内容品类。
@bridgemindai [Claude Code]
https://x.com/bridgemindai/status/2103563056240263359
一周前用Fable 5.1,Claude Code半小时就能撞限额;Codex里的GPT-6 Astra四小时能烧光一周额度。今天他用Opus 5.5连跑8小时,一次都没撞上限。这次降价,大家感受到的是时间,不是美元。
🗣 用户心声
用户心声
算成本已经成了核心技能,用户希望工具跟上。Anthropic公布每任务成本之后,大家开始自己审计effort档位、缓存行为和子agent用的模型,还在要更多控制权,比如拿速度换额度的/slow模式(@Im_IrushiK),或者弄清楚一天里哪个时段额度掉得更快(@notomarsol)。
静默的行为变化最伤无人值守运行的信任。子agent被悄悄换成旧模型(@VictorTaelin),子agent的返回被当成用户点头(@joshmanders),说的是同一件事:自主只有在agent从不假装某个决定已经做过时才成立。
账号安全是最大的非技术焦虑。新号几分钟被封(@leodev)、接代理后被封(@exe0524)、一篇百万阅读的防封号指南(@app_sail),都说明大家想要跨harness使用订阅的明确规则;obelisk这类工具之所以存在,部分原因就是用户默认总有一天会丢号(@QuantumTransf)。
大家想拥有并带走自己的上下文。跨harness交接(@jqdsouza)、会话索引、自己做的手机桥接(@sato_neet),指向同一个需求:会话和记忆应该属于用户,而不是属于工具。
用户希望AI自己犯的错不要让用户买单。AI把数据弄坏了,修复还要扣用户额度,就像木匠锯错了木头却让业主付木料钱(@wurst_design)。
算成本已经成了核心技能,用户希望工具跟上。Anthropic公布每任务成本之后,大家开始自己审计effort档位、缓存行为和子agent用的模型,还在要更多控制权,比如拿速度换额度的/slow模式(@Im_IrushiK),或者弄清楚一天里哪个时段额度掉得更快(@notomarsol)。
静默的行为变化最伤无人值守运行的信任。子agent被悄悄换成旧模型(@VictorTaelin),子agent的返回被当成用户点头(@joshmanders),说的是同一件事:自主只有在agent从不假装某个决定已经做过时才成立。
账号安全是最大的非技术焦虑。新号几分钟被封(@leodev)、接代理后被封(@exe0524)、一篇百万阅读的防封号指南(@app_sail),都说明大家想要跨harness使用订阅的明确规则;obelisk这类工具之所以存在,部分原因就是用户默认总有一天会丢号(@QuantumTransf)。
大家想拥有并带走自己的上下文。跨harness交接(@jqdsouza)、会话索引、自己做的手机桥接(@sato_neet),指向同一个需求:会话和记忆应该属于用户,而不是属于工具。
用户希望AI自己犯的错不要让用户买单。AI把数据弄坏了,修复还要扣用户额度,就像木匠锯错了木头却让业主付木料钱(@wurst_design)。
📡 生态产品雷达
生态产品雷达
Codex(94次提及):最常见的对照对象,很多人两个都用、在两者之间交接
Opus 5.5(53次提及):这周视频、3D和长时运行案例背后的模型
Cursor(38次提及):多半作为大家迁出的另一个harness被提到
MCP(35次提及):健康数据、广告、Kling、Mobbin、会计API的连接层
Muse(34次提及):Meta的消费级agent,频繁被拿来和OpenClaw比较
Copilot / Autopilot(23次提及):微软基于OpenClaw的常驻agent
Jev(14次提及):便宜的决策模型,用于路由、打分和浏览器操作
Hermes(12次提及):另一个agent harness,常和Claude订阅搭配
Obsidian(7次提及):Karpathy式第二大脑的落脚处
video-use / HyperFrames(7次提及):视频浪潮背后的代码渲染管线
Whiteboard(4次提及):让agent画出自己写的代码结构图的画布
Hindsight(3次提及):开源的agent记忆引擎
ElevenLabs(3次提及):视频和漫画管线里的转写与配音
Kling(3次提及):通过MCP从Claude Code里调用的视频模型
Codex(94次提及):最常见的对照对象,很多人两个都用、在两者之间交接
Opus 5.5(53次提及):这周视频、3D和长时运行案例背后的模型
Cursor(38次提及):多半作为大家迁出的另一个harness被提到
MCP(35次提及):健康数据、广告、Kling、Mobbin、会计API的连接层
Muse(34次提及):Meta的消费级agent,频繁被拿来和OpenClaw比较
Copilot / Autopilot(23次提及):微软基于OpenClaw的常驻agent
Jev(14次提及):便宜的决策模型,用于路由、打分和浏览器操作
Hermes(12次提及):另一个agent harness,常和Claude订阅搭配
Obsidian(7次提及):Karpathy式第二大脑的落脚处
video-use / HyperFrames(7次提及):视频浪潮背后的代码渲染管线
Whiteboard(4次提及):让agent画出自己写的代码结构图的画布
Hindsight(3次提及):开源的agent记忆引擎
ElevenLabs(3次提及):视频和漫画管线里的转写与配音
Kling(3次提及):通过MCP从Claude Code里调用的视频模型
评论