最新 · Latest
2026年9月15日
三家实验室的 agent 越狱事故,背后是同一家特拉维夫公司
9 月 14 日发表在 https://www.effort.news/irregular 的一篇调查提出了一个业内没人拼到一起过的说法:今年夏天 OpenAI、Anthropic 和 Meta 三家各自爆出的网络安全评测越狱事故,用的是同一家供应商。这家公司叫 Irregular,总部在特拉维夫,创始人是 Dan Lahav 和 Omer Nevo。三家实…
2026年9月12日
同一天有三个人给 Hacker News 写了 AI 过滤器
9 月 11 日,三条不同的首页投稿干了同一件事:把 AI 内容从 Hacker News 里剔出去。Ayden Diel 做的 unslop.news,带 ai=exclude 开关的 hcker.news,还有 sprinklz.io 上一个把 AI 内容降权的重排器。三者前后不到一小时落地,分别拿到 160、161 和 101 分,作者看起来互相都不知…
2026年9月12日
有人花了 1500 美元证明「省 90% token」是假的
RTK 一直被当成编程 agent 的免费午餐传:把终端输出过一遍,省 60% 到 90% 的 token。Quesma 跑了 1740 次基准测试去验,答案是不成立。Fable 5.0 的成本降了 1% 到 5%,看你怎么算。DeepSeek V4 Pro 的成本涨了 5% 到 17%。完整报告在 https://quesma.com/blog/does-…
2026年9月11日
Anthropic 说 DeepSeek 把 1200 万条用户请求转发进了 Claude
9 月 10 日 Anthropic 发布 9 月威胁情报报告,覆盖 2025 年 12 月到 2026 年 8 月拦下的滥用,分七类危害。其中六类是熟悉的阴暗清单:网络攻击、监控、影响力行动、常规武器、生物滥用、诈骗。第七类会被吵好几周。Anthropic 直接点名中国实验室,指控他们把自己用户的流量转发进 Claude 来偷能力。
核心案例编号 GTG…
2026年9月10日
Cymphony 拿了 2500 万美元 A 轮,要给每个 agent 建人事档案
Cymphony 带着总计 3000 万美元走出隐身,其中 2500 万是 A 轮,由 Sequoia 和 SMBC 旗下 Fin Atlas Beyond Fund 联合领投,这家纽约加特拉维夫的公司投后估值超过一亿美元。剩下的是此前未披露的 Sequoia 种子轮——这个细节才是重点:Sequoia 连投两轮,合伙人 Bogomil Balkansky …
2026年9月9日
黑产盯上了 Claude 会话:偷的不是卡号,是额度
Anthropic 本周确认,一波信息窃取木马正在劫持 Claude 订阅账号——赃物不是你的信用卡,是你的用量额度。Windows 上的 Vidar、LummaC2、StealC、RedLine、Acreed,macOS 上的 Atomic Stealer,现在全都会顺走 Claude 的会话 cookie 和 token。会话本身已经登录过,MFA 直接…
2026年9月8日
Hyperprobe:让 agent 只读调试生产环境
编码 agent 几分钟就能写好修复代码,然后等一个人花四小时搞清楚 bug 到底是什么。Hyperprobe 打的就是这个缺口——YC S26 公司,Product Hunt 第 4 名、212 票。它让 Claude Code、Codex、Cursor 直接挂到你的生产服务上看实时变量状态,不用重新部署、不用重启,而且碰不了任何东西。
机制叫虚拟断点:…
2026年9月7日
LLM 裁判:读数会漂移,理由是编的
周末批次里还有两篇论文,枪口对准了裁判本身。Clean Engineering, Unstable Measurement(https://arxiv.org/abs/2609.04198)对共享端点上的黑盒 LLM 裁判做了预注册审计,发现读数不稳定——"明天用同一个模型名就能得到同一个裁判"这个假设,直接不成立。Legibility Is Not Int…
2026年8月28日
116 家公司联名签信:防御 AI 攻击的窗口正在关上
OpenAI、Anthropic、Google、微软和一百多家公司发了一封联名公开信,敦促所有人——包括政府——在 AI 驱动的网络攻击失控之前做好准备。信里最扎的一句:未来几个月,随着世界各地的模型越来越强,AI 驱动的攻击会变得远为广泛和复杂。把这句话从造模型的人嘴里翻译过来就是:我们接下来要发的东西落到坏人手里很危险,而坏人一定会拿到。
签名名单本身…
2026年8月23日
问五家大模型公司要失控预案,四家顾左右而言他
Guidelight AI Standards 问了五家前沿实验室一个直白的问题:拿出你们的书面预案——当模型试图摆脱人类控制时,你们怎么办。TechCrunch 发了结果,真正拿得出东西的只有一家。
OpenAI 得分最高,3/5——它描述了限制权限、暂停工作负载、缩减部署、把模型彻底下线的流程,并称实际执行过。Google 说这份评估"不能代表其安全措…
第 1 页
较早 →
招聘 · Hiring
AI Agent 公司最新职位,开放即收录。
xAI
Production Coordinator (Logistics)
xAI
Network Engineer
xAI
Network Engineer
xAI
Enterprise Commercial Counsel
xAI
AI Tutor - Video (Weekend)
Anthropic
Forward Deployed Engineer