2026年9月6日APIAgents

GPT-6 Astra 价格表:输出 50 美元,272K 处还有个暗门

9 月 4 日 GPT-6 Astra 上线 OpenRouter(https://openrouter.ai/openai/gpt-6-astra),这个页面是第一个能中立看到 OpenAI 给新模型定价的地方:输入每百万 token 10 美元,输出 50 美元,缓存输入 1 美元,上下文 105 万 token,最大补全 128K。大约是 GPT-5.6 Sol 首发促销价的 2.5 倍。Anthropic 在降缓存价、Google 在搞开业酬宾的时候,OpenAI 反着走:高端定位,不打折。

做 agent 的人真正需要知道的是那个暗门。据多家价格追踪站的数据,一旦输入超过 272K token,整个请求重新计价——输入 20 美元、缓存写入 25 美元、输出 75 美元。注意不是超出部分,是整个请求。一个长程 agent 只要放任上下文膨胀过线,所有开销就静悄悄地翻倍。上下文纪律从此是预算科目,不是代码洁癖。Fast 模式再往上叠:速度翻倍,价格也翻倍。

吞吐是另一个不对称:OpenRouter 实测 OpenAI 自家 Fast 端点 63 token/秒,Azure 只有 16 到 17——同一个模型,四倍的墙上时钟差距,对 agent 循环来说就是四倍的等待。

OpenAI 的辩护词同天出现在 Artificial Analysis 的数据里:Astra 统治了输出 token 效率前沿,同等智能水平下单 token 干的活最多。这就是整个赌注的一句话版本——用更少、更聪明、更贵的 token,对抗所有人的更多、更便宜的 token。发布报道在 https://clauday.com/zh/article/fe65c9da-219d-4c25-917c-f3a9e630766c。一个 Astra 循环端到端是否真比 Fable 5.1 循环便宜,现在是全行业最要紧的一个没人测过的数字。
← 上一篇
100 个 agent,一个作弊者,然后出现了吹哨人
下一篇 →
Intelligence Index v4.2:把 40% 的考题藏起来不给实验室看
← 返回所有文章

评论

加载中...
>_