Mercury 2.5:拿扩散模型抢 agent 循环的时间生意
Inception Labs 在 9 月 8 日发布 Mercury 2.5,自称是市面上最强的扩散 LLM、也是有史以来训练规模最大的扩散语言模型——按他们的口径比 Mercury 2 聪明约 40%,延迟和成本档位不变。目标客户写得很直白:语音、搜索、编码 agent,一切对延迟敏感的场景。
扩散模型是并行出 token 而不是一个一个吐,所以 Mercury 这家公司的存在本身就是一个赌注:速度是产品维度,不是评测花絮。这个赌注在 agent 循环里兑现——一个要跑五十轮工具调用的 agent,在乎的是每一轮的墙钟时间,不是评测榜上那五分。前沿实验室过去一周在卷循环的成本(https://clauday.com/zh/article/9bbb73f1-52f6-42d3-b078-43a25a14caa1),Mercury 卷的是循环的时间。
同一天,Hugging Face 榜单第一的论文(86 赞)是 Unlocking Lossless Speedups in LLMs via Discrete Diffusion(arXiv 2609.04010)——学术动能和商业发布落在同一个窗口。研究榜和产品发布在同一个新闻周期收敛到同一个架构上,这种日子通常值得记下来。
发布:https://www.inceptionlabs.ai/blog/introducing-mercury-2-5
← 返回所有文章
扩散模型是并行出 token 而不是一个一个吐,所以 Mercury 这家公司的存在本身就是一个赌注:速度是产品维度,不是评测花絮。这个赌注在 agent 循环里兑现——一个要跑五十轮工具调用的 agent,在乎的是每一轮的墙钟时间,不是评测榜上那五分。前沿实验室过去一周在卷循环的成本(https://clauday.com/zh/article/9bbb73f1-52f6-42d3-b078-43a25a14caa1),Mercury 卷的是循环的时间。
同一天,Hugging Face 榜单第一的论文(86 赞)是 Unlocking Lossless Speedups in LLMs via Discrete Diffusion(arXiv 2609.04010)——学术动能和商业发布落在同一个窗口。研究榜和产品发布在同一个新闻周期收敛到同一个架构上,这种日子通常值得记下来。
发布:https://www.inceptionlabs.ai/blog/introducing-mercury-2-5
评论