Mercury 2.5 Preview 是 Inception 在 2026 年 8 月 31 日发布的扩散式大语言模型,也就是 dLLM。现在还是 Preview 阶段,可以通过 OpenRouter 等平台调用。
它和主流大模型最大的差别,在生成方式。
传统自回归模型是一段一段往后生成,后一个 Token 要等前一个算完。Mercury 2.5 走的是并行路线:先生成一个粗略结果,再经过多轮去噪,把文本逐步修正。
这套机制的目标很直接:把生成速度提上去。
模型支持 256K~260K 上下文,最大输出约 65K Token,还有可调推理级别、并行工具调用和结构化 JSON 输出。
输入输出都是纯文本,不支持图片、视频或音频。
Inception 给它的定位也不是最顶级旗舰,而是对标 GPT-5.6 Luna 低推理档、Gemini 3.5 Flash-Lite 和 Claude Haiku 4.5 这一档。
一句话:不追求最强,先把“够用、便宜、快”做到极致。
现在的问题也很明确。
模型权重没开放,第三方跑分也没有。 BenchLM 这类平台暂时还看不到它的公开成绩,所以官方数据只能先当参考。
评论(0)