概览
Mercury 2.5 Preview 是 Inception Labs 于 2026 年 8 月 31 日前后上线的最新扩散式大语言模型(dLLM)。与自回归逐 token 解码不同,它通过并行细化同时生成并修正多个 token,官方称在标准 GPU 上可达约 1,107 tokens/秒,并相对 Mercury 2 有显著智能跃升;定位对标成本优化前沿档(如 GPT-5.6 Luna Low、Gemini 3.5 Flash-Lite、Claude Haiku 4.5)。官方模型页列出 260K 上下文,支持可调节推理、工具调用与结构化 JSON 输出;API 兼容 OpenAI 形态,也可经 OpenRouter 的 inception/mercury-2.5-preview 调用。官方标价为每百万 token 输入 $0.20、缓存输入 $0.02、输出 $0.75(OpenRouter 曾有限时 8 折至 2026-09-08 07:00 UTC,目录价以官网为准)。适用场景包括快速编码迭代、Agents/子代理、客服与企业搜索等延迟会叠加的生产负载。来源:https://www.inceptionlabs.ai/models 、https://openrouter.ai/inception/mercury-2.5-preview 。
- 模态
- 文本
- 许可说明
- 闭源 · 闭源 / API
能力
- 扩散式生成;可调节推理;工具调用;结构化 JSON 输出;OpenAI 兼容 API;低延迟 Agent 与编码
版本历史
Mercury 2.5 Preview
上下文 260K输入 $0.20 / 百万 tokens输出 $0.75 / 百万 tokens- dLLM 预览;约 1107 tok/s;list $0.20/$0.75