Mercury
Mercury

Mercury

扩散AI

Inception Labs 极速通用扩散大语言模型

访问官网
收录: 2026-09-09·更新: 2026-09-09·大语言模型

详细介绍

产品定位
Mercury 是 Inception Labs 推出的通用扩散大语言模型(Diffusion LLM),与 GPT、DeepSeek 等自回归模型逐个输出 token 不同,它从整段噪声草稿开始、经多步去噪并行精炼全部 token,把生成延迟与输出长度解耦,官方宣称速度可达每秒上千 token。相比代码专精的早期 Mercury Coder,Mercury 是面向通用推理与 Agent 的旗舰主线,最新 Mercury 2.5 号称迄今训练过的最大扩散语言模型。

核心能力
Mercury 2.5 提供可调推理层级、并行与原生工具调用、JSON 结构化输出,上下文窗口从 Mercury 2 的 128K 提升到 260K;官方称相较 Mercury 2 智能提升约四成,综合能力对标 GPT-5.6 Luna、Gemini 3.5 Flash-Lite 与 Claude Haiku 4.5 等成本优化模型,瞄准搜索 Agent、语音 Agent、编程子代理等对延迟敏感的复合调用场景,可通过 Inception API、OpenRouter、Baseten 接入。

实测表现
第三方实测确认其生成速度极快、肉眼无需快进,但推理与代码落地仍明显偏弱:强约束指令生成语句不通、24 点等推理题难解、浏览器自动化多失效,整体更像一款潜力巨大的新架构尝试。官方公布的速度与智能数据目前多为厂商口径,尚待更广泛的独立基准复现验证。