技术栈

扩散语言模型(dllm)

QC·Rex
3 小时前
agent 架构·扩散语言模型(dllm)·mercury 2.5·inception labs·低延迟推理·schema-aligned
Mercury 2.5 发布:当扩散大模型跑到 1,107 tokens/sec —— dLLM 的延迟经济学与 Java/Python 落地实战2026 年 9 月 8 日(UTC),Inception Labs 正式发布 Mercury 2.5。根据官方博客,这是目前市场上能力最强的扩散式大语言模型(diffusion LLM,简称 dLLM),也是官方声称"有史以来训练过的最大扩散语言模型"。三个数字构成了这次发布的核心叙事:1,107 tokens/sec 的生成速度、260K 的上下文窗口、以及发布期 $0.04/百万输入 token 的促销价格。消息当天登上 Hacker News 热榜,并同步上架 OpenRouter(模型 ID:i
我是有底线的