微软发布旗下首款具备思考能力的 MAI-Thinking-1 AI 模型

微软正式推出了 MAI-Thinking-1，这是该公司首款自主研发的"思考型"AI 模型。这款新品领衔了包含七款模型的全新 MAI 家族，涵盖文本、代码、图像及语音生成领域，彰显了微软旨在降低对 OpenAI 依赖、大力发展自有 AI 平台的战略方向。

Build 2026 大会亮相的七款新模型之一

在 Build 2026 大会上，微软一口气发布了多款自研 AI 模型，其中备受瞩目的旗舰新品便是 MAI-Thinking-1。这是微软在模型研发上迈出的一大步：公司直到去年才推出首批自研模型，而在此之前一直依赖 OpenAI 的技术。近期双方已修订合作协议，彼此间的绑定关系有所减弱。微软 AI 部门负责人穆斯塔法·苏莱曼（Mustafa Suleyman）亲自介绍了这七款模型组成的全新家族。

MAI-Thinking-1

MAI-Thinking-1 是微软 AI 旗下的旗舰级思考模型。这是一款中等规模的模型，据微软介绍，它在关键的软件开发测试中表现不输行业顶尖模型（尤其在 SWE-Bench Pro 榜单中取得了顶尖成绩之一），并且在盲测中，其用户偏好度与 Sonnet 4.6 持平。

该模型完全使用纯净数据从零开始训练，未对任何第三方模型进行蒸馏。

MAI 家族的其他模型

其余的新品覆盖了图像生成、语音转文字、语音合成以及代码编写等领域：

MAI-Code-1-Flash：一款资源消耗极低的代理式代码编写模型。它拥有 50 亿参数，性能对标 Haiku，但成本更低；目前已内置于 GitHub Copilot 和 Visual Studio Code 中。
MAI-Image-2.5 及其 Flash 版本：支持文本生成图像及图像编辑功能；在 Arena 排行榜上，该模型的表现超越了 Nano Banana Pro。
MAI-Transcribe-1.5：具备创纪录精度的语音转文字模型，速度是同类竞品的五倍，并支持 43 种语言的专业行业术语。
MAI-Voice-2：支持 15 种语言的自然语音合成，只需极短的音频样本即可模仿特定声音，并配备了防滥用保护机制。更经济的 MAI-Voice-2-Flash 版本将在稍后推出。

目前，这些模型已在 Microsoft Foundry 平台上线，开发者也可以通过 OpenRouter、Fireworks 和 Baseten 进行调用；这也是微软首次允许用户自行调整模型权重。MAI-Thinking-1 的问世表明，微软正愈发自信地构建自己的 AI 模型产品线，并持续降低对 OpenAI 的依赖。