微软发布旗下首款具备思考能力的 MAI-Thinking-1 AI 模型

微软正式推出了 MAI-Thinking-1,这是该公司首款自主研发的"思考型"AI 模型。这款新品领衔了包含七款模型的全新 MAI 家族,涵盖文本、代码、图像及语音生成领域,彰显了微软旨在降低对 OpenAI 依赖、大力发展自有 AI 平台的战略方向。

Build 2026 大会亮相的七款新模型之一

在 Build 2026 大会上,微软一口气发布了多款自研 AI 模型,其中备受瞩目的旗舰新品便是 MAI-Thinking-1。这是微软在模型研发上迈出的一大步:公司直到去年才推出首批自研模型,而在此之前一直依赖 OpenAI 的技术。近期双方已修订合作协议,彼此间的绑定关系有所减弱。微软 AI 部门负责人穆斯塔法·苏莱曼(Mustafa Suleyman)亲自介绍了这七款模型组成的全新家族。

MAI-Thinking-1

MAI-Thinking-1 是微软 AI 旗下的旗舰级思考模型。这是一款中等规模的模型,据微软介绍,它在关键的软件开发测试中表现不输行业顶尖模型(尤其在 SWE-Bench Pro 榜单中取得了顶尖成绩之一),并且在盲测中,其用户偏好度与 Sonnet 4.6 持平。

该模型完全使用纯净数据从零开始训练,未对任何第三方模型进行蒸馏。

MAI 家族的其他模型

其余的新品覆盖了图像生成、语音转文字、语音合成以及代码编写等领域:

  • MAI-Code-1-Flash:一款资源消耗极低的代理式代码编写模型。它拥有 50 亿参数,性能对标 Haiku,但成本更低;目前已内置于 GitHub Copilot 和 Visual Studio Code 中。
  • MAI-Image-2.5 及其 Flash 版本:支持文本生成图像及图像编辑功能;在 Arena 排行榜上,该模型的表现超越了 Nano Banana Pro。
  • MAI-Transcribe-1.5:具备创纪录精度的语音转文字模型,速度是同类竞品的五倍,并支持 43 种语言的专业行业术语。
  • MAI-Voice-2:支持 15 种语言的自然语音合成,只需极短的音频样本即可模仿特定声音,并配备了防滥用保护机制。更经济的 MAI-Voice-2-Flash 版本将在稍后推出。

目前,这些模型已在 Microsoft Foundry 平台上线,开发者也可以通过 OpenRouter、Fireworks 和 Baseten 进行调用;这也是微软首次允许用户自行调整模型权重。MAI-Thinking-1 的问世表明,微软正愈发自信地构建自己的 AI 模型产品线,并持续降低对 OpenAI 的依赖。

相关推荐
冬奇Lab5 小时前
每日一个开源项目(第140篇):AgentScope 2.0 - 阿里开源的生产级 Agent 框架
人工智能·开源·agent
冬奇Lab5 小时前
Skill 系列(04):Skill 指标体系——L1/L2/L3 三层监控,让质量下降有据可查
人工智能·开源·llm
IT_陈寒6 小时前
Vite的静态资源打包让我熬夜到三点,这坑千万别跳
前端·人工智能·后端
玩转AI不是事7 小时前
用IndexedDB做AI对话离线缓存实战
人工智能
Asize8 小时前
多模态生图:从 Vite 工程化到前端调用 Qwen Image
javascript·人工智能·后端
MobotStone8 小时前
AI项目越多,为什么越容易失控
人工智能·aigc
十有八七8 小时前
AI时代的置身X内
前端·人工智能
Lkstar8 小时前
A2A协议深度解析|Agent2Agent通信标准,智能体互联网的"HTTP"
人工智能·llm
百度Geek说8 小时前
当代码越来越便宜,什么在变贵?
人工智能
橘子星8 小时前
LLM 无状态架构实践:从原理到代码落地
前端·javascript·人工智能