微软正式推出了 MAI-Thinking-1,这是该公司首款自主研发的“思考型”AI 模型。这款新品领衔了包含七款模型的全新 MAI 家族,涵盖文本、代码、图像及语音生成领域,彰显了微软旨在降低对 OpenAI 依赖、大力发展自有 AI 平台的战略方向。
在 Build 2026 大会上,微软一口气发布了多款自研 AI 模型,其中备受瞩目的旗舰新品便是 MAI-Thinking-1。这是微软在模型研发上迈出的一大步:公司直到去年才推出首批自研模型,而在此之前一直依赖 OpenAI 的技术。近期双方已修订合作协议,彼此间的绑定关系有所减弱。微软 AI 部门负责人穆斯塔法·苏莱曼(Mustafa Suleyman)亲自介绍了这七款模型组成的全新家族。
MAI-Thinking-1 是微软 AI 旗下的旗舰级思考模型。这是一款中等规模的模型,据微软介绍,它在关键的软件开发测试中表现不输行业顶尖模型(尤其在 SWE-Bench Pro 榜单中取得了顶尖成绩之一),并且在盲测中,其用户偏好度与 Sonnet 4.6 持平。
该模型完全使用纯净数据从零开始训练,未对任何第三方模型进行蒸馏。
其余的新品覆盖了图像生成、语音转文字、语音合成以及代码编写等领域:
MAI-Code-1-Flash:一款资源消耗极低的代理式代码编写模型。它拥有 50 亿参数,性能对标 Haiku,但成本更低;目前已内置于 GitHub Copilot 和 Visual Studio Code 中。
MAI-Image-2.5 及其 Flash 版本:支持文本生成图像及图像编辑功能;在 Arena 排行榜上,该模型的表现超越了 Nano Banana Pro。
MAI-Transcribe-1.5:具备创纪录精度的语音转文字模型,速度是同类竞品的五倍,并支持 43 种语言的专业行业术语。
MAI-Voice-2:支持 15 种语言的自然语音合成,只需极短的音频样本即可模仿特定声音,并配备了防滥用保护机制。更经济的 MAI-Voice-2-Flash 版本将在稍后推出。
目前,这些模型已在 Microsoft Foundry 平台上线,开发者也可以通过 OpenRouter、Fireworks 和 Baseten 进行调用;这也是微软首次允许用户自行调整模型权重。MAI-Thinking-1 的问世表明,微软正愈发自信地构建自己的 AI 模型产品线,并持续降低对 OpenAI 的依赖。