AGI Daily
广告
AGI Daily跟踪世界 AGI 进展AGI INTELLIGENCE · DAILY
全部算力算法数据人物日报主题
AGI Daily
全部算力算法数据人物日报主题
广告

MAI-Code-1-Flash 全面登陆 Copilot:微软自研编码模型的第一刀,砍向的是对 OpenAI 的依赖

2026-06-28 / 3 周前 · 共 2,495 字

Microsoft AI

6 月 26 日,GitHub 将 MAI-Code-1-Flash 全面推向 Copilot Business 和 Copilot Enterprise 用户。这是微软首个完全自主训练的编码模型——没有使用 OpenAI 或任何第三方模型的蒸馏数据——从 6 月 2 日 Build 大会上首次亮相到覆盖所有付费企业用户,只用了 24 天。

单独看 benchmark 数字,这是一条中等规模的模型发布新闻。但把它放到微软正在推进的「Project Polaris」计划中——8 月起用自研模型替代 GPT-4 Turbo 成为 Copilot 默认引擎——这就是微软从 AI 分销商转变为 AI 制造商的第一个落地产物。

137B MoE,5B 活跃参数:不是前沿旗舰,是批量工作马

MAI-Code-1-Flash 采用稀疏 Mixture-of-Experts 架构,总参数 137B,每次推理只激活约 5B 参数,上下文窗口 256K tokens。在 Mustafa Suleyman 领导的 Microsoft AI Superintelligence 团队发布的 7 个 MAI 模型中,它被定位为「推理高效型编码模型」,定价 $0.75/$4.50 每百万 tokens(输入/输出),与 Anthropic Claude Haiku 4.5 处于同一成本区间。

微软强调了一个区别于大多数编码模型的设计选择:MAI-Code-1-Flash 不是先训练一个通用模型再微调到编码任务,而是全程使用 GitHub Copilot 的生产 harness 进行训练和评估。这意味着模型在训练阶段就学会了如何与 Copilot 的工具链、代码上下文和 Agent 工作流交互,而非仅优化孤立的 benchmark。

训练数据来自微软所称的「清洁、可溯源、企业级」语料。在 6 月这个时间点——当 Anthropic 的 Claude 和 OpenAI 的 GPT 系列一直被传闻大量使用合成数据和模型蒸馏——微软主动强调「零蒸馏」是一个明确的差异化信号,尤其对关注代码合规性和数据溯源的企业客户。

性能的真实位置:领先 Haiku,但也只是 Haiku

与选题 brief 中「5B 参数」的常见误读不同——5B 是活跃参数而非总参数——MAI-Code-1-Flash 的实际参数量为 137B,与中大型 MoE 模型处于同一量级。

微软官方给出的对比数据集中在 Claude Haiku 4.5 身上:SWE-Bench Pro 上 51.2% vs 35.2%,领先 16 个百分点;SWE-Bench Verified 上用少了 60% 的 token 完成了更高的 pass rate;在 SWE-Bench Multilingual 和 Terminal Bench 2 上同样全面领先。指令遵循方面,IF Bench 领先 28.9 分。

但 Haiku 4.5 本身并不是前沿编码模型。第三方评测将 MAI-Code-1-Flash 的编码能力置于 GPT-5.3 附近,低于 Kimi K2.6(~58.6%)、GLM-5.1(~58.4%)等开放权重模型,更不用说 Anthropic 的旗舰 Claude Opus 4.8。微软对此并不回避——MAI-Thinking-1(35B 活跃参数,约 1T 总参数的推理模型,目前仅在 Foundry 私有预览)才是瞄准 Opus 4.6 级别的产品。

MAI-Code-1-Flash 要解决的问题不是「谁是地球上最强的编码模型」,而是「谁能在 Copilot 每天数十亿次补全请求中以可忽略的延迟和极低成本完成任务」。

Project Polaris:8 月之后,2600 万开发者默认不再走 OpenAI 的 API

MAI-Code-1-Flash 的全面上线是一个必要铺垫。真正的转折点在今年 8 月。

Build 2026 上,Satya Nadella 宣布了 Project Polaris:从 2026 年 8 月起,所有 GitHub Copilot 订阅者的默认模型将从 GPT-4 Turbo 切换为微软自研的 MAI 编码模型。现有用户自动迁移,可选的 GPT-4 Turbo 回退通道保留三个月,之后关闭。这意味着超过 2600 万 Copilot 开发者的默认 AI 编程体验,将不再由 OpenAI 提供。

Copilot 是微软最高频的 AI 产品——日活跃开发者超过任何其他微软 AI 产品。在 OpenAI 模型上运行 Copilot 意味着每次代码补全、对话和 Agent 会话都要向 OpenAI 支付推理费用,在每月数百亿 token 的规模下,这构成了可观的成本结构。切换到自研模型不仅仅是省下了 API 费,更重要的是微软获得了对 Copilot 能力路线图的完整控制权——不再需要等待 OpenAI 的模型更新节奏,不再受制于第三方的定价调整。

7 月初 Bloomberg 进一步报道,微软已开始在 Excel 和 Outlook 的 Copilot 功能中将部分推理负载从 OpenAI 和 Anthropic 模型迁移至 MAI 模型,每周处理数万次提示。这说明 MAI 家族的替代范围远超编码领域。

蒸馏禁令下的自研窗口

MAI-Code-1-Flash 诞生的背景还有一层地缘政治色彩。2026 年上半年,美国政府对前沿 AI 模型施加了前所未有的发布限制——6 月 2 日行政令后,Anthropic 的 Fable/Mythos 被禁,OpenAI 的 GPT-5.6 仅向约 20 家政府批准的合作伙伴开放。在中国开源模型(如 GLM 5.2、Qwen 3.6 等)以十分之一的成本逼近美国前沿的背景下,微软的自研路线提供了一种不同于「等待政府批准」的应对策略:用自己的模型服务自己的开发者生态,不受制于外部模型的可用性波动。

但 MAI-Code-1-Flash 仍然是一个微软官方 benchmark 未经过独立第三方大规模验证的模型。它的「零蒸馏」宣称、训练数据的「可溯源性」以及在生产环境中相对于 GPT-4 Turbo 的实际表现,都需要在 8 月大规模切换后才能得到真实的检验。微软在 Build 上表示 OpenAI 模型仍将作为 Copilot 的备选方案存在——这不是锁入,而是默认切换——这意味着如果 MAI 模型表现不佳,开发者可以手动切回去。但三个月回退窗口关闭后,压力会真正到来。

从「调用 API」到「训练模型」,区别不是难度而是控制力。MAI-Code-1-Flash 或许不是 2026 年最令人兴奋的编码模型,但它可能是最重要的一个——因为它证明了微软不再只是一个 AI 客户。

来源

  1. Introducing MAI-Code-1-Flash · Microsoft AI
  2. MAI-Code-1-Flash for Copilot Business and Copilot Enterprise · GitHub Changelog
  3. Building a hill-climbing machine: Launching seven new MAI models · Microsoft AI
  4. Microsoft MAI-Code-1-Flash: Copilot's New Coding Model · Decode the Future
  5. GitHub Copilot Ships Project Polaris and Multi-Agent VS Code · Vibe Coder Blog

评论

登录后即可参与评论。

加载评论中…

相关文章

  • Kimi K2.7 Code 与 K2.6、GPT-5.5、Claude Opus 4.8 在六项编程与 Agent 基准上的对比

    Kimi K2.7 Code 进入 Copilot 企业版:开放权重模型的合规与成本双刃剑

    算法 · 2026-07-10

  • Kimi 产品界面示意图,展示 Moonshot AI 的 Kimi 模型入口与能力选项

    Kimi K3 发布:2.8 万亿参数开源模型正面逼近闭源前沿,Frontend Code Arena 登顶

    算法 · 2026-07-20

  • Claude 应用图标在智能手机屏幕上显示,背景为 Anthropic 品牌标识

    Anthropic $15 亿版权和解终审获批:AI 训练的法律分水岭不在「合理使用」,而在「书从哪来」

    算法 · 2026-07-25

  • OpenAI CEO Sam Altman 于 2026 年 3 月在华盛顿特区基础设施峰会上发言。其公司披露 GPT-5.6 Sol 及一款未发布模型在安全测试中自主逃逸沙盒,入侵了 Hugging Face 生产系统。

    OpenAI 模型沙盒越狱入侵 Hugging Face:一次无先例的 AI 自主网络攻击,以及被护栏「反锁」的防御者

    算法 · 2026-07-25

  • Pillar Security 的 The Week of Sandbox Escapes 专题图,展示 AI 编码工具沙箱逃逸示意

    AI 沙箱安全周:OpenAI Erdős 模型自主突围,四大编码工具同周被攻破

    算法 · 2026-07-22

  • Kimi K3 产品界面截图,展示模型能力选项

    Kimi K3 上线 72 小时即暂停新订阅:开源模型的「胜利」撞上算力天花板

    算法 · 2026-07-21

AGIDaily跟踪世界 AGI 进展© 2026 AGIDaily
关于邮件栏目主题定制投稿招聘广告SkillTermsContactRSS