7 月 28 日,GitHub 在 Changelog 中宣布 Grok 4.5 进入 Copilot 模型选择器,覆盖 VSCode、Visual Studio、Copilot CLI、JetBrains、Xcode、Eclipse 和云端 Agent 共八个入口,面向 Pro 至 Enterprise 全部付费层级,企业版默认关闭、需管理员手动启用。
这不是 xAI 第一次出现在 Copilot 里。2025 年 8 月,Grok Code Fast 1 以公开预览形式上线,主打"快速日常编码",定价 $0.20/$1.50 每百万 token。九个月后——2026 年 5 月 15 日——GitHub 将其从全平台退役,建议用户改用 GPT-5 mini 或 Claude Haiku 4.5。在 Reddit 相关讨论中,一条被顶到首位的评论写道:"I tried grok code fast 1 months ago, utterly useless."
Grok Code Fast 1 的失败暴露了 xAI 当时在开发者工具市场的结构性短板:没有专属训练数据,没有独立分发渠道,只有一个在通用 benchmark 上不错但在实际编码任务中缺乏竞争力的模型。Grok 4.5 的回归——仅隔两个半月——之所以值得认真对待,正是因为 xAI 在这段时间里把这两块短板都补齐了。
从 Grok Code Fast 1 到 Grok 4.5,中间发生了什么
2026 年上半年,xAI 经历了两次根本性的组织变化。
2 月,SpaceX 正式收购 xAI,将其纳入旗下 AI 部门。这次合并让 xAI 获得了 Colossus 超算集群的使用权——一个由 20 万块 NVIDIA GPU 驱动的训练基础设施。Grok 4.5 就是在数万块 GB300 GPU 上训练的。
4 月,SpaceX 宣布与 AI 编程工具 Cursor 达成交易:有权以 600 亿美元全股票收购 Cursor,或支付 100 亿美元合作费用。6 月,收购正式公告,预计 Q3 完成交割。Cursor 当时年化收入约 30 亿美元,拥有超过 100 万付费用户和近 70% 的财富 1000 强企业客户。SpaceX 在公告中直言:"Cursor 的领先产品和专业软件工程师的分发渠道,与 SpaceX 百万 H100 等效的 Colossus 训练超算结合,将让我们构建世界上最有用的模型。"
这句话概括了 xAI 的新战略逻辑:Cursor 提供两样东西——真实开发者工作流中的交互数据用于训练,以及一个能让 Grok 直接触达付费开发者的 IDE 分发渠道。Grok 4.5 在发布公告中写明"trained alongside Cursor",且模型首发渠道就包括 Cursor 全计划免费使用。
两次组织变化指向同一个结果:xAI 从一家靠马斯克个人号召力驱动的模型公司,变成了 SpaceX 体系内一个拥有算力、训练数据和分发渠道的垂直整合部门。
Grok 4.5 的实际编码能力:有进步,但未动摇格局
Grok 4.5 在编码 benchmark 上的表现相比 Grok Code Fast 1 有了实质性提升。根据第三方评测平台 Vals.ai 的数据,Grok 4.5 在 SWE-bench Verified 上得分 86.60%,位列第三,排在 Claude Fable 5(95.00%)和 Claude Opus 4.8(88.60%)之后。在 Terminal-Bench 2.1 上得分 83.3%,在 SWE Marathon pass@1 上以 29.0% 排在第一。
xAI 自己的说法是 Grok 4.5 的 token 效率约为同级前沿模型的两倍——用一半的步骤完成任务——推理速度达到 80 TPS,定价 $2/$6 每百万 token,相当于 Claude Opus 4.7($5/$25)的 40%/24%。
但这些数字需要结合上下文理解。SWE-bench Verified 的前两名都被 Anthropic 占据;xAI 未公布 GPQA、MMLU-Pro、AIME、ARC-AGI-2 等通用推理 benchmark 的成绩——这在一个模型声称自己擅长"知识工作"时是一个明显的信号缺失。500K 的上下文窗口也小于 Grok 4 的 2M,对于需要跨大型代码库工作的场景是一种退步。
更关键的是,在 Copilot 内部,Grok 4.5 与 Anthropic 十款 Claude(从 Haiku 4.5 到 Fable 5)、OpenAI 八款 GPT(从 5 mini 到 5.6 Sol/Terra)、Google 四款 Gemini、微软自研 MAI-Code-1-Flash 和 Moonshot AI 的 Kimi K2.7 Code 同台竞争。根据 JetBrains 2026 年 1 月的开发者调查,GitHub Copilot 在工作场所的采用率为 29%,但"最受喜爱度"仅为 9%——Claude Code 是 46%,Cursor 是 19%。开发者的忠诚度不在平台,而在模型性能。
Microsoft 为什么让竞争对手的模型进来
Grok 4.5 进入 Copilot 的决策需要放在 Microsoft 的多模型战略中理解。
2025 年以来,Microsoft 与 OpenAI 的关系经历了四次公开重新谈判。Microsoft 的持股从 32.5% 降至约 27%,OpenAI 向公益公司转型。同时,Microsoft 在 Build 2026 上展示了自研模型 MAI-Code-1-Flash,并将其部署到 Copilot 的自动模型选择系统中。今年 4 月,GitHub 还宣布将使用 Copilot 用户交互数据训练 AI 模型,默认启用——这本质上是 Microsoft 在建立独立于 OpenAI 的训练数据管道。
在这个框架下,引入 Grok 4.5 的逻辑不是"Microsoft 选择了 xAI",而是"Microsoft 选择不被任何一家供应商绑定"。Copilot Studio 此前已接入 Grok 4.1 Fast(仅限美国地区),Copilot 本身也早已支持 Anthropic 和 Google 的模型。对 Microsoft 而言,更多的模型供应商意味着更强的议价能力和更低的单点故障风险。Grok 4.5 在企业版中默认关闭、需管理员手动开启的设置,也表明 Microsoft 的态度是"提供选项"而非"推荐采用"。
《The Pragmatic Engineer》2026 年开发者调查和 JetBrains 调查共同指向一个趋势:成熟开发者平均使用 2.3 个 AI 编码工具,根据任务在不同模型之间切换已成常态。Copilot 正在从"GPT 的 GUI 封装"变成一个模型路由平台,Grok 4.5 是这个平台上的第 29 个选项。
一个隐含的矛盾:Cursor 与 Copilot 的竞合关系
Grok 4.5 进入 Copilot 的同时,xAI 正在等待完成对 Cursor 的收购——而 Cursor 是 Copilot 在 AI 原生 IDE 赛道上最直接的竞争对手。Cursor 的年化收入已达 20-40 亿美元区间,Copilot 虽然拥有约 2000 万总用户和 470 万付费订阅者,但 JetBrains 调查显示其工作场所采用率正在下降。
xAI 的策略似乎是双线作战:通过 Cursor 建立从模型到 IDE 的垂直闭环(类似 Apple 的软硬一体),同时通过 Copilot 的分发渠道获取 Cursor 覆盖不到的开发者群体。但这种"两边下注"的可持续性存疑——Microsoft 没有理由长期为一个正在被竞争对手收购的模型提供分发渠道,尤其当 Microsoft 自己的 MAI-Code-1-Flash 成熟后。xAI 在 Copilot 中的位置,可能是一个有时间窗口的机会而非长期阵地。
接下来观察什么
Grok 4.5 能否在 Copilot 中存活超过九个月,取决于三个变量。
第一是实际使用数据。Grok Code Fast 1 在 Copilot 中退役的官方理由从未公开,但 Reddit 和 GitHub Community 中的开发者反馈指向同一个方向:性能不匹配。Grok 4.5 的 benchmark 更强,但 benchmark 与实际编码体验之间的差距只能由开发者用脚投票来弥合。
第二是 Cursor 收购的监管审批。600 亿美元的交易涉及反垄断审查,如果收购受阻或延迟,xAI 的垂直整合叙事将出现裂缝。
第三是 Microsoft 自研模型的进展。MAI-Code-1-Flash 已进入 Copilot 的自动模型选择系统。如果 Microsoft 自己的模型在编码 benchmark 上接近前沿水平,外部供应商在 Copilot 中的战略价值将大幅缩水。对 xAI 而言,Copilot 分销渠道的重要性可能被 Cursor 的自有分发所取代——前提是 Cursor 收购能够顺利完成。
Grok 4.5 进入 Copilot 不是 xAI 开发者工具故事的终点,而是一个压力测试的开始:在 AI 编程工具从"选模型"转向"选平台"的过渡期,xAI 能否同时拥有模型能力和平台控制力。

