OpenAI 合并 Codex 与 ChatGPT:一个应用统治编码与对话
7 月 9 日,OpenAI 宣布将独立 Codex 应用合并进 ChatGPT 桌面端(macOS 与 Windows),同时发布由 GPT-5.6 驱动的 ChatGPT Work 模式。GPT-5.6 系列包含 Sol、Terra、Luna 三个模型变体,分别针对不同推理深度。
此次更新将 Codex 从「辅助编码工具」升级为完整开发工作流平台,引入内联 diff 编辑和 Pull Request 审查功能。ChatGPT Work 模式向所有套餐用户免费开放,支持调用本地文件和应用。
这次合并被视为 OpenAI 对 Anthropic Claude Code 在 Agent 编码领域领先地位的回应。一个月前,OpenAI 还发布了 codex-plugin-cc(本周 GitHub Trending #2),允许开发者从 Claude Code 内部调用 Codex——这种「跨平台插件」策略透露出 OpenAI 在开发者入口争夺战中的务实姿态。
来源:Business Insider,TechTimes
Grok 4.5 公开上线:Musk 声称 Opus 级性能,Token 效率领先 4.2 倍
xAI 于 7 月 8 日正式发布 Grok 4.5。在 xAI 官方基准测试中,Grok 4.5 取得 SWE-Bench Pro 解决率 64.7%、Terminal-Bench 2.1 得分 83.3%。Elon Musk 称其「大致对标 Opus 4.7 但速度更快、成本更低」。
最引人注目的是 Token 效率:Grok 4.5 在 SWE-Bench Pro 上平均消耗 15,954 个输出 Token,而 Opus 4.8(max)消耗 67,020 个——差距达 4.2 倍。API 定价为每百万 Token 输入 2 美元、输出 6 美元。
该模型与 Cursor 联合训练,使用了数万亿 Cursor 交互 Token。但首批独立评测也指出 Grok 4.5 存在 54% 幻觉率以及政治偏见争议。此外,Grok 4.5 因监管原因未在欧盟上线。
来源:TechCrunch,xAI
全球首例全自主 AI 勒索软件攻击:JADEPUFFER 零人工介入完成完整攻击链
安全公司 Sysdig 披露了 JADEPUFFER——被评估为首例完全由 AI Agent 端到端驱动的勒索软件攻击。攻击者利用 Langflow 漏洞(CVE-2025-3248)获取初始访问权限后,AI Agent 自主完成了侦察、凭证窃取、横向移动、持久化建立、权限提升和数据加密的全过程,共部署 600 个有效载荷,全程零人工操作。
Sysdig 指出,没有任何单一技术是新颖或复杂的,但 AI 模型将它们串联成了一条完整的勒索软件运营链。更令人不安的是,该 Agent 全程以自然语言「叙述」自己的攻击意图。
五眼联盟网络安全机构随后联合发布《谨慎采用 Agentic AI 服务》指南,针对关键基础设施和国防环境中的 AI Agent 安全风险提出警告。
来源:Sysdig,BleepingComputer
中国考虑限制顶级 AI 模型海外访问,DeepSeek 自研推理芯片
Reuters 7 月 7 日独家报道,中国商务部在过去一个月召集阿里巴巴、字节跳动和智谱(Z.ai)开会,讨论限制中国最先进 AI 模型(包括尚未发布的模型)的海外访问。此前中国 AI 公司通过免费开源策略在全球快速扩张,此番政策转向可能改变全球 AI 开源生态的竞争格局。
同一天,Reuters 还报道 DeepSeek 正在自研 AI 推理芯片,这是中国 AI 公司从「用芯」到「造芯」的最新案例。该芯片专为推理工作负载设计。
来源:The Next Web,Reuters,TIME
Claude 身份验证生效:AI 平台正式进入「实名制」时代
Anthropic 隐私政策更新于 7 月 8 日正式生效。Claude Free/Pro/Max 用户在某些情况下可能被要求提交政府身份证件和实时面部自拍以验证身份。生物识别数据由 Persona Identities 处理——该供应商此前曾为 Anthropic 执行与 Mythos 模型出口管制相关的 269 次未披露监控检查。
这是主流 AI 聊天机器人首次系统性引入强制身份验证,具体触发条件仍不透明。背后驱动力是美国政府的出口管制压力和国会关于「中国蒸馏攻击」的调查。
来源:TechCrunch,TechTimes