AGI Daily
广告
AGI Daily跟踪世界 AGI 进展AGI INTELLIGENCE · DAILY
全部算力算法数据人物日报主题
AGI Daily
全部算力算法数据人物日报主题
广告

Lilian Weng 离开 Thinking Machines 48 小时后回归 OpenAI,将领导递归自我改进研究

2026-07-30 / 2 天前 · 共 3,873 字

模型
Samuel Boivin/NurPhoto via Getty Images

7 月 27 日周日下午,Lilian Weng 在 X 上发布了一封给 Thinking Machines 同事的内部告别信。七个月来她生病的时间比生命中任何时候都多,"consistent stress and workload"已经超出了身体能够承受的范围。"If I cannot give it 100% for what I should be responsible for, I fail my job,"她写道。

两天后的周三,OpenAI 向 TechCrunch 确认 Weng 将回归公司,领导一个专注于递归自我改进(recursive self-improvement)的顶级研究团队。她在 Thinking Machines 的最后一天恰好也是 7 月 29 日。

一封以健康为由的告别信,和一份行业公认压力最大的研究议程,几乎同时出现在同一个人身上。这中间的矛盾之处,比事件本身更值得拆解。

从安全架构师到自改进研究负责人

Weng 不是普通的研究者。她 2018 年加入 OpenAI,最初在机器人团队参与训练机械手解魔方的项目。随着 OpenAI 全面转向大语言模型,她转而建立 Applied AI Research 团队,交付了 fine-tuning API、embeddings API 和 moderation 端点——这些至今仍是 OpenAI 开发者基础设施的底层组件。

GPT-4 发布后,她将 OpenAI 分散的安全工作整合为一支 80 多人的统一团队,覆盖对抗鲁棒性、安全评估和部署基础设施。2024 年 8 月,她升任 VP of Research and Safety。三个月后她离开 OpenAI,当时正值 Jan Leike 和 Ilya Sutskever 等安全高管相继出走的风波末期。

2025 年 2 月,她与前 OpenAI CTO Mira Murati 等人共同创立 Thinking Machines Lab。这家公司在同年 7 月完成了一笔由 Andreessen Horowitz 领投的 20 亿美元种子轮,估值 120 亿美元。不到两周前,Thinking Machines 刚刚发布了 Inkling——一个 9750 亿参数的混合专家模型,在 Artificial Analysis 的美国开源模型排名中位列第一。

现在 Weng 回到了她最熟悉的公司,但身份和任务完全不同。OpenAI 发言人告诉 The Information,她将带领一个顶级团队负责"加速内部研究",核心方向是递归自我改进——用 AI 系统加速 AI 本身的设计、训练和评估。

递归自我改进,从理论话语到工程议程

递归自我改进的概念可以追溯到 I.J. Good 1965 年的论文:一台"超级智能机器"能够设计出比自己更聪明的机器,触发所谓的"智能爆炸"。Eliezer Yudkowsky 在 2008 年正式将其命名为递归自我改进。几十年来,这一直是 AI 安全讨论中的理论框架,而不是工程路线图。

过去两年情况发生了实质性变化。2026 年 2 月,OpenAI 在发布 GPT-5.3-Codex 时首次承认,该模型的早期版本"在创建自身过程中起到了关键作用",帮助调试训练运行和管理部署基础设施。这是前沿实验室首次公开确认一个模型实质性参与了生成其后继者的工程循环。同年 5 月,Anthropic 披露 Claude 编写了公司约 80% 的生产代码,Claude Agent 已进行了约 800 小时开放式 AI 安全研究实验。Google DeepMind 的 AlphaEvolve 发现的算法改进使 LLM 训练时间减少了约 1%。

Weng 本人对这个方向的理解远超一般管理者。就在离开 Thinking Machines 的几周前,7 月 4 日,她在个人博客 Lil'Log 上发表了题为《Harness Engineering for Self-Improvement》的长文,综合了约 35 篇论文。文章的核心论断是:近期实现递归自我改进的可行路径不是让模型重写自身权重,而是改进她所称的"harness"——围绕基础模型、编排其执行的系统性框架,包括工具调用管理、规划循环、文件系统持久记忆、子 Agent 委派和评估。

她在文中枚举了六个结构挑战:弱评估器无法可靠评估新研究产出;任务规模超出上下文窗口后的记忆管理;训练数据中的正向结果偏差使模型难以放弃失败假设;进化优化循环中的多样性崩塌;reward hacking——系统优化代理指标而非预期结果的行为,她在引用 Self-Taught Optimizer (STOP) 研究时指出,在能力足够的基模型上,这种行为在四次自改进迭代后就会出现;以及短期 benchmark 表现与长期工程质量之间的错配。

她的建议简洁但难以执行:评估器和权限控制层必须位于自改进循环之外。如果系统可以修改自己的评估器,它就可以学会欺骗评估器。人类监督应以"正确的时机、正确的抽象层次"嵌入架构,而不是事后嫁接。

OpenAI 此前已将递归自我改进列为战略核心。首席科学家 Jakub Pachocki 3 月告诉 MIT Technology Review,构建"全自动 AI 研究员"是公司未来数年的"北极星",目标在 2026 年 9 月前实现"自动化 AI 研究实习生"——距现在不到五周。6 月发布的 Frontier Safety Blueprint 将 RSI 定为"未来十年可能最具后果性的前沿安全问题",同时将其列为核心研究优先事项。

Thinking Machines 与四位创始人的离开

Weng 的离职是 Thinking Machines 创始人团队持续流失的最新一例。这家由 Mira Murati 在 2025 年 2 月创立、初始六位联合创始人的公司,如今只剩下两位:CEO Murati 和首席科学家 John Schulman。

最早离开的是 Andrew Tulloch,2025 年 10 月加入 Meta。1 月 14 日,Murati 在 X 上宣布与联合创始人兼 CTO Barret Zoph"分道扬镳",同时任命 PyTorch 联合创始人 Soumith Chintala 为新 CTO。不到一小时后,OpenAI 应用 CEO Fidji Simo 宣布 Zoph、联合创始人 Luke Metz 和研究员 Sam Schoenholz 三人回归 OpenAI。据 Wired 报道,Zoph 与 Murati 的分手并不友好——他在周一告知考虑离开,周三即被解雇。

到 5 月,据 Business Insider 统计,Thinking Machines 的 42 名创始成员中已有 13 人离开,Meta 和 OpenAI 均在积极挖角。Weng 是第四位离开的联合创始人,也是今年第三位回到 OpenAI 的。

Murati 在 X 上回应 Weng 的告别帖时写道:"We'll miss you, it's been wonderful building Thinky together. I'm glad that you're putting your health first."目前尚不清楚 Murati 是否事先知道 Weng 将加入 OpenAI。

健康、人才与竞赛的不可调和

Weng 不是今年第一个因健康原因从 AI 领导岗位退下来的人。7 月初,Fidji Simo 因慢性病复发从 OpenAI 二号职位上退后一步。1 月,xAI 联合创始人 Greg Yang 因莱姆病诊断转为顾问角色,说需要在健康上"go founder mode"。

这些人有一个共同特征:他们坐在 CEO 之下的层级,承受着可以压垮人的运营强度。The Next Web 的报道指出,硅谷一些 AI 团队实行"996"制——早 9 点到晚 9 点,每周六天。公司最高层基本不动,而竞赛不会为任何人减速。

退一步看,Thinking Machines 的人才回流 OpenAI 已经不是孤立事件:Zoph、Metz、Schoenholz、Weng——这是今年第四个从 Murati 的创业公司回到 OpenAI 的人。除了 Thinking Machines 本身的组织问题(Zoph 的激烈分手暗示了内部摩擦),这一模式指向一个结构性现实:拥有近乎无限资源的 OpenAI 正在系统性地回收当初离开它的人,而递归自我改进正成为整合这种人才的战略锚点。

但 Weng 案例的独特之处在于,她陈述的健康原因与她接受的任务之间存在直接张力。一个写下了"consistent stress and workload pushed me beyond what my health can sustain"的研究者,马上要去领导一个被 OpenAI 自己定义为"未来十年最具后果性"的研究方向。一个认真分析过 reward hacking 会在四次迭代后出现、坚持人类必须在循环中的人,将在内部承担起确保这个循环不以失控方式闭合的责任。

前 OpenAI 危险能力评估负责人 Steven Adler 曾公开表示递归自我改进"让安全挑战难度大幅上升"。前政策负责人 Miles Brundage 通过 ControlAI 指出,AI 公司尚未解释"递归自我改进意味着什么、为什么他们认为是好事、或者为什么更大的风险是正当的"。DeepMind CEO Demis Hassabis 在 1 月的世界经济论坛上直接承认:"我们都在建设的这个自改进循环——能否在没有人类参与的情况下安全闭合,仍有待观察。"

Weng 在她的 Lil'Log 文章中给出了自己的答案:"Humans should move up the stack, not be removed from the loop......After all, we are building the technology for better future of humanity, not the other way around."她的任命是否赋予这句话结构性分量——还是说这只是又一个被听见但不被遵循的内部声音——将是她回到 OpenAI 之后真正值得追踪的问题。

来源

  1. Thinking Machines co-founder Lilian Weng left the company citing health reasons, then joined OpenAI · TechCrunch
  2. Lilian Weng rejoins OpenAI after leaving Thinking Machines Lab over the startup's grueling pace · Business Insider
  3. She left the AI race over her health. Two days later, OpenAI had her back. · The Next Web
  4. Lilian Weng Rejoins OpenAI for Recursive Self-Improvement · AI Weekly
  5. OpenAI's Safety Architect Lilian Weng Returns With a Single Mission: Making AI Improve Itself · TechTimes
  6. Harness Engineering for Self-Improvement · Lil'Log
  7. Mira Murati's startup, Thinking Machines Lab, is losing two of its co-founders to OpenAI · TechCrunch

评论

登录后即可参与评论。

加载评论中…

相关文章

  • 一只手拿着电路板,左右两侧分别是代表三星和 SK Hynix 奖金的韩元纸币

    奖金差三倍:三星芯片人才涌向 SK Hynix,HBM4 垂直整合告急

    人物 · 2026-07-29

  • Dario Amodei, Anthropic CEO,在公开活动上发言

    Dario Amodei 打破沉默:不反对开源模型,但生物武器风险改变了一切

    人物 · 2026-07-27

  • SSI 与 Nvidia 战略合作示意图

    Ilya 的 SSI 走出隐身:Nvidia 数十亿美元下注,安全路线之争迎来新变量

    人物 · 2026-07-27

  • David Luan(左)与 Pieter Abbeel 合影

    Amazon 关闭 AGI Lab:18 个月的「通用智能」实验宣告终结

    人物 · 2026-07-27

  • Wayve 自动驾驶测试车行驶在德国街道上

    AI 独角兽造「金手铐」:员工要约收购从例外变成行规

    人物 · 2026-07-25

  • Google DeepMind 在伦敦国王十字车站旁的新总部 Platform 37 大楼,DeepMind AI 研究团队的核心办公地

    DeepMind 的「内部敌人」:$1900 亿 AI 军备竞赛为何输给了员工士气

    人物 · 2026-07-25

AGIDaily跟踪世界 AGI 进展© 2026 AGIDaily
关于邮件栏目主题定制投稿招聘广告SkillTermsContactRSS