翁荔重返 OpenAI 领导自进化团队,Thinking Machines 六联创仅剩两人
7 月底,因健康原因离开 Thinking Machines Lab 不到一周的翁荔,确认重返 OpenAI,负责领导内部优先级极高的 RSI(自进化)团队——目标是让模型训练并改进自己的后继模型。至此,TML 六位联合创始人中已有三人回归 OpenAI,仅剩 CEO Mira Murati 与首席科学家 John Schulman。
7 月底,因健康原因离开 Thinking Machines Lab 不到一周的翁荔,确认重返 OpenAI,负责领导内部优先级极高的 RSI(自进化)团队——目标是让模型训练并改进自己的后继模型。至此,TML 六位联合创始人中已有三人回归 OpenAI,仅剩 CEO Mira Murati 与首席科学家 John Schulman。
翁荔加入 OpenAI,早期负责强化学习与机器人研究。
OpenAI 经历高层震荡——Ilya Sutskever、Jan Leike、John Schulman、Mira Murati、Barret Zoph 等核心人物数月内相继离开。翁荔也选择离职,公开理由是"在 OpenAI 工作近七年后,希望离开去探索新的东西",未指向安全路线分歧。
加入 Mira Murati 创办的 Thinking Machines Lab,任联合创始人。公司愿景:让前沿 AI 更容易被用户定制,同时推进安全与对齐。
TML 完成 20 亿美元种子轮融资,投后估值 120 亿美元——a16z 领投,Nvidia、AMD 参投,为硅谷历史上规模最大的种子轮之一。
翁荔宣布离开 TML,主因是连续数月的健康问题与创业高强度工作带来的身体压力。她在声明中说:"自己无法以初创公司所需的节奏继续工作下去",并希望找一个"有明确边界的岗位"。CEO Murati 留言:"很高兴你把健康放在第一位。"
确认重返 OpenAI,领导 RSI(自进化)团队。据内部人士透露,该项目属于 OpenAI 内部优先级极高的研究方向。
注:时间线基于公开报道整理,部分节点的时间精度为月级;翁荔重返 OpenAI 的确切日期与 RSI 团队组建时间尚未公开。
RSI(Recursive Self-Improvement,递归自进化)的核心目标是:让模型能够训练并改进自己的后继模型。如果实现,意味着 AI 系统的进步不再完全依赖人类标注与反馈,而是由模型自身驱动迭代。
这一方向在 AI 研究中兼具前沿性与争议性:能力跃迁的潜力巨大,但"模型改进自身"也意味着安全对齐的难度可能指数级上升——而翁荔此前在 OpenAI 的核心身份,恰恰是安全负责人。
值得注意的是,翁荔本月初刚在个人博客 Lil'Log 上发布过一篇 RSI 主题的深度文章。她长期撰写 Transformer、强化学习、Agent 等技术入门文章,其中许多已成为相关领域的经典参考材料。
Thinking Machines Lab 诞生于 2024 年 OpenAI 那轮高层震荡。Murati 从 OpenAI 带出一批老同事,组建了一支明星团队。然而一年半过去,「人」从最宝贵的资产变成了最大的风险。
六位联合创始人去向:
截至发稿,TML 尚未发布旗舰模型。在很长一段时间里,「人」是这家公司最核心的资产——20 亿美元种子轮估值的支撑,很大程度上来自这支团队的履历密度。而当这支团队正在被原雇主逐个回收,估值的信用基础也在同步稀释。
北京大学本科毕业,之后出国攻读博士,早期研究核心是强化学习。在 AI 圈,她还有一个特别身份——高产技术博主,长期经营个人博客 Lil'Log,撰写 Transformer、强化学习、Agent 等主题,许多文章成为相关领域的经典入门材料。
2018 年加入 OpenAI,此后六年间角色经历数次大幅转变:
升任 VP 后,她负责 Safety Systems 团队,研究模型如何被 jailbreak、如何产生有害内容,以及如何通过后训练为 ChatGPT 拉起护栏。她是 GPT-4 Technical Report 作者之一,也是 2024 年 OpenAI 发布的 Rule-Based Rewards 工作的核心作者。
2024 年末,在 Ilya、Leike、Schulman、Murati 等核心人物相继离开的节点上,翁荔也选择了离职——但当时公开给出的理由并未指向安全路线分歧,而是"希望离开去探索新的东西"。
如今,在离开 OpenAI 约一年半后,她又回到了这家公司——这一次,她负责的不是安全,而是最具能力跃迁潜力的自进化方向。
此消息由 OpenAI 内部人士透露,截至发稿未见官方公告或独立第三方报道确认。RSI 团队的具体规模、技术路线与时间表均未公开;翁荔从 TML 离职的完整原因——健康问题之外是否存在团队内部分歧——亦无公开证据,外界的"内部矛盾"推测目前仅为猜测。
阅读建议:关注两点——一是 RSI 作为方向本身的分量(模型自进化是 AI 研究中最具长期影响力的命题之一),二是翁荔从"安全 VP"到"自进化负责人"的角色转换,这在 AI 安全叙事中是一个值得追踪的信号。
翁荔个人技术博客 Lil'Log 长期更新 AI 前沿深度文章,本月初发布的 RSI 主题博文可作为理解其新工作方向的入口。
lilianweng.github.io → Lil'Log