🔄 人才动向

翁荔重返 OpenAI 领导自进化团队,Thinking Machines 六联创仅剩两人

7 月底,因健康原因离开 Thinking Machines Lab 不到一周的翁荔,确认重返 OpenAI,负责领导内部优先级极高的 RSI(自进化)团队——目标是让模型训练并改进自己的后继模型。至此,TML 六位联合创始人中已有三人回归 OpenAI,仅剩 CEO Mira Murati 与首席科学家 John Schulman。

来源:公开报道 2026-07-30 全文约 3 分钟读完
#翁荔 #OpenAI #ThinkingMachines #RSI #AI人才动向
1.5 年 离开 OpenAI 到重返的间隔
6 → 2 Thinking Machines 联合创始人剩余
3 / 4 离职联创中选择 OpenAI 为下一站

⚡ 30 秒速览

  • 发生了什么:翁荔周一宣布因健康离开 TML,称"无法以初创公司所需的节奏继续工作",不到一周即确认重返 OpenAI。
  • 新角色:领导 RSI(递归自进化)团队,让模型能够训练并改进自己的后继模型——OpenAI 内部优先级极高的方向。
  • TML 现状:6 位联创仅剩 2 人(Murati、Schulman),42 人创始团队至少 14 人离开。
  • 反向虹吸:离开 TML 的 4 位联创中,3 人以 OpenAI 为下一站(翁荔、Barret Zoph、Luke Metz),1 人去了 Meta(Andrew Tulloch)。
  • 翁荔其人:北大本科,OpenAI 六年老兵,前 VP of Research and Safety,GPT-4 技术报告作者,本月初刚发布 RSI 主题深度博客。

01事件还原 一年半内的完整弧线

翁荔加入 OpenAI,早期负责强化学习与机器人研究

OpenAI 经历高层震荡——Ilya Sutskever、Jan Leike、John Schulman、Mira Murati、Barret Zoph 等核心人物数月内相继离开。翁荔也选择离职,公开理由是"在 OpenAI 工作近七年后,希望离开去探索新的东西",未指向安全路线分歧。

加入 Mira Murati 创办的 Thinking Machines Lab,任联合创始人。公司愿景:让前沿 AI 更容易被用户定制,同时推进安全与对齐。

TML 完成 20 亿美元种子轮融资,投后估值 120 亿美元——a16z 领投,Nvidia、AMD 参投,为硅谷历史上规模最大的种子轮之一。

翁荔宣布离开 TML,主因是连续数月的健康问题与创业高强度工作带来的身体压力。她在声明中说:"自己无法以初创公司所需的节奏继续工作下去",并希望找一个"有明确边界的岗位"。CEO Murati 留言:"很高兴你把健康放在第一位。"

确认重返 OpenAI,领导 RSI(自进化)团队。据内部人士透露,该项目属于 OpenAI 内部优先级极高的研究方向。

注:时间线基于公开报道整理,部分节点的时间精度为月级;翁荔重返 OpenAI 的确切日期与 RSI 团队组建时间尚未公开。

02RSI:让模型训练自己的后继模型

RSI(Recursive Self-Improvement,递归自进化)的核心目标是:让模型能够训练并改进自己的后继模型。如果实现,意味着 AI 系统的进步不再完全依赖人类标注与反馈,而是由模型自身驱动迭代。

模型 v1自主训练模型 v2再次训练模型 v3 …

这一方向在 AI 研究中兼具前沿性与争议性:能力跃迁的潜力巨大,但"模型改进自身"也意味着安全对齐的难度可能指数级上升——而翁荔此前在 OpenAI 的核心身份,恰恰是安全负责人。

值得注意的是,翁荔本月初刚在个人博客 Lil'Log 上发布过一篇 RSI 主题的深度文章。她长期撰写 Transformer、强化学习、Agent 等技术入门文章,其中许多已成为相关领域的经典参考材料。

03Thinking Machines 的人才流失

Thinking Machines Lab 诞生于 2024 年 OpenAI 那轮高层震荡。Murati 从 OpenAI 带出一批老同事,组建了一支明星团队。然而一年半过去,「人」从最宝贵的资产变成了最大的风险

4联创已离职(共 6 位)
14+42 人创始团队已离开
$120 亿投后估值(2025.7)

六位联合创始人去向:

留任
Mira MuratiCEO · 前 OpenAI CTO
留任
John Schulman首席科学家
→ OpenAI
翁荔领导 RSI 团队
→ OpenAI
Barret Zoph后于 2026.6 再次离开 OpenAI
→ OpenAI
Luke Metz已加入 OpenAI
→ Meta
Andrew Tulloch已加入 Meta

截至发稿,TML 尚未发布旗舰模型。在很长一段时间里,「人」是这家公司最核心的资产——20 亿美元种子轮估值的支撑,很大程度上来自这支团队的履历密度。而当这支团队正在被原雇主逐个回收,估值的信用基础也在同步稀释。

04翁荔其人 从强化学习到安全 VP

北京大学本科毕业,之后出国攻读博士,早期研究核心是强化学习。在 AI 圈,她还有一个特别身份——高产技术博主,长期经营个人博客 Lil'Log,撰写 Transformer、强化学习、Agent 等主题,许多文章成为相关领域的经典入门材料。

2018 年加入 OpenAI,此后六年间角色经历数次大幅转变:

强化学习 / 机器人应用 AI / 基础模型VP of Research and Safety

升任 VP 后,她负责 Safety Systems 团队,研究模型如何被 jailbreak、如何产生有害内容,以及如何通过后训练为 ChatGPT 拉起护栏。她是 GPT-4 Technical Report 作者之一,也是 2024 年 OpenAI 发布的 Rule-Based Rewards 工作的核心作者。

2024 年末,在 Ilya、Leike、Schulman、Murati 等核心人物相继离开的节点上,翁荔也选择了离职——但当时公开给出的理由并未指向安全路线分歧,而是"希望离开去探索新的东西"。

如今,在离开 OpenAI 约一年半后,她又回到了这家公司——这一次,她负责的不是安全,而是最具能力跃迁潜力的自进化方向

编辑视角

此消息由 OpenAI 内部人士透露,截至发稿未见官方公告或独立第三方报道确认。RSI 团队的具体规模、技术路线与时间表均未公开;翁荔从 TML 离职的完整原因——健康问题之外是否存在团队内部分歧——亦无公开证据,外界的"内部矛盾"推测目前仅为猜测。

阅读建议:关注两点——一是 RSI 作为方向本身的分量(模型自进化是 AI 研究中最具长期影响力的命题之一),二是翁荔从"安全 VP"到"自进化负责人"的角色转换,这在 AI 安全叙事中是一个值得追踪的信号。

2024 年那轮被外界解读为"安全路线分裂"的高层出走,正在以人才回流的方式被重新定义——安全派不仅回来了,还被安排领导最具能力跃迁潜力的自进化方向。OpenAI 内部的张力没有消解,只是被重新封装进了同一个组织框架内。

延伸阅读

翁荔个人技术博客 Lil'Log 长期更新 AI 前沿深度文章,本月初发布的 RSI 主题博文可作为理解其新工作方向的入口。

lilianweng.github.io → Lil'Log