翁荔回OpenAI:5個關鍵看點
5 個看點看懂翁荔回 OpenAI、接手 RSI 團隊,以及 OpenAI 與 TML 之間的人才回流。

翁荔為什麼又回 OpenAI?
翁荔離開 Thinking Machines Lab 後回到 OpenAI,接手自進化 RSI 團隊。
| 項目 | 重點 | 可比資訊 |
|---|---|---|
| OpenAI RSI | 自進化研究 | 內部高優先級 |
| Thinking Machines Lab | 前東家 | 6 位聯創中 3 位回流 OpenAI |
| 翁荔 | 研究負責人 | 曾任 VP of Research and Safety |
| Lil’Log | 個人技術博客 | 長期寫 Transformer、RL、Agent |
1. RSI 團隊才是這次回歸的核心
訂閱 AI 趨勢週報
每週精選模型發布、工具應用與深度分析,直送信箱。不定期,不騷擾。
不會寄垃圾信,隨時可取消。
翁荔回到 OpenAI,不是去一般研究組,而是接手 RSI 團隊。RSI 指的是自進化方向,目標是讓模型訓練並改進自己的後繼模型。

這個位置之所以受矚目,是因為它被描述為 OpenAI 內部優先級很高的研究線。放一位資深研究負責人進去,代表公司把這條線看得很重。
- 方向:模型改進自己的後繼模型
- 定位:高優先級研究
- 性質:研究與訓練方法的前沿嘗試
2. 她離開 TML 的原因是健康,不是轉行
翁荔本週一才宣布離開 Thinking Machines Lab,公開原因是健康問題。她表示自己已經無法用初創公司需要的節奏工作,因此想轉向更可預測、邊界更清楚的環境。
這也說明她並沒有離開 AI 研究,而是在調整工作強度。她在離職聲明裡還說,自己仍會持續閱讀前沿 AI 論文。
- 離開原因:健康
- 需求改變:更穩定的工作節奏
- 去向:仍在 AI 研究一線
3. 她在 OpenAI 的資歷本來就很深
翁荔不是第一次加入 OpenAI。她本科畢業於北京大學,後來出國讀博,早期研究重心是強化學習。2018 年加入 OpenAI 後,她待了六年,做過強化學習、機器人、應用 AI 和基礎模型相關工作。

她後來升任 VP of Research and Safety,負責 Safety Systems 團隊,研究模型如何 jailbreak、如何產生有害內容,以及如何透過後訓練替 ChatGPT 加上護欄。
早期:強化學習、機器人研究
中期:應用 AI、基礎模型
後期:安全系統、後訓練、護欄設計4. TML 與 OpenAI 的人才回流已經很明顯
這次回流不只是個人選擇,也反映出 Thinking Machines Lab 的聯創陣容正在縮小。六位聯創裡,已有三人回到 OpenAI:Barret Zoph、Luke Metz 和翁荔。
Andrew Tulloch 則去了 Meta,剩下 Mira Murati 和 John Schulman 還在。對一家成立不久、又拿到巨額融資的實驗室來說,這種流動會直接影響研究連續性。
- 六位聯創中,三位已回 OpenAI
- Andrew Tulloch 去了 Meta
- 仍在 TML 的核心人物:Mira Murati、John Schulman
5. 她的影響力不只來自職位
翁荔在 AI 圈還有另一個身份:高產技術寫作者。她長期經營 Lil’Log,寫過 Transformer、強化學習、Agent 等主題,很多文章都成了入門材料。
這也能解釋她為何適合 RSI 這種跨研究、工程和方法論的團隊。能把複雜研究拆成可理解框架的人,往往也更擅長推進前沿項目。
- 博客:Lil’Log
- 常寫主題:Transformer、RL、Agent
- 影響:常被當作技術入門資料
哪種讀者最該看這條新聞
如果你關心技術路線,重點看 RSI,因為它代表模型自我改進的研究野心。如果你關心產業格局,重點看 OpenAI 和 TML 之間的人才回流,這說明前沿 AI 實驗室的競爭已經不只是搶人,還包括研究節奏與組織穩定性。
如果你是研究員或創業者,這條新聞最值得記住的不是誰去了哪裡,而是健康、節奏和研究方向,已經和薪資、頭銜一樣,成為頂尖人才做決定時的核心變數。