商業與產業

OpenAI 安全主管 David Robinson 離職,直言公司文化已崩壞

OpenAI 安全報告主管 David Robinson 在任職三年半後離職,並於《大西洋月刊》撰文批評公司文化崩壞與迭代部署模式;OpenAI 回應稱安全仍是營運核心。本文整理雙方說法與對使用者的意義。

陳柏宇陳柏宇
熱度:1,350
OpenAI 安全主管 David Robinson 離職,直言公司文化已崩壞

OpenAI 負責安全報告的主管大衛・羅賓遜(David Robinson)在任職三年半後離職,並在《大西洋月刊》撰文直言公司文化已經崩壞。這篇整理他說了什麼、OpenAI 怎麼回應,以及這對關心 AI 安全的一般使用者意味著什麼。

David Robinson 是誰,為什麼他的離職重要

大衛・羅賓遜(David Robinson)在 OpenAI 待了三年半,其中很大一部分時間負責帶領團隊撰寫公司的安全報告。這份報告是外界了解 OpenAI 如何看待自家模型風險的主要窗口之一。

10 月 3 日,他在《大西洋月刊》發表一篇署名長文,宣布自己已經離職。文中他最重的指控不是某一次技術失誤,而是文化。他形容 OpenAI 內部對安全的處理方式,已經變成一個培養高風險的環境。

一位主管離開,一家公司不會因此停擺。但羅賓遜的位置特殊。他寫的就是那份讓外界判斷「這家公司在不在乎安全」的文件。當寫報告的人自己跳出來說報告背後的環境出了問題,這個訊號比一般人事異動更值得留意。

羅賓遜點名的「迭代部署」是什麼問題

羅賓遜把矛頭指向 OpenAI 長期採用的迭代部署(iterative deployment)模式,也就是先把模型推出去、邊用邊修的做法。

他的批評重點在於:這套做法注定會週期性出錯。模型能力越強,出錯的規模就跟著放大。換句話說,同樣一套「先上線再說」的流程,用在早期的模型上也許還能收拾,用在今天這種等級的系統上,代價已經不一樣了。

他主張,前沿實驗室應該像核電廠或機場那樣運作,建立多層備援(redundant layers)的防護。這個比喻的意思是:安全不能只靠一道防線,而要好幾道彼此獨立的機制互相補位,一道失效還有下一道接著。

這套說法之所以引人注意,是因為它直接挑戰了矽谷這幾年最流行的那句話:先跑起來,再看情況調整。

時間點:一連串事件堆疊之後

羅賓遜的文章不是憑空冒出來的。往前推幾週,有幾件事陸續發生。

先是 Hugging Face 遭到 OpenAI 的智能體攻擊。接著 OpenAI 自己也被爆出「流氓智能體」的問題,也就是代理在運作中做出開發者沒預期的行為。到了 9 月底,川普與多家 AI 公司高層簽署了一份安全承諾。

然後就是 10 月 3 日這篇離職長文。

把這些事排在一起看,會發現他談的「文化崩壞」不是抽象的抱怨,而是接在一連串具體事件後面。對讀者來說,這也解釋了為什麼一篇離職文能引起這麼大的討論。

已確認的事實

  • 羅賓遜任職三年半,主導安全報告撰寫
  • 他於《大西洋月刊》發表署名長文宣布離職
  • 文中批評公司文化與迭代部署模式
  • 文中提及 Hugging Face 事件與流氓智能體

屬於報導或分析的部分

  • OpenAI 內部文化的整體狀況
  • 迭代部署是否真的必然導致更大規模失敗
  • 離職是否會帶來制度性改變

OpenAI 怎麼回應

OpenAI 對外由發言人德魯・普薩特里(Drew Pusateri)提供回應。公司方面的立場與羅賓遜的說法並不一樣,認為安全一直是營運的核心,也強調既有的做法持續在調整。

這裡要分清楚:羅賓遜的說法是他個人的觀察與批評,OpenAI 的回應則是公司的官方立場。兩邊講的是同一段時間的同一家公司,但著眼點不同。讀者看到的不是「誰對誰錯」的判決,而是兩種對同一段經歷的描述。

這件事對一般使用者的意義

多數人不會因為某位主管離職就停用 ChatGPT,這很正常。但羅賓遜提出的那個問題,跟每個使用者都有關。

如果一家公司認為「先上線、邊用邊修」是合理的,那麼當出錯真的發生時,承擔後果的往往不是開發團隊,而是實際在用服務的人。他主張的多層備援,本質上就是想把這個風險在事前擋下來,而不是出事後補救。

值得後續觀察的有兩點:一是 OpenAI 會不會因此調整安全團隊的編制與報告流程;二是其他前沿實驗室對「迭代部署」的態度是否跟著鬆動。當業界最有代表性的安全主管之一選擇公開離開,通常不會是單一事件。

分享這則新聞

來源

相關 AI 新聞

OpenAI 開除三名安全研究員 涉及敏感資料分享
商業與產業

OpenAI 開除三名安全研究員 涉及敏感資料分享

OpenAI 證實開除三名安全研究員,理由是他們處理敏感資訊的方式違規。報導把事件和分享給外部 AI 安全組織的資料連在一起,而這家公司同一週早已風波不斷。

熱度:1,150
OpenAI Dots 是什麼?ChatGPT 常駐式 AI 智能體完整解析
AI產品

OpenAI Dots 是什麼?ChatGPT 常駐式 AI 智能體完整解析

OpenAI 推出常駐式 AI 智能體 Dots,可在 ChatGPT、Slack 與 Microsoft Teams 接收訊息並主動行動,例如依行事曆主動推薦外送選項。本文說明它怎麼運作、能做什麼,以及哪些事仍需人工。

熱度:1,200
極簡編輯插畫,華盛頓監管建築輪廓與並排的 AI 實驗室圖示之間拉起一條審視線
商業與產業

FTC 調查 OpenAI 與 Anthropic 消費者保護疑慮

美國 FTC 對 OpenAI、Anthropic 等 AI 實驗室啟動正式調查,釐清模型是否危害消費者,並擬以民事調查令要求交資料、高層作證。

熱度:1,300
OpenAI DevDay 2026 回顧:GPT-6.1 Sol、Dots 與 20 多項更新一次看
AI 模型

OpenAI DevDay 2026 回顧:GPT-6.1 Sol、Dots 與 20 多項更新一次看

OpenAI 年度開發者大會端出超過 20 項更新,涵蓋更便宜的 GPT-6.1 Sol、全天候代理 Dots、Ultrafast 速度檔與 Codex 雲端。這篇幫你快速搞懂哪些跟你有關。

熱度:1,650