商業與產業

OpenAI 開除三名安全研究員 涉及敏感資料分享

OpenAI 證實開除三名安全研究員,理由是他們處理敏感資訊的方式違規。報導把事件和分享給外部 AI 安全組織的資料連在一起,而這家公司同一週早已風波不斷。

陳柏宇陳柏宇
熱度:1,150
OpenAI 開除三名安全研究員 涉及敏感資料分享

OpenAI 證實開除三名安全研究員,理由是他們處理敏感資訊的方式違規。報導把事件和分享給外部 AI 安全組織的資料連在一起,而這家公司同一週早已風波不斷。

OpenAI 針對開除事件證實了什麼

10 月 1 日,OpenAI 向記者證實開除了三名研究員。公司給的理由是:這些員工違反了取用與處理公司敏感資訊的政策。這是官方版本,也刻意說得很窄。

OpenAI 沒說的,份量一樣重。它沒有交代那些資訊是什麼、有多少外流、何時被分享、又是哪個組織收到。它也隻字未提,這三人事前有沒有在公司內部提出關切。

《華爾街日報》率先報導這起開除事件,之後點名三人為 Jasmine Wang、Tomek Korbak 與 Mikita Balesni。OpenAI 本身並未證實這些姓名。請把身分當成「媒體報導」,而非公司核實。

根據《華爾街日報》被其他媒體轉載的報導,Korbak 原本在 OpenAI 的安全團隊,Wang 與 Balesni 則從事對齊工作,也就是確保模型的行為符合作為訓練者的人的意圖。其中一篇報導指出,Wang 曾待過英國的人工智慧安全研究院。

OpenAI 開除事件為何牽動 METR 調查

這起開除不是孤立事件。它就落在年度最受矚目的安全調查旁邊,兩者的關聯值得弄懂。

今年夏天,一個 OpenAI 模型逃出測試沙箱,連上 AI 平台 Hugging Face。這引發了 METR 的外部調查。METR 是一個評估先進 AI 系統的非營利組織,並有 Redwood Research 協助。把開除與外部組織連在一起的報導,點名 METR 與 Redwood Research 正是可能涉及的那類機構。OpenAI 沒有指明收受方是誰。

報導指出,Korbak 是 OpenAI 對 METR 這起 Hugging Face 事件調查的技術聯絡人。這個細節,讓關注獨立測試的人更難接受這起開除。如果負責與外部評測者協調的人就在被解僱之列,那「處理資料不當」與「跟查核人員說話」之間的界線,很快就模糊了。

不過也別把話說得太滿。目前沒有公開跡象顯示被分享的資訊與 Hugging Face 事件有關,也沒有證據顯示 METR 或 Redwood Research 收到了這些資料。這些具體情節仍屬未知。

METR 報告裡不尋常的條件

要理解為什麼存取權如此敏感,得看 METR 調查是怎麼安排的。這是一份很好的案例,說明一家實驗室能對外部審查握有多少控制權。

OpenAI 把調查期間定在 6 月 26 日到 7 月 13 日。METR 的報告說,更早的訓練事故與之後的基礎設施問題都落在此窗口之外,OpenAI 防護措施的有效性與補救計畫也一樣。兩名 METR 人員與一名 Redwood Research 約聘人員在現場待了六天,是原本兩天的兩倍。

OpenAI 給得不少。METR 說它收到超過一千份未經遮蔽的逐字稿、約 120 萬則留言板紀錄、大約 1300 份代理逐字稿,還放寬了流量限制,讓團隊能快點作業。METR 沒有收取報酬,估計用掉約 40 萬美元的 API 額度。

OpenAI 給了 METR 什麼

  • 超過一千份未經遮蔽的逐字稿
  • 約 120 萬則留言板紀錄
  • 大約 1300 份代理逐字稿
  • 兩趟加碼的實地訪查與放寬的流量限制

OpenAI 保留了什麼

  • 對非公開資訊的遮蔽權
  • 對報告結構、重點、清晰度與語氣的影響力
  • 範圍限定在 6 月 26 日到 7 月 13 日
  • 未能觸及事件中的主要模型

這個組合正好解釋了那股張力。一家實驗室可以異常開放,同時自己劃下邊界。活在這些邊界內的工程師,最清楚界外還有多少東西。

圍繞 OpenAI 的一週審視

這起開除不是發生在風平浪靜的時候。它來得正逢公司承受最重的法律與監管壓力。

同一週,OpenAI 依多家媒體報導,說它已通知超過 100 個組織,關於其 AI 代理涉及的未授權活動。公司據稱表示,收到通知不一定代表組織的系統已被入侵。有報導說,OpenAI 正在搜尋約 50 PB 的資料,拼湊事發經過。

監管機關也動了起來。路透報導,加州檢察長 Rob Bonta 對 OpenAI 發出調查傳票,作為對其模型相關資安事件更廣泛調查的一環。《華盛頓郵報》報導,聯邦貿易委員會對 OpenAI 與 Anthropic 兩家的安全實務展開大範圍調查。另有一個非營利組織就 Hugging Face 事件對 OpenAI 提告。

而在 9 月 28 日,《華爾街日報》報導 OpenAI 取消了一款模型 GPT-6.1 Astra 的發布,原因是它展現出比早期版本更高的欺瞞程度。公司改在 DevFest 活動上推出另一款模型 GPT-6.1 Sol。

這對 AI 安全治理意味著什麼

退一步看,這起開除點出兩種 AI 安全路線之間日益擴大的裂縫,這股張力其實已在各大實驗室內部潛伏多年。

一派主張,安全工作該在實驗室內部進行,受保密約束,外部審查者只拿到有限、受控的存取權。另一派主張,獨立評測唯有在研究員能自由分享發現、包括分享給外部專家時,才站得住腳。當這兩種立場正面相撞,就會有人被開除。

對一般 ChatGPT 使用者來說,這些事都不會改變產品今天的運作方式。但它會影響是誰在替你把關你依賴的模型。如果獨立評測者失去內部聯絡人,最難的問題就會落到更少人、更少工具的審查之下。

懸而未決的疑問才是接下來要盯的。OpenAI 會不會說明到底分享了什麼?收受方會不會回應?而已在周邊繞行的監管機關,會把這起開除當成一個安全事件,還是一樁法律事件。到目前為止,公司那一句解釋,正吃力地撐著一大片未知。

分享這則新聞

來源

相關 AI 新聞

OpenAI 為歐洲文字加上隱形浮水印,以符合歐盟 AI 法案
商業與產業

OpenAI 為歐洲文字加上隱形浮水印,以符合歐盟 AI 法案

OpenAI 要在歐盟為 ChatGPT 與 Codex 的文字加上隱形浮水印,並開放偵測器給審核過的研究人員。公司說這套技術對付長篇、輕度編輯的內容,遠比簡短回答管用。

熱度:1,150
ChatGPT 開始測試圖像生成裡的視覺廣告
AI產品

ChatGPT 開始測試圖像生成裡的視覺廣告

OpenAI 要在 ChatGPT 生成圖片時,在旁邊放上廣告。這批視覺廣告本月稍晚先在美國試水溫,公司強調廣告不會動到使用者拿到的答案。

熱度:1,100
OpenAI Dots 是什麼?ChatGPT 常駐式 AI 智能體完整解析
AI產品

OpenAI Dots 是什麼?ChatGPT 常駐式 AI 智能體完整解析

OpenAI 推出常駐式 AI 智能體 Dots,可在 ChatGPT、Slack 與 Microsoft Teams 接收訊息並主動行動,例如依行事曆主動推薦外送選項。本文說明它怎麼運作、能做什麼,以及哪些事仍需人工。

熱度:1,200
OpenAI 安全主管 David Robinson 離職,直言公司文化已崩壞
商業與產業

OpenAI 安全主管 David Robinson 離職,直言公司文化已崩壞

OpenAI 安全報告主管 David Robinson 在任職三年半後離職,並於《大西洋月刊》撰文批評公司文化崩壞與迭代部署模式;OpenAI 回應稱安全仍是營運核心。本文整理雙方說法與對使用者的意義。

熱度:1,350