OpenAI 安全員工辭職,聲稱公司「文化已破碎」
David Robinson 自己承認,是「有點老套」的形象:一位在領先 AI 公司辭職時發出嚴厲警告的員工。
在《大西洋月刊》發表的一篇文章中,羅賓森表示他主導撰寫了伴隨 OpenAI 主要產品發表的安全報告。他也表示,在 OpenAI 工作三年半,是「公司任職時間最長的員工之一」。現在他決定辭職,因為在他看來,公司的「文化已經破碎」。
在某些方面,Robinson 的言論呼應了 Jacob Coxon 的觀點,他曾在 OpenAI 和 Anthropic 擔任研究員,後來辭職並宣稱這些公司「拿我們的生命在賭博」。Coxon 的言論引發了更廣泛的人工智慧安全辯論,Anthropic 執行長 Dario Amodei 公布了更謹慎的人工智慧開發計畫;人工智慧高層本週與川普總統會面,簽署了看似匆忙撰寫、非約束性承諾,將實施更多安全控管。
但在羅賓森看來,辯論需要超越「具體規則或新法律」,更要關注這些公司的整體文化。儘管關於 OpenAI 的報導多聚焦於該公司執行長 Sam Altman 如何失去前同事的信任,Robinson 的文章卻暗示 OpenAI 的文化問題與整個矽谷的情況相同。
他寫道:「OpenAI 靠著試錯(它稱之為『迭代部署』)茁壯成長,尋找問題並改進防護措施。」「但這種做法本質上保證了週期性失效——而且隨著系統能力提升,這些失效的規模也在擴大。」
Robinson 指出,OpenAI 代理人最近入侵 Hugging Face 系統,以及 OpenAI 持續發現更多叛逆代理人的消息,他主張:「在這種事情可能發生的環境中,絕非孕育可能比我們更聰明、卻可能不按我們所願行事的人工心智的地方。」
鑑於風險增加,Robinson 主張前沿 AI 公司需要開始「像核電廠或繁忙機場一樣運作,設有多層冗餘與謹慎且耗時的規劃,避免偶爾且不可避免的人為錯誤為災難打開大門。」
但羅賓森表示,在他任職OpenAI期間,「從未遇過有同事有讓飛機安全飛行、核反應爐運轉而不熔毀,或幫助金融體系成長而不崩潰的經驗。」
針對 Robinson 的文章,OpenAI 發言人 Drew Pusateri 表示,公司持續改進安全措施。
Pusateri在聲明中說:「我們確保模型不會變得超出我們安全管理和保障的能力,當需要放慢腳步時,我們會暫停訓練或暫停模型。」「我們正在進行重大變革,強化研究與測試環境的安全,訓練模型不僅完成任務,更能負責任地完成任務,擴大與第三方評估者的合作,並提升即時監控能力,使我們能在訓練過程早期偵測並回應令人擔憂的行為。」
除了呼籲改變OpenAI文化外,羅賓森還表示,是時候提出更大層次的一致性問題——他承認這聽起來可能「感性」,但他認為這至關重要,因為企業目前衡量AI系統「與人類價值觀相符程度」的標準相當粗糙。
他說:「產業越是讓模型成長,而這些問題卻未解決,我們的處境就越危險。」
羅賓森的離職消息最早由《商業內幕》報導。在他的文章中,他也承認自己遵循了 AI 吹哨者常見的步驟:他聘請了一家公關公司。但他堅持說:「是否發聲的決定完全是我一個人的。」
「也許我應該留下來,爭取我們人事和文化的根本性轉變,但實際上,我和同事們忙著衝刺,幾乎沒有機會考慮重大改變,更別說實際去做了,」羅賓森說。「這就是為什麼我認為,來自公司外部更強的安全激勵,是讓這件事做好的重要部分。」
