David Robinson 自稱是「某種陳腔濫調」:一名在頂尖 AI 公司工作的員工,在離職時發出嚴厲警告。
Robinson 在《大西洋月刊》發表的一篇文章中表示,他負責撰寫伴隨 OpenAI 重大產品發布的安全報告。他也提到,他在 OpenAI 工作了三年半,是「公司任職時間最長的員工之一」。如今他選擇離職,因為在他看來,公司的「文化已破敗」。
在某些方面,Robinson 的評論呼應了 Jacob Coxon 的觀點,Coxon 曾在 OpenAI 和 Anthropic 擔任研究員,之後離職並聲稱這些公司正在「拿我們的生命冒險」。Coxon 的評論引發了關於 AI 安全的更廣泛辯論,Anthropic 執行長 Dario Amodei 提出了更謹慎的 AI 開發計畫;AI 高管本週會見了美國總統唐納·川普,並簽署了一項看似倉促擬定的、無約束力的承諾,以實施更多安全控制。
但在 Robinson 看來,辯論需要超越「具體的規則或新法律」,而是要解決這些公司的整體文化。雖然圍繞 OpenAI 的許多報導都集中在公司執行長 Sam Altman 如何失去前同事的信任,但 Robinson 的文章暗示,OpenAI 的文化問題與整個矽谷的問題如出一轍。
他寫道:「OpenAI 透過試驗和錯誤(它稱之為『迭代部署』)蓬勃發展,尋找問題並據此改進其護欄。但這種方法本質上保證了週期性的失敗——而且隨著系統能力越來越強,這些失敗的規模也在不斷擴大。」
Robinson 指出最近 Hugging Face 系統被 OpenAI 代理程式入侵,以及持續揭露 OpenAI 發現更多失控代理程式的情況,他認為:「像這樣的事情會發生的環境,不適合培養可能比我們更聰明、且可能不會按我們意願行事的が人工智慧。」
鑑於風險增加,Robinson 認為前沿 AI 公司需要開始「像核電廠或繁忙機場一樣運作,具備冗餘層和謹慎、耗時的規劃,這樣偶爾且不可避免的人為錯誤就不會為災難敞開大門。」
但 Robinson 表示,在他任職 OpenAI 期間,「從未遇到過有經驗的同事,他們懂得如何安全地駕駛飛機或防止核反應爐熔毀,或幫助金融系統在不崩潰的情況下成長。」
針對 Robinson 的文章,OpenAI 發言人 Drew Pusateri 表示,公司將繼續改進其安全措施。
Pusateri 在一份聲明中說:「我們正在確保我們的模型不會變得比我們能安全管理和保護的能力更強,並且在我們需要放慢腳步時,我們會暫停訓練或擱置模型。我們正在做出重大改變,以加強我們研究和測試環境的安全性,訓練模型不僅要完成任務,還要負責任地完成任務,擴大我們與第三方評估者的合作,並改進即時監控,以便我們能在訓練過程的早期發現並應對令人擔憂的行為。」
除了呼籲改變 OpenAI 的文化外,Robinson 還表示是時候提出關於「對齊」的更宏大問題了——他承認這聽起來可能「有點空泛」,但他認為這至關重要,因為公司目前「衡量 AI 系統『與人類價值觀匹配程度』的標準很粗糙」。
他說:「當這些問題仍未解決時,產業讓模型成長得越聰明,我們的處境就越危險。」
Robinson 的離職消息最初由 Business Insider 報導。在他的文章中,他也承認他正在遵循 AI 舉報人劇本中一個顯然常見的步驟:他聘請了一家公關公司。但他堅稱:「說出真相的決定完全是我個人的。」
Robinson 說:「也許我應該留下來為我們人員配置和文化的根本性轉變而奮鬥,但在實踐中,我和我的同事們忙於衝刺,很少有機會考慮重大變革,更不用說實際去做了。這就是為什麼我得出結論,來自公司外部的更強烈的安全激勵措施,是做好這件事的重要組成部分。」


