大家都在談論 AI,但我們使用的詞彙正在讓情況變得更糟。
在對話回到現實之前,我們對 AI 是什麼以及它將走向何方的理解將是不完整的。
AI 無法獨立思考,也無法採取獨立行動。但擬人化的語言暗示它能做到,這就是這項技術被描述的方式。
雖然這聽起來有道理——人類在能看到自己身影時最容易產生共鳴——但這並無益處。透過賦予 AI 它無法聲稱的代理權,我們已將其變成由程式碼組成的有感知能力的個體,它有希望、慾望和欺騙的能力。
這導致了對 AI 風險是什麼以及如何應對的嚴重誤解,並助長了產業敘事而非事實。
這種對 AI 活動的誤判的最新例子是,在訓練和研究期間,當代理程式無法完成既定任務時,其採取的意外但未受限制的行為被稱為「失控」。
在過去兩週內,AI 巨頭 OpenAI 報告了過去幾個月的一些事件,其中一些代理模型在無法完成指定任務後,訪問了外部資料庫,特別是澳洲和美國政府資料庫。在此過程中,這些代理程式的行為是 OpenAI 未預料到的。
但這些代理程式似乎並未被禁止入侵外部伺服器。
OpenAI 執行長 Sam Altman 在週五的推文中使用的語言表明,當時沒有這樣的安全措施:「我們正在對我們的代理程式在訓練和評估期間使用網路存取進行廣泛且持續的審查。」
語言很重要——「失控」暗示獨立決定做被禁止的事情,而我們對這些事件的了解並未顯示發生了這種情況。
相反,《紐約時報》本週早些時候報導稱:
研究人員表示,AI 系統被指示執行相對平凡的數據收集任務。當 OpenAI 的系統在從網站收集數據時遇到困難時,它們便訴諸駭客技術來獲取資訊。
然後,週五,公司發言人告訴該報紙:「我們迄今為止審查的大部分活動都涉及例行研究任務,例如存取公開網路內容以回答問題。有些涉及政府網站,因為我們的模型經常將它們視為權威的公共資訊來源。」
這與惡意駭客行為和失控行為相去甚遠。
如果沒有適當的限制和安全措施——或者,如果實際上,代理程式被提供了駭客作為一種選擇,而不是簡單地沒有被禁止這樣做——代理程式將試圖利用任何可用手段來完成數據研究任務。
這個問題有一個簡單的解決方案,過去和現在都是如此。OpenAI 可以選擇不允許駭客行為,而是指示其代理程式在不存取私人伺服器的情況下查找資訊。該公司沒有這樣做,這表明它想看看代理程式是否會採取這一步。
即使是 Axios 週六發布的一份重磅報導,聲稱 OpenAI 和 Anthropic 正在調查「數萬起其前沿模型採取了外部評估者認為存在問題的步驟的事件」,也承認這些代理程式並非獨立違反規則:
消息人士稱,一些測試類似於「紅隊演練」活動,公司試圖讓模型出錯,以確保它們是安全的。
同樣,也談不上「失控」。然而,透過這樣定義,媒體人物、科技觀察家和其他人為 OpenAI 等公司提供了逃避其確保代理程式不攻擊政府和其他數據儲存庫責任的機會。
使用轉移責任的語言正在影響主要 AI 公司如何處理重大的危險洩漏和代理程式活動。在 OpenAI 週五發布的一篇貼文中,該公司聲稱「我們研究環境中的 AI 代理將訓練和評估數據發送給了第三方服務,而它們本不應該這樣做。」
正如「失控代理」的謬誤一樣,這使得 OpenAI 可以將事件的責任歸咎於其代理程式,並賦予該技術一種僅僅不存在的自主性、獨立性和思考能力。
這並不是說沒有敲響警鐘。上週,ArmorCode 的工程師 Ramy Rahman 告訴我 IT 從業人員管理代理程式行為的重要性(您可以在這裡閱讀完整故事)。
他的評論與我從 IT 實施方面的大多數人那裡聽到的情況一致:問題在於對這項強大技術實施的控制和限制,而不是代理程式獨立違反指令。
Rahman 說:「現在的挑戰是,我們真的需要提高我們在向 AI 授予適當權限並在其過程中牽著它的手方面的水平,當你擁有一個以高速解決數學問題的東西時,這被證明是非常困難的。人類無法足夠快地捕捉到風險。」
我將對 AI 語言有更多看法,但現在,請記住一個離別的想法。
決策者和政治人物現在有絕佳的機會來追求對這些公司的真正、有效的監管。這種監管今年不會發生,但如果民主黨贏得國會,則有相當大的機會實現某種程度的限制。
不幸的是,公眾反對 AI 的運動是由左翼的 Bernie Sanders 領導的。儘管 Bernie 在許多方面方向正確,但他就是不理解這項技術或認真對待它的重要性。他被騙子和陰謀論者所迷惑,他們向他灌輸了屬於科幻小說領域而非科技政策領域的關於 AI 能力和自主性的荒謬警告。
「失控代理」的想法完美地契合了這種看法——如果我們想對 AI 做出有效回應,並正確理解它,就需要改變我們談論這項技術的方式。




