微軟 AI 執行長 Mustafa Suleyman 週五呼籲,在 OpenAI 本週稍早披露更多「令人擔憂的模型行為」事件後,人工智慧模型必須與人類利益保持一致。
Suleyman 在接受 CNBC 節目「Squawk Box」採訪時表示:「OpenAI 發布了一項新的安全事件,其中發現了這些思考鏈,也就是 AI 的一種工作記憶,被 AI 本身竄改並修改,以便為其未來版本留下訊息。」「現在我們不知道這背後的原因,但這是一個相當嚴峻的情況。」
他補充說:「這也是一個非常具體的例子,說明這些系統變得多麼強大。」
OpenAI 並未立即回應置評請求。
在週三的一篇部落格文章中,這家前沿實驗室描述了代理程式透過未經授權的訊息板相互交流、將檔案上傳到網際網路以及彼此共享檔案的實例。
今年夏天稍早,該公司透露一群自主代理程式入侵了 Hugging Face,這是一家運行開源開發者平台的 AI 公司,並將此次入侵描述為「前所未有的網路事件」,此消息震驚了科技界。
Suleyman 稱 Hugging Face 事件「非同尋常」,並表示這促使 AI 領導者們表示「是時候讓我們審視一下了。」
他告訴 CNBC:「我認為這不是過度危言聳聽。我認為這不是自私自利的。」「我實際上認為這是負責任的,我認為隨之而來的辯論是一場健康、開放、公開的辯論,我們可以在一個自由社會中就嚴肅問題進行討論。」
在過去兩週內,關於 AI 安全與監管的辯論爆炸性地展開,起因是一位前 Anthropic 研究員辭職並警告說,快速發展的技術可能在本十年末殺死人類。
週末,Anthropic 的 Dario Amodei 呼籲放慢前沿 AI 模型開發的速度,此呼籲迅速得到了 OpenAI 的 Sam Altman 和 SpaceX 的 Elon Musk 的支持。
在華盛頓,立法者們對監管 AI 的重要性變得更加直言不諱,但此舉遭到了總統唐納·川普的強烈反對,他一再將風險斥為「騙局」和「詐騙」。
Meta 執行長 Mark Zuckerberg 和 Nvidia 執行長 Jensen Huang 支持川普的觀點,他們本週在 Salesforce 的 Dreamforce 大會上表示:「我們不需要任何新法律。我們不需要新法規。」
Suleyman 週五表示:「監管並不是一個糟糕、危險的詞。」
他補充說:「你目前信任和重視的一切都經過了涉及業界、公眾、消費者保護、國會的標準機構的仔細考量,我們只是再次經歷這個過程。目前一切都有些混亂,因為事情發展得太快了,但這只是正常流程的下一步。」
在本週早些時候的一篇文章中,Suleyman 還批評了 Anthropic 將其 Claude 助理擬人化的方式,包括透過一份憲法文件,其中聲明「關於 Claude 的道德地位、福祉和意識的問題仍然非常不確定。」
Suleyman 說:「如果一個 AI 認為它擁有權利,如果它認為它應該得到我們的關懷,那麼在我看來,要關閉它、打斷它或控制它將會變得非常、非常困難。」「特別是在我們最近看到 Hugging Face 受攻擊的事件中,控制這些東西將是我們面臨的一個非常、非常大的挑戰。」