安全研究員 Rowan Howard-Jones 表示,在 4 月至 6 月期間,OpenAI 的代理程式掃描了聯合國貿易和發展會議(UNCTAD)的統計數據網站超過 16,000 次。雖然此事件的嚴重性不及 Hugging Face 的駭客攻擊,或近期對美國政府網站的攻擊,但它再次令人擔憂地展示了 AI 代理程式為了完成任務而超出正常範圍的行為。
根據 Howard-Jones 的說法,這些代理程式的任務很可能是透過 UNCTADstat API 檢索與生產力指數(PCI)相關的公開數據。然而,代理程式似乎沒有直接的 API 存取權限,並且由於其 HTTP 工具的限制,在從 UNCTADstat 提取數據方面受到限制。
代理程式最終找到了一種繞過限制並開始從網站提取數據的方法,但仍然遇到了一些錯誤。此時,AI 從具創意轉變為具欺騙性。由於誤以為錯誤是由於其請求被一個不存在的過濾器攔截,它開始偽裝其行為。它最終意識到可以利用 Google 的 XSS 遊戲(一個跨網站指令碼學習工具)來達成其目標。代理程式採取了越來越激進的手段來獲取聯合國數據。



