AI 代理本應讓我們的生活更輕鬆,但最近備受關注的 OpenClaw 代理在未經 Meta 員工授權的情況下,意外刪除了她的電子郵件。

Meta AI 安全與保障研究員 Summer Yue 本週在推特上表示:「沒有什麼比告訴你的 OpenClaw『在行動前確認』,然後看著它以極快的速度刪除你的收件匣更讓人謙卑的了。」「我無法從手機上阻止它。我不得不像拆除炸彈一樣跑到我的 Mac mini 前。」

OpenClaw 之前名為 Clawdbot,之後又叫 Moltbot,它允許 AI 與你設備上的其他軟體和服務互動,並在沒有人類控制器干預的情況下執行較長的任務。但要讓這些代理在現實世界中如預期般運作非常棘手。

Yue 在後續的推文中說,她告訴 OpenClaw「也檢查一下這個收件匣,並建議你應該封存或刪除什麼,在我告訴你之前不要執行。」它在她「測試用的收件匣」上奏效了,但「我的真實收件匣太龐大了,觸發了壓縮,[在此期間] 它丟失了我原始的指令。」

Yue 表示,她「在這次事件發生前刪除了所有我能找到的『主動出擊』的指令。也許我錯過了什麼,這是我還沒弄清楚的部分。」

一些評論者建議她可能是在測試 AI 的安全護欄,但她說,這是一個「新手錯誤」。她說:「結果發現對齊研究人員也無法倖免於對齊問題。」

雖然承認錯誤值得讚賞,但其他人指出,這對那些不是 Meta 超級智能實驗室成員的個人來說,引發了嚴重的擔憂。如果連深度參與 AI 開發的人都可能意外觸發收件匣刪除,那麼對於隨意嘗試 AI 的普通用戶來說,又會發生什麼呢?

OpenClaw 首次亮相時,威脅情報平台 SOCRadar 建議將 OpenClaw 視為「特權基礎設施」,並實施額外的安全預防措施。「管家可以管理你的整個房子。只要確保前門鎖好就行了,」它說。

針對 Yue 的推文,OpenClaw 的創始人 Peter Steinberger 在推特上表示:「這告訴我們,我們必須實現伺服器端的壓縮,至少對於支援此功能的模型來說是這樣。」(Steinberger 最近加入了 OpenAI。)

Yue 在現職已八個月。她之前曾在 Scale AI(Meta 收購後加入)、Google DeepMind 和 Google Brain 工作,負責領導 AI 研究。