Anthropic主張設立道德界限,而OpenAI則接受較為寬鬆的法律界限,現在隨著五角大廈在對伊朗的攻擊中急速推出政治化的AI策略,OpenAI將從中受益。

2月28日,OpenAI宣布已達成一項協議,允許美國軍方在機密環境中使用其技術。執行長Sam Altman表示,該談判是在五角大廈公開譴責Anthropic後才開始進行,過程「確實相當匆忙」。

OpenAI在公告中極力強調,並未讓步到讓五角大廈隨意使用其技術。公司發布部落格文章說明協議保障不會用於自主武器和大規模國內監控,Altman也表示公司並未接受Anthropic拒絕的相同條款。

表面上看似OpenAI同時贏得合約與道德制高點,但細讀條款與法律語言後,顯示出另一層意義:Anthropic採取道德立場贏得許多支持者卻未成功,而OpenAI則採取務實且法律導向的策略,對五角大廈較為寬鬆。

目前尚不清楚OpenAI是否能在軍方急速推動政治化AI策略、針對伊朗攻擊期間,落實其承諾的安全防護措施,或該協議是否能讓希望公司採取更強硬立場的員工滿意。這條平衡之路將相當艱難。(OpenAI未立即回應關於協議的進一步詢問。)

Altman表示,OpenAI能達成協議的原因不在於界限,而在於方法。「Anthropic似乎更專注於合約中的具體禁止條款,而我們則依據適用法律,這讓我們感到安心。」

OpenAI表示,願意與五角大廈合作的基礎之一,是假設政府不會違法。公司分享了合約部分摘錄,引用多項與自主武器和監控相關的法律與政策,從2023年五角大廈關於自主武器的指令(不禁止但規範設計與測試)到第四修正案,後者保障美國人免受大規模監控。

然而,喬治華盛頓大學法學院政府採購法研究副院長Jessica Tillipman指出,公開摘錄「並未賦予OpenAI像Anthropic那樣獨立禁止政府合法使用的權利」,僅表明五角大廈不得違反現行法律與政策。

Anthropic之所以獲得許多支持者,包括OpenAI部分員工,是因為他們不認為這些規則足以防止AI自主武器或大規模監控的產生。假設聯邦機構不會違法,對於記得愛德華·斯諾登揭露的監控行為曾被內部認定合法、後經漫長訴訟才被判非法的人來說,幾乎沒有保障(更別提現行法律允許的多種監控手段,AI可能擴大其範圍)。在這方面,我們基本回到原點:允許五角大廈在任何合法用途上使用AI技術。

OpenAI國家安全合作負責人昨日表示,如果你認為政府不會遵守法律,那你也不應該相信政府會尊重Anthropic所提的紅線。但這並非反對設立紅線的理由。執法不完美不代表限制無意義,合約條款仍會影響行為、監督與政治後果。

OpenAI聲稱有第二道防線。公司表示將掌控模型的安全規則,不會提供軍方去除安全控管的AI版本。「我們可以將紅線——禁止大規模監控與禁止無人參與的武器系統指揮——直接嵌入模型行為中。」OpenAI員工Boaz Barak在X上表示。

但公司未說明軍方安全規則與一般用戶規則有何不同。執法也從未完美,尤其OpenAI首次在機密環境中推出這些保護措施,且預計僅用六個月時間。

另一個問題是:是否應由科技公司禁止合法但道德上不可接受的行為?政府顯然認為Anthropic願意扮演此角色不可接受。週五晚間,美國對德黑蘭發動攻擊前八小時,國防部長Pete Hegseth在X上嚴厲批評:「Anthropic展現了傲慢與背叛的典範。」他呼應川普總統命令政府停止與Anthropic合作,因該公司試圖阻止其模型Claude用於自主武器或大規模國內監控。「戰爭部必須對Anthropic模型擁有完全、無限制的合法使用權。」

除非OpenAI完整合約揭露更多內容,否則難以不將該公司視為在意識形態天秤上搖擺,一方面承諾將利用影響力做正確事,另一方面則以法律作為五角大廈使用技術的主要防線。

有三件事值得關注。首先,這立場是否能讓OpenAI最關鍵的員工接受。AI公司在人才上投入巨大,部分員工可能視Altman的說法為不可原諒的妥協。

其次,Hegseth承諾對Anthropic展開的全面打擊。除了取消政府合約,他宣布Anthropic將被列為供應鏈風險,「任何與美國軍方有業務往來的承包商、供應商或合作夥伴不得與Anthropic進行商業活動。」此舉是否合法仍有爭議,Anthropic表示若威脅實施將提告,OpenAI也反對此舉。

最後,五角大廈如何在加劇對伊朗攻擊的同時,替換Claude——目前唯一在機密行動中使用的AI模型(包括委內瑞拉部分行動)?Hegseth給予六個月期限,期間軍方將逐步引入OpenAI及Elon Musk的xAI模型。

但據報導,Claude在禁令發布數小時後仍被用於對伊朗攻擊,顯示替換過程將極為複雜。即使Anthropic與五角大廈間的長期爭執結束(我不認為如此),我們現在看到五角大廈的AI加速計劃正迫使公司放棄曾劃下的界線,中東新衝突成為主要試驗場。

如果你有相關情報,歡迎透過Signal(用戶名:jamesodonnell.22)聯繫我。