八十年來,西方聯盟的力量根植於道德合法性、共同價值觀以及由此產生的塑造國際規範的信譽。北約在冷戰期間的持久性,不僅僅依靠核威懾:一種共同的信念,即聯盟代表著一個值得維持的基於規則的秩序,其中武力使用的界限受到法律約束,受到民主問責的限制,並接受獨立審查。數十個國家認同一個權力受到制約的框架。這個框架目前正受到多方面的壓力,其中一個意想不到的因素是先進軍隊在目標鎖定過程中日益增長的人工智慧(AI)應用。今年早些時候,美國與伊朗之間的戰爭期間,由Palantir公司建造、運行Anthropic的Claude的Maven Smart System,以五年前難以想像的速度,協助生成和優先排序目標。
這引發了一個緊迫的問題:隨著AI將殺傷鏈壓縮至機器速度,人類決策將會如何?本文聚焦於一個層面——決策支援系統,這些系統整合情報、提名和優先排序目標,並日益運用生成模型來進行推理。如果西方未能按照其價值觀來實施,自動化該過程的競賽可能會變成一個偽裝成戰術能力提升的戰略烏龍。
西方軍隊在利用AI支援的機器速度目標鎖定能力的同時,無法維持其現有的人類監督模式和標準。然而,這應該促使他們重新設計監督機制,而不是放棄它,因為良好的監督最終是戰略優勢的來源。盟國政府應在這些系統完全整合之前,就哪些判斷應保留給人類達成一致,並確保加速殺傷鏈的相同技術也能加強監督本身的品質。
從化學武器到核武器,人類一再面對改變戰爭的技術,每次最終都發展出相應的學說、規範和治理結構。但AI的獨特之處在於,它改變的是決策方式,而不僅僅是武器的效能或執行人類決策的效率。早期的技術發展為軍隊帶來了更高的速度、準確性或規模,但人類早已決定了打擊目標。例如,一種「發射後不管」的彈藥,是執行人類的決定,而不是自己做出決定。
有些技術的影響更深遠:雷達改變了目標識別的方式。自動化防空系統是最接近的比較對象,它們可以在沒有人類干預的情況下完成交戰——儘管僅限於狹窄的範圍內,且參數由人類預先設定。否則,以往的技術只影響了人類決策的輸入端,並由人類以人類的速度得出結論。監督機制圍繞著這種速度建立。另一方面,AI本身就達成了判斷,速度之快,以至於無人能質疑,甚至理解其推理過程。物理武器可以被禁止或限制,而融入過程中的判斷則更難監管。
AI在目標鎖定中的價值主張是顯著提高的速度和規模:更多的自動化,更多的戰場勝利機會,這是其論點。但這也是錯誤的戰略後果變得最為嚴峻的地方。大部分公開辯論集中在戰爭中的AI是否能遵守國際人道法。區分、比例、必要性和人道原則的遵守至關重要且要求嚴格,是西方道德權威的基礎。但它運作在一個相對明確的框架內,將既定規則應用於特定情況。目標鎖定決策的考量遠不止於打擊是否合法。在英國的目標鎖定學說中,法律顧問考慮「我們能否在遵守國際法的同時進行打擊」,而政策顧問則回答「我們應該嗎?」
「我們應該嗎?」這個問題可能是一個更微妙的命題。沒有固定的規則可以解決它。這是一個動態評估行動的戰略和政治影響。合法的打擊仍然可能激怒第三方,而第三方對最終解決方案至關重要;可能在一個聯盟中製造裂痕,而聯盟的團結本身就是一種戰略資產;或者可能失去當地社區的合作,而這些社區的同意和情報是依賴的。戰術軍事上的勝利,可能被戰略溝通成本的顯著增加所抵消。
考慮一個位於人口稠密地區的建築群,情報已確認一名對數十名盟軍死亡負責的高級指揮官。打擊在法律上是可行的——目標已準確識別,附帶損害估計在比例原則的門檻之內。但該建築群靠近一個具有深遠文化意義的場所,而該指揮官正在與一個通過秘密渠道接觸的派別進行談判,該渠道已花費數月時間建立,旨在尋求停火。打擊幾乎肯定會破壞這些談判,並產生盟國政府難以公開辯護的圖像,而此時國內對該行動的同意已經動搖。然後,指揮官準備轉移,但沒有關於他去向的情報。決策者應該權衡現在打擊,在他消失之前,與談判幾乎肯定會破裂的風險。沒有任何演算法可以解決這個問題。這需要一個人承受巨大的壓力,權衡不可比較的值,並對結果負責。
自動化目標鎖定的驅動力經常被視為競爭的必然。西方的對手正在積極追求AI支援的戰爭。如果西方不跟上他們的步伐,論點是,它將接受一種轉化為行動和最終戰略失敗的劣勢。
這個邏輯不一定錯,但它不完整。匹配對手的能力是基本要求。問題在於,在追求這個基本要求時,軍隊是否會工程化地剔除區分民主社會如何作戰的監督機制,從而放棄支撐西方八十年戰略優勢的不對稱性。民主國家永遠無法在不受約束的武力運用上勝過威權政權,也不應該嘗試。克制是維繫聯盟的合法性架構,維持國內對軍事行動的政治同意,並提供制定國際規範的道德權威。
然而,沒有哪個軍隊能在利用這項技術提供的軍事優勢的同時,保留其現有的人類監督模式。最近美伊衝突中廣泛引用的每二十四小時一千次打擊的節奏,意味著每次目標鎖定決策大約只有八十六秒。現有的審查程序並非為這種節奏而設計,如果它們確實以誠信的方式執行,而不是對機器決策的橡皮圖敲的話。
然而,確實有樂觀的理由。保障措施和節奏通常被認為是直接的權衡。但根本性的重新設計——一種利用AI的重新設計——可以在保持與機器速度同步的同時,提高監督的品質,而不是僅僅維持它。這種能力可以轉向內部:呈現相關的先例,標記聯盟的敏感性,或加強指揮官對預期附帶損害影響的理解。更雄心勃勃的是,在目標鎖定過程中以對抗性的方式部署AI——作為一個實時紅隊,持續對目標建議進行法律、道德和戰略標準的壓力測試——將代表對未經輔助的人類審查所能達到的真實進步。指揮官們有充分的動機希望將這些考量納入其中。如果他們搞錯了,他們的職業生涯,甚至可能還有自由,都將面臨風險。
重新設計這些流程將會因複雜性而變得棘手。AI支援的工作流程可能會悄悄地預設決策空間——所謂的「分診陷阱」,它決定了指揮官能看到哪些選項——而審查機器推理可能會消耗這些系統節省的時間。還有自動化偏見:一種眾所周知的傾向於不加批判地服從一個複雜系統,隨著AI能力的增強,這種傾向只會加劇。
AI推理的臭名昭著的不透明性加劇了這些問題。現有的目標鎖定過程從自身的失敗中學習,因為調查和詢問會審查理由和人類邏輯:2021年對一次錯誤的美國喀布爾打擊的審查,重建了分析師看到了什麼以及他們假設了什麼。這就是過程如何不斷改進以避免未來發生錯誤。一個通過無人能理解的路線提名目標的AI系統,打破了這個循環。關鍵是這些系統必須保持可審計性。
然而,我認為這些批評不一定反對AI在致命武力監督中的應用。它們反而是其設計要求。問題不在於是否讓人類參與其中,而在於如何在這些系統施加的節奏下,使人類判斷具有實質性。這將要求國防部和制定學說的指揮部重新設計監督的進行方式——幾乎肯定會比政府目前願意接受的程度更信任技術。這些機構越早誠實地面對這一點,就越早能設計出更好的東西。
AI有一天可能會超越人類識別細微差別、權衡相互競爭的考量和預測戰略後果的能力。隨著其進步,護欄可能會隨之移動,儘管不一定 uniform。在「我們能否」的一側,測試是遵守定義規則,隨著系統在嚴格測試和審計下證明可靠性,並由人類法律顧問監督,授權範圍可以擴大。在「我們應該嗎」的一側,護欄本質上錨定於問責制,而技術的任何進步都不會改變這一點。
但這不是今天可用的技術,政府不能指望一個尚不存在的能力來放鬆監督。機器永遠無法為奪取人類生命的決定承擔道德責任。因此,AI應該繼續作為指導武力使用的決策的輸入——就像今天的法律或政策建議一樣——而不是其本身的一種權威。它運行的框架應該由人類設計、驗證、擁有和審計,因為民主社會中使用武力的合法性最終取決於人類的問責制。
隨著AI融入盟國收集、處理和採取目標資訊的方式,它將在技術相互依賴之外,創造學說上的相互依賴。盟國已經在應對不同的法律解釋和比例原則,這些通過國家限制、紅牌程序和逐案審查以人類節奏來管理。但AI支援的目標鎖定將要求預先就系統的設計原則達成一致。合作夥伴不僅需要確保單獨的輸出符合其國家標準,還需要確保系統的底層框架符合其標準。這並非不可克服,但如果無法解決,人類監督的不兼容標準可能會使聯盟行動在功能上變得不可能。
令人鼓舞的是,現有的基礎可以讓我們建立。近六十個國家認可的「AI和自主性軍事使用的政治宣言」,概述了軍事系統中AI的規範框架。荷蘭領導的「軍事領域負責任AI全球委員會」提出,應將保障人類能動性、責任和問責制整合到AI支援的軍事系統的整個生命週期中。這些是正確的直覺。將這些原則轉化為實踐,意味著相關機構需要採取具體步驟。
以下是四項建議。首先,政府應預先確定哪些類型的判斷絕不委託給AI。例如,當需要權衡相互競爭的考量而不是與固定規則進行衡量時;當涉及預先指定的敏感性時(類似於禁飛名單,但擴展到政治和更廣泛的考量);當系統自身的信心或數據的時效性低於設定閾值時;或者當規則和閾值本身正在被創建或修改時,決定應恢復給人類。
第二,國防部應在目標鎖定過程中建立一個對抗性紅隊——一種AI能力,以系統生成目標提名時的速度,對每個提名進行法律、道德和戰略標準的壓力測試,呈現出人類應該權衡的內容,而不是自行做出判斷。這應該是AI目標鎖定平台的合同要求,並在演習中以與目前用於提高目標生成速度和規模的系統相同的嚴格程度進行測試。
第三,目標提名和AI「決策」背後的推理應該保持可審計性,達到足夠的標準,以便調查能夠確定發生了什麼以及為什麼。系統應自動記錄每個提名輸入、聲明理由和模型版本,以及任何相關的人類決策。
第四,政府應採取措施,防止「人在迴路中」退化為橡皮圖敲。這個問題在國防領域之外已經得到了充分研究。要求決策者提問而不是簡單發出建議的系統,可以讓審查人員保持參與,就像將紅隊反對打擊的論點與支持打擊的論點放在一起一樣。強制問責制效果較差:證據表明,那些內化了檢查機器輸出的責任的專業人員,才是真正這樣做的人,這使得這既是一個培訓和文化問題,也是一個設計問題。
所有這四項都始於政策和學說,由國家國防部負責。每一步都服務於相同的目的:保護合法打擊是否明智的判斷,並將其保留在能夠對其負責的手中。但這不能孤立地完成。在AI支援的目標鎖定中就聯盟人類監督標準達成一致的最明顯,如果不是最直接的地方,就是北約。
這一切都不需要成為一種限制。相反,這是西方的優勢所在。一種將人類決策置於核心的學說,加強了作為持久戰略力量基礎的合法性、問責制和信任。放棄這一點,或許會帶來一些戰術上的成功,但卻會放棄更具決定性的東西。西方以前也面臨過這樣的時刻,當時新技術考驗著其價值觀的界限。每一次,它的優勢都來自於將其價值觀融入其作戰和獲勝的方式,而不是拋棄它們。西方以前做到過,而且它還可以再次做到。


