儘管美國軍方的大數據計畫Maven多年來已加速了打擊行動的規劃,但這些評論表明,生成式AI現正為此類審議增添新的詮釋層級。

據一位了解內情、要求匿名接受《MIT Technology Review》採訪的國防部官員透露,美國軍方可能會使用生成式AI系統對目標清單進行排序,並就優先打擊哪些目標提出建議,這些建議將由人類進行審核。此番關於軍方可能如何使用AI聊天機器人的披露,正值五角大廈因一次襲擊伊朗學校的事件而面臨審查之際,該事件仍在調查中。

一份可能的目標清單可能會被輸入五角大廈正在部署於機密環境的生成式AI系統。該官員表示,接著,人類可能會要求該系統分析資訊並對目標進行優先排序,同時考慮飛機目前的位置等因素。隨後,將由人類負責檢查和評估結果與建議。理論上,OpenAI的ChatGPT和xAI的Grok可能成為未來用於此類情境的模型,因為這兩家公司最近都與五角大廈達成協議,允許其模型用於機密環境。

該官員將此描述為一種可能的工作方式範例,但並未證實或否認AI系統目前是否以此方式運作。

其他媒體曾報導,Anthropic的Claude已被整合到現有的軍事AI系統中,並在伊朗和委內瑞拉的行動中使用,但該官員的評論深入闡述了聊天機器人可能扮演的具體角色,特別是在加速目標搜尋方面。這也揭示了軍方部署兩種不同AI技術的方式,每種技術都有其獨特的限制。

自至少2017年以來,美國軍方一直在開發一項名為Maven的「大數據」計畫。它使用較舊類型的AI,特別是電腦視覺,來分析五角大廈收集的海量數據和影像。例如,Maven可能會處理數千小時的無人機飛行畫面,並透過演算法識別目標。喬治城大學2024年的一份報告顯示,士兵們使用該系統來選擇和審查目標,這加快了這些目標的批准流程。士兵們透過一個帶有戰場地圖和儀表板的介面與Maven互動,該介面可能會用一種顏色標示潛在目標,用另一種顏色標示友軍部隊。

該官員的評論表明,生成式AI現正被添加為一個對話式聊天機器人層級,軍方可能會利用它來更快地尋找和分析數據,以便在做出諸如哪些目標應優先打擊等決策。

生成式AI系統,如ChatGPT、Claude和Grok的基礎技術,與主要為Maven提供動力的AI技術有根本上的不同。它們建立在大型語言模型的基礎上,戰鬥測試的經驗較少。而且,雖然Maven的介面迫使用戶直接檢查和解釋地圖上的數據,但生成式AI模型產生的輸出更容易存取,卻更難驗證。

該官員補充說,將生成式AI用於此類決策正在縮短目標鎖定過程所需的時間,但當被問及如果人類需要花時間仔細檢查模型的輸出,額外的速度提升有多少時,他並未提供細節。

在近期襲擊伊朗一所女子學校、造成一百多名兒童死亡的事件後,軍事AI系統的使用正受到越來越多的公眾審查。多家新聞媒體報導稱,此次襲擊來自一枚美國飛彈,儘管五角大廈表示仍在調查中。雖然《華盛頓郵報》報導稱Claude和Maven參與了伊朗的目標決策,但目前尚無證據能解釋生成式AI系統在其中扮演了何種角色(如果有的話)。《紐約時報》週三報導稱,初步調查發現過時的目標鎖定數據是導致此次襲擊的部分原因。

五角大廈近幾個月來一直在加強其在各項行動中對AI的使用。自去年12月以來,透過一項名為GenAI.mil的計畫,它開始向數百萬軍人提供非機密的生成式AI模型使用權,用於分析合約或撰寫簡報等任務。但只有少數生成式AI模型獲得五角大廈批准用於機密用途。

第一個是Anthropic的Claude,除了在伊朗的使用外,據報導還在1月份抓捕委內瑞拉領導人尼古拉斯·馬杜羅的行動中使用。但在五角大廈與Anthropic之間近期就Anthropic是否能限制軍方使用其AI產生分歧後,國防部將該公司指定為供應鏈風險,並由川普總統在社群媒體上要求政府在六個月內停止使用其AI產品。Anthropic正在法庭上對此項指定提出異議。

OpenAI於2月28日宣布了一項協議,允許軍方在其機密環境中使用其技術。伊隆·馬斯克的公司xAI也達成了一項協議,允許五角大廈在其機密環境中使用其Grok模型。OpenAI表示,其與五角大廈的協議附帶有某些限制,但這些限制的實際有效性尚不清楚。