AI 驅動的欺騙行為已滲透我們的網路生活。有些是你可以輕易辨識的高調案例,例如白宮官員最近分享了明尼蘇達州抗議者的操縱圖像,然後嘲笑那些質疑的人。其他時候,它則悄悄地滲入社群媒體動態並累積觀看次數,例如俄羅斯影響力活動目前正在散播的影片,旨在阻止烏克蘭人參軍。
正是在這種混亂之中,微軟提出了一份藍圖,與 MIT Technology Review 分享,說明如何驗證網路上的真實內容。
該公司的一個 AI 安全研究團隊最近評估了記錄數位操縱的方法,如何應對當今最令人擔憂的 AI 發展,例如互動式深度偽造和廣泛可用的超擬真模型。隨後,它建議了 AI 公司和社群媒體平台可以採用的技術標準。
要理解微軟正在推動的黃金標準,想像一下你有一幅林布蘭的畫作,並試圖證明其真實性。你可能會用一份詳細的清單來描述其來源,說明畫作來自何處以及所有權轉移的次數。你可能會加上一個對人眼不可見但機器可讀的水印。你還可以對畫作進行數位掃描,並根據筆觸生成一個數學簽章,就像指紋一樣。如果你在博物館展示這件作品,懷疑的參觀者就可以檢查這些證明來驗證它是原作。
這些方法中的每一種,在驗證網路內容的努力中都已不同程度地被使用。微軟評估了其中 60 種不同的組合,模擬了每種設置在不同失敗情境下的表現——從元數據被剝離到內容被輕微修改或故意操縱。然後,該團隊繪製了哪些組合能產生平台可以自信地向人們展示的可靠結果,哪些組合又如此不可靠,以至於可能造成更多混淆而非澄清。
該公司首席科學官 Eric Horvitz 表示,這項工作是由立法推動的——例如將於 8 月生效的加州 AI 透明法案——以及 AI 在結合影片和語音方面以驚人的保真度發展的速度。
Horvitz 告訴 MIT Technology Review:「你或許可以稱之為自我監管。」但顯然他認為從事這項工作有助於提升微軟的形象:「我們也正試圖成為那些希望了解世界正在發生什麼的人們,一個被選中、受歡迎的提供者。」
儘管如此,Horvitz 拒絕承諾微軟將在其平台全面採用自己的建議。該公司處於一個龐大的 AI 內容生態系統的中心:它營運 Copilot,可以生成圖像和文字;它營運 Azure,客戶可以透過該雲端服務存取 OpenAI 和其他主要 AI 模型;它擁有 LinkedIn,這是世界上最大的專業平台之一;並且它持有 OpenAI 的重要股份。但當被問及內部實施時,Horvitz 在一份聲明中表示:「公司內部的產品群組和領導者參與了這項研究,以指導產品路線圖和基礎設施,我們的工程團隊正在根據報告的發現採取行動。」
需要注意的是,這些工具存在固有的限制;就像它們無法告訴你你的林布蘭畫作的意義一樣,它們也不是為了判斷內容是否準確而設計的。它們只顯示內容是否被操縱。Horvitz 表示,他必須向立法者和其他對大型科技公司作為事實仲裁者持懷疑態度的人說明這一點。
「這不是關於做出任何關於真偽的決定,」他說。「這是關於提供標籤,讓大家知道內容的來源。」
加州大學柏克萊分校教授 Hany Farid 專門研究數位鑑識,他並未參與微軟的研究。他說,如果業界採用該公司的藍圖,將會大大增加用操縱內容欺騙公眾的難度。他表示,複雜的個人或政府可以設法繞過這些工具,但新標準可以消除相當一部分誤導性材料。
「我不認為這能解決問題,但我認為它解決了其中很大一部分問題,」他說。
然而,有理由認為微軟的方法是一種有些天真的技術樂觀主義。越來越多的證據表明,即使人們知道 AI 生成的內容是虛假的,他們仍然會受到影響。在最近一項關於親俄羅斯 AI 生成的烏克蘭戰爭影片的研究中,指出影片是由 AI 製作的評論所獲得的參與度遠低於將其視為真實的評論。
Farid 问道:「有些人,無論你告訴他們什麼,他們都會堅持自己的信念嗎?」他說:「是的。」但他補充說:「我確實認為,絕大多數美國人和世界公民都想知道真相。」
這種願望並沒有促使科技公司採取緊急行動。Google 在 2023 年開始為其 AI 工具生成的內容添加水印,Farid 認為這對他的調查很有幫助。一些平台使用 C2PA,這是微軟在 2021 年協助推出的來源證明標準。但微軟建議的變更的完整套件,儘管強大,但如果威脅到 AI 公司或社群媒體平台的商業模式,可能仍然只是建議。
Farid 說:「如果像 Mark Zuckerbergs 和 Elon Musks 這樣的人認為,在某樣東西上貼上『AI 生成』的標籤會降低參與度,那麼他們當然有動機不這麼做。」Meta 和 Google 等平台已經表示會包含 AI 生成內容的標籤,但 Indicator 去年的一項審計發現,其在 Instagram、LinkedIn、Pinterest、TikTok 和 YouTube 上的測試貼文中,只有 30% 被正確標記為 AI 生成。
更強硬的內容驗證措施可能來自世界各地正在審議的許多 AI 法規。歐盟的 AI 法案,以及印度和其他地方提出的規則,都將迫使 AI 公司要求某種形式的披露,表明內容是由 AI 生成的。
微軟的一個優先事項是,不出所料地,在塑造這些規則方面發揮作用。該公司在加州 AI 透明法案的起草過程中進行了遊說,Horvitz 表示,這使得該法案關於科技公司如何披露 AI 生成內容的要求「更加現實一些」。
但另一個是人們對此類內容驗證技術推出不當可能發生的情況感到非常擔憂。立法者要求能夠驗證真實性的工具,但這些工具很脆弱。如果標籤系統倉促推出、應用不一致或經常出錯,人們可能會完全不信任它們,整個努力將適得其反。這就是為什麼研究人員認為,在某些情況下,顯示任何內容都比顯示一個可能錯誤的判決更好。
不充分的工具也可能為研究人員所稱的社會技術攻擊創造新的途徑。想像一下,有人拿一張真實的、關於一個充滿爭議的政治事件的圖片,並使用 AI 工具僅更改圖片中一小部分像素。當它在網路上傳播時,平台可能會誤導性地將其歸類為 AI 操縱。但結合來源證明和水印工具將意味著平台可以澄清內容僅部分由 AI 生成,並指出修改的位置。
加州 AI 透明法案將是這些工具在美國的首次重大考驗,但執法可能會受到川普總統去年底發布的行政命令的挑戰,該命令尋求限制對產業「負擔過重」的州 AI 法規。政府普遍採取反對遏制虛假資訊的立場,去年,透過 DOGE,它取消了與錯誤資訊相關的撥款。當然,川普政府的官方政府渠道也分享了被 AI 操縱的內容(MIT Technology Review 報導稱,例如,國土安全部使用 Google 和 Adobe 的影片生成器來製作與公眾分享的內容)。
我問 Horvitz,來自這個來源的假內容是否像來自其他社群媒體的假內容一樣讓他擔心。他最初拒絕評論,但隨後表示:「政府並非沒有參與各種形式的操縱性虛假資訊的領域,而且這是全球性的。」