根據CNBC取得的內部訊息,Google、LinkedIn和Wikipedia是Meta計劃捕捉員工鍵盤敲擊與滑鼠點擊行為的數百個網站和應用程式之一,這是該公司用來訓練人工智慧模型的專案之一。
一款名為「模型能力計畫」(Model Capability Initiative,簡稱MCI)的新員工追蹤工具,讓Meta能觀察並收集員工在工作電腦上的操作數據,路透社於週二首次報導此事。被追蹤的網站清單還包括微軟的GitHub、Salesforce的Slack與Atlassian,這些資訊先前未曾曝光。
Meta自家產品如Threads與Manus也在追蹤名單中,該名單仍在變動中,原本還包含OpenAI的ChatGPT與Anthropic的Claude等人工智慧應用程式。
MCI工具追蹤的第三方網站與服務清單在內部廣泛流傳,並在討論區引發熱議,起因是一名Meta超級智慧實驗室(Meta Superintelligence Labs,MSL)成員發出備忘錄,試圖緩解員工對監控與隱私的擔憂。CNBC取得了該備忘錄。
此數據收集專案與Meta執行長馬克·祖克柏(Mark Zuckerberg)追趕生成式人工智慧領域的雄心密切相關,該領域中Meta落後於OpenAI、Anthropic與Google。為縮短差距,祖克柏自去年夏天起大舉投資,聘請Scale AI的Alexandr Wang組建團隊並開發新基礎模型。
本月初,Meta發布了自聘請Wang以來的首個重大AI模型,名為Muse Spark,這是由Wang監督的MSL開發的Muse系列新模型的首度亮相。
與其他科技巨頭類似,Meta積極推動能執行各種辦公與程式編碼相關任務的AI代理人,這些任務通常由白領員工完成。
Meta發言人證實了該專案,但未對追蹤網站清單發表評論。
「如果我們要打造能幫助人們完成日常電腦任務的代理人,我們的模型需要真實範例,了解人們如何使用電腦——例如滑鼠移動、點擊按鈕與操作下拉選單等行為,」發言人表示。「為此,我們推出了一款內部工具,將在特定應用程式上捕捉這類輸入,以協助訓練模型。已有防護措施保護敏感內容,且數據不會用於其他用途。」
多位Meta員工在內部訊息中形容這項數據追蹤專案為「反烏托邦」,另有人擔憂MCI可能廣泛暴露敏感資料,包括用戶密碼、新產品開發細節,以及員工的移民身份、健康狀況或家庭成員等個人資訊。
MSL成員在備忘錄中表示,為了「教導我們的模型能使用電腦」,Meta需要一個「龐大且無偏見」的數據集,反映員工在企業設備上工作的方式與任務執行情況。
「我們需要捕捉螢幕上的內容,作為操作或互動的上下文,」備忘錄指出。
在列出「幾項保證」時,MSL代表強調新工具僅能觀看員工「螢幕內容」,且「不會讀取檔案或附件」。
「任何偶然從螢幕捕捉到的企業郵件中的個人資訊,因上述防護措施,將不會被模型學習,」備忘錄寫道。
備忘錄建議仍對數據追蹤工具感到擔憂的Meta員工,「可以透過避免在工作電腦上處理私人事務,來控制螢幕上顯示的內容」。