我們成立Glasswing計畫,是因為觀察到Anthropic訓練的新一代前沿模型Claude Mythos 2 Preview展現出可能重塑資安領域的能力。這款通用且尚未公開的前沿模型揭示了一個嚴峻事實:AI模型在程式碼能力上已達到超越大多數頂尖人類專家的水準,能夠發現並利用軟體漏洞。
Mythos Preview已經發現數千個高嚴重性漏洞,涵蓋所有主要作業系統與網頁瀏覽器。隨著AI技術快速進步,這類能力將迅速普及,甚至可能落入不負責任的使用者手中,對經濟、公共安全及國家安全造成嚴重影響。Glasswing計畫正是為了緊急將這些能力用於防禦目的。
作為Glasswing計畫的一部分,合作夥伴將使用Mythos Preview協助防禦性資安工作;Anthropic也會分享所學,讓整個產業受益。我們同時開放超過40家維護關鍵軟體基礎設施的組織使用此模型,掃描並保護自家及開源系統。Anthropic承諾投入高達1億美元的Mythos Preview使用額度,並捐贈400萬美元給開源資安組織。
Glasswing計畫只是起點。沒有人能獨自解決資安問題:前沿AI開發者、軟體公司、資安研究者、開源維護者及全球政府都扮演關鍵角色。防禦全球網路基礎設施的工作可能需歷時數年,而前沿AI能力在未來幾個月內將大幅提升。資安防禦者必須立即行動,才能掌握先機。
我們日常依賴的軟體,負責銀行系統、醫療紀錄、物流網絡及電力系統等,歷來都存在漏洞。多數為輕微錯誤,但部分為嚴重安全缺陷,一旦被發現,可能讓駭客劫持系統、癱瘓運作或竊取資料。
我們已見證駭客攻擊對企業網路、醫療系統、能源基礎設施、交通樞紐及政府機關資訊安全造成的嚴重後果。國際間,中國、伊朗、北韓及俄羅斯等國家支持的攻擊威脅民用及軍事基礎設施安全。即使是針對單一醫院或學校的小規模攻擊,也可能造成龐大經濟損失、敏感資料外洩,甚至危及生命。全球資安犯罪的財務損失估計每年約達5000億美元。
過去多年,許多漏洞因需高度專業技能才能發現與利用,故長期未被察覺。最新的前沿AI模型大幅降低了尋找與利用漏洞的成本、難度與專業門檻。過去一年,AI在閱讀與推理程式碼方面日益精進,尤其擅長發現漏洞並設計利用方式。Claude Mythos Preview展現了資安技能的飛躍——它發現的漏洞有些經過數十年人類審查與數百萬次自動化測試仍未被察覺,且其開發的利用手法日益複雜。
自DARPA十年前的網路大挑戰以來,前沿AI模型已能與頂尖人類專家競爭漏洞發現與利用能力。若無適當防護,這些強大資安能力可能被用於攻擊全球重要軟體的眾多漏洞,導致駭客攻擊更頻繁且破壞力更強,並助長美國及其盟友的對手。因而,解決這些問題是民主國家的重要安全優先事項。
儘管AI輔助的資安攻擊風險嚴峻,但同時也帶來希望:相同的AI能力若用於防禦,能有效發現並修補軟體缺陷,甚至開發出更安全的新軟體。Glasswing計畫是為防禦者在AI驅動的資安時代取得持久優勢的重要一步。
過去數週,我們利用Claude Mythos Preview發現數千個零時差漏洞(即軟體開發者先前未知的缺陷),其中許多為關鍵漏洞,涵蓋所有主要作業系統與瀏覽器,以及其他重要軟體。
我們在前沿紅隊部落格中公布部分已修補漏洞的技術細節,並展示Mythos Preview如何自主發現並開發利用手法。以下為三個範例:
我們已將上述漏洞通報相關軟體維護者,並均已修補。對於其他漏洞,我們今日提供加密雜湊,待修補完成後再公開細節。
評測基準如CyberGym顯示Mythos Preview與次佳模型Claude Opus 4.6間存在顯著差距。
除了我們的工作,許多合作夥伴已使用Mythos Preview數週,並分享以下發現:
思科資安長表示,AI能力已突破門檻,改變保護關鍵基礎設施的緊迫性,傳統防護方法已不足,必須積極採用新方法。
亞馬遜AWS資安長指出,AI是其大規模防禦的核心,Mythos Preview已協助強化關鍵程式碼。
微軟資安副總裁強調,AI使資安不再受限於人力,能及早發現並減輕風險,並期待與Anthropic及產業合作提升資安成果。
CrowdStrike技術長提醒漏洞被發現到被利用的時間已從數月縮短至數分鐘,強調必須加速合作防禦。
開源維護者指出,Glasswing計畫讓開源軟體維護者能利用AI大規模主動發現並修補漏洞,改變過去資安資源不足的困境。
摩根大通資安長表示,Glasswing提供評估下一代AI資安工具的獨特機會,並強調合作的重要性。
谷歌表示,跨產業合作對於新興資安議題至關重要,並持續投資AI資安工具。
Palo Alto Networks產品技術長指出,Mythos Preview能發現前代模型無法察覺的複雜漏洞,強調必須讓開源維護者及防禦者掌握此類模型,並準備面對AI輔助攻擊。
Claude Mythos Preview強大的資安能力來自其卓越的程式編碼與推理技能,在多項軟體編碼任務中取得最高分數。
我們不計畫將Claude Mythos Preview公開,但目標是讓用戶能安全大規模部署此類模型,除了資安外,也帶來其他多元效益。為此,我們將開發資安等防護措施,阻擋模型最危險的輸出,並計畫在未來Claude Opus新版本中推出這些防護。
今日宣布是長期努力的開始,成功需科技產業及其他領域廣泛參與。
Glasswing合作夥伴將獲得Claude Mythos Preview使用權,協助發現並修補基礎系統漏洞,涵蓋全球龐大網路攻擊面,工作重點包括本地漏洞偵測、黑盒測試、端點安全及滲透測試。
Anthropic承諾投入1億美元模型使用額度,支持研究預覽階段大量使用。之後,參與者可透過Claude API、Amazon Bedrock、Google Cloud Vertex AI及Microsoft Foundry以每百萬輸入/輸出代幣25美元至125美元價格使用模型。
此外,我們已捐贈250萬美元給Linux基金會旗下Alpha-Omega與OpenSSF,以及150萬美元給Apache軟體基金會,協助開源軟體維護者應對變化(有意者可透過Claude for Open Source計畫申請)。
我們預期此工作將持續擴大並進行數月,並會盡可能分享成果,讓其他組織應用經驗。合作夥伴將在能力範圍內共享資訊與最佳實踐;90天內,Anthropic將公開報告所學、修補漏洞及可披露的改進。我們也將與頂尖資安組織合作,提出AI時代資安實務建議。
Anthropic持續與美國政府官員討論Claude Mythos Preview的攻防資安能力。正如前述,保護關鍵基礎設施是民主國家的國家安全首要任務,這些新興資安能力更凸顯美國及盟友必須保持AI技術領先地位。政府在維持領先、評估及減輕AI國安風險方面扮演重要角色,我們準備協助各級政府代表完成相關任務。
我們期望Glasswing計畫能促成產業與公共部門更大規模合作,共同探討強大模型對資安的影響。我們邀請其他AI業者加入,共同制定產業標準。中期而言,獨立第三方組織或許是持續推動大型資安專案的理想平台,能整合公私部門力量。