從 4 月 24 日起,Copilot 免費、Pro 和 Pro+ 版本的互動資料——具體而言,包括輸入、輸出、程式碼片段及相關內容——將用於訓練和改進我們的 AI 模型,除非用戶選擇退出。
今天,我們宣布一項關於 GitHub 如何使用資料來提供更智慧、更具情境感知能力的程式碼輔助的政策更新。從 4 月 24 日起,Copilot 免費、Pro 和 Pro+ 版本的互動資料——具體而言,包括輸入、輸出、程式碼片段及相關內容——將用於訓練和改進我們的 AI 模型,除非用戶選擇退出。Copilot Business 和 Copilot Enterprise 版本不受此更新影響。
這種方法符合既定的業界實踐,並將提高所有用戶的模型效能。透過參與,您將幫助我們的模型更好地理解開發工作流程,提供更準確、更安全的程式碼模式建議,並提高其在程式碼進入生產環境之前幫助您捕捉潛在錯誤的能力。
我們最初的模型是使用混合了公開可用資料和手工編寫的程式碼範例所建構的。在過去一年中,我們開始整合來自微軟員工的互動資料,並看到了有意義的改進,包括在多種語言中接受率的提高。
透過整合微軟互動資料所看到的改進表明,我們可以透過訓練真實世界的互動資料來提高模型對更多樣化使用案例的效能。如果您決定參與此計畫,我們可能收集和利用的互動資料包括:
此計畫中使用到的資料可能會與 GitHub 的附屬公司共享,這些公司是我們公司家族的一部分,包括微軟。這些資料不會與第三方 AI 模型提供者或其他獨立服務提供者共享。
我們相信 AI 輔助開發的未來取決於像您這樣的開發者的真實互動資料。這就是為什麼我們將微軟的互動資料用於模型訓練,並將開始使用 GitHub 員工的互動資料。
如果您選擇用您的互動資料幫助我們改進模型,我們不勝感激。您的貢獻對於建立服務於整個開發者社群的 AI 工具具有意義。如果您選擇不參與,那也沒關係——您仍然可以充分享受您所熟悉和喜愛的 AI 功能。
我們可以一起繼續建立能夠加速您的工作流程,並賦予您更快、更好地編寫更安全軟體的 AI。