OpenAI 發布了由其未發布的尖端模型產生的 722 篇論文,聲稱解決了數百個長期存在的數學難題。這些成果涵蓋了 372 個結果家族,並包含模型推理的摘要、計算估計和嘗試問題的統計數據。獨立數學家諮詢小組 AGMAI 敦促 AI 公司負責任地發布研究成果,並避免將其作為行銷工具。儘管這些結果的全面影響尚待評估,但它們引發了關於研究倫理和學術誠信的激烈辯論。
這些結果的發布已預期數週,但直到現在 OpenAI 尚未提供有關模型解決了哪些問題或確切發布時間的詳細資訊。今年九月,該公司曾表示其模型「已解決了數學領域絕大多數超過 100 個長期存在的難題」。此次發布的論文和其他詳細資料還包含了一些關於模型推理的摘要、計算量估計以及嘗試解決的問題數量統計。OpenAI 聲稱,「平均結果」使用了相當於三小時 ChatGPT Pro 的運算量。
AGMAI,即數學與人工智慧諮詢小組,於九月下旬發布了其首份建議,敦促 AI 實驗室盡快透過既有的學術管道發布數學研究成果,並披露所使用的模型名稱、提示詞和計算成本等細節。該小組還懇請 AI 公司「避免將數學研究成果的發布視為推廣其模型的行銷工具」,他們認為這種做法對數學界造成了重大損害。
OpenAI 描述了其本次發布的流程如下:
對於本次發布,我們將在 GitHub 儲存庫中發布結果,並制定論文修訂和引用協議。我們將繼續探索其他由社群託管的替代方案,以符合委員會的指導方針。對於未來的發布,我們致力於透過引用、數學闡述和結果呈現來進一步提高論文品質,以便更好地理解。
這些結果的全面影響可能需要一些時間才能顯現,因為數學家們需要時間來評估和消化它們。這些成果為 OpenAI 和 Anthropic 等競爭對手實驗室產生的、該領域仍在處理中的數學研究成果快速增長的體系增添了新的內容,其中包括關於千禧年獎問題(該領域最著名的難題之一)的研究成果。今年 AI 實驗室進入該學科的速度——特別是他們處理公告的方式——引發了關於研究實踐、倫理以及公司如何歸功於其系統所依賴並可能用於產生結果的人類數學家的激烈辯論。



