OpenAI 發佈另一批數學突破

OpenAI 已經揭示了一些長期以來的數學問題的解決方案,這些解決方案來自一個尚未發布的前沿模型,涵蓋了 722 篇手稿中的 372 個結果家族,這些結果家族將相關的論文分組。這一系列突破不僅令數學界的部分人士印象深刻,亦讓人感到不安,同時引發了有關研究倫理和學術行為的問題。根據 AGMAI,這個新成立的獨立顧問小組由精英數學家組成,旨在負責任地傳達這些結果,發布的內容包括對“數百個”未解問題的解決方案。這些結果已經預期了幾周,儘管直到現在 OpenAI 尚未提供有關模型解決了哪些問題或具體何時會發布的詳細資訊。九月份,該公司表示其模型已經“解決了超過 100 個長期存在的未解問題,涵蓋了數學的大多數領域。”發布的論文和其他細節還包括模型推理的一些摘要、使用的計算估算以及嘗試解決的問題數量的統計數據。OpenAI 聲稱“平均結果”使用了相當於三小時的 ChatGPT Pro 思考時間。

AGMAI,即數學與人工智能顧問小組,在九月底發布了其首份建議,敦促 AI 實驗室在可能的情況下及時通過既定的學術渠道發布數學結果,同時披露使用的模型名稱、提示和計算成本等細節。該小組還懇請 AI 公司“避免將數學結果的發布視為推廣其模型的營銷工具”,他們表示這種做法對數學界造成了重大傷害。以下是 OpenAI 描述其此次發布過程的方式:

“對於此次發布,我們將結果發佈在 GitHub 儲存庫中,並設有論文修訂和引用的協議。我們將繼續探索其他符合委員會指導方針的社區主辦的替代方案。對於未來的發布,我們致力於通過引用、數學表述和結果的呈現進一步提高論文的質量,以便更好地理解。”

這些結果的全面影響可能需要一些時間才能顯現,因為數學家們需要評估和消化它們。這些結果為 OpenAI 和競爭實驗室如 Anthropic 的快速增長的數學結果體系增添了新的內容,該領域仍在處理這些結果,包括與千禧獎問題有關的結果,這是該領域最著名的未解問題之一。今年 AI 實驗室在這一學科的迅速進展——特別是他們對公告的處理——引發了對研究實踐、倫理以及公司如何給予人類數學家應有的信用的激烈辯論,這些數學家的工作是他們的系統所建立的基礎,並可能用來產生結果。