OpenAI發布了第一批研究結果。 Astra,他們的下一代人工智慧模型該公司在數學和理論計算機科學領域的十個未解難題上取得了進展。據該公司稱,其中一些難題十多年來一直懸而未決,沒有任何重大進展。該公告於2026年8月1日發布,在科學界引起了廣泛關注,但許多研究人員呼籲在獨立專家對結果進行審查之前保持謹慎。
這則廣告與其他類似廣告的不同之處在於: OpenAI不僅公佈了結果,也公佈了正式的展示過程。 在精實驗證系統中,任何數學家都可以自動檢查論證的正確性。此外,該公司還詳細闡述了整個探索過程,包括249頁的論點和62頁的註釋,在此類溝通中展現了非凡的透明度。
十個問題及其相關性

Astra 研究的問題涵蓋了現代數學的各個領域,其中包括: 對康涅斯剛性猜想的反駁這結果對算子代數有重大影響,非索菲群的顯式構造是群論中的一個基本問題。此外,還獲得了高維球堆積問題的新上界,該問題在資訊理論和糾錯碼領域有著直接的應用。
在組合數學領域,Astra 解決了匈牙利數學家保羅·埃爾德什提出的三個問題:問題 146、180 和 183。其中最後一個問題與多色拉姆齊數有關,專家托馬斯·布魯姆稱其為“所有問題中最令人驚訝的一個”。其他進展包括算術電路的新下界、量子博弈的平行重複定理,以及與後量子密碼學相關的最近向量問題的近似難度結果。
成本和方法
OpenAI透露, 找到這些解決方案的總代幣成本約為 2.000 美元。根據 Sol 的 API 收費標準,該費用不包含模型訓練或人工研究工作。這個流程結合了 Astra 的論證產生功能和專家意見,幫助將這些論證轉化為清晰的文稿,並最終產生可自動驗證的精實認證。
形式化是精實生產的關鍵:它允許任何有權存取軟體的人逐步驗證演示的邏輯正確性。然而, 數學家仍然需要驗證所使用的定義和假設是否與原始問題相符。這是機器無法獨立完成的任務。 OpenAI已承諾負責修正這項工作,但尚未指定任何獨立機構公開評估全部十個結果。
與深藍的比較及必要的注意事項
一些媒體將這一里程碑事件與1997年「深藍」戰勝加里·卡斯帕羅夫相提並論,但專家指出: 數學比國際象棋更複雜。在遊戲中,結果立竿見影;而在數學中,一個證明可能需要數月的同儕審查才能被接受。此外,Astra 並未公開,因此外部研究人員無法復現該過程或確定模型的失敗率。
OpenAI 先前曾有過看似正確的結果在專家審核後被證實錯誤的經驗。 2016 年 2 月,該公司提交了 First Proof 挑戰賽的解決方案,後來承認其中一個方案是錯誤的。因此, 科學界堅持認為,這十項進展應該被視為有希望的,但並非最終結果。直到得到獨立核實為止。
在歐洲,馬德里理工大學和劍橋大學等大學的研究人員已表示有興趣分析OpenAI發布的精實認證。人工智慧參與產生新的數學知識的可能性引發了關於未來人類科學家角色的討論,儘管該公司強調,在未來許多年裡,結果的驗證和背景解讀仍將依賴專家。
然而,Astra 的聲明標誌著一個轉折點:人工智慧不再局限於解決已知答案的問題,而是開始對前沿知識問題提出獨到的見解。數學領域真正的「深藍時刻」或許並非源於某個驚世駭俗的成果,而是循序漸進的,隨著這些模型逐漸成為能夠探索成千上萬條路徑並形式化此前任何研究人員都未曾驗證過的結論的合作者。