🔬
OpenAI 模型解決了 80 年前的離散幾何猜想
OpenAI 的一個模型成功推翻了離散幾何領域中長期存在的「單位距離問題」猜想。這一成就凸顯了 AI 系統在推動基礎數學研究方面日益增長的能力。
Tag: #formal-reasoning5 results
OpenAI 的一個模型成功推翻了離散幾何領域中長期存在的「單位距離問題」猜想。這一成就凸顯了 AI 系統在推動基礎數學研究方面日益增長的能力。

OpenAI 的模型成功解決了一個困擾人類數學家長達八十年的複雜數學難題。這項成就凸顯了 AI 在形式推理與先進科學發現方面日益增強的能力。
Yann LeCun 的 Logical Intelligence 獲 10 億美元種子輪,用於開發能量基模型生成數學驗證程式碼,繞過 Transformers。此舉針對自迴歸 LLM 在形式推理與規劃的限制。關於 EBM 實用性對抗 GPT-5 等擴展 LLM 的爭論激烈。

TREAT 是一項基準測試,用於評估大型語言模型在定理條件被改寫為數學等價形式後,是否仍能辨識已知定理。最佳模型的準確率僅達 60.73%,顯示模型在表示方式改變時,存取形式知識的能力相當脆弱。

這篇論文提出 RAIL——推理、保證、介接與學習——作為設計可靠神經符號 AI 系統的統一框架。研究將這些原則應用於物理感知機器學習、Alpha 系列神經引導搜尋、因果學習,以及工具增強型 LLM 等領域。