
自主 AI 研究員邁向新前沿
Import AI 探討具備能力的自主 AI 研究員如何成為人工智慧的新前沿。文章也討論 RSI 模擬器,以及 Mark Zuckerberg 對技術進步較為悲觀的看法。
Tag: #scientific-discovery33 results

Import AI 探討具備能力的自主 AI 研究員如何成為人工智慧的新前沿。文章也討論 RSI 模擬器,以及 Mark Zuckerberg 對技術進步較為悲觀的看法。

據報導,OpenAI 的 AI 解出了 10 道長期未解的數學問題,其中一些難題曾困擾學界數十年。這項進展正促使包括菲爾茲獎得主 James Maynard 在內的數學家重新思考 AI 將如何改變數學研究。
Anthropic 表示,尚未公開發布的 Claude 研究版模型在黎曼猜想研究上取得實質進展。在多日自主測試期間,該模型將黎曼 Zeta 函數位於臨界線上的零點比例已知下限,從 41.6% 提高至 67.2%。

AI for Science 正快速走向閉環系統:自動提出假設、執行實驗、驗證結果,再將合格成果回饋到下一輪。文章警告,這類系統雖能提升產出效率,卻可能削弱科學家的品味與判斷力,並受限於既有資料與概念的邊界。

Mirendil 簽署了一項價值超過 1 億美元的 Google Cloud 合作案,以擴充其運算基礎設施。新增的運算能力將支援自我改進 AI 系統研究,目標是加速科學發現與 AI 開發。

美國已啟動 Genesis Mission,這項大型計畫將 AI、超級運算與國家實驗室連結,以加速科學發現。該計畫從超過 5,000 份申請中選出 278 個項目,涵蓋核能、量子計算、材料、生物、氣候與宇宙學等領域。

Hypothesis Evolution Protocol (HEP) 為 LLM 代理進行科學研究提供了一個結構化框架。它將非結構化的推理轉化為可審計的操作,從而能夠更好地驗證假設生成、測試和信念更新的過程。

FirstResearch 引入了一種結構化的「研究問題證書」,使 LLM 生成的科學假設具備可檢查性和可審計性。該框架透過強制執行科學發現的明確推導約束,表現優於現有的基準代理。

OpenAI 的模型成功解決了一個困擾人類數學家長達八十年的複雜數學難題。這項成就凸顯了 AI 在形式推理與先進科學發現方面日益增強的能力。

本文批評當前的AI系統過於偏重預測,而非具備遠見,認為它們僅在既有範式內優化,難以實現科學突破。作者呼籲開發能提出全新概念框架的AI,而不僅僅是處理既有數據的預測工具。