Search

直接匹配不多,已補上最新動態。

Tag: #efficient-training3 results

RSM:20倍速遞歸推理模型

RSM:20倍速遞歸推理模型

遞歸莖模型(RSM)透過訓練時分離隱藏狀態歷史、使用暖啟步驟,並僅在最終迭代施加損失,改進 TRM,實現 20 倍速訓練與 5 倍錯誤率降低。它支援無需重新訓練的測試時數千步擴展,在 Sudoku-Extreme 達 97.5% 準確率、在 Maze-Hard 達 80%。收斂行為提供內建可靠性訊號,防範幻覺。

Ox Alpha:神秘模型公開亮相

Ox Alpha:神秘模型公開亮相

Ox Alpha 是一款透過 OpenRouter 與 OpenCode 提供的匿名模型,具備 100 萬 token 上下文、圖片與影片輸入、工具呼叫及免費使用等能力。早期測試顯示其推理與程式設計表現強勁,但開發者、參數量、訓練資料與正式基準排名仍未獲確認。