Search

Tag: #manipulation7 results

小米開源 VLA 後訓練流程

小米開源 VLA 後訓練流程

小米發布開源 VLA 模型 Xiaomi-Robotics-0 的完整後訓練流程,讓機器人能以亞毫米精度連續收納耳機入盒。僅用 20 小時真機數據訓練,即克服極小公差與表面粗糙度挑戰。模型權重、程式碼與資源現已在 HuggingFace 與 GitHub 公開。

對齊概念:有缺陷的抽象

對齊概念:有缺陷的抽象

本文批判AI對齊概念如賦權與可修正性,為根植於自由意志與可操縱目標的不連貫人類直覺的簡單抽象。它檢視定義非操縱AI行為的方法,但結論無一提供技術對齊的有用「真名」。作者將此置於其腦狀AGI安全研究脈絡,使用同情與認可獎勵。

AI Alignment ForumCommunityMay 11#ai-alignment#manipulation#corrigibility