
跨維智能DexWorldModel蟬聯榜首
跨維智能的DexWorldModel奪得榜首。世界模型真正考場在機器人執行,而非僅模擬。重塑具身世界模型評價方式。
Tag: #robotics-benchmark10 results

跨維智能的DexWorldModel奪得榜首。世界模型真正考場在機器人執行,而非僅模擬。重塑具身世界模型評價方式。

中國人形機器人在北京半馬拉松以50分26秒奪冠,遠超人類男子世界紀錄57分20秒。較去年進步1小時50分。中國將2026年定位為人形機器人商業化元年。

宇樹科技 H1 人形機器人刷新百米測試奔跑速度世界紀錄,峰值速度達 10 米/秒。接近人類極限博爾特 10.44 米/秒,展現機器人運動能力躍進。

World Humanoid Robot Games 在真實飯店環境中測試機器人搬運行李、補充客房用品與整理床鋪的能力。這項 30 分鐘挑戰評估負重平衡、靈巧抓取、導航與長鏈任務規劃,並給予全自主操作高於遙控操作的評分權重。

五所高校聯合發布了首份機器人三視角世界模型評測結果。排行榜將持續更新,納入更多模型與評測結果。

中國科學技術大學與北京人形機器人創新中心推出 Labimus,這是一個針對精準化學實驗室的人形機器人靈巧操控仿真與評測平台。該平台透過 3x4 的評測矩陣,嚴格測試機器人在粉末稱量與工具操作中的精度與魯棒性。

Honor「Flash」人形機器人在北京亦莊人形機器人半馬拉松中以 50 分 26 秒奪冠,超越人類世界紀錄 56 分 42 秒。賽道長 21.0975 公里,包含多樣複雜地形。此成就為機器人耐力樹立新基準。

Honor 人形機器人 Lightning 以 50 分 26 秒贏得北京機器人半馬拉松,超越人類世界紀錄 57 分 20 秒超過六分鐘。由去年進入機器人領域的中國公司 Honor 開發。此事件突顯人形機器人技術的快速進展。

AutoBio 獲 ICLR 2026 接收,由香港大學 MMLAB 與上海交大團隊開發,為數字生物實驗室的 VLA 模型模擬基準。解決長時序任務、螺紋工具精準互動,以及液體/透明容器視覺挑戰。開源程式碼評估 VLA 是否能自動化真實實驗。

中國實體 AI 新創 Spirit AI 憑藉 Spirit v1.6 模型,短暫在全球實體 AI 基準 RoboArena 上超越 Nvidia。這項排名結果引發疑似操縱的爭議,也凸顯自主系統評估的困難。