
CMG Lab 解決具身智慧中的 VLA 捷徑學習問題
China Merchants Group 旗下的 LionRock AI Lab 開發了一種解決視覺-語言-動作 (VLA) 捷徑學習的方法。這項在 IROS 2026 發表的突破性成果,提升了具身智慧的空間視覺能力。
Tag: #vla27 results

China Merchants Group 旗下的 LionRock AI Lab 開發了一種解決視覺-語言-動作 (VLA) 捷徑學習的方法。這項在 IROS 2026 發表的突破性成果,提升了具身智慧的空間視覺能力。

本文探討了具身智能從實驗室演示走向獲利工業應用的過程,強調在滿足現實工廠需求方面,穩健的控制系統比單純的 VLA 模型更為重要。

由韓峰濤與高陽創立的千尋智能,在極短時間內完成數十億融資,專注於「物理AI」與VLA模型。該公司採用「髒數據」策略來擴展機器人學習能力。
產業正轉向「物理 AI」作為下一個兆級美元市場,重點在於整合視覺-語言-動作 (VLA) 模型與世界模型,以實現機器人對物理空間的理解與導航。
至少五家中國具身智能公司——智平方、自变量、星海图、千寻智能與银河通用——投後估值已超過200億元人民幣。它們的估值不僅取決於目前的出貨量,更反映基座模型架構、資料閉環與商業化潛力。

Papers with Code 推出了專屬的機器人技術專區,用於追蹤主要基準測試、熱門論文和開源項目。目前涵蓋了 LIBERO 和 SimplerEnv 等基準測試中的 110 多個項目。
Robbyant 開源了 LingBot-VLA 2.0,研究顯示將絕對關節目標改為相對關節動作後,成功率大幅提升了 21.3%。此次發布包含權重、程式碼以及用於具身智慧研究的 GM-100 基準測試。

螞蟻集團發布了 Lingbot-VLA 2.0,這是一款經過 60,000 小時數據訓練的開源視覺語言動作模型。該模型旨在與超過 20 種不同類型的機器人平台兼容。

Neuro-Symbolic Drive 引入了一種框架,利用來自傳統規劃器的規則基礎推理軌跡來監督駕駛視覺語言動作 (VLA) 模型。此方法確保模型的自然語言推理與其物理運動生成在結構上緊密耦合。