🔥36氪•較早收集於 12m
地瓜機器人與千尋智能達成 VLA 戰略合作
#robotics#vla#edge-ai#embodied-aispirit-v1.5-/-sunray-s600digua-robotqianxun-intelligencespirit-v1.5sunray-s600
💡適用於具身智慧開發者的高性能 VLA 模型與晶片組合。
⚡ 30-Second TL;DR
有什麼變化
Spirit v1.5 為超越 Pi0.5 的開源 VLA 模型
為什麼重要
此次合作透過彌合先進 VLA 模型與專用邊緣硬體之間的差距,加速了具身智慧(Embodied AI)的落地應用。
下一步行動
若您的機器人專案需要高性能邊緣推理能力,請評估 Spirit v1.5 模型。
誰應關注:Developers & AI Engineers
關鍵要點
- •Spirit v1.5 為超越 Pi0.5 的開源 VLA 模型
- •旭日 S600 晶片具備 560TOPS (INT8) AI 算力
- •專注於機器人領域的邊緣端高效推理
🧠 深度解析
Web-grounded analysis with 24 cited sources.
🔑 增強重點摘要
- •千尋智能的Spirit v1.5模型在2026年1月於RoboChallenge Table30真機評測中超越Pi0.5,位列第一,並已開源其權重與代碼,推動具身智能領域的透明化與協作發展。
- •地瓜機器人作為地平線機器人拆分出的獨立公司,專注於提供機器人核心計算平台及軟硬體基礎設施,而非機器人本體,並已在2026年4月完成B2輪融資,累計融資額超過3.7億美元。
- •Spirit v1.5模型的訓練採用多樣化數據採集範式,不依賴「乾淨」的演示數據,允許失敗和中斷,旨在讓模型學習如何處理真實世界的複雜情況,而非僅僅執行預設動作,顯著提升了遷移效率並降低了算力依賴。
- •旭日S600晶片採用「大小腦」異構設計,其中「大腦」包含18核A78AE CPU和全新BPU Nash,支持多種具身大模型算法高效部署,而「小腦」則配置6核R52+ MCU,專為人形機器人提供高可靠、實時運動控制能力。
- •地瓜機器人已建立涵蓋芯片、操作系統、算法中心及數據解決方案的「Wintel」式生態系統,旨在為廣泛的機器人產品提供通用底座,並已服務超過10萬名機器人開發者。
📊 競品分析▸ Show
| 特性/模型 | Spirit v1.5 | Pi0.5 |
|---|---|---|
| 開發者 | 千尋智能 (Spirit AI) | Physical Intelligence |
| 發布時間 | 2026年1月12日 (開源) | 2025年9月 (升級版), 2025年4月22日 (論文) |
| 基準測試 | RoboChallenge Table30 #1 | RoboChallenge Table30 (被Spirit v1.5超越) |
| 訓練數據範式 | 多樣化數據採集,不依賴「乾淨」數據,允許失敗和中斷 | 異構任務協同訓練,多機器人、高層語義預測、網絡數據等 |
| 架構 | 統一的VLA架構,整合視覺、語言、動作;Qwen3-VL-4B-Instruct + DiT + flow matching | 基於Pi0,結合圖像觀察、語言指令、物體檢測、語義子任務預測、低級動作的多模態示例 |
| 泛化能力 | 高遷移效率,降低算力依賴 | 開放世界泛化能力,能在全新環境中執行長序列和靈巧操作 |
| 開源狀態 | 已開源模型權重、代碼及示例 | 已開源 (OpenPi repository) |
🛠️ 技術深入
- Spirit v1.5 VLA 模型:
- 架構: 統一的視覺-語言-動作 (VLA) 架構,整合視覺感知、語言理解和動作生成於端到端決策過程。
- 骨幹網絡: 採用Qwen3-VL-4B-Instruct作為骨幹網絡。
- 動作表達: 使用DiT (Diffusion Transformer) 結合Flow Matching,以60步的動作分塊 (action chunk) 進行動作表達。
- 訓練範式: 引入多樣化數據採集範式,訓練不依賴「乾淨」的演示數據,允許失敗、打翻、中斷等情況,以學習如何處理真實世界的複雜性,而非僅僅執行預設動作。
- 硬體要求 (測試): 在NVIDIA A100 80GB GPU上進行測試。
- 旭日 S600 晶片:
- AI 算力: 560 TOPS (INT8)。
- 架構: 高效靈活的「大小腦」異構設計。
- 大腦 (AI 推理與邏輯調度):
- 18核A78AE CPU (負責複雜邏輯調度)。
- 全新自研「納什」架構BPU (AI 推理),專為CNN和Transformer優化。
- 支持VLA、VLM、LLM、Locomotion等多種具身大模型算法在端側高效部署。
- 小腦 (運動控制):
- 6核R52+ MCU (獨立負責高實時、高可靠性的運動控制)。
- 部分核心可運行在鎖步模式 (Lock-Step) 下,提供功能安全保障。
- 專為人形機器人優化。
- 功耗: 針對具身智能應用,強調低功耗。
- 開發平台: 作為具身智能機器人「大算力開發平台」推出,並與「地瓜機器人一站式開發平台」結合,提供軟硬結合、端雲一體的開發體系。
🔮 前景展望AI analysis grounded in cited sources
此次合作將加速具身智能機器人在工業自動化和家庭服務等多元場景的規模化落地。
軟硬體深度整合的解決方案降低了開發門檻,結合VLA模型的通用學習能力和邊緣端高效推理,使得機器人能更快適應複雜任務和環境。
中國在具身智能基礎模型領域的國際競爭力將顯著提升。
千尋智能的Spirit v1.5模型在國際基準測試中取得領先地位並開源,結合地瓜機器人在晶片和生態系統的佈局,標誌著中國團隊從「跟隨模式」轉向「全球第一梯隊」。
機器人開發將從傳統的程式編寫轉向更高效的模型訓練與部署。
VLA模型實現了機器人通過單次示教或口頭描述快速學習新任務,結合地瓜機器人提供的軟硬體一體化開發平台,將大幅縮短新任務部署時間,提升開發效率。
⏳ 時間線
2024-01
千尋智能 (Spirit AI) 成立;地瓜機器人從地平線機器人AIoT部門正式分拆。
2024-09
地瓜機器人發布RDK X5開發套件和RDK S100具身智能計算平台。
2025-11
地瓜機器人揭曉具身智能機器人大算力開發平台S600,並宣布將於2026年第一季度正式發布。
2026-01
千尋智能開源自研VLA基礎模型Spirit v1.5,該模型在RoboChallenge綜合評測中斬獲第一,超越Pi0.5。
2026-02
千尋智能宣布連續完成兩輪融資近20億元,估值突破百億。
2026-04
地瓜機器人完成1.5億美元B2輪新融資,累計融資總額超3.7億美元。
📎 來源 (24)
Factual claims are grounded in the sources below. Forward-looking analysis is AI-generated interpretation.
📰
AI 週報
閱讀本週精選 AI 大事摘要 →
👉相關動態
AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: 36氪 ↗