
全球首例 OpenClaw 太空算力操控地面機器人
國星宇航-上海交通大學太空計算聯合實驗室完成全球首個 OpenClaw 調用太空算力操控地面人形機器人試驗。透過自然語言指令上傳「星算」01衛星大模型進行在軌推理,下發決策至地面執行完整閉環。驗證太空算力為機器人/無人機等矽基智能體提供安全全球 AI 服務。
Tag: #llm-inference43 results

國星宇航-上海交通大學太空計算聯合實驗室完成全球首個 OpenClaw 調用太空算力操控地面人形機器人試驗。透過自然語言指令上傳「星算」01衛星大模型進行在軌推理,下發決策至地面執行完整閉環。驗證太空算力為機器人/無人機等矽基智能體提供安全全球 AI 服務。

NVIDIA Blackwell 平臺在金融交易的 LLM 推論方面創下 STAC-AI 新紀錄。它能精細分析新聞、社群媒體和財報等非結構化資料,產生交易洞見。此進展推動投資策略的 AI 自動化。

KCD 杭州站已開放徵稿,邀請社群共同探討 Agent 時代的雲原生技術、可觀測性與大模型推理。這項活動面向希望分享或了解 AI Agent 基礎架構的技術從業者。

DecodeShare 是一項新的研究協議,旨在隔離大型語言模型在解碼階段隱藏狀態中低維度的通用任務子空間。透過干預此子空間,研究人員可以顯著影響模型效能,並提供比基於預填充(prefill)方法更可靠的激活導向(activation steering)手段。

全球企業正日益採用如 Zhipu 的 GLM-5.2 與 DeepSeek 的 V4 Flash 等中國開源權重模型,以降低 AI 基礎設施成本。由於這些模型在效能上具有競爭力且價格低於美國同類產品,它們在 Vercel 等平台上正獲得顯著的採用率。

ExLlamaV3 迎來首個正式生產版本,針對推論速度與硬體效率進行了重大優化。此次更新包含全新的注意力與 GEMV 核心,並增強了對現代模型架構的支援。

報告指出 NVIDIA 正在準備即將推出的 RTX 5090 顯示卡的新款「SE」變體。這顯示基於 Blackwell 架構的消費級 GPU 產品線可能進一步擴充。

Akashic 是一項新的 LLM 推論服務,利用 MemAttention 將數據組織成有界區塊,藉此優化長文本管理。它透過減少檢索碎片化並最小化 I/O 開銷來提高效率,無需重複重寫完整的互動歷史記錄。

傳聞 iPhone 18 Pro 將搭載的 A20 Pro 晶片可能採用 96 位 LPDDR6 記憶體匯流排。此升級旨在顯著提升本地大型語言模型與 Siri 的效能,打破蘋果長達 13 年的 64 位元設計傳統。
本基準測試分析了在 NVIDIA L4 GPU 上運行 Gemma 2 9B 模型時,FP8 量化對效能的影響。研究顯示,儘管 FP8 提升了解碼速度,但會產生顯著的「預填充稅」,導致首個 Token 生成時間 (TTFT) 增加。