Search

Tag: #inference127 results

NVIDIA Vera Rubin 瞄準1兆美元AI市場

NVIDIA Vera Rubin 瞄準1兆美元AI市場

GTC大會上黃仁勳推出Vera Rubin超級電腦平台,含7顆晶片包括Rubin GPU、Vera CPU及Groq LPU推理。新NemoClaw代理工具包、Nemotron開源模型聯盟、GR00T N2機器人及DRIVE自動駕駛擴張,預測2027年AI晶片營收1兆美元。涵蓋訓練至實體AI全棧。

虎嗅MediaMar 17#ai-chips#inference#agent
NVIDIA Rubin+Groq 衝刺萬億美元 GPU

NVIDIA Rubin+Groq 衝刺萬億美元 GPU

在 GTC 大會上,NVIDIA 推出整合 Groq LPU 的 Vera Rubin 系統,這是針對推理優化的 7 顆晶片 AI 基礎設施,將 prefill 分拆至 GPU,decode 至 LPU。解決 GPU 在高速 token 生成的限制,使 1GW 資料中心 token 產出提升 350 倍。NVIDIA 預測 2027 年 GPU 市場達萬億美元,受 agentic AI 推理需求驅動。

虎嗅MediaMar 16#gtc#lpu#inference
階躍星辰全面開源 Step 3.5 Flash

階躍星辰全面開源 Step 3.5 Flash

中國大模型創業公司階躍星辰開源 Agent 基座模型 Step 3.5 Flash 的預訓練權重(Base)、中訓練權重(Midtrain)及 Steptron 訓練框架。採用稀疏 MoE 架構,總參數 1960 億,推理僅激活約 110 億參數。單請求代碼任務推理速度最高達 350 TPS。

36氪MediaMar 4#moe#agent#inference
Page 3 of 13