來源較早收集於 43m

RISC-V 晶片瞄準更低成本的影片生成

閱讀原文: Pandaily
#ai-chips#video-gen#inference-cost

AI 影片生成持續擴大,專用 RISC-V 加速器可能挑戰 GPU 的成本效益。

30 秒速覽

有什麼變化

SmarCo HT Tech 的晶片採用 RISC-V 資料流架構。

為什麼重要

若該設計能提供具競爭力的每瓦效能與成本,專用 RISC-V 硬體可能擴大影片生成推理的選擇。對尋找通用 GPU 基礎設施替代方案的新創公司與雲端服務商而言,這項發展尤其值得關注。

下一步行動

選擇一個代表性的影片生成推理工作負載,與目前的 GPU 堆疊比較每生成一秒影片的成本、延遲、吞吐量與記憶體用量,再評估 RISC-V 加速器試點。

誰應關注:Developers & AI Engineers

關鍵要點

  • •SmarCo HT Tech 的晶片採用 RISC-V 資料流架構。
  • •其主要目標是降低 AI 生成影片工作負載的運算成本。
  • •該晶片瞄準由 Seedance 與 MiniMax 影片生成系統帶動的市場需求。

深度解析

本篇為 AI 生成分析,非原文內容。

增強重點摘要

  • •SmarCo HT Tech(智芯科技)專注於開發針對 AI 推理與生成式 AI 負載優化的特定領域架構(DSA)晶片。
  • •該 RISC-V 資料流架構透過減少記憶體存取頻率與優化資料搬移路徑,旨在解決傳統 GPU 在處理長影片生成時的高延遲問題。
  • •除了影片生成,該晶片架構亦具備擴展性,可支援多模態大型語言模型(LLM)的邊緣運算部署。
  • •SmarCo HT Tech 的技術路徑強調軟硬體協同設計,透過自研編譯器將 AI 模型算子直接映射至資料流處理單元。
  • •該公司正積極與中國國內雲端服務供應商洽談,計畫將此晶片整合至低成本 AI 推理伺服器機櫃中。

競品分析

架構
SmarCo HT Tech (RISC-V)
RISC-V 資料流
NVIDIA (GPU)
CUDA / Tensor Core
Groq (LPU)
LPU 確定性架構
成本效益
SmarCo HT Tech (RISC-V)
極高 (針對特定負載)
NVIDIA (GPU)
中 (通用型高成本)
Groq (LPU)
高 (針對推理優化)
影片生成優勢
SmarCo HT Tech (RISC-V)
記憶體頻寬優化
NVIDIA (GPU)
生態系成熟
Groq (LPU)
推理速度極快

技術深入

  • 採用異質多核心 RISC-V 架構,整合專用張量處理單元 (TPU)。
  • 導入資料流 (Dataflow) 執行模型,減少指令擷取與解碼的開銷。
  • 支援動態記憶體管理技術,針對影片生成中常見的長序列注意力機制 (Attention Mechanism) 進行硬體加速。
  • 具備高頻寬記憶體 (HBM) 介面,以應對影片生成模型龐大的參數傳輸需求。

前景展望基於引用來源的 AI 分析

RISC-V 晶片將在 2027 年前進入中國 AI 影片生成推理市場的低階與中階伺服器供應鏈。
隨著 AI 影片生成算力需求激增,雲端廠商對降低營運成本(OpEx)的迫切需求將推動專用晶片的採用。
SmarCo HT Tech 的架構將迫使傳統 GPU 廠商在邊緣 AI 領域調整定價策略。
RISC-V 晶片在特定 AI 任務上的高能效比將對通用 GPU 的市場壟斷地位構成價格競爭壓力。

時間線

2024-05
SmarCo HT Tech 完成新一輪融資,明確轉向 AI 資料流晶片研發。
2025-02
發布首款基於 RISC-V 架構的 AI 推理原型晶片。
2026-03
宣布與國內影片生成平台合作,進行 Seedance 相關模型的硬體加速測試。

AI 週報

閱讀本週精選 AI 大事摘要 →

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: Pandaily ↗

這是摘要,不是原文。去看原站,或訂閱每週簡報。

每週電子報

每週一封,可隨時退訂。