
HBF 瞄準 3TB/s,提升 AI 推論速度
SK hynix 與 SanDisk 發表 High Bandwidth Flash(HBF)標準,旨在解決 AI 推論中的記憶體頻寬瓶頸。該標準目標頻寬最高可達 3TB/s,若成本下降並廣泛採用,可能加速大型模型推論。
Tag: #ai-inference28 results

SK hynix 與 SanDisk 發表 High Bandwidth Flash(HBF)標準,旨在解決 AI 推論中的記憶體頻寬瓶頸。該標準目標頻寬最高可達 3TB/s,若成本下降並廣泛採用,可能加速大型模型推論。
Amazon Web Services 雲端業務主管表示,客戶正從主要使用 AWS 訓練 AI 模型,轉向將 AI 整合進企業營運。這項轉變正推升 AI 推論需求,也就是執行已訓練模型以產生結果的流程。

中國伺服器CPU龍頭海光信息因AI推論需求激增而獲市場重新評價。AMD與Intel漲價加速國產替代趨勢。本文質疑其8000億人民幣估值是否合理。

Nvidia 執行長 Jensen Huang 宣告進入 AI 工廠時代,產出智慧而非軟體。代理式 AI 推理需求超越 AWS、Azure 和 Google Cloud 現有雲端儲存架構設計。堆疊下層正醞釀沉默危機。

Intel 押注 AI 推論與代理工作負載,將 CPU 重新帶回運算核心。策略針對代理、機器人與邊緣裝置,讓 CPU 再度受矚目。儘管晶片製造問題持續,Intel 盼以此扭轉頹勢。

Qujing Tech源自清華高性能計算實驗室,聘請中國工程院院士鄭緯民為首席科學顧問、清華教授武永衛為首席科學家。公司擁有計算與儲存系統逾20年積累,透過異構協同領先高效AI Token生產。獲高瓴創投等投資,目標企業級AI推理領導地位。
華為發布針對AI推理場景的全新AI數據基礎設施,包括中心AI數據平台與邊緣FusionCube A1000超融合一體機。三者透過UCM統一管理,提升Agent推理準確率30%;支援全棧部署,AI應用上線週期縮短80%,算力利用率提升30%。

TinyCorp 開發適用 Apple 晶片 Mac 的 eGPU 擴展板,透過 Thunderbolt 轉 PCIe 連接 RTX 5060 GPU,用於 AI 大模型推理。提供約 40Gbps 頻寬與自訂 Python 驅動程式支援 ARM macOS。Q2 2025 上市,整合電源管理,專注純計算任務。

南亞科技披露客製化 AI 記憶體研發進展,部分產品進入試產階段,採用 UltraWIO 架構。此架構類似 HBM 與 GPU 結合,提升 AI 資料頻寬。預計今年下半年公布更多成果。
SK 海力士與閃迪於加州閃迪總部聯合舉辦 HBF 規格標準化聯盟啟動會。HBF(High Bandwidth Flash)是面向 AI 推理時代的下一代儲存器解決方案。活動於 2 月 25-26 日舉行。