來源最新收集於 3h

Qualcomm 發表主打本地 AI 的手機晶片

閱讀原文: TechCrunch AI
#on-device-ai#smartphone-silicon#edge-inference

Qualcomm 宣稱其頂級手機晶片可不依賴雲端執行 300 億參數 MoE 模型。

30 秒速覽

有什麼變化

Qualcomm 推出兩款聚焦 AI 的新智慧型手機處理器。

為什麼重要

在本機執行更大型模型可降低雲端依賴,並改善行動應用的隱私與延遲。不過開發者仍需針對記憶體、散熱限制與電池消耗進行模型最佳化。

下一步行動

在新的 Qualcomm 平台上分析量化混合專家模型的峰值記憶體、每秒 Token 數與電池影響。

誰應關注:Developers & AI Engineers

關鍵要點

  • Qualcomm 推出兩款聚焦 AI 的新智慧型手機處理器。
  • 據 Qualcomm 表示,頂級晶片可在本機執行 300 億參數的混合專家模型。
  • 此次發布支持生成式 AI 推論向裝置端移轉的趨勢。
關鍵數字5.0GHz50%300 億

深度解析

背景與延伸:來自公開資料,非原文內容。引用 11 個來源。

增強重點摘要

  • 兩款新晶片分別為 Snapdragon 8 Elite Gen 6 與更高規格的 Snapdragon 8 Elite Extreme Gen 6,均採用台積電 2 奈米先進製程製造。
  • 晶片整合高通第三代自主客製化 Oryon CPU,採八核心架構,包含兩顆最高時脈達 5.0GHz 的 Prime 核心,並具備專屬 FlexCache 快取技術。
  • Hexagon NPU 擴充了 50% 的大型共享記憶體(Large Shared Memory),用於存放 Context 狀態與 KV-cache,大幅減少對外部系統 DRAM 的頻寬依賴。
  • 平台加入專用低功耗感測樞紐(Sensing Hub),可支援全天候運行的邊緣 Agentic AI,提供發言者識別與情境歷程追蹤能力。
  • 終端合作夥伴包含 Motorola、小米與中興通訊(ZTE),預計自 2026 年底陸續推出終端裝置,其中 Motorola 將率先導入 Extreme 旗艦版本。

技術深入

  • 製程工藝:採用台積電(TSMC)2 奈米(2nm)製程節點,提升運算密度與能源使用效率。
  • CPU 架構:第三代客製化 Oryon CPU,配備 8 核心(2 顆 5.0GHz Prime 核心 + 6 顆效能核心)及 FlexCache 記憶體架構。
  • AI 推論規模:頂規 Snapdragon 8 Elite Extreme Gen 6 支援在終端本機完整執行 300 億參數(30B)的混合專家(MoE)模型。
  • NPU 記憶體優化:Hexagon NPU 擴增 50% 的 Large Shared Memory,能將 KV 快取與情境暫存保留於晶片內部,解決全球記憶體緊縮帶來的頻寬瓶頸。
  • 代理型感知引擎:獨立低功耗 Sensing Hub,專門處理說話者分段辨識、自動語境追蹤與本機記憶等持續性背景任務。
  • 影像處理規格:Extreme 版本硬體媒體引擎支援專業級編碼格式的 8K 60fps 高規格錄影。

前景展望基於引用來源的 AI 分析

智慧型手機本機代理(Agentic AI)生態將迎來實用化落地
藉由獨立低功耗感應樞紐與 300 億參數 MoE 模型的終端推論能力,手機無須頻繁呼叫雲端即可持續感知環境並執行複雜助理任務。
晶片內建記憶體設計將成為緩解行動 DRAM 成本壓力的主流解方
超大規模資料中心對高頻寬記憶體的需求造成手機 RAM 供應吃緊,在 NPU 上增加晶片內共享記憶體能有效減少終端硬體對超大容量外掛 RAM 的依賴。

時間線

2026-09
Qualcomm 於夏威夷驍龍高峰會正式發表 Snapdragon 8 Elite Gen 6 及 Extreme 旗艦 AI 晶片

AI 週報

閱讀本週精選 AI 大事摘要 →

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: TechCrunch AI

這是摘要,不是原文。去看原站,或訂閱每週簡報。

每週電子報

每週一封,可隨時退訂。