🇭🇰SCMP Technology•較早收集於 2m
香港推出基於 DeepSeek 的國產晶片優化 AI 模型

💡首個針對國產晶片優化的 DeepSeek 模型,為繞過高階 GPU 供應限制提供了新路徑。
⚡ 30-Second TL;DR
有什麼變化
HKGAI-V3 是基於 DeepSeek V4 架構構建。
為什麼重要
此發展標誌著中國 AI 生態系統在軟硬體協同優化上的戰略轉向,有助於降低對外國 GPU 架構的依賴。
下一步行動
如果您正在開發需部署於國產 AI 硬體基礎設施上的應用,請評估使用 HKGAI-V3 模型。
誰應關注:Developers & AI Engineers
關鍵要點
- •HKGAI-V3 是基於 DeepSeek V4 架構構建。
- •該模型專為在國產 AI 晶片上運行而優化。
- •實現了超過十倍的 Token 處理效率提升,並增強了代理(agentic)能力。
🧠 深度解析
Web-grounded analysis with 30 cited sources.
🔑 增強重點摘要
- •香港生成式人工智能研發中心(HKGAI)於2023年10月成立,由香港科技大學牽頭,是InnoHK創新香港研發平台下唯一專注於生成式人工智能的研究及開發中心。
- •DeepSeek V4模型於2026年4月正式發布,其核心技術創新包括DeepSeek稀疏注意力(DSA)和混合壓縮注意力(HCA)等新型注意力機制,使其能以顯著降低的計算和記憶體成本實現百萬(1M)Token的上下文長度。
- •HKGAI-V3模型不僅針對國產AI晶片進行了優化,更深度融入了「香港文化基因」,使其能夠理解並以地道的粵語和普通話語境進行交流,並在測試中展現出作為香港首個生產力級超級智能體,可單次無干預穩定運行長達28小時的能力。
- •DeepSeek V4系列包含兩個版本:DeepSeek-V4-Pro(總參數1.6兆,活躍參數490億)和DeepSeek-V4-Flash(總參數2840億,活躍參數130億),兩者均支援1M上下文長度及思考/非思考雙模式。
- •中國國產AI晶片產業正加速發展,華為海思、阿里巴巴平頭哥等公司的9款國產AI晶片已於2026年5月首次納入中國安全可靠認證體系,顯示出在技術制裁背景下,中國在AI晶片自給自足方面邁出關鍵一步。
📊 競品分析▸ Show
| 模型/特點 | DeepSeek V4-Pro (基於DeepSeek V4的HKGAI-V3) | Claude Opus 4.5/4.6 | GPT-4o / GPT-5.2/3.0/3.1 |
|---|---|---|---|
| 基礎架構 | 混合專家(MoE)架構,新型混合注意力機制 (CSA+HCA) | 混合推理模型 (標準模式+延伸思考模式) | - |
| 上下文長度 | 1M Token (標準配置) | - | - |
| 性能基準 | 世界知識評測領先所有開源模型,直逼Gemini-Pro-3.1;數學/STEM/編碼領域超越所有開源模型,比肩頂級閉源模型;Agentic Coding開源SOTA。 | 在HLE (Humanity's Last Exam) 等頂尖知識推理任務上仍領先DeepSeek V4-Pro約6個月技術優勢。 | DeepSeek V4-Pro表現高於GPT-5.2和Gemini-3.0-Pro,但仍落後於GPT-5.4和Gemini-3.1-Pro約3至6個月。 DeepSeek V3在MMLU評分與GPT-4o相匹敵。 |
| 成本效益 | 訓練成本遠低於競爭對手,推理成本大幅降低。 | 性能強大但價格昂貴。 | - |
| 國產晶片優化 | 專為國產AI晶片優化,實現深度適配,推動「去CUDA化」。 | - | - |
| 本地化能力 | 深度融入香港語境、文化,支援兩文三語。 | - | - |
🛠️ 技術深入
- DeepSeek V4採用了創新的混合注意力機制,結合了CSA(輕度壓縮+稀疏選擇)和HCA(重度壓縮+稠密注意力)。
- HCA能夠將連續的128個詞壓縮成一個「超級概念塊」,為模型提供廉價的全局底噪,確保在處理百萬字時錨定宏觀語境。
- CSA則配備「微型雷達」閃電索引器,將當前查詢降維成極小數據包,快速掃描壓縮塊並鎖定最相關的線索,實現精準核對。
- 這種混合注意力機制將Transformer架構中注意力機制的計算複雜度從O(n²)降低到可接受水平,並實現超過90%的KV緩存壓縮,使得1M Token上下文在工程上可行,大幅降低了計算資源和顯存需求。
- DeepSeek V4-Pro擁有1.6兆總參數和490億活躍參數,而V4-Flash則有2840億總參數和130億活躍參數。
- 針對國產晶片的優化,可能沿用了DeepSeek V3.1中使用的UE8M0 FP8縮放浮點格式等低精度推理技術,以節省顯存並降低計算開銷。
- DeepSeek模型(包括V3)採用了混合專家(MoE)架構,允許模型將不同的Token自動路由到最合適的專家模型,從而提高推理效率並降低運算成本。
🔮 前景展望AI analysis grounded in cited sources
香港將加速成為中國AI技術自主化的重要樞紐。
HKGAI-V3針對國產晶片的優化,結合香港政府對AI產業的戰略性投入,將鞏固其在推動中國AI技術國產化和國際輸出中的獨特地位。
中國國產AI晶片生態系統將加速成熟並獲得更廣泛應用。
DeepSeek V4與華為昇騰等國產晶片的深度適配,以及其他國產晶片通過安全可靠認證,將推動軟硬體協同發展,降低對進口技術的依賴。
香港市民和企業將受益於更具本地化特色和成本效益的AI服務。
HKGAI-V3模型融入香港文化基因,並優化效率,預計將催生更多貼近本地需求的垂直應用,如「港話通」、「港文通」等,提升公共服務和商業效率。
⏳ 時間線
2023-07
DeepSeek AI 成立,由對沖基金幻方量化聯合創始人梁文鋒創立。
2023-10
香港生成式人工智能研發中心(HKGAI)成立,由香港科技大學牽頭,隸屬於InnoHK創新香港研發平台。
2025-01
DeepSeek 發布其旗艦模型DeepSeek-R1及同名聊天機器人,並迅速在全球市場獲得關注。
2025-02
HKGAI 發布首個本地大模型HKGAI V1,基於DeepSeek 671B並結合香港本地數據進行訓練。
2025-03
黃廷方慈善基金及信和集團捐贈2億港元予HKGAI,支持其AI大模型研發與應用,特別是「港話通」服務平台。
2025-12
HKGAI自主研發的智能聊天機器人應用程式「港話通」推出試運行版,旨在為香港市民提供本地化智能服務。
2026-04
DeepSeek V4預覽版正式上線並開源,帶來百萬字上下文能力,並首次實現與華為昇騰等國產晶片的深度適配。
2026-05
華為海思、阿里巴巴平頭哥等9款國產AI晶片首次納入中國安全可靠認證體系,加速國產晶片的可靠性與佔比。
2026-06-03
HKGAI正式推出基於DeepSeek V4的HKGAI-V3模型,該模型針對國產晶片進行了優化,並發布了「Agent Workshop」智能體平台。
📎 來源 (30)
Factual claims are grounded in the sources below. Forward-looking analysis is AI-generated interpretation.
- hkgai.info
- hkust.edu.hk
- deepseek.com
- cnyes.com
- csdn.net
- tencent.com
- 36kr.com
- youtube.com
- hk01.com
- mingpao.com
- bastillepost.com
- worldjournal.com
- udn.com
- ikala.ai
- effectstudio.com.tw
- ourchinastory.com
- yungtung.com.tw
- atlascloud.ai
- hk01.com
- hk01.com
- policyaddress.gov.hk
- digitalpolicy.gov.hk
- leungsir.net
- locpg.gov.cn
- info.gov.hk
- gvm.com.tw
- technews.tw
- geekpark.net
- itib.gov.hk
- hkgai.info
📰
AI 週報
閱讀本週精選 AI 大事摘要 →
👉相關動態
AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: SCMP Technology ↗