⚛️較早收集於 74m

國產 4B 認知模型發布,性能媲美 GPT-4o

國產 4B 認知模型發布,性能媲美 GPT-4o
PostLinkedIn
⚛️閱讀原文: 量子位

💡媲美 GPT-4o 的 4B 模型,可能重新定義端側 AI 的效率與部署策略。

⚡ 30-Second TL;DR

有什麼變化

模型參數僅 4B,適合高效能端側部署。

為什麼重要

這項突破顯示邊緣裝置無需依賴大型雲端叢集即可實現高推理能力,有望大幅降低行動 AI 應用的推理成本。

下一步行動

評估該模型在端側任務上的推理能力,並與您目前使用的小型語言模型 (SLM) 進行對比。

誰應關注:Developers & AI Engineers

關鍵要點

  • 模型參數僅 4B,適合高效能端側部署。
  • 性能基準測試表現媲美 GPT-4o。
  • 展現了輕量化認知 AI 架構的重大進展。

🧠 深度解析

Web-grounded analysis with 16 cited sources.

🔑 增強重點摘要

  • 該模型由中國AI初創公司Nextie(明日新程)開發,該公司由「微軟小冰之父」李笛及其原班人馬於約半年前創立。
  • 「新程Alpha」的核心理念是「認知模型」,旨在剝離海量事實記憶,僅保留思考演算法,以解決傳統大模型在擴展性上的困境。
  • 該模型聲稱可實現100%的算力成本節省,將運算模式從「燒顯卡」轉變為「交電費」,並支援直接端側運行,大幅降低了AI部署的門檻。
  • 「認知模型」的提出與OpenAI創始成員Kapasi關於「推理模型變天」的預言相呼應,強調知識不等於智能,預示著AI發展的新方向。
  • 其性能基準測試表現據稱可媲美尚未公開的GPT-5.4,而非GPT-4o,這表明其在輕量化模型中達到了更高的性能基準。
📊 競品分析▸ Show
特性/模型新程Alpha (Nextie)GPT-4o (OpenAI)GPT-4o mini (OpenAI)
參數規模4B (十億)據稱約1.76萬億(MoE架構,每次推理約2800億)小型模型,具體參數未公開
部署方式端側部署雲端API服務雲端API服務
性能宣稱媲美GPT-5.4GPT-4級智能,速度更快,多模態能力提升成本效益高,能力比GPT-4更強
核心理念認知模型:剝離知識,保留思考演算法原生多模態處理,統一神經網路處理多種輸入輸出成本效益與低延遲,適用於廣泛任務
成本效益算力成本立省100%,從燒顯卡變為交電費API成本相對較高OpenAI所有模型中最具成本效益
模態支援未明確提及,但作為「認知模型」可能側重推理文本、音訊、圖像輸入與輸出文本、圖像(未來支援音訊、影片)

🛠️ 技術深入

  • 認知模型核心:新程Alpha的核心在於其「認知模型」架構,旨在剝離傳統大模型中龐大的事實記憶,轉而專注於保留和優化思考演算法。這種設計理念旨在解決大模型因參數規模擴大而帶來的「Scaling困境」,即模型認知負擔過重和算力成本高昂的問題。
  • 輕量化設計:僅4B的參數規模使其能夠高效地在端側設備上部署和運行,大幅降低了對高性能GPU的依賴,實現了顯著的算力成本節省。
  • 推理能力優先:透過專注於思考演算法,模型能夠在長程任務中避免因死記硬背導致的錯誤累積,提升在邏輯陷阱和複雜問題上的推理能力。
  • 通用輕量化技術:雖然新程Alpha的具體技術細節未公開,但一般輕量化AI模型通常採用模型量化(將浮點數壓縮為低精度)、模型剪枝(刪除冗餘連接或神經元)和知識蒸餾(用大模型訓練小模型)等技術來減少計算和儲存需求,以適應邊緣設備的資源限制。

🔮 前景展望AI analysis grounded in cited sources

輕量化認知模型將加速AI在資源受限環境中的普及。
透過大幅降低算力成本和支援端側部署,這類模型能使AI應用更廣泛地融入物聯網設備、邊緣計算和個人終端,推動AI普惠化。
AI產業將從單純追求模型規模轉向更注重「智能核心」和推理能力的發展。
「認知模型」的成功證明,剝離冗餘知識、專注思考演算法能有效提升AI效率和解決「Scaling困境」,引導行業從「大」走向「精」。
中國在輕量化AI模型領域的創新將提升其在全球AI競爭中的地位。
「新程Alpha」的發布顯示中國團隊在AI架構創新和實踐方面具備領先能力,尤其是在成本效益和邊緣部署方面,有助於縮小與國際領先水平的差距。

時間線

2023-03
OpenAI發布GPT-4,採用MoE架構,展示大規模多模態模型能力。
2024-05
OpenAI發布GPT-4o,強調原生多模態處理能力,回應速度接近人類對話水平。
2024-07
OpenAI發布GPT-4o mini,作為成本效益高的小型模型,擴展AI應用範圍。
2025-12
Nextie(明日新程)公司成立,由李笛及其原班人馬創立,並在奇績創壇Demo Day首次公開提出「認知模型」概念。
2026-06-09
Nextie(明日新程)發布「新程Alpha」認知模型,參數僅4B,聲稱性能媲美GPT-5.4並支援端側部署。

📎 來源 (16)

Factual claims are grounded in the sources below. Forward-looking analysis is AI-generated interpretation.

  1. qbitai.com
  2. sina.cn
  3. qbitai.com
  4. high-flyer.cn
  5. volcengine.com
  6. ntu.edu.tw
  7. note.com
  8. openai.com
  9. tencent.com
  10. ibm.com
  11. 36kr.com
  12. baidu.com
  13. tencent.com
  14. 2cm.com.tw
  15. ubestream.com
  16. qq.com
📰

AI 週報

閱讀本週精選 AI 大事摘要 →

👉相關動態

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: 量子位