⚛️量子位•較早收集於 74m
國產 4B 認知模型發布,性能媲美 GPT-4o

💡媲美 GPT-4o 的 4B 模型,可能重新定義端側 AI 的效率與部署策略。
⚡ 30-Second TL;DR
有什麼變化
模型參數僅 4B,適合高效能端側部署。
為什麼重要
這項突破顯示邊緣裝置無需依賴大型雲端叢集即可實現高推理能力,有望大幅降低行動 AI 應用的推理成本。
下一步行動
評估該模型在端側任務上的推理能力,並與您目前使用的小型語言模型 (SLM) 進行對比。
誰應關注:Developers & AI Engineers
關鍵要點
- •模型參數僅 4B,適合高效能端側部署。
- •性能基準測試表現媲美 GPT-4o。
- •展現了輕量化認知 AI 架構的重大進展。
🧠 深度解析
Web-grounded analysis with 16 cited sources.
🔑 增強重點摘要
- •該模型由中國AI初創公司Nextie(明日新程)開發,該公司由「微軟小冰之父」李笛及其原班人馬於約半年前創立。
- •「新程Alpha」的核心理念是「認知模型」,旨在剝離海量事實記憶,僅保留思考演算法,以解決傳統大模型在擴展性上的困境。
- •該模型聲稱可實現100%的算力成本節省,將運算模式從「燒顯卡」轉變為「交電費」,並支援直接端側運行,大幅降低了AI部署的門檻。
- •「認知模型」的提出與OpenAI創始成員Kapasi關於「推理模型變天」的預言相呼應,強調知識不等於智能,預示著AI發展的新方向。
- •其性能基準測試表現據稱可媲美尚未公開的GPT-5.4,而非GPT-4o,這表明其在輕量化模型中達到了更高的性能基準。
📊 競品分析▸ Show
| 特性/模型 | 新程Alpha (Nextie) | GPT-4o (OpenAI) | GPT-4o mini (OpenAI) |
|---|---|---|---|
| 參數規模 | 4B (十億) | 據稱約1.76萬億(MoE架構,每次推理約2800億) | 小型模型,具體參數未公開 |
| 部署方式 | 端側部署 | 雲端API服務 | 雲端API服務 |
| 性能宣稱 | 媲美GPT-5.4 | GPT-4級智能,速度更快,多模態能力提升 | 成本效益高,能力比GPT-4更強 |
| 核心理念 | 認知模型:剝離知識,保留思考演算法 | 原生多模態處理,統一神經網路處理多種輸入輸出 | 成本效益與低延遲,適用於廣泛任務 |
| 成本效益 | 算力成本立省100%,從燒顯卡變為交電費 | API成本相對較高 | OpenAI所有模型中最具成本效益 |
| 模態支援 | 未明確提及,但作為「認知模型」可能側重推理 | 文本、音訊、圖像輸入與輸出 | 文本、圖像(未來支援音訊、影片) |
🛠️ 技術深入
- 認知模型核心:新程Alpha的核心在於其「認知模型」架構,旨在剝離傳統大模型中龐大的事實記憶,轉而專注於保留和優化思考演算法。這種設計理念旨在解決大模型因參數規模擴大而帶來的「Scaling困境」,即模型認知負擔過重和算力成本高昂的問題。
- 輕量化設計:僅4B的參數規模使其能夠高效地在端側設備上部署和運行,大幅降低了對高性能GPU的依賴,實現了顯著的算力成本節省。
- 推理能力優先:透過專注於思考演算法,模型能夠在長程任務中避免因死記硬背導致的錯誤累積,提升在邏輯陷阱和複雜問題上的推理能力。
- 通用輕量化技術:雖然新程Alpha的具體技術細節未公開,但一般輕量化AI模型通常採用模型量化(將浮點數壓縮為低精度)、模型剪枝(刪除冗餘連接或神經元)和知識蒸餾(用大模型訓練小模型)等技術來減少計算和儲存需求,以適應邊緣設備的資源限制。
🔮 前景展望AI analysis grounded in cited sources
輕量化認知模型將加速AI在資源受限環境中的普及。
透過大幅降低算力成本和支援端側部署,這類模型能使AI應用更廣泛地融入物聯網設備、邊緣計算和個人終端,推動AI普惠化。
AI產業將從單純追求模型規模轉向更注重「智能核心」和推理能力的發展。
「認知模型」的成功證明,剝離冗餘知識、專注思考演算法能有效提升AI效率和解決「Scaling困境」,引導行業從「大」走向「精」。
中國在輕量化AI模型領域的創新將提升其在全球AI競爭中的地位。
「新程Alpha」的發布顯示中國團隊在AI架構創新和實踐方面具備領先能力,尤其是在成本效益和邊緣部署方面,有助於縮小與國際領先水平的差距。
⏳ 時間線
2023-03
OpenAI發布GPT-4,採用MoE架構,展示大規模多模態模型能力。
2024-05
OpenAI發布GPT-4o,強調原生多模態處理能力,回應速度接近人類對話水平。
2024-07
OpenAI發布GPT-4o mini,作為成本效益高的小型模型,擴展AI應用範圍。
2025-12
Nextie(明日新程)公司成立,由李笛及其原班人馬創立,並在奇績創壇Demo Day首次公開提出「認知模型」概念。
2026-06-09
Nextie(明日新程)發布「新程Alpha」認知模型,參數僅4B,聲稱性能媲美GPT-5.4並支援端側部署。
📎 來源 (16)
Factual claims are grounded in the sources below. Forward-looking analysis is AI-generated interpretation.
📰
AI 週報
閱讀本週精選 AI 大事摘要 →
👉相關動態
AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: 量子位 ↗