💼VentureBeat•較早收集於 42m
Phi-4-Vision 以 1/5 資料匹敵巨頭
#multimodal#vision-language#data-efficiency#reasoningphi-4-reasoning-vision-15bmicrosoftphi-4-reasoning-vision-15bhuggingfacephi-4
💡15B 模型以 200B 資料勝過萬億 token 對手—多模態部署的效率突破(28字元)
⚡ 30-Second TL;DR
有什麼變化
15B 參數,開放權重,多模態(圖像+文字)
為什麼重要
證明透過智慧資料策劃,小模型可超越巨頭,大幅降低訓練成本與碳足跡。以開放權重民主化高效多模態 AI,適用邊緣部署並擴大存取。
下一步行動
從 Hugging Face 下載 Phi-4-reasoning-vision-15B,並在你的視覺語言資料集上基準測試推理任務。
誰應關注:Developers & AI Engineers
關鍵要點
- •15B 參數,開放權重,多模態(圖像+文字)
- •訓練用 200B token,對比對手 1T+ token
- •擅長數學/科學推理、圖表解讀、GUI 使用
- •在效率與效能匹敵/超越更大模型
- •透過 Microsoft Foundry、HuggingFace、GitHub 以寬鬆授權
🧠 深度解析
背景與延伸:來自公開資料,非原文內容。引用 6 個來源。
🔑 增強重點摘要
📊 競品分析▸ Show
| 特徵/基準 | Phi-4-multimodal-instruct | Phi-3.5-vision-instruct |
|---|---|---|
| AI2D | 優於 | 遜於 |
| ChartQA | 遜於 | 優於 |
| InterGPS | 優於 | 遜於 |
| MathVista | 優於 | 遜於 |
| POPE | 遜於 | 優於 |
| 輸入價格 (USD/1M tokens) | $0.06~$0.13 | 未提供 |
| 輸出價格 (USD/1M tokens) | $0.14~$0.50 | 未提供 |
| 輸出速度 (tokens/s) | 7.1 | 未提供 |
🛠️ 技術深入
🔮 前景展望AI analysis grounded in cited sources
⏳ 時間線
2025-01
Phi-4 正式發布,14B 參數 SLM 於 Azure AI Foundry 和 Hugging Face 上架
2025-02
Phi-4-multimodal-instruct 在 Huggingface OpenASR 排行榜奪第一,WER 6.14%
2026-03
推出 Phi-4-reasoning-vision-15B,強調視覺語言及推理能力
📎 來源 (6)
Factual claims are grounded in the sources below. Forward-looking analysis is AI-generated interpretation.
📰
AI 週報
閱讀本週精選 AI 大事摘要 →
👉相關動態
AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: VentureBeat ↗
每週 AI 簡報
每週一封,可隨時退訂。


