來源Reddit r/LocalLLaMA•較早收集於 5h
Arc Pro B70 在 Qwen3.5-27B 達 135 tps
#gpu-benchmark#inference#intel-xpu#high-concurrencyintel-arc-pro-b70intel-arc-pro-b70qwen3.5-27bvllmllama.cpp
💡Intel GPU 近 Nvidia LLM 速度且半價?基準 + 安裝指南(22字元)
⚡ 30 秒速覽
有什麼變化
單查詢 12 tps,32 併發 135 tps
為什麼重要
驗證 Intel Arc 適用於大規模成本效益 LLM 推論,雖功耗效率落後 Nvidia;吸引避開 CUDA 鎖定的預算使用者。
下一步行動
使用貼文 Docker 指令於 Ubuntu 26.04 beta 在 Arc B70 部署 vllm。
誰應關注:Developers & AI Engineers
關鍵要點
- •單查詢 12 tps,32 併發 135 tps
- •高負載 TG 比 RTX PRO 4500 慢 20%
- •註明功耗高 50%
- •需 Ubuntu 26.04 與 vllm Intel beta fork
- •分享簡易 vllm Docker 指令
📰
AI 週報
閱讀本週精選 AI 大事摘要 →
👉相關動態
AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: Reddit r/LocalLLaMA ↗
每週電子報
每週一封,可隨時退訂。