來源較早收集於 5h

Arc Pro B70 在 Qwen3.5-27B 達 135 tps

PostLinkedIn
🦙閱讀原文: Reddit r/LocalLLaMA
#gpu-benchmark#inference#intel-xpu#high-concurrencyintel-arc-pro-b70intel-arc-pro-b70qwen3.5-27bvllmllama.cpp

💡Intel GPU 近 Nvidia LLM 速度且半價?基準 + 安裝指南(22字元)

⚡ 30 秒速覽

有什麼變化

單查詢 12 tps,32 併發 135 tps

為什麼重要

驗證 Intel Arc 適用於大規模成本效益 LLM 推論,雖功耗效率落後 Nvidia;吸引避開 CUDA 鎖定的預算使用者。

下一步行動

使用貼文 Docker 指令於 Ubuntu 26.04 beta 在 Arc B70 部署 vllm。

誰應關注:Developers & AI Engineers

關鍵要點

  • 單查詢 12 tps,32 併發 135 tps
  • 高負載 TG 比 RTX PRO 4500 慢 20%
  • 註明功耗高 50%
  • 需 Ubuntu 26.04 與 vllm Intel beta fork
  • 分享簡易 vllm Docker 指令
📰

AI 週報

閱讀本週精選 AI 大事摘要 →

👉相關動態

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: Reddit r/LocalLLaMA

這是摘要,不是原文。去看原站,或訂閱每週簡報。

每週電子報

每週一封,可隨時退訂。