
Arc Pro B70 AI 推理效能飆升 80%
英特爾 Arc Pro B70 在 MLPerf v6.0 基準測試中,AI 推理性能比 B60 提升 80%。4 張 B70(128GB 顯存)搭配至強 6 處理器,輕鬆處理 1200 億參數 LLM。軟體升級讓現有 B60 提升 18%。
Tag: #gpu-benchmark8 results

英特爾 Arc Pro B70 在 MLPerf v6.0 基準測試中,AI 推理性能比 B60 提升 80%。4 張 B70(128GB 顯存)搭配至強 6 處理器,輕鬆處理 1200 億參數 LLM。軟體升級讓現有 B60 提升 18%。
使用 vLLM v0.18.0 在 96 個 B200 GPU 上實現 Qwen 3.5 27B(FP8)總 1.1M 令牌/秒。DP=8 比 TP=8 效能高 4 倍;MTP-1 提升利用率,MTP-5 崩潰。97% 擴展效率,但 Inference Gateway 增加 35% 開銷。
基準測試顯示 Intel Arc Pro B70 32GB 在單一 Qwen3.5-27B@Q4 查詢達 12 tps(llama.cpp/vllm),32 併發時擴展至 135 tps – 落後 RTX PRO 4500 20%,但功耗高 50%。需 Ubuntu 26.04 beta 與 beta vllm fork。提供詳細 Docker 指令。

Reddit 用戶針對如 GPT120b 的 LLM 推理,基準測試 NVIDIA RTX 6000 96GB 對單 AMD W7800 48GB。令牌/秒比率 (0.49) 與 VRAM 頻寬比率 (0.48) 高度吻合,證明速度主導。多 GPU 設定性能趨向平均,建議優先頻寬而非僅容量。

據報導,AMD Radeon RX 9050 在 1080P 解析度下的性能約落後 RTX 5050 20%。這款 GPU 於 7 月底在拉丁美洲、亞太地區及日本推出,但 AMD 據稱未提供評測樣品,因此全球評測數量相當有限。
使用 llama.cpp 和 OpenCode 測試老舊 Titan X Pascal GPU 於本地 AI 任務。達成 500 令牌/秒提示處理及 25 令牌/秒生成速度,生成速度為 AMD 9070 XT 一半但相當競爭。證明舊硬體仍適用推論。

最新重測發現,GTX 1080 Ti 在許多現代遊戲中仍能勝任 1080p 遊戲。11GB VRAM 讓它維持一定實用性,但其功耗效率與整體效能已明顯顯露老態。

3DMark 2001 迎來發布25週年,於2001年3月13日推出。它首次讓3DMark與基準測試概念走入大眾視野。文章探討用RTX 5090跑分會有多高。