Search

Tag: #edge-inference33 results

Strix Halo 基準測試新 LLM

Strix Halo 基準測試新 LLM

Strix Halo(Ryzen AI Max+ 395)基準測試 Minimax M2.5、Step 3.5 Flash、Qwen3-Coder-Next、GLM 4.6V/4.7 Flash 的量化版本,於 30k 上下文下運行。使用 llama.cpp 於 ROCm 7.2,配備 128GB RAM。可依需求測試更多模型。

Reddit r/LocalLLaMACommunityFeb 20#llama-cpp#rocm-benchmarks#edge-inference
Page 3 of 4