Search

Tag: #moe-inference6 results

256GB VRAM AI 伺服器八個月實測評測

256GB VRAM AI 伺服器八個月實測評測

一名基礎架構工程師分享一台工作站級 AI 伺服器經過六至八個月運作後的實務評測,目標是支援大型 MoE 推理、創意工作與企業研究。系統結合八張 RTX 3090、兩張 RTX 5090、512GB ECC 記憶體,並透過 Open WebUI 搭配 llama.cpp 或 koboldcpp。

Reddit r/LocalLLaMACommunityAug 3#multi-gpu#moe-inference#local-ai