Search

直接匹配不多,已補上最新動態。

Tag: #gpu-scheduling3 results

Run:ai 與 NIM 提升 GPU 使用率

Run:ai 與 NIM 提升 GPU 使用率

部署 LLM 的組織面臨多樣推理工作負載挑戰,小型嵌入模型僅需數 GB,而 70B+ 參數 LLM 需多 GPU,導致低利用率、高成本與不可預測延遲。NVIDIA Run:ai 與 NIM 透過有效打包工作負載優化資源分配。此整合最大化推理的 GPU 效率。

NVIDIA Developer BlogOfficialFeb 27#gpu-scheduling#llm-inference