Search

直接匹配不多,已補上最新動態。

Tag: #request-scheduling1 results

AWS 推出由 llm-d 驅動的分散式推論

AWS 推出由 llm-d 驅動的分散式推論

AWS 介紹由 llm-d 驅動的下一代推論功能,包括分散式服務、智能請求調度及專家並行。這些功能可在 Amazon SageMaker HyperPod EKS 上實現,帶來推論效能、資源利用率及營運效率的顯著提升。部落格詳細說明概念、益處及實施方式。

AWS Machine Learning BlogOfficialMar 16#expert-parallelism#request-scheduling