🦙最新收集於 15h

llama.cpp 獲得實驗性 MoE 專家擴展功能

llama.cpp 獲得實驗性 MoE 專家擴展功能
PostLinkedIn
🦙閱讀原文: Reddit r/LocalLLaMA
#mixture-of-experts#local-inference#model-optimization#experimental-branchllama.cpp-moex-expansion-branchllama.cppglm 5.3 flashmetal

💡這項實驗性 llama.cpp 功能可能改善本地 MoE 模型使用專家容量的方式。

⚡ 30-Second TL;DR

有什麼變化

這個自訂分支的目標是支援 MoE 模型的 Expert expansion。

為什麼重要

如果這項功能能拓展到 Metal 以外的平台,可能為本地推論使用者提供另一種最佳化或擴展 MoE 模型專家執行的方法。不過目前證據仍屬初步,因為測試平台與模型覆蓋範圍有限。

下一步行動

複製 moex-expansion 分支,並在你的 CUDA、ROCm 或 Metal 環境中,以一個 MoE 模型與目前的 llama.cpp 版本進行基準測試。

誰應關注:Developers & AI Engineers

關鍵要點

  • 這個自訂分支的目標是支援 MoE 模型的 Expert expansion。
  • 目前的初步測試是在 Apple Metal 後端上進行。
  • 開發者表示效能優於其 DS4 版本,但仍需要更廣泛的驗證。
📰

AI 週報

閱讀本週精選 AI 大事摘要 →

👉相關動態

AI 策展新聞聚合。所有內容版權歸原始發布者所有。
原始來源: Reddit r/LocalLLaMA

這是摘要,不是原文。去看原站,或訂閱每週簡報。

每週 AI 簡報

每週一封,可隨時退訂。