Search

Tag: #amd-gpu12 results

Zyphra 推出高效 ZAYA1-8B MoE 模型

Zyphra 推出高效 ZAYA1-8B MoE 模型

Zyphra 發布 ZAYA1-8B,這是一個開放的 8B 參數混合專家推理模型,在 AMD Instinct MI300 GPU 上訓練,在基準測試中與 GPT-5-High 和 DeepSeek-V3.2 競爭。Apache 2.0 授權可在 Hugging Face 免費下載並自訂。它具備創新的 MoE++ 架構,提供優異效率。

VentureBeatMediaMay 7#moe#amd-gpu#reasoning-model
AMD GPU 自製分塊注意力機制

AMD GPU 自製分塊注意力機制

一位使用者為不受支援的 AMD MI50 GPU(gfx906)開發 PyTorch 基於分塊注意力的 flash-attention 替代方案,避免視訊生成時 OOM。受 llama.cpp 啟發,使用查詢分塊、softmax 後備機制,以及 BF16 轉 FP16 等優化。純 PyTorch,無需自訂核心。

Reddit r/LocalLLaMACommunityMar 28#flash-attention#amd-gpu#tiling
Page 1 of 2