Search

Tag: #efficient-inference6 results

Qwen3.6-35B-A3B 開源 MoE 模型發布

Qwen3.6-35B-A3B 開源 MoE 模型發布

Qwen3.6-35B-A3B 是全新開源稀疏 MoE 模型,總參數 35B,活躍參數 3B,採用 Apache 2.0 許可。代理編碼能力媲美活躍參數大 10 倍的模型,並具強大多模態感知與思考/非思考模式。可於 HuggingFace、ModelScope 及 Qwen Studio 下載。

Reddit r/LocalLLaMACommunityApr 16#moe#multimodal#agentic-coding
🔬

PentaNet 以五元量化超越 BitNet

PentaNet 是一種新 LLM 架構,使用原生五元 {-2,-1,0,1,2} 量化,在 WikiText-103 上比 BitNet 改善 6.4% 困惑度,同時透過位元移位保留零乘法推理。權重分佈穩定而不崩潰為三元,提供更多模型容量。程式碼、PyTorch 層與模型已在 GitHub 和 HuggingFace 開源。

Reddit r/MachineLearningCommunityMar 28#quantization#pentanary#efficient-inference