Search

Tag: #moe-models14 results

🤖

中國 LLM 現況全覽

詳細剖析中國 LLM 生態,ByteDance 的 Doubao 為專有領導者,Alibaba 的 Qwen 在開源權重模型表現出色。Deepseek 以 MLA 等技術創新,「六小虎」如 Zhipu 和 Minimax 發布大型開源 MoE 模型提供廉價推理。Meituan 積極推出如 562B LongCat-Flash。

Reddit r/LocalLLaMACommunityMar 23#chinese-llms#open-weight#moe-models
中國AI算力反擊戰

中國AI算力反擊戰

DeepSeek 宣布 V4 多模態模型將優先使用國產晶片,首次實現全流程非 Nvidia 方案。中國公司轉向混合專家模型等演算法優化,大幅降低成本,並推進國產晶片用於訓練。這標誌從推理到完整訓練的轉變。

虎嗅MediaMar 4#china-ai#chips#moe-models
V100 基準測試:功率限制與卸載優化

V100 基準測試:功率限制與卸載優化

在 Ryzen 7600X 上對 V100 32GB GPU 進行 20 個 LLM 模型(MoE 與密集型)的 6 小時基準測試,涵蓋 300W-150W 功率限制與 CPU 卸載層級,最高達 32K 上下文。功率限制至 200W 生成僅損失 <2%;MoE 模型遠優於密集型處理卸載。頂尖表現:Nemotron-30B Mamba2 達 152 t/s。

Reddit r/LocalLLaMACommunityMar 28#v100-benchmarks#cpu-offload#moe-models
Page 1 of 2