Search

Tag: #inference127 results

🔬

INT8 精度勝過 FP16

深度學習從業人員觀察到 ONNX 導出模型上,INT8 訓練後量化推理精度高於 FP16,超出相對於 FP32 基準的預期。尋求此異常解釋。

Reddit r/MachineLearningCommunityApr 27#quantization#int8#fp16
AMD R9700 96GB VRAM 勝過 5090 價格

AMD R9700 96GB VRAM 勝過 5090 價格

Reddit 貼文讚揚 AMD R9700 擁有 96GB VRAM,提供 RTX 5080 等級推理速度與品質。宣稱價格低於 RTX 5090,適合未來 AI 節點。使用者為第二張模糊照片致歉。

Reddit r/LocalLLaMACommunityApr 2#gpu#vram#inference
ASICs於AI推理崛起對抗GPUs

ASICs於AI推理崛起對抗GPUs

ASICs因成本較低及功耗僅GPU的1/10而在推理中崛起,適合如Groq僅支援25種模型的固定場景。GPUs主導訓練,尤其是LLM,因靈活性及依賴Nvidia生態。中大型雲廠與Marvell/Broadcom合作開發ASIC。

虎嗅MediaMar 24#asic#inference#training
Page 12 of 13