Search

Tag: #fine-tuning102 results

🤖

Nemotron 3 Nano微調策略

自學從業者轉向微調NVIDIA的Nemotron 3 Nano(混合Mamba-MoE)用於多任務推理,尋求相對於密集模型的策略變更。主要疑慮:MoE路由器/Mamba-2的LoRA、負載平衡、遺忘。使用H100上40-80k蒸餾範例。

Reddit r/MachineLearningCommunityApr 26#fine-tuning#hybrid-arch#multi-task
🤖

Gemma-4 微調與部署的試煉

團隊微調與部署 Gemma-4 的經驗揭露關鍵問題:PEFT 與自訂層不相容、SFTTrainer 因 KV 共享靜默失敗、DeepSpeed 儲存空適配器,以及伺服工具缺乏即時 LoRA 支援。修復包括解包層、更新 transformers、避免 DeepSpeed,以及手動合併權重。

Reddit r/MachineLearningCommunityApr 18#fine-tuning#lora#deployment
8GB VRAM 本地微調 Gemma 4

8GB VRAM 本地微調 Gemma 4

Unsloth 支援在 8GB VRAM 上本地微調 Gemma 4 E2B/E4B,比 FlashAttention-2 快 1.5 倍且 VRAM 少 60%。修復梯度累積損失爆炸、26B/31B 索引錯誤、use_cache 問題及 float16 音頻溢位等 bug。提供文字、視覺、音頻的免費 Colab 筆記本及 Unsloth Studio UI。

Reddit r/LocalLLaMACommunityApr 7#fine-tuning#optimization#notebooks
Page 3 of 11