Search

Tag: #fine-tuning102 results

Ling-3.0 發布六個基礎檢查點

Ling-3.0 發布六個基礎檢查點

AntLing 已發布六個官方 Ling-3.0 基礎檢查點,涵蓋兩種模型尺寸與三個訓練階段。這些採用 MIT 授權且無存取限制的儲存庫, предназначено 用於持續預訓練、微調與研究,而非直接聊天使用。

Reddit r/LocalLLaMACommunity1d ago#base-model#fine-tuning#mit-license
🤖

開源 20GB MedQA 84% LLM

Empirisch Tech 開源 Chaperone-Thinking-LQ-1.0,這是 4-bit GPTQ 量化與 QLoRA 微調的 DeepSeek-R1-32B 模型,在 MedQA 上達 84%。可在單一 L40 GPU 的 20GB VRAM 運行,比基底快 1.6 倍。設計用於本地醫療保健,尊重資料主權。

Reddit r/MachineLearningCommunityApr 21#open-source#quantization#fine-tuning
將遺傳特徵蒸餾至基礎模型的研究

將遺傳特徵蒸餾至基礎模型的研究

研究人員證實,透過教師模型的輸出對基礎模型進行微調,會導致模型繼承特定的行為特徵(如負面情緒或審查機制),即使過濾掉明確提及這些特徵的內容也無法完全阻止。此研究提供了一種無需大規模 SFT 流程即可重現這些現象的方法。

AI Alignment ForumCommunityJul 14#model-distillation#alignment#fine-tuning
Page 1 of 11