Search

Tag: #fine-tuning102 results

TRL v1.0:後訓練庫抵禦領域假設失效

TRL v1.0:後訓練庫抵禦領域假設失效

Hugging Face 發布 TRL v1.0,這是一個後訓練庫,即使 AI 領域推翻其基礎假設仍能持續運作。它支援如 RLHF 等穩健微調方法,應對快速進展。此穩定工具幫助開發者維持可靠模型對齊。

Hugging Face BlogOfficialMar 31#rlhf#ppo#dpo
TeachingCoach:AI聊天機器人指導教師

TeachingCoach:AI聊天機器人指導教師

TeachingCoach 是一款微調聊天機器人,為高等教育教師提供即時、教學基礎的指導。它使用資料導向管道從教育資源提取規則,並產生合成對話來微調模型。專家評估顯示其在清晰度和回應性上優於 GPT-4o mini,使用者研究指出深度與效率的權衡。

📰

125k 程式碼資料集發布

一個涵蓋 8 種語言的 125k 程式碼資料集已在 Hugging Face 上發布,用於訓練和升級程式碼模型。使用隱藏的 Hunter Alpha 模型免費生成。完整 450k 版本即將推出,並開放合作。

Reddit r/LocalLLaMACommunityMar 16#dataset#sft#fine-tuning
Page 8 of 11