Search

Tag: #model-training40 results

T2 縮放優化訓練與推理運算

T2 縮放優化訓練與推理運算

威斯康星大學麥迪遜分校與史丹佛大學研究人員推出 Train-to-Test (T2) 縮放法,共同優化模型參數、訓練資料與推理樣本。建議訓練比 Chinchilla 規定小得多但資料量大得多的模型,將節省運算用於多重測試時樣本。此法提升複雜任務效能,同時控制企業應用推理成本。

VentureBeatMediaApr 17#scaling-laws#model-training
Page 2 of 4