Search

Tag: #model-scaling25 results

🤖

小型 LLM 原始層實證發現

橫跨 4 款小型 LLM(360M-1B 參數)的 18 項實驗顯示,支架原始(Layer 0a:SOMEONE、TIME、PLACE)與內容原始(Layer 0b:FEAR、GRIEF)間存在激活差距,平均 +0.245,且隨規模縮小。11 種組合匹配 Layer 1 概念;可透過 Ollama 重現。

Reddit r/MachineLearningCommunityMar 17#semantic-primitives#model-scaling
Page 1 of 3