Search

直接匹配不多,已補上最新動態。

Tag: #moe-signals1 results

🤖

Transformer 內部訊號預測生成正確性

跨 4 模型(Llama-3.1-8B、Qwen-2.5-7B 等)的 14,540 追蹤研究顯示,內部訊號如早期視窗驚奇度以 AUROC 高達 0.90 預測正確性。早期 10 權標記平均驚奇度將 HumanEval Pass@k 從 15-31% 提升至 48-56%。訊號與輸出信心正交;MoE 與密集模型差異明顯。

Reddit r/MachineLearningCommunityMar 17#auroc#moe-signals