Search

直接匹配不多,已補上最新動態。

Tag: #plan-conditioning1 results

計劃條件提升擴散語言模型推理

計劃條件提升擴散語言模型推理

擴散語言模型在推理任務上表現不佳,歸因於協調問題;計劃條件方法在前置自迴歸模型生成的計劃作為支架,將 LLaDA-8B-Instruct 在 GSM8K 上從 75.6% 提升至 87.2%,HumanEval 從 37.2% 至 50.0%。擴散模型受益幅度為 AR 基線的 2-10 倍,跨種子標準差為零,推理極其穩定。此方法每題成本約 0.002 美元,延遲增加約 2 秒。

ArXiv AIResearchMar 17#diffusion-models#plan-conditioning