拒绝大力出奇迹,PRISM 框架让 dLLM 也能高效 Test-Time Scaling

从 Best-of-N、Self-Consistency 到更复杂的搜索与验证框架,Test-Time Scaling 已经成为提升大模型复杂推理能力的重要范式 … 针对这一问题,论文提出了 PRISM:Pruning, Remasking, and Integrated Self-verification Method,一个专为离散扩散语言模型设计的高效 Test-Time Scaling 框架 … 此次入选 ICML 2026 的 PRISM,则将这一研究脉络进一步延伸到推理阶段,关注如何通过层次化搜索、自验证反馈和局部 remasking,让离散扩散模型在无需额外 verifier 的情况下实现高效 Test-Time Scaling。

原文连接