LayerRecall 让模型不仅会从历史中找回相关记忆,还知道应该把记忆送进哪些视频 DiT 层。论文设计了 100 个未参与训练的三镜头 prompt,专门测试主体、颜色、位置和场景四类长时记忆压力,每类 25 个案例,并与 13 个长视频生成或记忆增强基线进行比较。LayerRecall 给长视频生成带来的启发,或许不是简单地”增加记忆容量”,而是给有限记忆做一次更聪明的调度:合适的内容,在合适的时刻,交给合适的层。
LayerRecall 让模型不仅会从历史中找回相关记忆,还知道应该把记忆送进哪些视频 DiT 层。论文设计了 100 个未参与训练的三镜头 prompt,专门测试主体、颜色、位置和场景四类长时记忆压力,每类 25 个案例,并与 13 个长视频生成或记忆增强基线进行比较。LayerRecall 给长视频生成带来的启发,或许不是简单地”增加记忆容量”,而是给有限记忆做一次更聪明的调度:合适的内容,在合适的时刻,交给合适的层。