AMAZINGINDEX.COM 日报快照
56.6
VOL. 2026.07
2026.07.24
← 返回 2026.07.24 日报
日报快照 · Daily Snapshot
NO. 024

视频自回归训练补上梯度缺失一环

#HF_PAPERS HuggingFace Papers 2026.07.24
推荐指数 59.0 NO. 024 · 2026.07.24
upvotes29comments1

Self Gradient Forcing 提出双阶段训练策略,让自回归视频扩散模型在生成历史帧时也能接收未来帧的梯度反馈,解决"历史上下文-梯度断层"问题。对长视频生成团队来说,这是降低曝光偏差的另一条可行路径,且无需全序列反向传播。

视频自回归训练补上梯度缺失一环

当前主流的自回归视频生成如 OpenAI Sora、Google Lumiere 的滚动生成方案,都依赖 KV cache 复用但无法优化历史写入质量,导致误差随长度累积。SGF 的 trick 在于用第一遍无梯度 rollout 保存中间状态,第二遍选择性注入梯度,规避了全序列 BPTT 的显存爆炸。

这个方法理论上可以嫁接在任何基于 Self Forcing 的现有模型上,但论文尚未公布代码和训练开销数据,实际能外推到多长视频、对推理速度有无影响,需要等开源后验证。如果你在做长视频生成的训练 infra,建议跟踪其后续实现。

查看原文 →