下一块预测:通过半自回归建模进行视频生成

💡 原文中文,约500字,阅读约需2分钟。
📝

内容提要

本研究提出了一种名为下一块预测的半自回归框架,旨在解决自回归视频生成中的单向依赖和推理速度慢的问题,从而显著提升生成效率和空间依赖捕捉能力。

🏷️

标签

➡️

继续阅读