找到 323 条结果

提出预测式视频VAE,丢弃未来帧使潜空间捕获运动先验,提升34.42 FVD并加速收敛52%

Yian Zhao, Feng Wang, Qiushan Guo, Chang Liu, Xiangyang Ji, Jian Zhang, Jie Chen 2026-05-06
变分自编码器 扩散模型 潜空间设计 视频生成 预测学习

四阶段流水线(SFT+GRPO+提示增强+自回归蒸馏)弥合视频扩散模型预训练与部署差距。

Zeyue Xue, Siming Fu, Jie Huang, Shuai Lu, Haoran Li, Yijun Liu, Yuming Li,... 2026-04-29
GRPO RLHF 后训练 扩散模型 自回归蒸馏

把时间做成可学习概念,教会模型感知并按指定播放速度生成视频

Yen-Siang Wu, Rundong Luo, Jingsen Zhu, Tao Tu, Ali Farhadi, Matthew... 2026-04-24
慢动作数据集 扩散模型 时间建模 自监督学习 视频理解

ByteDance Seed 团队发布的多模态音视频联合生成模型,在 T2V/I2V/R2V 三大任务六维评测中全面领先 Sora 2 Pro、Veo 3.1、Kling 3.0。

Team Seedance, De Chen, Liyang Chen, Xin Chen, Ying Chen, Zhuo Chen, Zhuowei... 2026-04-16
可控生成 图生视频 多模态生成 扩散模型 文生视频

单图生成长时3D一致视频并重建可交互3D场景

Tianchang Shen, Sherwin Bahmani, Kai He, Sangeetha Grama Srinivasan, Tianshi... 2026-04-15
3D Gaussian Splatting 三维重建 扩散模型 视频生成 长时一致性

循环Transformer+环内自蒸馏,单次训练实现任意时间推理,参数减少4倍。

Sahil Goyal, Swayam Agrawal, Gautham Govind Anil, Prateek Jain, Sujoy Paul,... 2026-04-13
参数高效 图像生成 循环Transformer 扩散模型 视频生成