找到 323 条结果

提出视频扩散模型PISCO,用稀疏关键帧控制实现精确的视频物体插入

Xiangbo Gao, Renjie Li, Xinghao Chen, Yuheng Wu, Suofei Feng, Qing Yin, Zhengzhong Tu 2026-02-13
实例插入 扩散模型 稀疏控制 视频生成 视频编辑

通过动力学增强的潜在动力学模型,从无标签视频学习可迁移任务知识

Zhongwei Ren, Yunchao Wei, Xiao Yu, Guixun Luo, Yao Zhao, Bingyi Kang,... 2026-02-11
世界模型 机器人操作 自监督学习 视频生成 长时序推理

32B参数非对称双塔架构,实现高保真唇形同步与音视频对齐的开源联合生成模型

SII-OpenMOSS Team, Donghua Yu, Mingshu Chen, Qi Chen, Qi Luo, Qianyi Wu,... 2026-02-10
MoE架构 唇形同步 多模态扩散 视频生成 音视频对齐

用 Transformer 替代 CNN 做视频压缩,支持自适应长度编码和扩散解码

Yao Teng, Minxuan Lin, Xian Liu, Shuai Wang, Xiao Yang, Xihui Liu 2026-02-06
Transformer 扩散模型 自编码器 视频压缩 视频生成

通过滑动窗口运动提取和梯度复用,实现无训练视频运动转移加速3.4倍

Yue Ma, Zhikai Wang, Tianhao Ren, Mingzhe Zheng, Hongyu Liu, Jiayi Guo, Mark... 2026-02-06
DiT 扩散模型 视频生成 计算效率 运动转移

通过识别并压缩注意力中的虚拟头实现自回归视频扩散模型的无损加速

Hang Guo, Zhaoyang Jia, Jiahao Li, Bin Li, Yuanhao Cai, Jiangshan Wang,... 2026-02-05
KV缓存压缩 扩散模型 推理加速 注意力优化 视频生成