找到 323 条结果

把电影编码为可编辑的电影知识图谱,用重构残差驱动双环文本梯度自进化

Chuyue Li, Jinpeng Yu, Haozhe Wang, Tian Xueyun, Zhijing Zhang, Bingnan Li,... 2026-08-14
文本梯度优化 智能体 知识图谱 视频生成 视频表示学习

首个流式音视频联合身份替换框架:单一扩散模型同步换脸换声,3步采样13.6 FPS

Yuxuan Zhang, Haozhong Xiong, Jiayi Song, Jinpeng Yu, Yang Shi, Jiaming Liu,... 2026-08-14
LoRA 扩散模型蒸馏 流式自回归生成 视频生成 语音转换

从野外视频自监督学习离散'物理语言',先推理后渲染的物理世界模型。

Shuyao Shang, Yuqi Wang, Ruopeng Gao, Xu Chen, Tieniu Tan, Lue Fan, Zhaoxiang Zhang 2026-07-31
世界模型 扩散模型 物理世界 自监督学习 视觉语言模型

通过反向KL分解,把演化上下文作为在线监督信号注入蒸馏目标。

Yuran Wang, Zekun Wang, Bohan Zeng, Ruixu Zhang, Wenxuan Liu, Liu Yang,... 2026-07-31
上下文蒸馏 医学问答 反向KL分解 在线策略蒸馏 大语言模型

训练并行解码器,用单次前向同时预测多个去噪步的速度,实现少步、高质、高多样性的扩散与流模型蒸馏。

Neta Shaul, Chao Liu, Arash Vahdat, Julius Berner 2026-07-29
图像生成 少步采样 扩散蒸馏 流匹配 视频生成

揭示CFG组合OPD的分支歧义缺陷,提出分支感知的PDM目标稳定跨尺度蒸馏

Bingnan Li, Haozhe Wang, Haozhong Xiong, Fangtai Wu, Jinpeng Yu, Yang Shi,... 2026-07-28
CFG 扩散模型蒸馏 无分类器引导 策略内蒸馏 视频生成

把身份保持建模为视频重打光,用重打光人脸+法线+关键帧+深度联合控制,实现关键帧编辑的逐帧扩散传播。

Yuancheng Xu, Mingming He, Pablo Salamanca, Li Ma, Yash Kant, Emmett Steven,... 2026-07-27
ControlNet 人脸动画 扩散Transformer 视频到视频 视频生成