找到 56 条结果

通过循环一致性目标约束误差累积,实现稳定长时域视频生成

Junchao Huang, Ziyang Ye, Xinting Hu, Tianyu He, Guiyu Zhang, Shaoshuai Shi,... 2026-02-04
世界模型 扩散模型 自回归生成 视频生成 长时域建模

提出LingBot-VA自回归扩散框架,统一视频动态预测与动作推理实现闭环机器人操控

Lin Li, Qihang Zhang, Yiming Luo, Shuai Yang, Ruilin Wang, Fei Han, Mingrui... 2026-02-02
世界模型 扩散模型 机器人操控 自回归生成 视觉-语言-动作模型

提出VLUAS范式,将视觉信号从被动输入转变为生成目标,实现标准VLM统一处理多模态和视觉任务

Zhixiang Wei, Yi Li, Zhehan Kan, Xinghua Jiang, Zuwei Long, Shifeng Liu,... 2026-01-28
多模态大模型 统一架构 自回归生成 视觉感知 视觉语言模型

首个无需扩散解码器的统一自回归多模态模型,支持文本、图像、语音的任意到任意生成

Dongjie Cheng, Ruifeng Yuan, Yongqi Li, Runyang You, Wenjie Wang, Liqiang... 2026-01-27
图像生成 多模态大语言模型 统一模型 自回归生成 语音合成