首次通过内省一致性训练使DLM达到AR模型质量,在15个基准测试中实现3×吞吐量提升
Yifan Yu, Yuqing Jian, Junxiong Wang, Zhongzhu Zhou, Donglin Zhuang, Xinyu...
2026-04-14
并行生成
扩散语言模型
推理优化
自回归模型
用轻量微调让 AR 模型一次生成多 token,无需架构改动即可调节速度与质量。
Ziqi Jin, Lei Wang, Ziwei Luo, Aixin Sun
2026-04-09
KV 缓存
多 token 生成
扩散语言模型
推理加速
模型微调
统一2D/3D生成,用跨模态一致性约束缓解3D数据稀缺问题
Chongjie Ye, Cheng Cao, Chuanyu Pan, Yiming Hao, Yihao Zhi, Yuanming Hu,...
2026-04-03
3D生成
多模态学习
指令编辑
自回归模型
跨模态对齐
基于Transformer的自回归3D高斯场景生成方法,支持无条件生成、补全和大场景合成
Nicolas von Lützow, Barbara Rössle, Katharina Schmid, Matthias Nießner
2026-04-02
3D生成
Gaussian Splatting
Transformer
场景合成
自回归模型
系统综述视频生成模型作为世界模拟器时的效率优化技术,涵盖建模范式、架构设计和推理算法三个维度。
Muyang He, Hanzhong Guo, Junxiong Lin, Yizhou Yu
2026-03-31
世界模型
扩散模型
效率优化
注意力机制
自回归模型
大规模双手机动数据集与生成框架,支持精细手指协同与接触交互
Zimu Zhang, Yucheng Zhang, Xiyan Xu, Ziyin Wang, Sirui Xu, Kai Zhou, Bing...
2026-03-31
LLM标注
人体动画
动作捕捉
双手机动生成
扩散模型
为动作量化的行为克隆建立理论框架,证明稳定动力学下可实现最优样本复杂度
Haoqun Cao, Tengyang Xie
2026-03-24
动作量化
强化学习
理论分析
自回归模型
行为克隆
高效RL框架对齐蒸馏视频模型与人类偏好
Songchun Zhang, Zeyue Xue, Siming Fu, Jie Huang, Xianghao Kong, Y Ma,...
2026-03-23
强化学习
模型对齐
自回归模型
蒸馏
视频生成
基于离散token+自回归建模+大规模预训练的语音生成基础模型,支持零样本克隆与小时级长文本生成
Yitian Gong, Botian Jiang, Yiwei Zhao, Yucheng Yuan, Kuangwei Chen, Yaozhou...
2026-03-20
基础模型
自回归模型
语音克隆
语音合成
音频tokenizer
按语义显著性排序3D形状token,实现高效自回归生成
Niladri Shekhar Dutt, Zifan Shi, Paul Guerrero, Chun-Hao Paul Huang, Duygu...
2026-03-19
3D生成
Token化
形状表示
自回归模型
语义对齐
通过嵌入空间中的掩码token探测,实现无需训练的多token预测,显著提升推理效率。
Raghavv Goel, Mukul Gagrani, Mingu Lee, Chris Lott
2026-03-19
免训练
多token预测
嵌入空间探测
推理加速
自回归模型
用相机位姿统一动作控制与3D一致性,构建交互式游戏世界模型
Jisu Nam, Yicong Hong, Chun-Hao Paul Huang, Feng Liu, JoungBin Lee, Jiyoung...
2026-03-18
3D一致性
世界模型
相机控制
自回归模型
视频生成
用软标签替代one-hot解决大码本训练困难
Shufan Li, Jiuxiang Gu, Kangning Liu, Zhe Lin, Aditya Grover, Jason Kuen
2026-03-17
图像生成
矢量量化
离散模型
自回归模型
训练优化
首次将双向音视频扩散模型蒸馏为实时流式自回归生成器
Yaofeng Su, Yuming Li, Zeyue Xue, Jie Huang, Siming Fu, Haoran Li, Ying Li,...
2026-03-16
多模态
扩散蒸馏
流式生成
自回归模型
音视频生成
通过内容自适应的token分配,在保持重建质量的同时节省24%以上的视频token开销
Tianwei Xiong, Jun Hao Liew, Zilong Huang, Zhijie Lin, Jiashi Feng, Xihui Liu
2026-03-13
token优化
自回归模型
自适应压缩
视频分词器
视频生成
对角蒸馏实现31FPS实时视频生成,加速277倍
Jinxiu Liu, Xuanming Liu, Kangfu Mei, Yandong Wen, Ming-HsuanYang, Weiyang Liu
2026-03-11
分布匹配蒸馏
实时生成
扩散蒸馏
自回归模型
视频生成
利用TTT层实现线性复杂度的长上下文自回归3D高斯重建
Chen Wang, Hao Tan, Wang Yifan, Zhiqin Chen, Yuheng Liu, Kalyan Sunkavalli,...
2026-02-24
3D重建
测试时训练
自回归模型
长序列建模
高斯泼溅
用自回归 Transformer 从文本生成模块化 3D 建筑资产
Lingting Zhu, Shengju Qian, Haidi Fan, Jiayu Dong, Zhenchao Jin, Siwei Zhou,...
2026-02-24
3D 生成
Transformer
模块化设计
游戏资产
自回归模型
通过推理时剪枝不稳定token消除长视频生成中的时序漂移
Ariel Shaulov, Eitan Shaar, Amit Edenzon, Lior Wolf
2026-02-11
token剪枝
推理优化
自回归模型
视频生成
长视频
提出600万高质量图文对数据集,弥合开源与商用文生图模型的数据鸿沟
Xu Ma, Yitian Zhang, Qihua Dong, Yun Fu
2026-02-11
微调
扩散模型
数据集
文生图
自回归模型