← 前一天
2026-08-12
后一天 → 今日

将视频模型的最终去噪潜变量直接映射为4D动态场景,绕过RGB解码,单checkpoint跨生成器复用

Zihao Liu, Xiaolong Shen, Zhenglin Zhou, Ruijie Quan, Yi Yang
3D重建 4D生成 前馈重建 潜空间接口 视频扩散模型

仅凭闭合状态单次观测,网格锚定交叉验证多模型输出,重建部件与关节参数

Daeun Lee, Jaeah Lee, Woosung Kim, Haebeom Jung, Jaesik Park
3D重建 数字孪生 视觉语言模型 视频扩散模型 铰接物体

低分辨率通读全文、按需放大关键区域,让8B模型在长文档问答上同时更准、更快、更少幻觉

Kaican Li, Weiyan Xie, Lewei Yao, Jiannan Wu, Lanqing Hong, Yongxiang Huang,...
主动感知 以图思考 多模态大模型 强化学习 视觉智能体

用质量校准排序与跨层自蒸馏修复 query 竞争错配,仅改训练、推理零开销,三类分割一致涨点

Fang Li, Yu He, Haoyang Tong, Lichen Ma, Jingling Fu, Wenxiao Fan, Tongxuan...
Mask Transformer 即插即用训练框架 图像分割 知识蒸馏 质量感知排序