找到 272 条结果

首个多智能体框架,通过规划-生成-批评流程赋予任意图像生成器交错生成能力

Dian Zheng, Harry Lee, Manyuan Zhang, Kaituo Feng, Zoey Guo, Ray Zhang, Hongsheng Li 2026-06-12
交错生成 图像生成 多智能体系统 强化学习 视觉语言模型

提出Z-Reward教师-学生框架,将推理增强的分数分布蒸馏到高效的学生奖励模型中

Xin Jin, Huanqia Cai, Zhen Li, Zechao Zhan, Dengyang Jiang, Aiming Hao,... 2026-06-11
奖励建模 强化学习 文本到图像生成 知识蒸馏 视觉语言模型

通过焦距统一、文本像素引用和数据缩放,标准VLM无需复杂设计即可掌握多样化3D任务

Zhipeng Cai, Zhuang Liu, Yunyang Xiong, Zechun Liu, Vikas Chandra, Yangyang Shi 2026-06-01
3D理解 多视图几何 深度估计 视觉语言模型 计算机视觉