找到 92 条结果

8B-MoT 无编码器无VAE统一模型,靠空间联合重建与多专家RL蒸馏兼顾理解、生成与编辑

Haiwen Diao, Jiahao Wang, Chenjing Ding, Hanming Deng, Jiangnan Chen, Ruixi... 2026-09-11
像素空间流匹配 原生统一多模态模型 图像生成 图像编辑 在线策略蒸馏

补丁重参数化让冻结语义ViT兼得理解与重建,单一视觉空间支撑生成与编辑

Jinbo Yan, Limeng Qiao, Jie Qin, Junyan He, Feize Wu, Guanglu Wan 2026-08-24
图像生成 图像编辑 流匹配 统一多模态模型 视觉tokenizer

提出EVR奖励:多假设评估+视觉验证,强化学习优化多参考图像编辑。

Yingmao Miao, Pengfei Zhang, Xiaochen Lv, Meng Yu, Lei Sun, Xiangxiang Chu,... 2026-08-03
DiffusionNFT 图像编辑 多参考图像编辑 多模态大语言模型 奖励模型

用图像编辑模型改造任务图片,系统提升视频模型视觉推理能力

Robert Geirhos, Yuxuan Li, Thaddäus Wiedemer, Neha Kalibhat, Zi Wang, Mani... 2026-07-29
图像编辑 提示工程 测试时扩展 真实感偏差 视觉推理

用RGB统一视觉任务的输入输出,冻结图像编辑器零样本完成25项感知与生成任务

Timing Yang, Jinrui Yang, Xinlong Li, Yuhan Wang, Haoran Li, Yanqing Liu,... 2026-07-15
RGB表示 可控生成 图像编辑 密集预测 统一视觉模型

把虚拟试衣转为图像编辑任务,用手绘掩码精确控制衣物尺寸、款式与摆放

Seungyong Lee, Hyun Jun Jang, Sangoh Kim, Sungjoon Park 2026-07-14
可控生成 图像编辑 实例分割 扩散变换器 虚拟试衣

提出基于示例的人像结构精修框架,通过自增强范式和4700万对数据集实现精确操作传递

Zhihong Liu, Zheng Li, Jiachun Jin, Siqi Kou, Yitao Jian, Fengpei Yu, Zhijie Deng 2026-06-30
Diffusion Transformer 人像精修 图像编辑 数据增强 示例学习