找到 127 条结果

8B-MoT 无编码器无VAE统一模型,靠空间联合重建与多专家RL蒸馏兼顾理解、生成与编辑

Haiwen Diao, Jiahao Wang, Chenjing Ding, Hanming Deng, Jiangnan Chen, Ruixi... 2026-09-11
像素空间流匹配 原生统一多模态模型 图像生成 图像编辑 在线策略蒸馏

补丁重参数化让冻结语义ViT兼得理解与重建,单一视觉空间支撑生成与编辑

Jinbo Yan, Limeng Qiao, Jie Qin, Junyan He, Feize Wu, Guanglu Wan 2026-08-24
图像生成 图像编辑 流匹配 统一多模态模型 视觉tokenizer

用随图像频谱演化的移动低通终点替换固定终点,让像素级流匹配按粗到细轨迹生成

Haoyang Tong, Yu He, Fang Li, Lichen Ma, Jingling Fu, Dong Chen, Zhen Chen,... 2026-08-19
像素空间生成 图像生成 流匹配 粗到细生成 频谱先验

训练并行解码器,用单次前向同时预测多个去噪步的速度,实现少步、高质、高多样性的扩散与流模型蒸馏。

Neta Shaul, Chao Liu, Arash Vahdat, Julius Berner 2026-07-29
图像生成 少步采样 扩散蒸馏 流匹配 视频生成

用角相似度替代欧氏距离做码本路由,解决高维视觉量化坍缩。

Tianren Ma, Lin Long, Chuyan Chen, Mu Zhang, Junbo Zhao, Tong Zhang, Qixiang Ye 2026-07-28
codebook collapse 图像生成 图像重建 多模态理解 表示自编码器

把能量距离变成常数规模三体散射,实现高维一步生成

Peng Sun, Zhenglin Cheng, Deyuan Liu, Jun Xie, Xinyi Shang, Tao Lin 2026-07-27
MMD Wasserstein梯度流 一步生成 分布匹配 图像生成

推理时用FFT频谱对齐校正扩散模型曝光偏差,开销仅3-4%

Yuya Kobayashi, Masato Ishii, Yuhta Takida, Takashi Shibuya, Yuki Mitsufuji 2026-07-27
图像生成 扩散模型 无训练引导 曝光偏差 频谱对齐

寄存器令牌在无异常值的DiT中仍提升像素空间生成质量,并提出Register Guidance

Nikita Starodubcev, Ilia Sudakov, Ilya Drobyshevskiy, Artem Babenko, Dmitry Baranchuk 2026-07-16
像素空间扩散 图像生成 寄存器令牌 引导采样 扩散Transformer

通过在感知特征空间监督流匹配,将采样步数从35-50步减少到4-8步且保持质量

Chuyang Zhao, Yifei Song, Hongfa Wang, Jianlong Yuan, Yuan Zhang, Siming Fu,... 2026-07-07
图像生成 少步采样 感知监督 流匹配 生成模型

通过精确估计MMD和多编码器约束优化,实现一步生成器的SOTA质量

Lan Feng, Wuyang Li, Eloi Zablocki, Matthieu Cord, Alexandre Alahi 2026-07-03
MMD 一步生成 分布匹配 图像生成 表征学习

端到端联合训练VQ tokenizer和AR generator,将ImageNet训练加速10倍

Bin Lin, Zheyuan Liu, Chenguo Lin, Sixiang Chen, Yunyang Ge, Yunlong Lin,... 2026-07-01
向量量化 图像生成 端到端训练 自回归模型