找到 127 条结果

提出基于MoE的语义感知风格迁移框架,支持从颜色到深层次的多样化风格

Shihao Zhu, Ziheng Ouyang, Yijia Kang, Qilong Wang, Mi Zhou, Bo Li,... 2026-03-18
Diffusion Models Mixture of Experts 图像生成 计算机视觉 风格迁移

提出球形编码器,通过将图像均匀映射到球面潜在空间,实现单步高质量图像生成。

Kaiyu Yue, Menglin Jia, Ji Hou, Tom Goldstein 2026-02-26
图像生成 少步生成 潜在空间 球形分布 自编码器

通过频谱演化感知的缓存策略,在保留内容质量的同时加速扩散模型推理

Jiwoo Chung, Sangeek Hyun, MinKyu Lee, Byeongju Han, Geonho Cha, Dongyoon... 2026-02-26
图像生成 扩散模型 推理加速 缓存策略 视频生成

提出Nexus适配器,通过跨注意力融合文本与结构,实现高效条件生成

Aryan Das, Koushik Biswas, Swalpa Kumar Roy, Badri Narayana Patro, Vinay Kumar Verma 2026-02-19
图像生成 扩散模型 条件生成 跨注意力 适配器

通过思维链推理实现统一多模态模型的测试时迭代优化

Leon Liangyu Chen, Haoyu Ma, Zhipeng Fan, Ziqi Huang, Animesh Sinha,... 2026-02-18
图像生成 图像编辑 多模态 思维链 测试时缩放

通过Reason-Reflect-Refine框架将理解嵌入生成过程,解决多模态模型中生成与理解的权衡问题

Sen Ye, Mengde Xu, Shuyang Gu, Di He, Liwei Wang, Han Hu 2026-02-18
图像生成 多模态模型 强化学习 视觉理解 迭代优化