找到 140 条结果

OGPP:用轨道规范化+索引嵌入+几何路径统一粒子生成的对称性与属性编码

Sinan Wang, Jinjin He, Shenyifan Lu, Ruicheng Wang, Greg Turk, Bo Zhu 2026-05-05
几何深度学习 流匹配 生成模型 粒子系统 计算机图形学

CoReDi:让语义投影与扩散模型联合训练,稳定共演化提升生成质量。

Theodoros Kouzelis, Spyros Gidaris, Nikos Komodakis 2026-04-24
ImageNet 图像生成 扩散模型 流匹配 特征坍塌

用视觉隐空间世界模型给VLA加上前瞻规划,实现工业机械臂零人工干预

Adriana Aida, Walida Amer, Katarina Bankovic, Dhruv Behl, Fabian Busch,... 2026-04-23
世界模型 工业部署 机器人操作 流匹配 视觉-语言-动作模型

APEX:用条件空间仿射偏移在流匹配模型内生构造对抗信号,实现无判别器的高保真一步生成。

Deyuan Liu, Peng Sun, Yansen Han, Zhenglin Cheng, Chuyan Chen, Tao Lin 2026-04-15
LoRA蒸馏 一步生成 文生图 条件偏移 流匹配

通过两阶段框架学习 64× 时间压缩的稠密运动潜空间,使目标条件运动生成比视频模型快 4 个数量级。

Nick Stracke, Kolja Bauer, Stefan Andreas Baumann, Miguel Angel Bautista,... 2026-04-14
世界模型 流匹配 潜空间学习 目标条件生成 运动生成

用多奖励 Langevin 动力学 + 提示感知自适应策略,在推理时免训练、免反演地引导扩散/流匹配模型

Onkar Susladkar, Dong-Hwan Jang, Tushar Prakash, Adheesh Juvekar, Vedant... 2026-04-10
Langevin 动力学 SAM2 可微分 VQA 图像编辑 奖励引导

Sony AI 发布音效基础模型,集成音频编解码、文本对齐、文本到音频与视频到音频扩散生成

Gaëtan Hadjeres, Marc Ferras, Khaled Koutini, Benno Weck, Alexandre Bittar,... 2026-04-03
CLAP 多模态生成 流匹配 潜在扩散模型 视频到音频

通过微观精确SDE和宏观双重信任区域,使视频GRPO探索保持在数据流形附近

Mingzhe Zheng, Weijie Kong, Yue Wu, Dengyang Jiang, Yue Ma, Xuanhua He, Bin... 2026-03-24
GRPO 强化学习对齐 扩散模型 流匹配 视频生成