找到 57 条结果

提出 LoRWeB,通过可学习的 LoRA 基底和动态编码器组合,实现对未见视觉类比任务的泛化编辑。

Hila Manor, Rinon Gal, Haggai Maron, Tomer Michaeli, Gal Chechik 2026-02-23
Flow Matching LoRA 参数高效微调 图像编辑 扩散模型

基于扩散模型的多音轨同步生成框架,推理速度提升25-50%

Shih-Lun Wu, Ge Zhu, Juan-Pablo Caceres, Cheng-Zhi Anna Huang, Nicholas J. Bryan 2026-02-13
Flow Matching 多音轨 扩散模型 音乐生成 音频分离

提出pMF方法实现单步无潜变量图像生成,ImageNet 256×256达2.22 FID

Yiyang Lu, Susie Lu, Qiao Sun, Hanhong Zhao, Zhicheng Jiang, Xianbang Wang,... 2026-01-30
Flow Matching 像素空间生成 单步生成 图像生成 扩散模型

基于2万小时真实双臂机器人数据训练的VLA基础模型,实现跨平台泛化与高效训练

Wei Wu, Fan Lu, Yunnan Wang, Shuai Yang, Shi Liu, Fangjing Wang, Qian Zhu,... 2026-01-28
Flow Matching VLA基础模型 双臂机器人 大规模预训练 机器人操作

提出统一动作空间和混合流架构,实现单一模型跨5种机器人平台部署

Hao Luo, Ye Wang, Wanpeng Zhang, Sipeng Zheng, Ziheng Xi, Chaoyi Xu, Haiweng... 2026-01-21
Flow Matching Vision-Language-Action模型 人机融合学习 机器人基础模型 跨具身泛化

首个基于流匹配的GUI Agent,通过连续轨迹生成实现拖拽等高自由度操控

Siyuan Hu, Kevin Qinghong Lin, Mike Zheng Shou 2026-01-14
Continuous Control Flow Matching GUI Agent Human-Computer Interaction Visual-Language-Action Model