找到 86 条结果

提出 UnifiedReward-Flex,通过上下文自适应层次化推理动态构建个性化奖励模型。

Yibin Wang, Yuhang Zang, Feng Han, Jiazi Bu, Yujie Zhou, Cheng Jin, Jiaqi Wang 2026-02-04
偏好优化 多模态 奖励模型 强化学习 视觉生成

首个可复现Suno级别商业系统的开源音乐基础模型家族,支持长达6分钟的可控歌曲生成

Dongchao Yang, Yuxin Xie, Yuguo Yin, Zheyu Wang, Xiaoyu Yi, Gongxi Zhu,... 2026-01-16
基础模型 多模态 开源 歌曲合成 音乐生成