← 前一天
2026-09-10
后一天 → 今日

用世界模型替代昂贵的沙箱执行训练研究智能体,在线去偏去噪,训练加速3-4倍且性能更优。

Xiyuan Yang, Sheikh Sarwar, Jingru Cheng, Zhan Shi, Duanshun Li, Huiyuan...
LLM后训练 世界模型 具身智能 强化学习 自动研究智能体

用紧凑的语义动作接口,让基础 VLM 零样本或数 GPU 小时微调即可直接操控机器人

Yanzhe Chen, Zechen Bai, Zhijun Cao, Wenzheng Zeng, Kevin Qinghong Lin, Yiqi...
Sim-to-Real VLA 对比 VLM 智能体 具身智能 机器人操作

用可执行程序维护显式世界状态,把视频模型降级为纯粹的生成式渲染器

Zheng-Hui Huang, Guixu Lin, Jiacheng Lin, Yi-Chuan Huang, Ruihan Yu, Muyao...
3D场景理解 世界模型 交互式环境 可控视频生成 生成式渲染

密集执行奖励+TITO/R3稳定化,将122B MoE模型RL训练为64.0%解题率的终端智能体

Junyao Yang, Yucheng Shi, Zhongzhi Li, Ruhan Wang, Zongxia Li, Haitao Mi,...
MoE训练稳定性 PPO 可验证奖励 强化学习 终端智能体

首个物体接地且姿态感知的协同语音手势扩散模型,在因果潜空间实现时序可控、无穿模的手势合成

Vida Adeli, Soroush Mehraban, Jacob Rommann, Harrison Sanborn, Cole...
SMPL-X 人体-场景交互 协同语音手势生成 合成数据集 因果潜空间

DF26基准显示人类与最先进检测器识别AI生成视频的能力已接近随机

Severyn Shykula, Andrii Yermakov, Ivan Samarskyi, Dmytro Mishkin, Jan Cech,...
全合成视频 基准数据集 深度伪造检测 视频生成 跨生成器泛化