找到 251 条结果

用 3D 轨迹作为视频到机器人动作的可复用中间表征,纯视频预训练即可匹敌有动作监督的 VLA。

Seungjae Lee, Yoonkyo Jung, Jusuk Lee, Jonghun Shin, Amir Hossein... 2026-06-15
3D 轨迹预测 世界模型 机器人操作 流匹配 视频预训练

首个同时满足高保真、长时一致性和高效生成的机器人操作世界模型

Arnav Kumar Jain, Yilin Wu, Jesse Farebrother, Gokul Swamy, Andrea Bajcsy 2026-06-12
世界模型 多视图预测 机器人操作 流匹配 测试时规划

提出使用单个LLM同时扮演Agent和环境两个角色,实现自举式协同进化,在多任务基准中平均提升超过4%

Xucong Wang, Ziyu Ma, Shidong Yang, Tongwen Huang, Pengkun Wang, Yong Wang,... 2026-06-10
Agent-环境协同进化 LLM智能体 世界模型 强化学习 自举学习

在潜在空间直接构建3D记忆,实现高效几何一致的视频生成

Weijie Wang, Haoyu Zhao, Yifan Yang, Feng Chen, Zeyu Zhang, Yefei He,... 2026-06-09
3D一致性 世界模型 扩散模型 空间记忆 视频生成

提出首个评估视频生成模型物理可执行性的基准测试框架,通过模拟器中的实际执行成功来衡量模型的物理知识。

Rui Zhao, Kaiming Yang, Jifeng Zhu, Siyang Chen, Ziqi Wang, Weijia Wu, Kevin... 2026-06-05
世界模型 机器人操作 物理可执行性 行为先验 视频生成

通过模态感知的一致性蒸馏,将世界动作模型的推理延迟从8.1秒降至348毫秒,实现23倍加速

Arman Akbari, Ci Zhang, Arash Akbari, Lin Zhao, Yixiao Chen, Weiwei Chen,... 2026-06-05
世界模型 实时控制 扩散模型 机器人 知识蒸馏

用一个 Mixture-of-Transformers 统一语言/图像/视频/音频/动作的理解与生成

Aditi, Niket Agarwal, Arslan Ali, Jon Allen, Martin Antolini, Adeline... 2026-06-04
Mixture-of-Transformers Physical AI 世界模型 全模态 具身智能