用世界模型替代昂贵的沙箱执行训练研究智能体,在线去偏去噪,训练加速3-4倍且性能更优。
Xiyuan Yang, Sheikh Sarwar, Jingru Cheng, Zhan Shi, Duanshun Li, Huiyuan...
2026-09-10
LLM后训练
世界模型
具身智能
强化学习
自动研究智能体
用紧凑的语义动作接口,让基础 VLM 零样本或数 GPU 小时微调即可直接操控机器人
Yanzhe Chen, Zechen Bai, Zhijun Cao, Wenzheng Zeng, Kevin Qinghong Lin, Yiqi...
2026-09-10
Sim-to-Real
VLA 对比
VLM 智能体
具身智能
机器人操作
开源模块化研究栈把世界-动作模型预训练变成受控实验,提炼三大准则并开源6400小时数据预训练模型
Yuran Wang, Siqiao Huang, Mingleyang Li, Chenhao Zhang, Jiaqi Liang, Weiyang...
2026-09-09
世界-动作模型
具身智能
具身预训练
机器人操作
流匹配
图像先验快速初始化加智能体局部演化,24倍提速生成物理有效且多样的仿真场景
Xingjian Ran, Xiaoye Mo, Sihao Liu, Jianyu Zhang, Li Luo, Bo Dai
2026-09-09
3D场景生成
VLM智能体
具身智能
布局多样性
物理有效性
以可执行技能契约和守卫运行时把VLA策略变成闭环具身智能体
Wei Wang, Wenqiao Zhang, Yutong Lin, Yuqian Yuan, Tianwei Lin, Jinhao Mao,...
2026-09-08
VLA
具身智能
智能体框架
机器人操作
闭环控制
保持解析-生成-放置顺序,把精度留给VLM闭环gizmo交互,实拍还原为可编辑仿真场景
Minghan Qin, Yuang Wang, Xiuyu Yang, Yushi Long, Yujian Zhang, Ruihuan Wang,...
2026-09-01
3D场景重建
9-DoF位姿估计
VLM智能体
具身智能
实到仿真(Real-to-Sim)
在Minecraft版Among Us沙盒中首次量化VLM智能体的言语与非言语联合欺骗
Jaewoo Ahn, Junseo Kim, Hyunseo Kim, Heeseung Yun, Jaehyeon Son, Zsolt Kira,...
2026-09-01
AI安全与对齐
LLM-as-a-Judge
VLM智能体
具身智能
多智能体
用意图-观察-记忆三通道协议把VLM与导航基础模型耦合成持久具身智能体,刷新三大EQA基准
Zixing Lei, Gengze Zhou, Xiong-Hui Chen, Jiazhao Zhang, Yiyang Huang, Hang...
2026-09-01
具身智能
具身问答
导航基础模型
工具增强推理
智能体框架
用冻结教师VLM把已执行行为的语义目标蒸馏进VLA动作解码器,大幅提升操作成功率与泛化
Sangoh Lee, Sangwoo Mo, Wook-Shin Han
2026-08-31
具身智能
意图蒸馏
机器人操作
知识蒸馏
行为克隆
把游戏开发变成“引擎检查+人类验收”的可验证奖励环境,驱动世界模型自我改进
Pengfei Zhou, Hexin Wang, Zhengfeiyang Zhang, Yixing Ma, Zhenglin Wan,...
2026-08-28
世界模型
具身智能
可验证奖励
强化学习
智能体
把真实香港搬进物理仿真沙盒,测出多模态智能体“认得出却走不到”的城市行动能力断层。
Tianjie Ju, Zheng Wu, Yueqing Sun, Yuhan Cui, Bobo Li, Shengqiong Wu,...
2026-08-28
具身智能
城市导航
基准与评测环境
多模态大语言模型
智能体评估
三系统架构+3.7万小时异构数据一阶段预训练,协同理解、预测与行动的具身基础模型。
GigaBrain Team, Angen Ye, Axiang Sun, Can Jin, Chenxi Cheng, Chong Shi,...
2026-08-26
VLA
世界模型
具身智能
强化学习
机器人基础模型
首篇智能眼镜系统综述:以感知-状态-行动闭环为纲,提出L0-L5能力分级与九维部署评估框架
Jiangning Zhang, Haojun Chen, Yong Liu
2026-08-26
L0-L5能力框架
具身智能
可穿戴智能体
智能眼镜
第一人称智能
以传统仿真器八项能力为标尺审计200篇文献,指出状态反馈与物理引擎是结构性缺口
Tong Wang, Huan Deng, Mucheng Yang, Yang He, Xiaohui Kuang, Gang Zhao
2026-08-25
世界模型
仿真器
具身智能
综述
自动驾驶
提出六层级人类情境分类法,系统梳理基础模型时代以人为中心智能的方法、数据与评测。
Yang Chen, Tianqi Wang, Xiaorui Jiang, Yilei Man, Yihua Shao, Mengyuan Liu,...
2026-08-24
世界模型
交互建模
人体感知与生成
以人为中心智能
具身智能
以夹爪为中心学习接触流形,按人类抓取拓扑零样本合成灵巧抓取
Julien Merand, Boris Meden, Liming Chen, Mathieu Grossard
2026-08-21
具身智能
机器人学习
灵巧抓取
生成模型
冻结VLA策略,用自进化的代码Critic与恢复技能实现机器人闭环执行治理与持续提升
Xin Ding, Liang Mi, Mingzhe Huang, Zixuan Wang, Chao Zhang, Zixu Hao, Fu...
2026-08-20
VLA
具身智能
推理基础设施
机器人操作
自进化Agent
4千条视触觉演示加DSR指标,识别任务成功却过度挤压物体的策略
Bowen Jing, Mingxin Wang, Ruiyang Hao, Chenchen Ge, Hanwen Shen, Junjie He,...
2026-08-20
具身智能
可变形物体
基准评测
机器人操作
视觉-触觉学习
首个3D世界构建智能体的评测+多模态RL训练框架,开源30B模型Pass@1超越GPT-5.5
Yansong Ning, Jingwen Ye, Zhongkai Wu, Yang Sun, Yiqin Zhu, Xingyi Li,...
2026-08-18
3D场景生成
Agentic RL
Benchmark
GRPO
具身智能
显式276维世界状态加零参数渲染器承担精确几何与控制,神经网络只负责画外观
Zian Meng, Zhen Li, Chuanhao Li, Qiang Li, Kaipeng Zhang
2026-08-17
世界模型
交互式视频生成
具身智能
可控生成
角色动画