找到 138 条结果

提出一个专为物理AI设计的多模态批评模型,通过自我参照的批评微调来提升物理推理和评估能力。

Tianyi Xiong, Shihao Wang, Guilin Liu, Yi Dong, Ming Li, Heng Huang, Jan... 2026-02-12
GRPO 具身智能 多模态批评模型 强化学习 机器人学

用两个协作智能体自动构建平衡评测基准并生成可执行评测流程,压缩85%冗余样本、降低77%评测成本

Shuai Zhang, Jiayu Hu, Zijie Chen, Zeyuan Ding, Yi Zhang, Yingji Zhang, Ziyi... 2026-02-05
具身智能 多智能体系统 自动化评估 视觉语言模型 评测基准

具身AI基座模型,通过3D空间推理和密集时序估计实现精准操作

Huajie Tan, Enshen Zhou, Zhiyu Li, Yijie Xu, Yuheng Ji, Xiansheng Chen,... 2026-01-22
3D空间推理 具身智能 多模态大模型 时序价值估计 机器人操作

通过隐式多模态思维链推理实现视觉语言导航,训练时用思维链、推理时无需显式生成,兼顾推理能力与实时性

Jing Zuo, Lingzhou Mu, Fan Jiang, Chengcheng Ma, Mu Xu, Yonggang Qi 2026-01-21
具身智能 多模态学习 思维链推理 视觉自回归模型 视觉语言导航

WorldMind框架通过过程经验和目标经验,在推理时自主对齐LLM智能体的内部世界模型

Baochang Ren, Yunzhi Yao, Rui Sun, Shuofei Qiao, Ningyu Zhang, Huajun Chen 2026-01-21
世界模型 具身智能 智能体 物理幻觉 经验学习

训练无关的测试时框架,通过粗到细视点探索提升3D具身问答性能

Haoyu Zhao, Akide Liu, Zeyu Zhang, Weijie Wang, Feng Chen, Ruihan Zhu,... 2026-01-09
3D场景理解 具身智能 测试时推理 空间推理 视觉-语言模型

提出PSN框架,让智能体通过可执行符号程序持续获取、精炼和重用技能

Haochen Shi, Xingdi Yuan, Bang Liu 2026-01-08
LLM智能体 具身智能 强化学习 持续学习 程序合成