将信念、意图、情绪等心智变量纳入世界模型以预测人类决策。
Hao Fei, Yiran Zhao
世界模型
心智理论
智能体决策
社会推理
部分可观测决策过程
用任务变换把开放式任务变成可验证的自我博弈环境,无需外部裁判即可规模化训练。
Qinsi Wang, Jing Shi, Huazheng Wang, Kun Wan, Yiran Wu, Bo Liu, Qingyun Wu,...
LLM自我改进
奖励设计
开放式任务
强化学习
自我博弈
首个大规模触觉预训练VTLA模型,把触觉当作预测目标并配ALTER离线强化学习。
NeoteAI Team, Fudan TEAI Team
VLA基础模型
机器人操作
离线强化学习
视觉-触觉-语言-动作模型
触觉感知
用弱模型的对数几率差合成代理教师,蒸馏出超越弱教师、逼近自身的强学生。
Fangxu Yu, Zinan Lin, Xiaodong Liu, Weijia Xu, Michael Xu, Tianyi Zhou, Jianfeng Gao
同策略蒸馏
大语言模型推理
对数几率算术
弱到强学习
强化学习
基于流匹配的两阶段图像到网格框架,中位6秒生成紧凑可用的艺术家网格
Jiale Xu, Rendong Liang, Yuhao Long, Siyuan Shen, Zangyueyang Xian, Zeyi Xu,...
3D网格生成
三维内容生成
图像到网格
流匹配
网格VAE
首个大规模触觉原生世界-动作模型,联合预测视觉、触觉与动作
NeoteAI Team, Fudan TEAI Team
世界-动作模型
机器人操作
流匹配
混合Transformer
触觉感知
提出八维度审计框架,系统审查88个商业AI产品的系统提示词
Xiangning Lin, Shenzhe Zhu, Shu Yang, Zhenyu Zhang, Haoqian Zhang, Yipeng...
AI安全
LLM治理
人机协作
灰色地带分析
用户保护
信息量而非长度才是文本-图像的缩放轴:结构化提示预测扩散损失
Zilong Chen, Chaorui Deng, Kunchang Li, Hongyi Yuan, Haoqi Fan
强化学习微调
扩散模型
提示增强
文本到图像生成
结构化提示
提出SAF四阶段流水线融合GRPO与OPD优势,避免熵坍塌并稳定提升性能。
Yifan Ding, Xincheng Wei, Yoshua Y. Li, Ziheng Li, Yuquan Lu, Siyu Zhang,...
GRPO
RLVR
强化学习
熵坍塌
知识蒸馏
提出 CAPA 基准,评测编程助手能否从同用户历史会话推断个性化歧义模式并在新会话复用以减少澄清
Zijian Xu, Wenshuo Zhang, Zisen Qin, Rui Sheng, Yushi Sun, Huamin Qu, Chuhan Shi
LLM基准测试
个性化
代码生成评估
歧义消解
编程助手
用QQ匹配替代EP正则化,矫正潜在空间重尾偏差,提升规划性能。
Zhoushun Yu, Xiaoyu Hu, Xiangyu Xu
QQ匹配
Wasserstein距离
世界模型
分布匹配
强化学习规划
CriPO用策略内自蒸馏注入缺失行为、翻转被压制的优势,约2×更少步数超越GRPO
Mingxuan Xia, Yuhang Yang, Chao Ye, Shuai Zhu, Shenzhi Yang, Guangcheng Zhu,...
RLVR/GRPO
大语言模型后训练
强化学习
策略自蒸馏
评分式奖励
首个联合评测准确率、记录完整性、溯源与成本的文档抽取基准
Boyang Zhang, Adrian Lyjak, Eli Stewart, Zhaoqi Li, Simon Suo
企业文档处理
基准测试
文档信息抽取
模式引导抽取
视觉语言模型
提出EVR奖励:多假设评估+视觉验证,强化学习优化多参考图像编辑。
Yingmao Miao, Pengfei Zhang, Xiaochen Lv, Meng Yu, Lei Sun, Xiangxiang Chu,...
DiffusionNFT
图像编辑
多参考图像编辑
多模态大语言模型
奖励模型
把世界动力学建模为物理时间上的潜在ODE速度场,未来预测即潜在空间积分
Dongxiu Liu, Haoyi Niu, Peng Cheng, Yuan Gao, Xirui Kang, Sangli Teng,...
JEPA
世界模型
机器人策略学习
潜在表征学习
神经ODE
为生命科学 AI 智能体提供自然语言文献检索的知识层。
Luigi Sigillo, Matteo Silvestri, Francesco Tabaro, Rajat Bhatnagar, Syed...
AI Agent
BM25
Europe PMC
RAG
文献检索
每个机器人仅凭局部观测与256字节消息预测同一未来集群状态。
Alan-Barsag Gazzaev, Alexey Garvilov, Sergey Muravyov
JEPA
去中心化
多智能体表征
标签高效
联合嵌入预测
在VLA预测失败时用RL策略组合式引导动作流,OOD任务成功率最高提升17.3%
Derek Ming Siang Tan, Shailesh Shailesh, Srikrishna Iyer, William Wei Jie...
失败检测
机器人操作
流匹配
测试时扩展
离线强化学习
将特权偏移重解为反事实敏感度,重分配 GRPO token 信用以提升长链推理。
Qiangqiang He, Zhongheng Wu, ZiJian Wang
GRPO
信用分配
强化学习
自蒸馏
长链推理
证明可复制证据下LLM防护存在能力-安全-开放三难困境。
Pingyu Wu, Lingyao Zhu, Weiming Zhang, Nenghai Yu
LLM安全
可信凭证
安全不可行性
对偶用途防护
对抗鲁棒性
9家公司访谈揭示自动驾驶测试现状并提出证据闭环测试框架
Qunying Song, Yuan Gao, Johannes Betz, Dietmar Pfahl, Mohammad Reza Mousavi,...
场景化测试
工业实证研究
测试框架
自动驾驶测试
访谈研究
在中间训练阶段注入宪法内容,让模型获得持久且可泛化的对齐。
Desiree Cho, Cameron Tice, Bernie Hogan, Hunar Batra, Puria Radmard, Jun...
LLM安全
中间训练
宪法式对齐
对齐持久性
课程学习
精修 SULAND 标注并在 35 种检测器上系统评估 RGB 地雷检测的 OOD 鲁棒性。
Sagar Lekhak, Prasanna Reddy Pulakurthi, Lalit Joshi, Ramesh Bhatta, Emmett...
DETR
Faster R-CNN
OOD泛化
RGB图像
UAV/UGV遥感
用3D神经隐式融合NIR与噪声RGB,无需干净RGB监督即可恢复暗光图像
Muyao Niu, Mingze Ma, Yifan Zhan, Qingtian Zhu, Zhihang Zhong, Wei Guo,...
3D融合去噪
位置编码
低光照成像
神经辐射场
神经隐式表征
LLM 易被显眼数值诱饵带偏而忽略隐含物理前提,SaliTrap 揭示这是知识抑制而非缺失。
Zheng Wu, Chenhao Xue, Shijie Zheng, Yijie Lu, Cheng Yang, Zhuosheng Zhang
大模型评测基准
常识推理
推理时干预
显著性偏见
鲁棒性与谄媚
提出能力维持型情感对话范式,关注长期使用中用户能力的维持
Ming Wang, Jiaqi Wu Young, Wenfang Wu, Daling Wang, Shi Feng
AI伴侣治理
位置论文
心理韧性
情感对话
纵向评估
实时采样博弈规划框架,在多车赛车中取得95.24%胜率与10Hz实时性
Zhouheng Li, Fangguo Zhao, Mattia Piccinini, Baha Zarrouki, Yuan Gao, Zitong...
GPU并行
博弈论
自动驾驶赛车
运动规划
迭代最优响应