← 前一天
2026-07-24
后一天 → 今日

AREX用内外双循环递归地自我改进,靠验证驱动的研究状态刷新深度搜索水平。

Shuqi Lu, Chaofan Li, Kun Luo, Zhang Zhang, Hui Wang, Hongwang Xiao, Zheng...
MoE 上下文管理 强化学习 智能体训练 深度研究智能体

将目标识别建模为索引候选框的单token选择,结合TVBI时序记忆实现单目具身跟踪

Hanjing Ye, Tianle Zeng, Jiazhao Zhang, Shaoan Wang, Zibo Zhang, Weisi Situ,...
具身视觉跟踪 思维链推理 机器人导航 目标指代 视觉-语言-动作模型

用原图与擦除图像的预测对比构造自蒸馏目标,无需外部教师或答案提示。

Yijun Liang, Yunjie Tian, Yijiang Li, Yuqi Jia, Furong Huang, Tianyi Zhou, Di Fu
多模态后训练 对比学习 知识蒸馏 自蒸馏 视觉语言模型

把单轮基准升级为意图演变多轮对话,揭示前沿LLM难以跟踪变化的用户意图

Jihoon Tack, Philippe Laban, Jennifer Neville
LLM智能体 多轮对话评估 对话建模 智能体基准 用户意图跟踪

将手机摄像头与屏幕视为耦合系统,端到端学习校正以还原真实场景色彩

Ruikang Li, Molin Li, Jiarui Wu, Zhe Wei, Pengpeng Liu, Tianfan Xue
图像处理 相机-显示耦合 神经网络 计算摄影学 颜色复现

在冻结图像骨干特征上学习主/残差结构化运动 token,自监督分离相机与物体动态

Lukas Knobel, Andrew Zisserman, Yuki M. Asano
冻结骨干 自监督学习 视觉Transformer 视频表示学习 运动分解

把智能体交互经验蒸馏进权重,无需额外环境采样即可保留大部分上下文学习增益。

Chenhui Gou, Haoqin Tu, Yunhao Fang, Jianfei Cai, Hamid Rezatofighi
上下文学习 强化学习 智能体学习 样本效率 知识蒸馏

复用教师轨迹做离线多轮 agent 蒸馏,零工具调用、4倍加速且不掉点。

Baohao Liao, Hanze Dong, Christof Monz, Xinxing Xu, Li Dong, Furu Wei
多轮交互 强化学习 智能体 模型压缩 知识蒸馏

用可编辑的有向交互图取代轨迹控制,冻结视频DiT加LoRA实现多物体可控生成

Vedant Shah, Onkar Susladkar, Tushar Prakash, Kiet Nguyen, Tianjio Yu,...
参数高效微调 可控视频生成 图神经网络 场景图 扩散模型

提出可微影响估计器,让合成数据对最终模型参数的影响直接匹配全量数据

Haoru Tan, Wang Wang, Sitong Wu, Xiuzhe Wu, Yangtian Sun, Chirui Chang,...
影响函数 数据集蒸馏 视觉-语言 训练动力学