提出以人的状态轨迹为核心对象的智能体新范式,主张在保护人类能动性前提下提供纵向支持。
Qianggang Ding, Xingyao Wang, Rui Feng, Zhibin Wang, Feixiang Wang, Kelong...
AI治理
个人世界模型
人本AI
智能体范式
立场论文
将视频模型的最终去噪潜变量直接映射为4D动态场景,绕过RGB解码,单checkpoint跨生成器复用
Zihao Liu, Xiaolong Shen, Zhenglin Zhou, Ruijie Quan, Yi Yang
3D重建
4D生成
前馈重建
潜空间接口
视频扩散模型
首篇以协同进化为核心的智能体系统综述,提出从智能体互适应到进化机制自主可进化的三阶段分类法
Qing Zong, Jiayu Liu, Junhao Shen, Zecong Tang, Linsi Wu, Yuxuan Liu, Rui...
协同进化
多智能体强化学习
开放式学习
智能体系统
综述
仅凭闭合状态单次观测,网格锚定交叉验证多模型输出,重建部件与关节参数
Daeun Lee, Jaeah Lee, Woosung Kim, Haebeom Jung, Jaesik Park
3D重建
数字孪生
视觉语言模型
视频扩散模型
铰接物体
以跨任务与跨谱系的比较证据改造自修改算子,Polyglot 成绩从50.8%升至93.2%
Changzhi Liu, Yilun Liu, Sikuan Yan, Volker Tresp, Yunpu Ma
LLM智能体
编码智能体
自进化系统
进化搜索
递归自改进
用对抗学习的动态表征补足静态Fréchet目标盲区,抑制Fréchet hacking
Mingju Gao, Jingkai Zhou, Kun Gai, Changqian Yu, Hao Tang
Fréchet距离
一步生成
分布匹配
后训练
对抗训练
200个多周生活任务基准,七个前沿模型最高仅32.5分
Xiaohongshu Inc
基准测试
智能体评测
环境仿真
生活助手
长程任务
让全模态对话模型不仅开口说话,还能以参考形象生成口型同步的视频回应
Haoyu Zhang, Zhipeng Li, Xiaoying Tang, Tianshu Yu, Yiwen Guo
全模态对话
扩散模型
流式生成
知识蒸馏
语音合成
把技能视为类型化契约,用最短忠实解释实现免评估、保稀有的技能压缩
Xiaofan Bai, Hongqiang Lin, Chao Liu, Yantao Zhang, Xuan Jin, Xipeng Cao, Yuhong Li
LLM智能体
上下文工程
技能压缩
提示压缩
最小描述长度
GRPO无参考奖励+SFT-RL插值,46语言翻译比肩GPT-5
Chris Han, Pengzhi Gao, Pei Fu, Jian Luan
GRPO
在线策略蒸馏
多语言LLM
强化学习
机器翻译
解码时屏蔽词首高频token迫使模型迂回表达,测其偏离惯常路径后的推理韧性
Tadanobu Chuyo Kamijo, Ori Rottenstreich, Javier Conde, Gonzalo Martínez,...
LLM鲁棒性
logit屏蔽
指令对齐
解码干预
评测诊断
用校准流量驱动的专家合并把推荐MoE压缩为更小的标准MoE,近无损且提速至2.21倍
Lei Xin, Bin Gu, Peize Li, Zitong Wang, Jianbo Zhao, Changjiang Jiang,...
专家合并
推理加速
推荐系统
模型压缩
混合专家MoE
系统比较三阶段边际价值剪枝:早期剪枝最多省73% token且质量基本不变,无单一方法全面占优
Harshitha Kolukuluru, Reshma Ashok, Kirat Arora, Evan William Ciccarelli,...
LLM智能体
上下文剪枝
效率优化
检索增强生成
深度研究智能体
首个评测LLM移动助手跨应用检索分散个人信息的基准,最强模型准确率仅57.3%
Junjie Ye, Zhuohui Sheng, Shaofan Liu, Yulun Zhu, Wenjie Fu, Dingwei Zhu,...
LLM智能体
信息检索
工具调用
移动助手
评测基准
低分辨率通读全文、按需放大关键区域,让8B模型在长文档问答上同时更准、更快、更少幻觉
Kaican Li, Weiyan Xie, Lewei Yao, Jiannan Wu, Lanqing Hong, Yongxiang Huang,...
主动感知
以图思考
多模态大模型
强化学习
视觉智能体
用单个8B教师同时蒸馏查询端与文档端,得到524M端到端单向量视觉文档检索器
Zhuchenyang Liu, Ziyi Wang, Yao Zhang, Yu Xiao
单向量检索
多模态嵌入
检索增强生成
模型压缩
知识蒸馏
统一时间序列数据集相似度基准的工具箱,揭示相似度与下游任务损失高度任务相关
Yen-Ku Liu, Hongjie Chen, Ryan A. Rossi, Franck Dernoncourt
基准测试
数据集相似度
时间序列
时间序列基础模型
迁移学习
602段360°视频重建秋叶原,175个人工任务暴露LMM城市导航远逊人类
Kenta Watanabe, Atsuyuki Miyai, Mizuki Takenawa, Kiyoharu Aizawa, Toshihiko Yamasaki
360°视频
具身智能
基准评测
空间推理
视觉语言导航
用质量校准排序与跨层自蒸馏修复 query 竞争错配,仅改训练、推理零开销,三类分割一致涨点
Fang Li, Yu He, Haoyang Tong, Lichen Ma, Jingling Fu, Wenxiao Fan, Tongxuan...
Mask Transformer
即插即用训练框架
图像分割
知识蒸馏
质量感知排序
首个在真实操作系统内评估端到端数据科学工作流的基准,275个任务,最强模型成功率仅56.7%
Mizanur Rahman, Mohammed Saidul Islam, Ridwan Mahbub, Md Tahmid Rahman...
Agent 基准
OSWorld
执行式评估
数据科学自动化
计算机使用智能体
离线抽取信息金块并切片复用上下文化KV缓存,在100ms尾部延迟预算下兼顾精度与效率
Gyuwan Kim, Cheoneum Park, Tao Yang
KV缓存复用
RAG
多跳问答
推理加速
缓存增强生成
用凹凸互锁拼图构建无歧义基准,揭示VLM几何推理随网格增大全面崩塌
Shawn Li, Wei Yang, Jike Zhong, Jiate Li, Jiawei Yang, You Qin, Ryan Rossi,...
基准评测
空间推理
视觉语言模型
用输入生成的幂律正算子替换注意力的固定双线性形式,训练后坍缩为可缓存的常量算子。
Burc Gokden
Lean形式化验证
Perron–Frobenius理论
大语言模型
学习双线性算子
注意力机制