用高保真手持采集替代遥操作,实现零机器人数据的策略训练与直接部署
Simple AI, Yuteng Wei, Jinming Ma, Jiawei Wang, Weitao Zhou, Yushen Zuo, Ke...
UMI数据采集
世界-动作模型
具身智能
数据引擎
机器人操作
用统一的多视图数据系统为代码智能体高效构建、增量维护并按需服务仓库上下文
Zhongming Yu, Hengjia Yu, Boqin Yuan, Shuting Zhao, Yizhao Chen, Aryan...
上下文交付
仓库级代码理解
代码智能体
增量索引维护
数据系统
RARG 把相关性作为 rg 执行先验,按文档相关度排序遍历并重排命中,提升智能体搜索准确率与效率
Jiangnan Li, Yuqing Li, Mo Yu, Jinchao Zhang, Jie Zhou
ripgrep
智能体搜索
检索增强生成
直接语料交互(DCI)
相关性引导
用VLM智能体逐步生长可编辑图层树并逐节点验证修复,从栅格图重建设计文件。
Jooyeol Yun, Jintae Park, Hyesu Lim, Junha Hyung, Hyungjin Chung, Jaegul Choo
可编辑设计重建
图像分层分解
层次化树扩展
矢量化
视觉语言模型智能体
编解码器原生视觉tokenizer+事件门控,4B参数实时流式多模态模型
Senqiao Yang, Kaichen Zhang, Zhaoyang Jia, Jinghao Guo, Yifei Shen, Xinjie...
AI4AI 数据流水线
System 1/2 双系统
VLM
可变分辨率训练
多模态大模型
在学生推理出错处让老师短暂接管再交还,修复在线策略蒸馏的前缀失败
Haolei Xu, Xiaowen Xu, Haiwen Hong, Zixuan Ni, Hongxing Li, Yiwen Qiu,...
在线策略蒸馏
大模型训练
推测解码
推理
知识蒸馏
提出InMind基准,证明检索式记忆无法在查询前识别隐式关联的结构性盲区。
Ruizhe Li, Mingxuan Du, Benfeng Xu, Zhendong Mao
基准测试
智能体记忆
检索增强生成
评测方法论
长期记忆
实时相机可控的视频世界模型,支持图像与视频条件的长程交互探索
Jiacong Xu, Hanwen Jiang, Zhixin Shu, Kalyan Sunkavalli, Vishal M. Patel, Yiqun Mei
实时生成
模型蒸馏
相机控制
稀疏注意力记忆
自回归生成
用图像编辑模型改造任务图片,系统提升视频模型视觉推理能力
Robert Geirhos, Yuxuan Li, Thaddäus Wiedemer, Neha Kalibhat, Zi Wang, Mani...
图像编辑
提示工程
测试时扩展
真实感偏差
视觉推理
3B参数把内容审核统一成yes/no问答,策略自适应且刷新多模态SOTA
Antonia Calvi, Avinash Sooriyarachchi, Giada Pistilli, Guillaume Lample,...
内容审核
多模态
大语言模型
安全分类
数据合成
从42个基准的模型失败中归纳10项原子感知能力并构建3000题评测集
Zichao Lin, Yifeng Xie, Bowen Qu, Haiming Wang, Jia Li, Haoning Wu, Yuhao...
MLLM评测
基准评测
多模态大模型
失败归因
感知幻觉
单一解码器模型实现15种模态间的任意到任意生成
Mingqiao Ye, Zhaochong An, Zhitong Gao, Xian Liu, François Fleuret, Chuan...
任意到任意生成
多模态大模型
流匹配
统一视觉模型
解码器架构
训练并行解码器,用单次前向同时预测多个去噪步的速度,实现少步、高质、高多样性的扩散与流模型蒸馏。
Neta Shaul, Chao Liu, Arash Vahdat, Julius Berner
图像生成
少步采样
扩散蒸馏
流匹配
视频生成
实证揭示动态MAFC基准仍残留17-29%污染并扭曲评测,呼吁更严苛的去污染评估
Haorui He, Xinwen Chen, Dacheng Wen, Reynold Cheng, Francis C. M. Lau, Yupeng Li
LLM评测
动态评测
基准污染
多模态事实核查
证据充分性
让RL真正学会写更快的正确代码:从测试、沙箱、奖励到GRPO全链路改造。
Pierre Chambon, Kunhao Zheng, Juliette Decugis, Benoit Sagot, Gabriel Synnaeve
GRPO
RLVR
代码优化
强化学习
竞赛编程
无需训练的层次化预算分配器,在剪枝前自适应分配音视频保留预算
Haoyang Huang, Wenjie Huang, Tianqi Xu, Hongyaoxing Gu, Kang Tan, Yikai Fu,...
OmniLLM
Qwen2.5-Omni
token压缩
全模态大模型
训练无关
系统诊断小模型PPO对齐的三大失效模式,提出工程化稳定框架与能力余量假说
Md Rezwanul Haque, Md. Milon Islam, Fakhri Karray
LoRA
PPO
RLHF
小语言模型
强化学习
从离线演示中挖掘有向时序代价,弥合 JEPA 训练与规划鸿沟
Jiaxin Bai, Jiaxuan Xiong
JEPA
世界模型
准度量学习
模型预测控制
潜空间规划
用分阶段验证协议定位压缩短文本生成瓶颈,发现编解码器而非生成器决定质量上限
Alexey Gavrilov, Alan-Barsag Gazzaev, Sergey Muravyov
TinyStories
VQ-VAE-2
压缩文本生成
瓶颈分析
码本重建
用代码归纳世界动力学,可仿真、可规划、可解释。
Jiaxin Bai, Jiaxuan Xiong
世界模型
代码世界模型
场景图
机器人操作
模型预测控制
用模型定向重建目标把预训练LM混合的策略解耦成策略对齐的潜在变量
Awni Altabaa, John Lafferty
变分推断
推理策略
模型可解释性
潜在变量模型
策略发现
训练CVE→ATT&CK多标签分类器,证明LLM弱标签无法提升金标准集,并揭示评估协议噪声的陷阱
Cédric Bonhomme, Alexandre Dulaunoy
LLM弱监督
MITRE ATT&CK
RoBERTa
多标签分类
安全漏洞分类
评测编码智能体在改代码前定位所需文件的能力,揭示检索无单一最优解
Bowen Qin, Yi Xie
上下文获取
仓库理解
代码检索
基准评测
编码智能体
用C++/ONNX引擎对比PyTorch,发现关键在运行时而非性能语言,批处理策略更重要
Venkata Naga Sai Vishnu Rohit Pulipaka, Anish Katta, Deva Rohit Reddy Peddireddy
ONNX Runtime
RLHF
torch.compile
奖励模型推理
延迟优化
人在回路迭代引导目标光谱签名,操作员逐轮确认候选,ACE仅需9次检视即找全7处地雷
Sagar Lekhak, Prasanna Reddy Pulakurthi, Emmett J. Ientilucci
人在回路
光谱签名匹配
地雷探测
无人机遥感
高光谱目标检测
BraTS-GLI派生资源:统一八类解剖-病灶标签,解决共病WMH的标签噪声。
Xingyu Xiang, Shuang Hao, Fan Wang, Jianhua Ma, Chunfeng Lian
BraTS
医学图像分割
多模态MRI
数据集
标签噪声
用 Stiefel 流形优化与稳健投影追踪绕开 CPCA 协方差秩亏瓶颈。
Yu-Hsi Chen, Abd-Krim Seghouane
Stiefel流形
公共主成分分析
域不变特征
域泛化
投影追踪
用自适应运动学卡尔曼滤波实现热红外无人机集群的边缘友好实时跟踪。
Yu-Hsi Chen
BoT-SORT
卡尔曼滤波
多目标跟踪
无人机跟踪
热红外
把多专家权重分配建模为离线策略学习,推理时分层融合实现零重训练的通用医学影像分析。
Zihan Li, Feiyang Liu, Dandan Shan, Ruibo Wang, Qingqi Hong
专家路由
测试时自适应
生物医学图像分析
离线策略学习
置信度校准