← 前一天
2026-08-27
后一天 → 今日

300个程序化视觉推理任务+可验证奖励评分器,让视觉生成成为可训练、可验证、可优化的推理媒介

Junxiang Xu, Ruisi Wang, Fanyi Pu, Maijunxian Wang, Ran Ji, Tongxi Zhou,...
交错生成 原生视觉推理 可验证奖励 基准测试 强化学习

把提示深度从单一标量改为在线估计的高斯分布,零额外采样实现每任务自适应引导

Zixuan Wang, Yanrui Miao, Zhengxi Lu, Teng Pan, Yiwen Qiu, Hongxing Li, Peng...
GRPO 奖励稀疏 智能体强化学习 课程学习 长视野任务

编码智能体中途换模需缴交接税:升级收不回一半质量差距且常不如重启,降档反而划算

Roy Ganz, Mor Shpigel Nacson, Adi Kalyanpur, Ron Litman
LLM智能体 SWE-bench 实证研究 成本-质量权衡 模型切换与交接

把效应与余效应提升为运行时机制,为动态组件组合提供可逆撤销与响应式依赖的形式基础

Yifan Shi, Wei Zhang, Tianyi Cui
AI智能体框架 动态组合 形式化方法 插件架构 效应系统

以因果自回归建模实现流式语音驱动的低延迟实时共语手势生成与自进化

Wentao Jiang, Youchen Xie, Haidi Fan, Yajing Chen, Xin Wang, Ye Shi, Jingya Wang
在线共语手势生成 数字人 流式实时交互 自回归动作生成 自进化数据闭环

用逐变量超分辨率合成0.1°数据,证明高分辨率预报瓶颈在数据,性能超越IFS-HRES

Yang Zhao, Peisong Niu, Tian Zhou, Ziqing Ma, Guanlong Ma, Rong Jin, Huiling...
AI天气预报 ERA5 数据缩放定律 超分辨率 高分辨率预报

同一模型经不同语言接口自博弈对打,实力与策略系统性偏移,英语最强、希伯来语最弱。

Bobby Cheng, Adam Gaber, Zhengyuan Liu, Catherine Arnett, Omer Goldman,...
LLM评估 多语言NLP 文本博弈环境 智能体评测 自博弈

仅凭查询文本为每个查询选择检索管线,比最强静态管线准确率高2.5%、速度快12.4倍

Emre Kuru, Mehmet Onur Keskin, Reza Farahbakhsh, Noel Crespi
RAG 信息检索 多模态检索 效率优化 检索路由