找到 188 条结果

立场论文:把交互式评估从基准格式升级为设计科学,提出E:X→Y框架与两轴分类法。

Keyang Xuan, Peiyang Song, Pan Lu, Pengrui Han, Wenkai Li, Zhenyu Zhang,... 2026-05-20
LLM智能体 交互式评估 分类法 基准评测 立场论文

用LLM智能体自主设计混合LLM架构,在1B规模上以原创的AIRAformer和AIRAhybrid结构超越Llama 3.2与Nemotron。

Alberto Pepe, Chien-Yu Lin, Despoina Magka, Bilge Acun, Yannan Nellie Wu,... 2026-05-18
LLM智能体 Mamba/Attention混合 混合模型 神经架构搜索 自动化机器学习

提出可量化指标 ECC 与交错训练策略,系统性解决 LLM 智能体在新环境中的过早利用失败。

Ziang Ye, Wentao Shi, Yuxin Liu, Yu Wang, Zhengzhou Cai, Yaorui Shi, Qi Gu,... 2026-05-18
GRPO LLM智能体 强化学习 环境理解 自主探索

LLM驱动的多智能体预测框架,分宏观与微观双视角合成预测

Sarkar Snigdha Sarathi Das, Palash Goyal, Mihir Parmar, Nanyun Peng, Vishy... 2026-05-15
LLM智能体 多智能体系统 多模态推理 时间序列基础模型 时间序列预测

面向长会话智能体的记忆评测基准,揭示所有系统依赖推理崩塌。

Seokwon Jung, Alexander Rubinstein, Arnas Uselis, Sangdoo Yun, Seong Joon Oh 2026-05-13
DAG知识图谱 LLM智能体 依赖推理 记忆系统 评测基准