找到 118 条结果

在零目标任务经验下,通过提议者引导的合成练习与验证门控的记忆准入,构建部署前的程序性记忆。

Yumin Choi, Sangwoo Park, Minki Kang, Jinheon Baek, Sung Ju Hwang 2026-05-15
Agent Memory Cold Start LLM Agent Self-Play Synthetic Practice

用书签式问答对在长剧情中按需检索与增量同步,让角色扮演智能体既保留细节又省算力

Letian Peng, Ziche Liu, Yiming Huang, Longfei Yun, Kun Zhou, Yupeng Hou, Jingbo Shang 2026-05-15
LLM Agent 剧情理解 检索增强生成 角色扮演智能体 长上下文记忆

用纯动作数据(无推理链)作参考引导,突破智能体RL的可达性壁垒,无需SFT冷启动即可比肩SFT+RL流程。

Yuxiang Ji, Zengbin Wang, Yong Wang, Shidong Yang, Ziyu Ma, Guanhua Chen,... 2026-05-14
LLM Agent 免SFT冷启动 动作引导 可达性壁垒 搜索Agent

为上下文优化器装上浏览器与维基百科工具,用束搜索训练消解检索噪声。

Zeyu Huang, Adhiguna Kuncoro, Qixuan Feng, Jiajun Shen, Lucio Dery, Arthur... 2026-05-14
LLM Agent RAG 上下文优化 信息检索 推理增强

用强化学习训练技能策展器,让 LLM 智能体在长任务流中持续积累并精炼可复用技能。

Siru Ouyang, Jun Yan, Yanfei Chen, Rujun Han, Zifeng Wang, Bhavana Dalvi... 2026-05-08
LLM Agent Procedural Memory Reinforcement Learning Self-Evolution Skill Curation