找到 448 条结果

结合LLM全局推理与RL局部决策的分层自主探索框架,在仿真和真实环境中显著提升探索效率

Shuhao Liao, Xuxin Lv, Jeric Lew, Shizhe Zhang, Jingsong Liang, Peizhuo Li,... 2026-01-22
分层规划 图推理 大语言模型 强化学习 机器人探索

成员推理攻击在语义保持的改写下会失效,不足以作为版权审计的可靠证据。

Murat Bilgehan Ertan, Emirhan Böge, Min Chen, Kaleel Mahmood, Marten van Dijk 2026-01-21
大语言模型 成员推理 改写防御 版权审计 稀疏自编码器

提出从文本语料库直接提取多轮工具使用轨迹的新范式,绕过对预定义工具的依赖

Zhihao Xu, Rumei Li, Jiahuan Li, Rongxiang Weng, Jingang Wang, Xunliang Cai,... 2026-01-19
多轮对话 大语言模型 工具调用 数据合成 自主智能体

利用熵作为自触发信号,在交互过程中动态生成步级经验指导,显著提升网页智能体推理能力

Wenyuan Zhang, Xinghua Zhang, Haiyang Yu, Shuaiyi Nie, Bingli Wu, Juwei Yue,... 2026-01-15
大语言模型 步级指导 熵触发 经验学习 网页智能体

系统综述大语言模型中的记忆机制,构建隐式/显式/智能体记忆三层分类体系

Zixia Jia, Jiaqi Li, Yipeng Kang, Yuxuan Wang, Tong Wu, Quansen Wang, Xiaobo... 2026-01-15
大语言模型 智能体 检索增强生成 综述 记忆机制