找到 448 条结果

提出OEL框架,让语言模型从部署经验中持续自我改进

Tianzhu Ye, Li Dong, Qingxiu Dong, Xun Wu, Shaohan Huang, Furu Wei 2026-03-18
上下文蒸馏 在线学习 大语言模型 强化学习 持续学习

MoDA:通过跨层深度KV注意力解决LLM深度扩展中的信息稀释问题

Lianghui Zhu, Yuxin Fang, Bencheng Liao, Shijie Wang, Tianheng Cheng, Zilong... 2026-03-17
Transformer架构 大语言模型 注意力机制 深度扩展 硬件优化

LLM展现类人动机结构:自报告动机可预测行为与表现

Omer Nahum, Asael Sklar, Ariel Goldstein, Roi Reichart 2026-03-17
LLM对齐 人机交互 动机心理学 大语言模型 行为分析

提出针对长期记忆检索的嵌入模型评估框架,涵盖4类记忆、22个数据集、193个检索任务

Xinping Zhao, Xinshuo Hu, Jiaxin Xu, Danyu Tang, Xin Zhang, Mengjia Zhou,... 2026-03-16
向量检索 基准测试 大语言模型 文本嵌入 记忆检索

提出关联创造力基准,通过知识图谱路径生成评估LLM的创意联想能力

Manya Wadhwa, Tiasa Singha Roy, Harvey Lederman, Junyi Jessy Li, Greg Durrett 2026-03-13
创造力评估 基准测试 大语言模型 推理能力 知识图谱

通过压缩LLM潜在响应生成输出空间嵌入,无需标注数据

Parishad BehnamGhader, Vaibhav Adlakha, Fabian David Schmidt, Nicolas... 2026-03-12
信息检索 大语言模型 文本嵌入 自监督学习 表征学习