左脑存事实右脑存情感,134毫秒流式检索让语音助手又快又懂你
Zhifei Xie, Jiaqi Lang, Ze An, Yifan Zhao, Dongchao Yang, Kai Li, Ziyang Ma,...
2026-08-27
RAG
实时语音对话
情感计算
模型蒸馏
流式检索
仅凭查询文本为每个查询选择检索管线,比最强静态管线准确率高2.5%、速度快12.4倍
Emre Kuru, Mehmet Onur Keskin, Reza Farahbakhsh, Noel Crespi
2026-08-27
RAG
信息检索
多模态检索
效率优化
检索路由
因果探针证明宽上下文是陷阱,多轮窄窗口生成带来最高约20个百分点的召回跃升
Peiyang Liu, Xi Wang, Di Liang, Wei Ye
2026-08-25
RAG
上下文归因
因果测量
推理时扩展
搜索多样化
用33维黑盒特征流加BiGRU序列标注检测token级幻觉,AUC较逐token独立分类提升11点
Igor Itkin
2026-08-20
BiGRU
RAG
信息论分析
多信号融合
幻觉检测
用私有审计真值图构建企业QA基准,专考语料中从未明说的组织关系推理
Akrin Zheng, Alexander Wu, Alaia Liu
2026-08-18
RAG
企业问答
多跳推理
知识图谱
评测基准
用查询依赖的权威建模与逐字引用约束,让 RAG 平衡总结意大利十个议会党团立场
Mirko Tritella, Riccardo Pozzi, Matteo Palmonari
2026-08-17
RAG
专家发现
引用忠实性
知识图谱
议会NLP
离线抽取信息金块并切片复用上下文化KV缓存,在100ms尾部延迟预算下兼顾精度与效率
Gyuwan Kim, Cheoneum Park, Tao Yang
2026-08-12
KV缓存复用
RAG
多跳问答
推理加速
缓存增强生成
用字段化布尔检索保留网页结构,智能体检视后只抓取相关章节,更准且更省token。
Shuai Wang, Haodong Chen, Yu Yin, Shengyao Zhuang, Bevan Koopman, Guido Zuccon
2026-08-05
RAG
信息检索
布尔检索
深度研究智能体
网页结构检索
为生命科学 AI 智能体提供自然语言文献检索的知识层。
Luigi Sigillo, Matteo Silvestri, Francesco Tabaro, Rajat Bhatnagar, Syed...
2026-08-03
AI Agent
BM25
Europe PMC
RAG
文献检索
用智能体搜索可执行的文档表示程序,固定BM25下8个检索任务召回率平均提升8.4%
Sam O'Nuallain, Nithya Rajkumar, Ramya Narayanasamy, Hanna Jiang, Shreyas...
2026-07-22
LLM智能体
RAG
信息检索
程序合成
自动优化
首个迭代式组件级 RAG 框架,将法规描述转为可执行 Scenic 场景脚本
Yuan Gao, Wenting Miao, Mattia Piccinini, Haoyu Wang, Qunying Song, Johannes Betz
2026-07-17
CARLA仿真
DSL代码生成
RAG
Scenic语言
场景生成
提出SOLAR:后悔门控准入+Thompson采样淘汰,破解LLM语义检索缓冲上的经典缓存失效
Yushi Sun, Bowen Cao, Wai Lam
2026-07-08
LLM智能体记忆
RAG
Thompson采样
在线学习
竞争比分析
小型语言模型在RAG系统中可媲美大型模型,且无需GPU
Dari Baturova, Elena Bruches, Ivan Chernov, Roman Derunets, Arsenii Fomin,...
2026-07-01
LLM-as-a-Judge
RAG
基准测试
小语言模型
通过gist token压缩+选择性展开实现无需架构修改的长上下文稀疏注意力
Yuzhen Mao, Michael Y. Li, Emily B. Fox
2026-06-29
KV-cache压缩
LLM
RAG
稀疏注意力
长上下文
用强化学习优化文档索引以提升复杂推理检索效果
Yongjia Lei, Nedim Lipka, Zhisheng Qi, Utkarsh Sahu, Koustava Goswami,...
2026-06-25
RAG
信息检索
强化学习
文档增强
检索增强
向LLM代理提供校准的置信度和基础性分数作为遥测信号,改善其检索决策
Ashwin Vinod, Ying Ding, Elias Stengel-Eskin
2026-06-23
Adaptive Retrieval
Calibrated Confidence
LLM Agents
RAG
Verifiers
一个轻量级多语言检索评估基准,通过Nano-sets实现快速模型选择和效率设置对比
Yuichi Tateno
2026-06-23
RAG
信息检索
多语言检索
文本嵌入
评估基准
通过句子级注意力引导的二叉树实现多粒度检索,平均提升信息效率6.1%
Amirhossein Abaskohi, Issam H. Laradji, Peter West, Giuseppe Carenini
2026-06-22
RAG
层次化检索
文档结构学习
注意力机制
长文档检索
提出Latent Memory,将每条多模态证据压缩为一个高维潜在token,实现高效的问答系统
Zhi Zheng, Ziqiao Meng, Hao Luan, Wei Liu, Wee Sun Lee
2026-06-10
RAG
多模态学习
对比学习
知识蒸馏
记忆压缩
通过控制干预审计揭示RAG重写增益主要来自答案字符串暴露而非证据质量改进
Yuejie Li, Yueying Hua, Ke Yang, Li Zhang, Yueping He, Ruiqi Li, Bolin Chen,...
2026-06-09
RAG
因果推断
多跳问答
数据污染
检索增强生成