将论文分解为可溯源的原子声明,重构化学跨论文检索的基础设施
标签:
全部
强化学习
扩散模型
大语言模型
基准测试
视频生成
视觉语言模型
世界模型
GRPO
多模态大模型
知识蒸馏
LLM智能体
多智能体系统
智能体
多模态学习
流匹配
具身智能
图像生成
基准评测
代码生成
LLM Agent
检索增强生成
注意力机制
机器人操作
多模态大语言模型
视频理解
可解释性
数学推理
图像编辑
多模态
机器人学习
RLVR
自监督学习
长上下文
后训练
Transformer
工具使用
对比学习
数据合成
视觉-语言-动作模型
推理加速
工具调用
LoRA
多模态推理
RAG
计算机视觉
LLM评估
信息检索
视觉推理
评测基准
高效推理
参数高效微调
扩散语言模型
自蒸馏
综述
Flow Matching
3D重建
模型压缩
自回归生成
持续学习
自回归模型
RAG 范式规模化研究:BM25 在大语料上反超 Agent 与图检索
用有限动作菜单重构检索接口,解决检索等价坍缩
RARG 把相关性作为 rg 执行先验,按文档相关度排序遍历并重排命中,提升智能体搜索准确率与效率
提出InMind基准,证明检索式记忆无法在查询前识别隐式关联的结构性盲区。
用结构化JSON协议蒸馏专有模型推理能力,提升开源模型智能体搜索
多语言RAG中兼顾语义相关性与语言一致性的重排序器
面向工业级金融文档的双语智能体推理基准,揭示当前系统的推理与布局短板。
提出三级九维文档集评估基准与评分准则驱动的免训练选档方法
多步 GraphRAG 引擎配 7B 提取模型,分离抽取与整合,证据召回率达 84%
首个迭代式组件级 RAG 框架,将法规描述转为可执行 Scenic 场景脚本
首个连续第一人称视频主动协助基准 EgoServe 与训练免记忆增强智能体 EgoMemo
基于工作流归纳的多轮智能科学文献搜索
👍 28将科学文献搜索建模为可编辑DAG工作流归纳问题,实现多轮交互式文献检索
通过多轮自适应检索和强化学习优化,显著提升KB-VQA任务的准确率
用冻结LLM的next-token预测损失训练密集检索器,无需标注正负样本对
用主题元数据引导粗粒度检索,实现高效精准的段落级 RAG 系统
理解环境感知信息检索的行为
👍 9通过强化学习让大语言模型适应不同检索器的查询策略
部署在德国大型医院的临床信息提取系统,通过代理式RAG和源文本标注达到96.5%准确率
通过检索驱动的动态工作空间扩展,将DCI扩展到大规模语料库,保持精确交互能力
为长视频RAG提出V-RAGBench基准与CARVE两阶段chunk级决策框架。