用Wikipedia引用构建1197题GraphRAG基准,多源聚合是优势
标签:
全部
强化学习
扩散模型
大语言模型
基准测试
视频生成
视觉语言模型
世界模型
GRPO
多模态大模型
知识蒸馏
LLM智能体
多智能体系统
智能体
多模态学习
流匹配
具身智能
图像生成
基准评测
代码生成
LLM Agent
检索增强生成
注意力机制
机器人操作
多模态大语言模型
视频理解
可解释性
数学推理
图像编辑
多模态
机器人学习
RLVR
自监督学习
长上下文
后训练
Transformer
工具使用
对比学习
数据合成
视觉-语言-动作模型
推理加速
工具调用
LoRA
多模态推理
RAG
计算机视觉
LLM评估
信息检索
视觉推理
评测基准
高效推理
参数高效微调
扩散语言模型
自蒸馏
综述
Flow Matching
3D重建
模型压缩
自回归生成
持续学习
自回归模型
视觉个性化图灵测试评估框架
👍 2提出VPTT评估范式和VPRAG框架,以感知不可区分性衡量生成模型的上下文视觉个性化能力
通过聚类-对比学习-检索增强生成的三阶段框架,从设计数据中提取风格知识以指导风格化设计改进。
通过层次化语义索引和双路径检索,在固定证据预算下实现高效多文档推理
智能体驱动的超长视频理解
👍 22提出EGAgent框架,通过实体场景图实现跨天超长视频的多跳推理问答
基于多模态检索增强生成的UI设计系统,帮助终端用户通过真实示例进行迭代式界面设计
首个端到端多模态深度研究基准,评估智能体的图文证据整合与报告生成能力
提出为代理搜索设计的检索器训练框架,通过迭代优化提升多跳问答性能
通过有限状态机实现可控自进化,提升深度研究任务的稳定性和性能
通过显式相关性指标调制LLM注意力机制,提升RAG系统对噪声文档的鲁棒性
系统综述大语言模型中的记忆机制,构建隐式/显式/智能体记忆三层分类体系
将GitHub历史经验治理为结构化记忆卡,提升代码智能体修bug能力
通过里程碑记忆+多模态搜索双创新,实现跨平台桌面智能体SOTA性能
提出双层记忆架构SEEM,通过情景事件帧和图记忆解决LLM长期记忆的检索分散问题
搜索增强LLM存在过度搜索问题:不必要的搜索调用增加成本并损害拒绝回答能力