提出不确定性感知多智能体框架,让 LLM 编码代理像人类开发者一样识别指令缺失并主动提问。
标签:
全部
强化学习
扩散模型
大语言模型
基准测试
视频生成
视觉语言模型
世界模型
GRPO
多模态大模型
知识蒸馏
LLM智能体
多智能体系统
智能体
多模态学习
流匹配
具身智能
图像生成
基准评测
代码生成
LLM Agent
检索增强生成
注意力机制
机器人操作
多模态大语言模型
视频理解
可解释性
数学推理
图像编辑
多模态
机器人学习
RLVR
自监督学习
长上下文
后训练
Transformer
工具使用
对比学习
数据合成
视觉-语言-动作模型
推理加速
工具调用
LoRA
多模态推理
RAG
计算机视觉
LLM评估
信息检索
视觉推理
评测基准
高效推理
参数高效微调
扩散语言模型
自蒸馏
综述
Flow Matching
3D重建
模型压缩
自回归生成
持续学习
自回归模型
多智能体框架将小时级原始素材自动剪辑为音乐同步的精剪短视频
生成式多智能体系统中涌现的社交智能风险
👍 52首个系统性研究LLM多智能体系统中15种涌现社交风险的实证工作
提出信用原生的人-智能体协作市场,实现任务、资产与激励的闭环
通过持久共享视觉契约协调多智能体,将研究故事转化为结构化学术手稿
提出多智能体框架协调记忆构建、检索和利用的全循环,解决战略盲视和延迟监督问题
提出多智能体协作框架解决流式视频理解中的实时推理、长期记忆和主动交互三大挑战
提出CareFlow基准和CarePilot框架,实现医疗软件长视野任务自动化
用计算图视角统一LLM工作流优化,按结构确定时机分类77篇文献并提出评估协议
受干细胞启发的多协议 AI 智能体框架,支持 5 种互操作性协议
异步软件工程代理的有效策略
👍 6提出CAID框架,基于SWE原语实现多代理分支合并协作
用多智能体框架从2D模型提取隐式3D知识生成连贯3D场景
通过意图感知路由和多智能体工具架构,实现可靠的伊斯兰知识问答系统
提出SCIENCECLAW+INFINITE框架,让自主AI智能体通过工件交换实现分布式科学协作与发现
通过持久记忆和自进化机制,让多智能体AI科学家从失败中学习并持续提升研究能力
通过多智能体问答框架实现视频生成的评估与迭代优化
首个评估多智能体长时序第一人称视频理解能力的问答基准及基线模型
多智能体竞争框架自动生成1-2分钟喜剧小品视频
通过分层并行架构和博弈协议解决LLM在长期规划中的约束漂移问题,FPR达52.65%
提出双层架构Mozi,通过治理控制平面和状态化技能图将LLM代理转变为可靠的药物发现协同科学家