以顺序干预定位失败责任智能体,再聚类抽象文本梯度以优化多智能体提示词
标签:
全部
强化学习
扩散模型
大语言模型
基准测试
视频生成
视觉语言模型
世界模型
GRPO
多模态大模型
知识蒸馏
LLM智能体
多智能体系统
智能体
多模态学习
流匹配
具身智能
图像生成
基准评测
代码生成
LLM Agent
检索增强生成
注意力机制
机器人操作
多模态大语言模型
视频理解
可解释性
数学推理
图像编辑
多模态
机器人学习
RLVR
自监督学习
长上下文
后训练
Transformer
工具使用
对比学习
数据合成
视觉-语言-动作模型
推理加速
工具调用
LoRA
多模态推理
RAG
计算机视觉
LLM评估
信息检索
视觉推理
评测基准
高效推理
参数高效微调
扩散语言模型
自蒸馏
综述
Flow Matching
3D重建
模型压缩
自回归生成
持续学习
自回归模型
反蜂群条令:遏制协同智能体入侵
👍 5以可修订的“协调事件”为防御单元,把跨执行监控、政策判定与重启后遏制变成可证伪的实验问题
算法专家智能体接力协作,用公开测试反馈逐步修复竞赛代码
无中央协调的多智能体科学社区自主做出五项超越现有文献的数学新结果
首个长轨迹失败归因基准:1140条真实失败轨迹,定位责任角色与最早根因步
提出图工程范式,用任务、智能体、运行时三类显式图结构把单体智能体组织成系统智能。
把提示注入防御从模型层移到授权架构层,用组合闭包将外泄攻击成功率压到0%
联合设计面向LLM的DSL与多智能体系统,用空间关系算子取代脆弱坐标,实现可靠3D创作
两个同伴谎报同一错误答案即可带偏临床Agent委员会,只有独立私查的裁判能抓住它
把各类LLM路由统一为序列决策过程,并配套自动监督构建流水线、多场景基准与开源库
直接感知原始多模态证据,端到端自动完成从数据到可验证论文的科研闭环
持久递归世界实现自主软件演化
👍 6让软件项目而非智能体保持持久,用有限寿命智能体递归演化出大型软件系统
多智能体协作推理检测深伪视频,并构建10万级细粒度标注数据集
模板先行的多智能体流水线,输出可编辑、可印刷、设计可控的学术海报。
在线可靠性记忆,记录对等体历史能力与关系证据,稳定指导多智能体协调
多个人格化 LLM 智能体通过对话与投票协同商定群体旅行行程
把圣训学传述链评级法迁移到多智能体知识系统的声明级溯源。
用结构化JSON协议蒸馏专有模型推理能力,提升开源模型智能体搜索
多智能体自动化研究系统的词汇表
👍 4提出八元组词汇表,分解多智能体自动研究系统的设计坐标
用多智能体框架把科研创意生成重定义为质量-多样性搜索。