找到 188 条结果

25,000+ 次实验揭示 LLM 智能体执行工作流却不会科学推理

Martiño Ríos-García, Nawaf Alampara, Chandan Gupta, Indrajeet Mandal, Sajid... 2026-04-23
AI for Science LLM智能体 基准测试 科学推理 认知评估

端到端语音模型集成推理与工具调用,任务完成率从34.88%提升至74.57%。

Tianle Liang, Yifu Chen, Shengpeng Ji, Yijun Chen, Zhiyang Jia, Jingyu Lu,... 2026-04-21
LLM智能体 多智能体系统 工具调用 思维链推理 端到端语音对话

自动识别智能体能力缺失并合成针对性训练环境的端到端系统

Hangoo Kang, Tarun Suresh, Jon Saad-Falcon, Azalia Mirhoseini 2026-04-14
LLM智能体 LoRA路由 合成环境 强化学习 能力分解

揭示多轮LLM Agent RL中推理表面多样但输入无关的「模板坍缩」,并提出MI诊断与SNR过滤。

Zihan Wang, Chi Gui, Xing Jin, Qineng Wang, Licheng Liu, Kangrui Wang, Shiqi... 2026-04-09
LLM智能体 PPO/GRPO 互信息 信噪比 强化学习

首个把形式化约束与自演化LLM智能体结合的端到端验证合成框架

Debangshu Banerjee, Changming Xu, Gagandeep Singh 2026-04-09
LLM智能体 形式化验证 神经符号方法 程序合成 约束学习