找到 188 条结果

提出MAXS元自适应推理框架,通过前瞻策略和轨迹收敛机制解决LLM智能体的短视推理和路径不稳定问题

Jian Zhang, Zhiyuan Wang, Zhangqi Wang, Yu He, Haoran Luo, li yuan, Lingling... 2026-01-15
LLM智能体 工具增强推理 推理优化 推理策略 测试时扩展

提出PSN框架,让智能体通过可执行符号程序持续获取、精炼和重用技能

Haochen Shi, Xingdi Yuan, Bang Liu 2026-01-08
LLM智能体 具身智能 强化学习 持续学习 程序合成