提出图工程范式,用任务、智能体、运行时三类显式图结构把单体智能体组织成系统智能。
Yuyuan Feng, Zhishang Xiang, Chaobin Yang, Qichao Ma, Zerui Chen, Yujing...
LLM智能体
图工程
多智能体系统
智能体编排
系统智能
μP宽度迁移+token缩放律两步法,从代理模型外推万亿token级MoE最优学习率
Nayeon Kim, Hojin Lee, Yunju Bak, Jaesun Park, Boseop Kim
MoE
Muon优化器
μP
大规模预训练
缩放律
冻结流式生成器,适配器在编辑到达时点火,无限轮指令编辑质量不衰减
Yunze Tong, Mushui Liu, Canyu Zhao, Shiyi Zhang, Didi Zhu, Peng Zhang,...
参数高效微调
扩散模型
自回归流式生成
视频生成
视频编辑
用时序置信度做异步分支控制,并行推理延迟降低21.8–32.2%
Xuteng Zhang, Wenhao Zeng, Xiaodong Gu, Chao Hu, Haotian Lin, Yuling Shi,...
LLM推理控制
并行推理
推理优化
测试时扩展
高效推理
PatternEval诊断基准与PatternRL训练对齐混合思考MLLM的响应行为
Xinming Wang, Weinong Wang, Hongming Yang, Yansong Lin, Zheng Ruan, Shangpin...
基准评测
多模态大模型
奖励模型
强化学习
混合思考
以先验知识固定交互路径并逆向改造网络视频,系统评测全模态大模型的实时视频助手能力。
Xianyun Sun, Chaoyou Fu, Zhengye Zhang, Feiyang Duan, Qingyuan Cao, Yonghui...
全模态大模型
多轮交互
流式视频理解
视频助手
评测基准
OPD迁移的是教师推理行为而非答案,同源才能整体对齐策略,多教师路由因此产生跷跷板效应
Zhaoyi Li, Deyang Kong, Yuan Wei, Evan Yang, Ranran Shen, Mahardika Krisna...
在线策略蒸馏
多教师蒸馏
大语言模型后训练
泛化分析
知识迁移
补丁重参数化让冻结语义ViT兼得理解与重建,单一视觉空间支撑生成与编辑
Jinbo Yan, Limeng Qiao, Jie Qin, Junyan He, Feize Wu, Guanglu Wan
图像生成
图像编辑
流匹配
统一多模态模型
视觉tokenizer
首个把状态重建与 NPC 决策从视频生成中解耦的四层闭环游戏世界模型
Zhiyang Deng, Boran Zhang, Danze Chen, Yeying Jin
LLM智能体
NPC行为
实时交互生成
游戏世界模型
视频扩散模型
提出PLANET角色从业务场景合成可执行可验证环境,训练出的策略在域内外基准均显著提升。
Minbyul Jeong, Chanwoong Yoon
世界构建
业务工作流
工具使用
智能体强化学习
环境合成
把查询解析为六槽位的必需/禁止/可忽略证据,用确定性评分加列表式校验重排图像
Enjun Du, Siyi Liu, Zirong Chen, Xinyu Zuo, Jinwen Luo, Ruiwen Tao, Lisheng...
MLLM
图像重排
多模态检索
知识蒸馏
约束满足
响应耦合分区+探针残差重构,22–26%密度下免训练稀疏注意力加速视频生成1.48–2.61倍
Pardis Taghavi, Reza Langari, Gaurav Pandey
世界模型
免训练方法
推理加速
稀疏注意力
视频生成
提出六层级人类情境分类法,系统梳理基础模型时代以人为中心智能的方法、数据与评测。
Yang Chen, Tianqi Wang, Xiaorui Jiang, Yilei Man, Yihua Shao, Mengyuan Liu,...
世界模型
交互建模
人体感知与生成
以人为中心智能
具身智能
自蒸馏QAT与S3D8格式将11B VLM压至3.7GB,Arm CPU手机端高效推理
Luka Ribar, Jeevan Bhoot, Douglas Orr
向量量化
模型量化
知识蒸馏
端侧推理
视觉语言模型
针对单用户CPU解码反向设计的卷积-注意力混合小模型,长上下文解码最高提速2.08倍
Christos Koutsiaris
CPU推理
小语言模型
混合架构
量化
高效推理
以像素级动作流为共享接口,统一跨本体世界建模、开环策略评估与逆向机器人控制
Hongyu Li, Bowen Wen, Xinghao Zhu, Yixuan Wang, Yilun Du, Yunzhu Li, George...
世界模型
扩散模型
机器人操控
策略评估
视频生成
RecVerse用认知分层记忆与轨迹级强化学习,在真实GUI环境中忠实模拟人类购物行为
Jiakai Tang, Yan Mi, Jing Yu, Yang Zhang, See-Kiong Ng, Qi Cao, Fei Sun, Xu...
GUI智能体
大语言模型智能体
强化学习
推荐系统
用户行为模拟
用轻量隐藏态门控连续调节安全LoRA强度,将HarmBench攻击成功率降至近零同时保留通用能力
Chengxiao Wang, Enyi Jiang, Xiaojing Liao, Sanmi Koyejo
LLM安全对齐
LoRA
安全-效用权衡
对抗鲁棒性
条件计算
匹配暴露实验显示信息流使LLM智能体词汇趋同,但四账号协同攻击无立场优势
Rana Muhammad Usman, Dominic Williamson
LLM智能体
平台风险
社会模拟
统计推断
预注册实验
免训练质量/刚度估计加双智能体探索,让机器人主动摸出隐藏物理属性。
Chen-Yu Lin, Jing-Wen Chen, Hsueh-En Chang, Hung-An Chen, Sheng-Hsun Chang,...
Code-as-Policy
VLM智能体
主动感知
机器人操作
物理属性估计
把烹饪环境编译成稠密答案表,免裁判地为27个前沿模型连续评分排名,并验证监督可迁移
Josef Chen, Erim Hayretci
LLM评测
LoRA后训练
可执行基准
奖励图谱
排行榜方法
批判性评估圣训计算在LLM时代的真实进展、结构性缺口与五大研究议程
Md. Ashraful Haque, Riasat Islam
AI伦理
圣训NLP
大语言模型
知识图谱
综述