← 前一天
2026-09-09
后一天 → 今日

用自然语言指令与音频上下文统一语音生成和编辑的开源基础模型,四步推理提速4.5倍

Ziyang Ma, Zhikang Niu, Wenming Tu, Tianrui Wang, Ruiqi Yan, Junxi Liu,...
偏好优化 开源模型 强化学习 整流流 统一基础模型

用弱教师策略偏移方向放大强学生自身梯度,加速训练并突破教师上限

Youngrok Park, Sangmin Bae, Hojung Jung, Jongwoo Ko, Yunseon Choi, Young Jin...
RLVR 在线策略蒸馏 多教师蒸馏 弱到强泛化 策略梯度缩放

按控制器决策的最大因果触达,把智能体视觉生成统一划分为 L0–L4 五层的综述与评估框架

Yinming Huang, Shuyuan Tu, Xi Yan, Jiahao Zhan, Zihan Yang, Zhen Xing, Hui...
LLM控制器 图像与视频生成 强化学习 智能体视觉生成 综述

首个AI智能体内部威胁检测开放基准:150账户、12威胁、40监控器大规模评测

Aashiq Muhamed, Virginia Smith
AI安全 LLM监控 MITRE ATT&CK 内部威胁检测 智能体评测基准

以可修订的“协调事件”为防御单元,把跨执行监控、政策判定与重启后遏制变成可证伪的实验问题

Gregory N Frank
入侵检测与响应 共识主动性 多智能体系统 安全立场论文 智能体安全