找到 101 条结果

把LSM的调解-策略-执行分离搬进LLM推理服务,让可解释性信号变成可运行的输出门禁。

XiuYu Zhang, Bonan Ruan, Junfeng Fang, An Zhang, Tat-Seng Chua, Zhenkai Liang 2026-08-31
LLM安全 可解释性 推理服务 系统安全 运行时防御

轻量适配器把冻结视觉-语言模型对齐到冻结人脸识别空间,提示词变语义锚点,无标注完成解释与审计。

Guray Ozgur, Mustafa Efe Tamyapar, Naser Damer, Fadi Boutros 2026-08-25
事后对齐 人脸识别 可解释性 模型审计 视觉-语言模型

提出三类行为探测与因果干预,量化并揭示ASR模型对公开基准的过拟合

Theo Lebryk, David Ayllon, Alice Baird, Jakub Piotr Cłapa, Jens Madsen,... 2026-08-21
可解释性 基准优化 模型评估 语音识别

分层智能体评测流水线把世界模型评分变成可审计的证据树,判断与人类高度一致

Weiliang Chen, Haowen Sun, Jun Gao, Jiawei Chi, Hanyang Wang, Qiyu Dai,... 2026-08-18
VLM-as-Judge 世界模型 可解释性 智能体评测 视频生成

模型无关框架,归因多模态临床AI的逐模态失效并区分显性与隐性失效

Quang Bui, Shlok Jaiswal, Samuel Paik-Heintz, Kevin Zhou, Kaushik Madapati,... 2026-08-04
临床AI 可解释性 多模态融合 失效分析 心脏基础模型

Chat模板token是DiT的隐式语义寄存器:语义走S→I→R间接回路,据此剪枝省20%注意力算力

Maohua Li, Qirui Li, Yanke Zhou, Yiduo Li, Zhaosheng Chi, Chao Xu, Cuifeng... 2026-07-22
可解释性 扩散模型 文本到图像生成 模型加速 注意力机制