找到 114 条结果

利用Fisher-Rao距离检测注意力转移,动态重加权token级优势以提升MLLM跨模态推理。

Hangui Lin, Yan Shu, Zhengyang Liang, Chi Liu, Xiangrui Liu, Minghao Qin,... 2026-06-11
多模态大模型 强化学习 注意力机制 视觉推理 跨模态协调

首个在消费级GPU上实现实时1080p视频恢复的单步生成模型

Jiaqi Yan, Xiangyu Chen, Xinlin Zhong, Haibin Huang, Chi Zhang, Jie Liu,... 2026-06-09
实时推理 注意力机制 生成式模型 视频恢复

揭示图语言模型中图sink token的激活模式与语义效用解耦现象

Ding Zhang, Runtao Zhou, Wenqing Zheng, Rizal Fathony, Bayan Bruss, Chirag Agarwal 2026-06-04
Transformer分析 图表示学习 图语言模型 机制可解释性 注意力机制

将注意力重新解释为函数空间之间的线性算子,实现高效且分辨率无关的算子学习

Jiefang Xiao, Maolin Gao, Simon Weber, Guandao Yang, Daniel Cremers 2026-06-04
PDE求解 函数映射 注意力机制 神经网络算子 算子学习