找到 114 条结果

用自主编程智能体替代进化搜索中的变异算子,生成超越专家优化的GPU注意力内核

Terry Chen, Zhifan Ye, Bing Xu, Zihao Ye, Timmy Liu, Ali Hassani, Tianqi... 2026-03-27
GPU内核优化 大语言模型 注意力机制 自主智能体 进化计算

统一框架支持任意离散扩散,首次大规模超越自回归

Oussama Zekri, Théo Uscidda, Nicolas Boullé, Anna Korba 2026-03-24
扩散模型 注意力机制 生成式模型 离散扩散 语言建模

首个相机条件约束的立体世界模型,联合学习外观与双目几何,实现端到端立体视频生成

Yang-Tian Sun, Zehuan Huang, Yifan Niu, Lin Ma, Yan-Pei Cao, Yuewen Ma, Xiaojuan Qi 2026-03-19
世界模型 扩散模型 注意力机制 相机控制 立体视频生成

MoDA:通过跨层深度KV注意力解决LLM深度扩展中的信息稀释问题

Lianghui Zhu, Yuxin Fang, Bencheng Liao, Shijie Wang, Tianheng Cheng, Zilong... 2026-03-17
Transformer架构 大语言模型 注意力机制 深度扩展 硬件优化

大规模人体数据集+非对称注意力,实现跨视角身份一致视频生成

Qin Guo, Tianyu Yang, Xuanhua He, Fei Shen, Yong Zhang, Zhuoliang Kang,... 2026-03-09
扩散模型 数据集构建 注意力机制 视频生成 身份保持

通过QK-norm和降低每步token数,使INT8注意力训练匹配全精度效果

Jintao Zhang, Marco Chen, Haoxu Wang, Kai Jiang, Ion Stoica, Joseph E.... 2026-03-06
Transformer 低比特量化 效率优化 模型训练 注意力机制