找到 60 条结果

系统研究高效推理训练机制,通过数据、奖励和优化策略实现更短、更准确的推理链生成

Taiqiang Wu, Zenan Zu, Bo Zhou, Ngai Wong 2026-02-25
大语言模型 奖励塑形 强化学习 推理链优化 高效推理

利用 RoPE 频率块的功能稀疏性,训练无关地动态预测 token 重要性以压缩 KV 缓存

Yifei Wang, Yueqi Wang, Zhenrui Yue, Huimin Zeng, Yong Wang, Ismini... 2026-02-05
KV缓存压缩 RoPE 注意力稀疏化 长上下文 高效推理

通过回收被丢弃的中间计算信号,显著提升扩散语言模型的推理准确率

Yuezhou Hu, Harman Singh, Monishwaran Maheswaran, Haocheng Xi, Coleman... 2026-02-05
并行解码 扩散语言模型 数学推理 残差学习 高效推理

紧凑高效的指令式图像编辑系统,2B VLM+1.6B扩散模型,4秒生成2K图像

Grigorii Alekseenko, Aleksandr Gordeev, Irina Tolstykh, Bulat Suleimanov,... 2026-01-16
图像编辑 扩散模型 指令跟随 视觉语言模型 高效推理

让小模型主动调用大模型,用1.07%的token成本恢复60%性能差距

Chengsong Huang, Tong Zheng, Langlin Huang, Jinyuan Li, Haolin Liu, Jiaxin Huang 2026-01-09
GRPO token-level路由 强化学习 模型协作 高效推理