找到 59 条结果

通过块扩散与自推测解码,把字节级语言模型的推理内存带宽最高砍掉九成。

Julie Kallini, Artidoro Pagnoni, Tomasz Limisiewicz, Gargi Ghosh, Luke... 2026-05-11
字节级语言模型 扩散语言模型 推测解码 推理加速 无分词器

通过分层潜在变量分解将文本生成为连续语义先验传输再条件解码。

Hongcan Guo, Qinyu Zhao, Yian Zhao, Shen Nie, Rui Zhu, Qiushan Guo, Feng... 2026-05-08
分层生成 扩散语言模型 流匹配 潜在变量 非自回归

首次通过内省一致性训练使DLM达到AR模型质量,在15个基准测试中实现3×吞吐量提升

Yifan Yu, Yuqing Jian, Junxiong Wang, Zhongzhu Zhou, Donglin Zhuang, Xinyu... 2026-04-14
并行生成 扩散语言模型 推理优化 自回归模型

通过直接条件蒸馏(DCD)把多步块扩散蒸馏为单步解码,同时用响应非对称扩散(RAD)削减72.3%训练FLOPs,在胸部X光报告生成上实现8倍理论加速和5.1倍实测加速。

Lifeng Chen, Tianqi You, Hao Liu, Zhimin Bao, Jile Jiao, Xiao Han, Zhicai... 2026-04-13
一步式推理 医学影像 扩散语言模型 知识蒸馏 胸部X光报告生成

统一扩散大语言模型后训练与评估的开源框架,支持多种模型家族和RL算法

Jingyi Yang, Yuxian Jiang, Xuhao Hu, Shuang Cheng, Biqing Qi, Jing Shao 2026-04-08
强化学习 扩散语言模型 模型对齐 系统优化 统一框架

通过双层优化引入参数记忆机制,解决扩散语言模型训练与推理不匹配和长上下文注意力稀释问题

Zehua Pei, Hui-Ling Zhen, Weizhe Lin, Sinno Jialin Pan, Yunhe Wang, Mingxuan... 2026-03-24
参数记忆 双层优化 快速权重 扩散语言模型 长上下文

提出StableDRL,通过无条件裁剪和自归一化解决dLLM强化学习中的奖励崩溃问题

Jianyuan Zhong, Kaibo Wang, Ding Ding, Zijin Feng, Haoli Bai, Yang Xiang,... 2026-03-09
GRPO 后训练优化 强化学习 扩散语言模型 训练稳定性