← 前一天
2026-09-08
后一天 → 今日

冻结AR权重、外挂LoRA扩散权重并行起草,AR验证实现全批量无损提速

Subham Sekhar Sahoo, Lingjie Chen, Khiem Pham, Jonathan Geuter, Chaitanya...
LoRA RL后训练加速 一致性蒸馏 扩散语言模型 投机解码

级联嵌入匹配加按需VLM裁决,让文本提示分割既追得稳,又能识破雕像画作等相似干扰。

Javier del Pino, Salvador Rodríguez, Alejandro Garabito, Javier Álvarez,...
3D重建前处理 VLM语义验证 开放词汇分割 文本提示分割 级联推理

把安全对齐从「整题拒绝」细化为学习主题内的拒绝边界,用数据组成控制安全与可用性权衡

Alejo López-Ávila, Iker García-Ferrero, Jezabel Garcia, Antonio Tiene, Román Orús
LLM安全对齐 LoRA微调 数据组成 窄边界拒绝 自生成安全数据