找到 191 条结果

系统性综述LLM在线策略蒸馏(OPD)的理论框架、方法分类、失败模式和工业实践

Mingyang Song, Mao Zheng 2026-04-02
在线策略学习 大语言模型 强化学习 模仿学习 知识蒸馏

首个任务和策略无关的主动视觉基础模型,用Canvas注意力实现高效序列推理

Yohaï-Eliel Berreby, Sabrina Du, Audrey Durand, B. Suresh Krishna 2026-03-25
Vision Transformer 主动视觉 基础模型 知识蒸馏 计算机视觉

用 mLSTM-SWA 混合架构蒸馏 Transformer,通过专家合并实现近乎无损的性能迁移

Lukas Hauzenberger, Niklas Schmidinger, Thomas Schmied, Anamaria-Roberta... 2026-03-17
xLSTM 模型压缩 知识蒸馏 线性注意力 高效推理

通过跨模态对齐将DINOv2转变为能统一处理RGB、深度、分割等多模态输入的视觉编码器

Rishabh Kabra, Maks Ovsjanikov, Drew A. Hudson, Ye Xia, Skanda Koppula,... 2026-03-13
对比学习 知识蒸馏 自监督学习 视觉编码器 跨模态学习

4B参数医疗智能体通过行为蒸馏实现离线部署,性能媲美前沿大模型

Yixiong Chen, Xinyi Bai, Yue Pan, Zongwei Zhou, Alan Yuille 2026-03-12
医疗AI 多模态 工具调用 智能体 知识蒸馏

用自身简洁行为蒸馏模型,无需标注即压缩推理token并提升准确率

Hejian Sang, Yuanda Xu, Zhengze Zhou, Ran He, Zhipeng Wang, Jiachen Sun 2026-03-06
大语言模型 强化学习替代方案 推理优化 推理压缩 知识蒸馏