找到 59 条结果

ROSA2 提出词与权重的联合优化框架,将多轮测试时策略适配的准确率提升30%并减少40%对话轮次。

Chenxing Wei, Hong Wang, Ying He, Zhongxiang Dai, Bo Jiang, F. Richard Yu, Yao Shu 2026-03-04
LLM 参数高效微调 多轮对话 提示优化 测试时适配

提出 LoRWeB,通过可学习的 LoRA 基底和动态编码器组合,实现对未见视觉类比任务的泛化编辑。

Hila Manor, Rinon Gal, Haggai Maron, Tomer Michaeli, Gal Chechik 2026-02-23
Flow Matching LoRA 参数高效微调 图像编辑 扩散模型

通过识别和聚类安全相关神经元,实现高效的后置安全对齐,大幅减少训练参数并保持模型能力。

Sasha Behrouzi, Lichao Wu, Mohamadreza Rostami, Ahmad-Reza Sadeghi 2026-02-20
参数高效微调 大语言模型安全 安全对齐 神经元级干预 越狱防御

从量子纠缠视角分析LoRA微调的内部参数结构与外部注意力表示,揭示注意力机制的‘无毛’特性。

Min Chen, Zihan Wang, Canyu Chen, Zeguan Wu, Manling Li, Junyu Liu 2026-01-13
参数高效微调 大语言模型 矩阵乘积态 纠缠熵 量子信息

动态分配专家LoRA秩,基于路由频率和梯度重要性提升MoE微调效果

Guanzhi Deng, Bo Li, Ronghao Chen, Xiujin Liu, Zhuo Han, Huacan Wang, Lijie... 2026-01-12
LoRA 动态秩分配 参数高效微调 大语言模型 混合专家模型