构建百万级多方言指令数据集并微调LLM可控生成阿拉伯诗歌。
Abdelrahman Sadallah, Kareem Elozeiri, Mervat Abassy, Rania Elbadry, Mohamed...
2026-05-01
LLM评估
LoRA
创意文本生成
指令微调
方言处理
把可控能力当插件,用KV-Cache/LoRA作统一接口注入扩散模型
Zhongjie Duan, Hong Zhang, Yingda Chen
2026-04-30
ControlNet替代
FLUX
KV-Cache
LoRA
可控扩散生成
用人眼校准的感知数据训练风格鲁棒的人脸身份识别器
Kwan Yun, Changmin Lee, Ayeong Jeong, Youngseo Kim, Seungmi Lee, Junyong Noh
2026-04-24
CLIP微调
LoRA
人脸识别
图像风格化
感知度量
用 RDP 算法把隐藏态当成几何轨迹,挑选关键层做稀疏 LoRA 微调
Yusuf Çelebi, Yağız Asker, Özay Ezerceli, Mahmoud ElHussieni, Selva Taş,...
2026-04-22
LoRA
几何分析
参数高效微调
层选择
表示学习
Mixture-of-LoRA-Experts架构在S2ST中复现76%的非语言发声。
Szu-Chi Chen, I-Ning Tsai, Yi-Cheng Lin, Sung-Feng Huang, Hung-yi Lee
2026-04-22
AudioLLM
LoRA
MoE
情感语音合成
语音到语音翻译
用全视角特征指导部分视角,通过LoRA实现多视角3D重建的测试时自进化。
Yuhang Dai, Xingyi Yang
2026-04-16
LoRA
三维重建
多视角几何
测试时自适应
特征一致性
基于 Focus-and-Refine 的区域化图像精修,在用户指定区域内恢复细节且严守背景不变。
Dewei Zhou, You Li, Zongxin Yang, Yi Yang
2026-04-13
LoRA
图像生成
图像编辑
多模态
局部精修
用端到端微调 LLM 从新闻预测供应链中断概率,显著优于 GPT-5 等基线。
Benjamin Turtel, Paul Wilczewski, Kris Skotheim
2026-04-03
LLM微调
LoRA
供应链风险
强化学习
校准
通过token级路由漂移分析与漂移感知的动态MoE扩展,解决VLM持续学习中的灾难性遗忘
Chongyang Zhao, Mingsong Li, Haodong Lu, Dong Gong
2026-03-31
LoRA
参数高效微调
大视觉语言模型
持续学习
混合专家模型
LoRA2让每个LoRA组件自适应学习最优秩,在保持生成质量的同时大幅降低内存消耗
Donald Shenaj, Federico Errica, Antonio Carta
2026-03-24
LoRA
个性化图像生成
参数高效微调
扩散模型
自适应架构
用 Task Vector 表征口音方向,通过缩放与组合实现细粒度口音强度控制和混合口音合成
Thanathai Lertpetchpun, Thanapat Trachu, Jihwan Lee, Tiantian Feng, Dani...
2026-03-13
LoRA
XTTS
任务向量
参数高效微调
口音控制
研究发现VLA模型用LoRA+RL做顺序微调就能避免灾难性遗忘,性能超越复杂CRL方法
Jiaheng Hu, Jay Shim, Chen Tang, Yoonchang Sung, Bo Liu, Peter Stone,...
2026-03-13
Catastrophic Forgetting
Continual Learning
LoRA
Reinforcement Learning
VLA
通过强化学习训练路由器,解决LoRA混合模型中路由权重塌陷问题
Ruizhong Qiu, Hanqing Zeng, Yinglong Xia, Yiwen Meng, Ren Chen, Jiarui Feng,...
2026-03-12
LoRA
参数高效微调
大语言模型
强化学习
混合专家
首个通过In-Context LoRA联合生成个性化音频和视频的方法
Aviad Dahan, Moran Yanuka, Noa Kraicer, Lior Wolf, Raja Giryes
2026-03-12
LoRA
个性化
扩散模型
语音克隆
说话人身份
用Dynamic LoRA提升少数民族语言OCR性能39%-66%
Bonan Liu, Zeyu Zhang, Bingbing Meng, Han Wang, Hanshuo Zhang, Chengping...
2026-02-25
LoRA
OCR
低资源学习
参数高效微调
少数民族语言
提出 LoRWeB,通过可学习的 LoRA 基底和动态编码器组合,实现对未见视觉类比任务的泛化编辑。
Hila Manor, Rinon Gal, Haggai Maron, Tomer Michaeli, Gal Chechik
2026-02-23
Flow Matching
LoRA
参数高效微调
图像编辑
扩散模型
通过可插拔LoRA模块让推理模型主动清理冗余上下文,实现可持续长链推理
Yilun Zheng, Dongyang Ma, Tian Liang, Jiahao Xu, Xinting Huang, Lihui Chen,...
2026-02-12
LoRA
上下文压缩
推理模型
测试时计算
长链推理
用动量混合参数化非线性轨迹,2步即可逼近50步教师模型的生成质量
Zihan Yang, Shuyuan Tu, Licheng Zhang, Qi Dai, Yu-Gang Jiang, Zuxuan Wu
2026-02-12
Flow Matching
LoRA
加速推理
图像生成
模型蒸馏
内在维度是衡量推理策略有效性的新指标,与泛化能力呈强负相关
Archiki Prasad, Mandar Joshi, Kenton Lee, Mohit Bansal, Peter Shaw
2026-02-11
LoRA
chain-of-thought
generalization
intrinsic-dimensionality
reasoning
系统性评估9种LoRA变体,发现适当调参后原版LoRA性能与变体相当
Yu-Ang Lee, Ching-Yun Ko, Pin-Yu Chen, Mi-Yen Yeh
2026-02-06
Hessian分析
LoRA
参数高效微调
大语言模型
超参数优化