通过学习最小充分域表示,从少量参考样本生成高质量领域特定数据
Tong Ye, Hang Yu, Tengfei Ma, Xuhong Zhang, Jianguo Li, Peng Di, Peiyu Liu,...
2026-06-03
对比学习
提示调优
数据合成
领域适应
在冻结MERT上训练旋律/节奏/音色三解耦头,实现可控可解释的音乐相似度。
Abhinaba Roy, Junyi Liang, Dorien Herremans
2026-06-03
对比学习
条件音乐生成
解耦表示
音乐信息检索
音频相似度
仅用轨迹级监督就能发现失败动作,VLA失败检测SOTA
Seongheon Park, Wendi Li, Changdae Oh, Samuel Yeh, Zsolt Kira, Michael...
2026-06-01
VLA
失败检测
对比学习
机器人
粗监督学习
用 Gemini 多模态底座统一文本/图像/视频/音频的稠密嵌入表示。
Madhuri Shanbhogue, Zhe Li, Shanfeng Zhang, Gustavo Hernández Ábrego,...
2026-05-27
Gemini
MTEB
RAG
多模态嵌入
对比学习
将英语对比偏好调优扩展到多语言场景,无需为每种语言单独标注偏好数据
Mike Zhang, Ali Basirat, Desmond Elliott
2026-05-27
DPO
偏好调优
多语言学习
对比学习
自生成数据
SMART框架让单向量嵌入模型直接获得多向量检索能力,无需重训练。
Jianrui Zhang, Hyun Jung Lee, Sukanta Ganguly, Tae-Eui Kam, Donghyun Kim,...
2026-05-26
后期交互
多向量嵌入
多模态检索
对比学习
嵌入模型
机制可解释性研究:相同编码器下评分机制决定作者信号的固化深度,造成四倍性能差距。
Francis Kulumba, Guillaume Vimont, Laurent Romary, Florian Cafiero
2026-05-20
作者归属
对比BERT
对比学习
机制可解释性
激活补丁
反转CoT顺序:先给草稿答案,再用连续嵌入作对比验证器触发反思
Dachuan Shi, Hanlin Zhu, Xiangchi Yuan, Wanjia Zhao, Kejing Xia, Wen Xiao, Wenke Lee
2026-05-20
Agent推理
Chain-of-Thought
LLM推理
对比学习
训练免方法
PUMA用推理级语义冗余检测替代单一答案信号,平均减26.2%token不损准确率
Dehai Min, Giovanni Vaccarino, Huiyi Chen, Yongliang Wu, Gal Yona, Lu Cheng
2026-05-19
对比学习
推理模型
效率优化
早期退出
语义冗余
用外部 AuralFuser 模块给 SAM2 注入音频,金字塔提示避免稀释。
Yuyuan Liu, Yuanhong Chen, Chong Wang, Junlin Han, Junde Wu, Can Peng,...
2026-05-18
SAM2
多模态融合
对比学习
视频分割
音频视觉分割
用层次化记忆树+对比投影器为大模型Agent精准划出安全/恶意决策边界,零训练、低延迟。
Zhe Liu, Zonghao Ying, Wenxin Zhang, Quanchen Zou, Deyue Zhang, Dongdong...
2026-05-14
LLM智能体安全
Prompt注入防御
对比学习
层次化记忆
检索增强生成
首个统一表格分类与检索的通用嵌入模型 TabEmbed,及配套的 TabBench 基准。
Minjie Qiang, Mingming Zhang, Xiaoyi Bao, Xing Fu, Yu Cheng, Weiqiang Wang,...
2026-05-08
基础模型
对比学习
嵌入模型
检索增强生成
表格学习
首个将SPICE网表、原理图、功能描述三模态对齐到统一语义空间的模拟电路检索框架,平均R@1达75.2%。
Yihan Wang, Lei Li, Yao Lai, Jing Wang, Yan Lu
2026-05-04
EDA
图神经网络
对比学习
检索增强生成
模拟电路设计
用双编码器VAE+可解释判别器,显式分离作者风格与内容主题。
Hieu Man, Van-Cuong Pham, Nghia Trung Ngo, Franck Dernoncourt, Thien Huu Nguyen
2026-04-24
AI生成文本检测
VAE
作者归属
可解释AI
对比学习
极性反转合成对偶指令,305M 模型在 FollowIR 提升 45%。
Qingcheng Zeng, Puxuan Yu, Aman Mehta, Fuheng Zhao, Rajhans Samdani
2026-04-22
信息检索
对比学习
指令微调
数据合成
稠密检索
用词义具象度指导硬负样本生成并修正InfoNCE梯度失衡。
Eun Woo Im, Dhruv Madhwal, Vivek Gupta
2026-04-21
InfoNCE
Vision-Language Model
多模态预训练
对比学习
硬负样本
首次将场景图嵌入洛伦兹双曲流形并引入蕴含损失,PP/Graph IoU 提升超8点。
Liyang Wang, Zeyu Zhang, Hao Tang
2026-04-21
3D 场景理解
双曲表示学习
场景图
对比学习
洛伦兹模型
提出Seeing Through Touch框架,用局部视觉-触觉对齐实现触觉引导的材料分割。
Seongyu Kim, Seungwoo Lee, Hyeonggon Ryu, Joon Son Chung, Arda Senocak
2026-04-15
具身智能
多模态定位
对比学习
材料分割
视觉-触觉学习
用语音驱动情绪,跨模态学习语义向量差生成未见过的情绪表情
Chanhyuk Choi, Taesoo Kim, Donggyu Lee, Siyeol Jung, Taehwan Kim
2026-04-13
Transformer
对比学习
情绪编辑
说话人脸生成
跨模态学习
利用T2I一致风格映射,构建170K风格/400K内容的1.4M风格配对数据集。
Junyao Gao, Sibo Liu, Jiaxing Li, Yanan Sun, Yuanpeng Tu, Fei Shen, Weidong...
2026-04-10
FLUX
对比学习
扩散模型
数据集构建
风格迁移