用MLLM生成客观图像描述作为锚点,量化跨模态不一致性进行讽刺检测
标签:
全部
强化学习
扩散模型
大语言模型
基准测试
视频生成
视觉语言模型
世界模型
GRPO
多模态大模型
知识蒸馏
LLM智能体
多智能体系统
智能体
多模态学习
流匹配
具身智能
图像生成
基准评测
代码生成
LLM Agent
检索增强生成
注意力机制
机器人操作
多模态大语言模型
视频理解
可解释性
数学推理
图像编辑
多模态
机器人学习
RLVR
自监督学习
长上下文
后训练
Transformer
工具使用
对比学习
数据合成
视觉-语言-动作模型
推理加速
工具调用
LoRA
多模态推理
RAG
计算机视觉
LLM评估
信息检索
视觉推理
评测基准
高效推理
参数高效微调
扩散语言模型
自蒸馏
综述
Flow Matching
3D重建
模型压缩
自回归生成
持续学习
自回归模型
自蒸馏实现持续学习:从演示中进行策略学习
👍 41通过自蒸馏将演示转化为策略学习信号,实现持续学习而非遗忘
通过 Highway 式残差连接取代 ResNet 式路径,使 Post-LN 在超深模型中稳定训练
提出评估AI理解音视频模因能力的基准,揭示当前模型在文化理解和无文本音频上的不足
多智能体框架将自然语言描述转化为可执行、可交互的AI Town游戏场景
进化搜索+LLM实现Verilog生成与PPA优化,达98.1%准确率
系统综述LLM在数据清洗、集成、增强三大数据准备任务中的方法、评估与挑战
通过元强化学习生成自适应课程,突破数学推理性能瓶颈
单遍处理60分钟音频,统一ASR/说话人分离/时间戳的端到端框架
K-means聚类构建多样化子表+LLM生成查询+对比微调提升表格检索
首个覆盖感知/推理/预测/决策四维度的多模态时间序列推理基准,评测30+主流模型
通过语义聚类和加权融合提升表格检索的语义表示质量
首个将心智理论(ToM)引入学术反驳的框架,通过建模审稿人心态生成策略性回复
提出PaST框架,通过正交的参数更新将RL技能注入SFT模型,解决知识与推理的脱节问题
沙箱中的大语言模型:激发通用智能体能力
👍 87通过代码沙箱环境激发LLM的通用智能体能力,实现跨领域性能提升
Qwen系列首个TTS模型,双轨架构实现97ms超低延迟流式语音合成,支持10语言500万小时训练
通过块扩散持续预训练,使扩散语言模型在代码任务上超越自回归基线
测试时强化学习训练LLM,在单个科学问题上发现新SOTA
锦标赛式提示词评估框架,系统比较六种教育对话提示模板的效果
首个金融智能体执行安全基准,揭示50%攻击成功率