8.9B模型联合下一概念预测与token预测,仅用51.3%数据即追平OLMo-3-7B。
NCP Team, Jiaqi Cao, Chiyu Chen, Shuang Cheng, Xu Cheng, Beiya Dai, Yufan...
Muon优化器
下一概念预测
向量量化
大规模预训练
架构创新
8B-MoT 无编码器无VAE统一模型,靠空间联合重建与多专家RL蒸馏兼顾理解、生成与编辑
Haiwen Diao, Jiahao Wang, Chenjing Ding, Hanming Deng, Jiangnan Chen, Ruixi...
像素空间流匹配
原生统一多模态模型
图像生成
图像编辑
在线策略蒸馏
仅用15k合成积木题训练,LVLM域外空间推理全面超越空间专精模型
Soohyun Ryu, Sohee Kim, Eunho Yang
GRPO
合成数据
后训练
强化学习
空间智能
为每个模型×领域自动进化专属安全harness,在四大基准上同时提升安全与效用
Nanxi Li, Yingzi Ma, Yulong Cao, Edward Suh, Bo Li, Dawn Song, Chaowei Xiao
LLM智能体安全
安全-效用权衡
提示注入防御
自动化程序搜索
诊断引导的三阶段工作流,区分可滤波的周期伪影与内容纠缠纹理,修复迭代AI编辑的数字波纹
Jiayin Chen, Yicheng Xu, Muting Wang
AI生成图像
伪影修复
图像恢复
迭代编辑
频域分析
渐进剪枝+跨尺度蒸馏,把语音大模型音频编码器从18层压到14层而精度几乎无损
Haojun Zhang, Yi Zou, Min Chen, Qize Yu, Lianrui Fan, Xini Ding, Hao Li,...
LoRA微调
模型压缩
知识蒸馏
结构化剪枝
语音识别
把长期情景记忆编译成语言-视觉计划,用固定上下文执行长时程记忆依赖操作
Sizhe Zhao, Haozhe Xie, Weiyu Zhao, Chenchu Zhang, Huan Wang, Chenyang Wang,...
VLA
世界模型
机器人学习
机器人操作
长时程记忆
无光流专用偏置的纯Transformer,三大光流基准全部刷新SOTA
Vladislav Bargatin, Alexander Yakovenko, Khaled Abud, Dmitriy Vatolin
光流估计
无归纳偏置
自监督预训练
视觉Transformer
高分辨率密集预测
开源Nemotron流水线纯自然语言证明获IMO 2026金牌(30/42分)
Ivan Moshkov, Stephen Ge, George Armstrong, Wei Du, Sadegh Mahdavi, Igor Gitman
后训练
强化学习
数学推理
测试时计算
竞赛证明
2.6GB的4B微调模型在地铁亭基准Tier 1达91.3分,追平GPT-5.4
Remco Hendriks
LLM即裁判
PEFT微调
开源模型评测
智能体基准
结构化输出
让编码智能体递归执行“建立整体—解析局部—回访整体”,从单图重建可执行的复杂3D场景程序
Zhiqi Li, Yuxuan Liao, Bo Zhu
3D场景重建
代码世界模型
场景程序生成
视觉语言编码代理
逆向图形学
首尾片段完形填空式评测揭示视频LLM的时序对齐瓶颈
Wenqi Pei, Henry Hengyuan Zhao, Yilai Liu, Jiahao Meng, Han Chen, Ziyu Wang,...
Video-LLM
基准评测
完形填空
时序推理
视频理解
训练免调推理时接口:把异构视觉证据转为干净视觉状态,驱动冻结世界模型探索视频世界。
Chenxi Song, Yanming Yang, Chi Zhang
可控视频生成
注意力引导
相机控制
视频世界模型
训练免调
以任务级验证损失为透镜,揭示图像tokenizer对统一自回归多模态联合建模的重塑作用。
Siting Li, Zhengyang Wang, Simon Shaolei Du, Xi Chen, Yang Liu
图像Tokenizer
多模态预训练
损失分析
统一多模态模型
缩放定律
让模型自演“粗心推理者”生成负向教师,推开缺陷token的概率分布,无标签提升数学推理
Rongcan Pei, Zhepei Wei, Shuyao Xu, Xinyu Zhu, Wei-Lin Chen, Yu Meng
LLM自改进
token级门控
数学推理
无标签训练
蒸馏与强化学习
保留少数垂直线token和局部窗口为全精度,其余低比特量化,实现近无损长上下文推理加速
Jiatong Ding, Bingxin Xing, Yu Zhang, Dian Ding, Xiaodong Yi, Xianbin...
KV缓存压缩
LLM推理加速
模型量化
注意力机制
混合精度
3.35B小模型靠三种数据混合训练,在60种语言上实现93%以上语内推理率
Mehrnaz Mofakhami, Ananya Sahu, Alejandro R. Salamanca, Daniel D'souza,...
多语言推理
小模型
数据混合
监督微调
跨语言迁移
UniH3用层级同质记忆与异质平衡器统一七种医学图像修复任务并刷新SOTA
Zhiwen Yang, Jiayin Li, Chengyu Liu, Hui Zhang, Bingzheng Wei, Yan Xu
All-in-One
医学图像修复
多任务学习
注意力机制
记忆网络
存少量球面锚点、按需再生整页嵌入,把索引压到每页约1KB
Mohamed Eltahir, Talal Aloushan, Rose Khairoalsendi, Jana Shata, Mohammed...
向量压缩
多模态检索
晚期交互
生成式嵌入
视觉文档检索
仅训封闭任务即浮现开放报告能力,冠脉造影端到端可审计解读
Jia-Jen Lee, Shih-Yen Hou, Kee Koon Ng, Wei-Chun Wang, Shih-Sheng Chang
医学影像AI
可解释性
强化学习
视觉语言模型
判决相同不等于语义等价:把Z3等价神谕蒸馏成免参考的生成式验证器
Vikash Singh, Debargha Ganguly, Aman Goel, Ali Torkamani, Xiaoxue Han,...
SMT求解器
奖励模型
机制可解释性
生成式验证器
神经符号推理
图注意力建模战场实体关系并动态分配战术角色,2v2超视距空战胜率达87%
Junlin Liu, Chengwei Li, Yang Gao, Hui Chang, Xinchen Zhang, Zhijun Zhao, Hao Zhao
MAPPO
分层强化学习
图注意力网络
多智能体强化学习
空战决策
代理双写者拆分话题消除DDS背压,关键订阅者尾延迟从15秒降至1.55毫秒
Kaushalraj Puwar, B. Thangaraju
DDS
QoS
ROS 2
中间件
实时系统
构建660个证据支撑实例,发现LLM定位研究想法中的实现关键缺陷是主要瓶颈
Yiling Ma, Yilun Zhao, Sihong Wu, Manasi Patwardhan, Arman Cohan
LLM科研智能体
可复现性
基准评测
规范缺陷分析
需求澄清
把审稿-反驳交互当作潜在监督,训练出能诊断弱点并给出可执行修改建议的评审模型
Yiling Ma, Yilun Zhao, Sihong Wu, Ziyu Chen, Manasi Patwardhan, Arman Cohan
GRPO强化学习
LLM-as-a-Judge
LLM后训练
同行评审
数据构建
多维刻画实体稀有性,推理+迭代检索的免训练框架超SOTA 6.9%,稀有实体最高提升23.3%
Parinthapat Pengpun, Simran Khanuja, Graham Neubig
Wikidata
多模态
多语言实体链接
推理模型
检索增强生成