在昇腾超算集群上高效后训练万亿参数 MoE,并面向运筹优化领域完成 CPT+SFT 专精
Dongfang Li, Xiaodong Luo, Ruoyu Sun, Xuhui Chen, Linyuan Qiu, Jian Meng,...
Ascend NPU
Mixture-of-Experts
大模型后训练
持续预训练
监督微调
两阶段训练修复自生成历史KV缓存写入的梯度缺口,让5秒训练窗口外推到数分钟视频
Junhao Zhuang, Shiyi Zhang, Yuxuan Bian, Yaowei Li, Yawen Luo, Yijun Liu,...
KV缓存
自回归扩散模型
视频生成
训练目标设计
长视频外推
提出三级九维文档集评估基准与评分准则驱动的免训练选档方法
Kailin Jiang, Lei Liu, Jian Xi, Hui Xu, Junlin Liu, Baochen Fu, Shaoqing...
LLM-as-Judge
文档集评估
检索增强生成
评估基准
评分准则
ActiveVision:测试 MLLM 能否反复回到图像中验证假设的视觉推理基准
Jiarui Zhang, Muzi Tao, Shangshang Wang, Ollie Liu, Xuezhe Ma, Willie Neiswanger
主动视觉
多模态大模型
智能体工具调用
视觉感知
视觉评测基准
首次系统刻画超网络知识注入的幂律缩放,目标模型缩放收益最大且OOD泛化优于微调
Nischay Dhankhar, Dos Baha, Abulhair Saparov
LoRA
参数高效微调
大语言模型
知识注入
缩放定律
用锚定与对齐两个损失,让VLA微调在零额外数据下同时保住语义理解与动作精度
Dwip Dalal, Shivansh Patel, Chahit Jain, Jeonghwan Kim, Utkarsh Mishra, Alex...
机器人操作
灾难性遗忘
知识蒸馏
行为克隆微调
视觉-语言-动作模型
从黎曼几何修正PPO裁剪,等距更新RIPO显著缓解探索坍缩。
Zhicheng Cai, Xinyuan Guo, Hanlin Wu, Mingxuan Wang, Wei-Ying Ma, Ya-Qin...
LLM推理
PPO裁剪
强化学习
探索利用权衡
策略优化
首个对文档原生操作做确定性验证的智能体基准,暴露长程状态跟踪与破坏性编辑两大短板。
Jiazhen Jiang, Boxi Cao, Lingyong Yan, Yaojie Lu, Hongyu Lin, Shuaiqiang...
Office自动化
文档操作
智能体基准
破坏性编辑
确定性验证
用自适应3D锚令牌把前馈3DGS的高斯预算按场景难度分配
Cho In, Jeonghwan Cho, Mijin Yoo, Gim Hee Lee, Seon Joo Kim
3D高斯泼溅
前馈重建模型
多视角重建
新视角合成
自适应表征分配
训练免修的稀疏注意力系统,用P2P头部迁移和空闲补偿消除多GPU视频生成的负载不均
Hao Liu, Chenghuan Huang, Ye Huang, Zhiying Wen, Mohan Zhang, Chen Li,...
多GPU推理
序列并行
扩散Transformer
稀疏注意力
系统优化
RECAP 通过协同训练线性头让目标模型指定内容可被独立探针验证,修复激活解释重建测试的忠实性漏洞。
Hiskias Dingeto
可解释性
对抗鲁棒性
深度监督
线性探针
自然语言自动编码器
从模糊需求出发、可向用户代理追问的480任务基准,测智能体从零构建可运行仓库的真本事
Zhongyuan Peng, Dan Huang, Chuyu Zhang, Caijun Xu, Changyi Xiao, Shibo Hong,...
Vibe Coding
交互式需求澄清
仓库级代码生成
基准评测
编码智能体
分类法驱动的可验证视觉推理环境,RLVR训练后24个外部基准平均提升约4个百分点
Md Tanvirul Alam
可验证奖励
强化学习
程序化数据生成
视觉推理
视觉语言模型
用代理似然把结果奖励RL引入潜在推理,实现潜在测试时扩展
Runyang You, Zhiyuan Liu, Yongqi Li, Wenjie Li
强化学习
思维链
测试时扩展
潜在推理
策略优化
用 Arma3 引擎自动生成多视角 RGB-热红外航拍目标检测合成数据集
Yechan Kim, JongHyun Park, Dongho Yoon, Namhoon Jung, Moongu Jeon
Arma3
RGB-热红外检测
合成数据生成
域适应
多视角学习
用VLM预测种子点,再用流匹配生成多本体抓取姿态。
Yang Xu, Gurpreet Singh Mukker, Raymond Wang, Jasper Gerigk, Maria Attarian,...
仿真到真实
多本体
机器人抓取
流匹配
灵巧手
把EEG分类模型编译成纯布尔电路,边缘端推理2.9倍加速且体积缩14倍。
Shyamal Y. Dharia, Stephen D. Smith, Camilo E. Valderrama
可微分逻辑门网络
布尔电路
模型量化
脑机接口
脑电EEG分类
提出双模态上下文牵引分类法与1500条数据集,作为VLM牵引效应诊断工具。
Karan Goyal, Afreen Hossain, Debojyoti Das, Vishal Bhutani
上下文牵引
可解释性
探针数据集
知识冲突
视觉语言模型
在 LaMARia 数据集上横跨四大范式基准测试六种 RGB 视觉 SLAM 系统的低光照表现
Oleh Basystyi, Anna Stasyshyn, Oleksandr Kosovan, Yaroslav Prytula
SLAM
UGV
VIO
低光照
基准测试
受控合成测试床揭示:数据均衡与字幕精确率主导T2V生成上限
Amber Yijia Zheng, Lu Liu, Raymond A. Yeh, Xi Yin
受控实验
字幕质量
扩散模型
数据消融
文本到视频生成