← 前一天
2026-08-14
后一天 → 今日

外置相机位姿索引的几何记忆,配合长时程教师蒸馏,实现三步生成、小时级不间断的交互世界模型

Yuanyang Yin, Gongxuan Wang, Yifan Zhan, Chuanhao Li, Kaipeng Zhang, Feng Zhao
世界模型 交互式生成 几何记忆 少步蒸馏 自回归生成

直接感知原始多模态证据,端到端自动完成从数据到可验证论文的科研闭环

Bobo Li, Hao Fei, Tianjie Ju, Mong-Li Lee, Wynne Hsu
AI Scientist LLM Agent 多智能体系统 多模态智能体 科学发现

397B 参数科学智能体基础模型:多模态科学理解、可验证强化学习与长程智能体训练的统一

Lei Bai, Jiaqi Cao, Chiyu Chen, Guanzhou Chen, Kai Chen, Guangran Cheng,...
后训练 基础模型 多模态 强化学习 时间序列

把电影编码为可编辑的电影知识图谱,用重构残差驱动双环文本梯度自进化

Chuyue Li, Jinpeng Yu, Haozhe Wang, Tian Xueyun, Zhijing Zhang, Bingnan Li,...
文本梯度优化 智能体 知识图谱 视频生成 视频表示学习

首个流式音视频联合身份替换框架:单一扩散模型同步换脸换声,3步采样13.6 FPS

Yuxuan Zhang, Haozhong Xiong, Jiayi Song, Jinpeng Yu, Yang Shi, Jiaming Liu,...
LoRA 扩散模型蒸馏 流式自回归生成 视频生成 语音转换

将顶层隐状态门控融合为下一步输入,以约1%推理开销换取约2倍训练数据量的效果

Xi Wang, Ziyang Cai, Zheng Zhan, Harry Dong, Ying Fan, Gustavo de Rosa, Tim...
LLM预训练 数据效率 测试时计算 潜在反馈 递归计算

用LLM在残差式DSL空间中自动搜索视觉token剪枝策略,94.4%剪枝下保留99%以上性能

Zhen Liu, Wenli Huang, Wei Song, Yuhan Liu, Zhiqin Yang, Jingwen Fu
AI4AI LLM驱动算法设计 多模态大模型 推理加速 视觉Token剪枝

把测试时推理重构为思维级束搜索:零和剪枝并从高分前缀分支,同硬件下精度与效率双升。

Lijie Yang, Hongyin Luo, Jiawei Zhao, Tri Dao, Ravi Netravali
LLM推理加速 推理系统 束搜索 测试时计算扩展 解码策略

用并行预填充器生成记忆目标,一致性损失训练滑窗解码器,实现可并行预训练的固定内存循环语言模型

Bo Liu, Qiang Liu
Transformer 一致性损失 循环记忆 语言模型预训练 高效注意力

用LLM性别分类加标签感知翻译模型的混合流水线,把英译罗性别准确率提升40个百分点以上

Ioana Grigore, Sergiu Nisioi
LoRA微调 低资源语言 大语言模型 性别偏见 机器翻译