← 前一天
2026-08-11
后一天 → 今日

150M参数模型融合循环记忆与潜在迭代推理,以$0.0007/题刷新ARC成本-精度前沿

Björn Engdahl, Adrian Kosowski, Jan Chorowski, Zuzanna Stamirowska,...
ARC-AGI BDH 上下文学习 循环网络 推理效率

利用加密思维链块的跨模型兼容性,让同厂商弱模型充当解密预言机,逐字还原强模型的隐藏推理。

Alexander Panfilov, David Schmotz, Ilia Shumailov, Luca Beurer-Kellner,...
API安全 LLM安全 思维链 模型蒸馏 越狱攻击

把可解释性作为训练约束内建于模型,Steerling-8B 证明解释能力随规模提升而不牺牲性能

Guide Labs Team, Andreas Madsen, Aya Abdelsalam Ismail, Giang Nguyen, Isaac...
内在可解释性 扩散语言模型 概念引导 概念瓶颈模型 缩放定律

用反事实证据干预把“答案是否依赖视觉证据”变成GRPO奖励,让VLM不再靠语言先验答题。

Haojie Huang, Xinlei Yu, Chengming Xu, Zhangquan Chen, Cheng Yang, Qingdong...
GRPO 反事实推理 多模态大模型 奖励设计 强化学习后训练

把歧义证据因子化为多维语义假设,并行检索、共识融合、逐维验证,将金标概念从排名深处提到榜首。

Linhai Ma, Ethan F. Wei, Xueqing Peng, Yan Wang, Lingfei Qian, Víctor...
LLM集成 临床编码 信息检索 实体链接 查询构造

提出ReMEMBER,以上下文缺口为条件检索并精炼历史证据,提升流式摘要记忆召回

Hyangsuk Min, Hwanjun Song
LLM评估 基准构建 检索增强生成 流式对话摘要 长上下文记忆

把视觉定位重构为文本片段与图像实例的双向对应预测,一个模型统一多种定位任务

Jieyu Zhang, Ziqi Gao, Luke Zettlemoyer, Ranjay Krishna
多模态大模型 开放词汇分割 指代消解 结构化预测 视觉语言定位