找到 323 条结果

DF26基准显示人类与最先进检测器识别AI生成视频的能力已接近随机

Severyn Shykula, Andrii Yermakov, Ivan Samarskyi, Dmytro Mishkin, Jan Cech,... 2026-09-10
全合成视频 基准数据集 深度伪造检测 视频生成 跨生成器泛化

视频模型能生成合理的单条未来,却难以复现同一条件下可能未来的正确分布。

Yuandong Pu, Le Zhuo, Sayak Paul, Gabriel Jorge Menezes, Avram Đorđević,... 2026-08-28
世界模型 分布对齐 概率校准 视频生成 评测基准

300个程序化视觉推理任务+可验证奖励评分器,让视觉生成成为可训练、可验证、可优化的推理媒介

Junxiang Xu, Ruisi Wang, Fanyi Pu, Maijunxian Wang, Ran Ji, Tongxi Zhou,... 2026-08-27
交错生成 原生视觉推理 可验证奖励 基准测试 强化学习

以像素级动作流为共享接口,统一跨本体世界建模、开环策略评估与逆向机器人控制

Hongyu Li, Bowen Wen, Xinghao Zhu, Yixuan Wang, Yilun Du, Yunzhu Li, George... 2026-08-24
世界模型 扩散模型 机器人操控 策略评估 视频生成

以冻结视觉基础模型特征构建语义潜空间,视频重建与生成双优、收敛快至6倍

Minghui Guo, Shengqiong Wu, Hao Fei 2026-08-19
扩散模型 潜在空间 表征学习 视频生成 视频自编码器

分层智能体评测流水线把世界模型评分变成可审计的证据树,判断与人类高度一致

Weiliang Chen, Haowen Sun, Jun Gao, Jiawei Chi, Hanyang Wang, Qiyu Dai,... 2026-08-18
VLM-as-Judge 世界模型 可解释性 智能体评测 视频生成