先手 SENTE · 周报阅读清单 · 精读 · arXiv 2608.14391

RA-Bench:AI 生成的「危机现场」视频,现有检测器挡得住吗?

Can We Defend Against AI-Generated Video Attacks on Real-World Crisis Events? A Systematic Evaluation of Detectors, Generators and Social Dissemination
Shuo Liang,Yixing Ma,Pengfei Zhou,Zhenglin Wan 等 12 位作者 · 2026-08-14

五位审核员都判为真的生成视频,检测器也基本认不出

打开交互式解读 →

3 分钟版

问题 现有 AI 生成视频检测基准很少覆盖真实危机场景,也缺少关于生成条件、人类感知和社交传播如何影响检测的证据。

思路 以真实视频为锚:收集 675 段真实危机视频,切分审核后保留 1,830 个真实片段,覆盖 10 个社会风险大类;用每个片段的首帧和统一描述驱动 4 个开源、5 个闭源生成模型,得到 16,056 个配对生成片段,并统一重新编码。

结果 传统检测器的 AUC 从公开参考的 67.6–98.6% 降到 43.9–57.3%;最强的零样本模型 Gemini-3.1-Pro-Preview 二分类平衡准确率 63.4%;五位审核员都判为真的 633 个生成视频上,各类检测器基本接近随机;模拟传播处理后,微调检测器的生成视频召回率从 46.0% 降到 1.4%(作者自报)。

所以呢 检测器的可靠性是有条件的:换一个生成模型、换一种提示、经过一次转发,结论就可能失效。单靠「事后检测」难以应对危机场景的虚假视频。

关键数字

局限与疑问

arXiv 摘要页 · PDF

AI 解读 · 基于原文:本页由 AI 根据论文原文整理,所有数字均可在原文中找到出处;引用前请核对原文。