← 返回博客

科普 · 观察

当检测工具也开始"狼来了":误判真图,比假图更危险

2026-08-09 · 科普 · 观察

本文由 AI 辅助起草,经人工编辑审核后发布。

我们做检测工具,每天最大的提醒反而是:别把分数当判决。最近一个案例把这件事说透了。

一组让人不安的数字

新闻核查机构 NewsGuard 在 2026 年 5 月做了一件事:拿了 15 张真实的新闻照片——都是美伊冲突期间,由正规媒体发布的现场图——分别喂给五款主流商业检测工具。结果,这 15 张百分之百真实的照片里,有大约 13% 被工具判成了"AI 生成"。其中一款工具最离谱,15 张里错了 6 张,错误率 40%。

这不是"偶尔看走眼"。是真实照片被系统性地当成假图。

最反直觉的一幕:用分数"证明"人死了

比数字更刺眼的是另一个故事。伊朗导弹袭击后,网上流传一段以色列总理还活着的"自证视频"——他在咖啡馆喝咖啡,用来辟谣"已被炸死"的说法。结果有人把这段视频丢进某款检测工具,拿到了 96.9% 的"疑似 AI 生成"结论,然后据此宣称:你看,连软件都说是假的,人早就没了。

后来核查人员把这段咖啡馆视频和同地点其他影像比对,确认它就是真的。问题在于,视频大概率被加了滤镜或轻微后期,背景一模糊,检测模型就把"不自然"当成了"生成"的证据。

一个本该戳穿谎言的工具,反过来给否认真相的人递了一把刀。

把真视频打成假,伤害的不只是视频里的人。它让所有真实记录都变得"可被质疑"——只要有人愿意,花一秒钟跑个检测,截个图,就能给任何他不喜欢的画面贴上"AI 造假"的标签。

为什么真图会被判成 AI

原因其实很日常。检测工具看的是像素层面的统计特征:噪点分布、压缩痕迹、光影一致性。而真实新闻照片偏偏就长在"容易被误伤"的区间里——

  • 冲突现场的图,常常是高对比、强阴影、画面抖动;
  • 经过社交平台多次转发,必然被压缩、缩放、重新编码;
  • 手机 HDR、计算摄影带来的"太干净"的质感,也会被当成"塑料感"。

一家检测公司的负责人自己跟 NewsGuard 承认:压缩和缩放就可能让真图被误读。换句话说,检测器在"干净的原图"上最准,在"互联网上真正流传的图"上最不准。而后者,恰恰是我们要分辨真假的地方。

我们怎么看:分数不是判决

我们一直坚持一个立场:检测器测的是"像素的出身",不是"事实的真假"。它说 96.9% 像 AI,只代表模型的判断,不代表真相。

这次审计还暴露一个程序性的漏洞:工具吐出一个自信的结论,平台和赛事评委就照着办,而几乎没有申诉通道。一位澳大利亚摄影师,一张用手机实拍的真照片,被比赛评委觉得"有点 AI 味"直接取消资格;一位用胶片相机拍的黑白照,也被论坛当成疑似 AI 删掉。一旦被打上嫌疑标签,自证清白的重担全落在被冤枉的人身上。

真相不该是"自证清白",而该是"除非有证据否则推定真实"。但现在很多地方,反过来。

三句给普通人的话

  • 别拿任何一款工具的单次结论去否认别人的画面。尤其当它说"这是假的"时,更要警惕——误判真图比漏掉假图更常被用来干坏事。
  • 真要较真,就交叉验证:换工具再跑一次、查原始出处、看拍摄地的其他影像。我们的理念也是给出"不确定"这一档,而不是硬下结论。
  • 保留原始文件。原图带的设备信息、时间戳,是证明"真的拍过"的最硬证据;截图和转发会把这些抹掉。

检测器是帮手,不是法官。它喊"狼来了"的时候,先别急着信,也别急着跟。

返回首页·关于·隐私政策·使用条款