2026-08-30 · 科普 · 观察
本文由 AI 辅助起草,经人工编辑审核后发布。
一份道歉声明,被全网拿去"验 AI"
这周最值得我们这行琢磨的一件事,不是哪条假视频疯传,而是一份真的声明被送上了检测台。
事情大家应该都刷到了:8 月 23 日,某巧克力品牌旗舰店一条七夕带货文案把"趁男朋友不在跟暧昧对象分享"写成甜蜜场景,全网炸锅;客服回了一句"不喜欢可以划走",火上浇油;8 月 25 日深夜,品牌官微发出致歉声明,说涉事视频由第三方运营团队创作、未严格执行审核流程,并列了三条整改措施。
按常规剧本,这事该慢慢凉了。但第二天出现了一个新玩法:有网友把这份致歉声明的文字复制进国家反诈中心 App 的"AI 内容鉴定"功能,检测报告显示——含 AI 生成痕迹。截图一发,#德芙道歉声明AI味# 直接上热搜,评论区最高赞是那句"整改措施前的小点一出现就是 AI"。紧接着一家游戏方宣布取消联名。道歉没成为终点,反而成了下一轮危机的起点。
我们盯这个案子,不是因为品牌翻车,而是因为这大概是第一次,一个官方免费检测工具被几十万人当成"公审的锤子"来用。
一句可能不受欢迎的话:这段文字本来就很难不被判 AI
先讲原理。图像检测好歹有像素统计特征可抓——噪点分布、频域痕迹、生成模型留下的规律。文字什么都没有,只有措辞和句式的分布。所谓"AI 文本检测",本质是在算一件事:这段话的用词选择,有多接近大模型最爱输出的那种平均值。
现在你回头看一份公关致歉声明的体裁要求:措辞克制、句式统一、套话齐全(深感抱歉、郑重致歉)、整改措施必须分条列点、情绪必须平坦、不能有个人风格。
这几乎是把"AI 文本高分特征"逐条对齐了一遍。所以哪怕这份声明是一个法务和一个公关熬夜手打、逐字过了三轮审,检测器给出"含 AI 生成痕迹"的概率也依然很高。这不是工具坏了,是这类体裁天生落在检测器的假阳性(false positives)高发区。
| 文本体裁 | 被判"AI 味"的风险 | 为什么 |
|---|---|---|
| 公关声明 / 通报 / 法律条款 | 极高 | 模板化、情绪平坦、必须分条 |
| 学生作业 / 标准化写作 | 高 | 被训练成一个标准腔调 |
| 私人吐槽 / 聊天记录 | 低 | 语病、跳跃、个人腔调多 |
| 真被 AI 一键生成后人工重写过的稿 | 可能变低 | 改动打散了统计特征 |
最后那行才是最尴尬的:一份认真用 AI 起草、又认真改过的稿子,读数可能反而比纯手写的模板稿更"干净"。所以在文字这块,检测分数和"有没有用心"根本不是同一条轴。
那网友是不是被工具误导了?也不是
这是我们想讲的第二层,稍微反直觉。
公众这次的判断——"这份道歉没诚意"——我们认为大概率是对的。但支撑这个判断的证据,从来不是检测结果。真正的证据是:深夜发布、把责任推给第三方运营团队、通篇讲审核疏漏、始终不回答"这样的内容为什么能从官方账号发出去"。这些是任何人读一遍就能感受到的东西,跟像素、词频、AI 概率没有半点关系。
检测器在这件事里扮演的角色,是给一个已经形成的直觉盖了个看起来很权威的章。人们先觉得不对,再去找一个能量化的、可截图的、带官方 logo 的东西来证明自己没冤枉它。
这次盖章的方向恰好和公众直觉一致,所以没人觉得有问题。但这是个危险的先例:下一次,同一个按钮可能把一封真人写的求助信、一份真实的病历说明、一段一线员工手写的解释,同样盖上"含 AI 生成痕迹"。到那时,被冤的人要拿什么去反驳一张"官方检测截图"?
我们在 8 月已经写过两次类似的坑:真实的路测视频被检测报告标出"AI 痕迹",真实的照片被判成 AI 后当事人得自证清白。区别只是这次被检测的是文字,而且检测按钮就在几亿人手机里。
官方把免费鉴定放进 App,这是好事
必须说清立场:我们支持这件事。据媒体报道,国家反诈中心 App 在 8 月上线了 AI 内容鉴定,覆盖文本、图像、视频、音频四类,每个账号每天有若干次免费额度。对普通人来说,这是第一道触手可及的官方防线——查一条"领导让我转账"的语音、验一段陌生来电视频,价值巨大。我们自己也是免费的中立第三方,方向完全一致。
问题只在于结果页那行字该怎么被理解。"含 AI 生成痕迹"是一条提示,不是一份判决。它的准确说法是:这段内容的统计特征更接近机器生成的分布。它不回答有没有诚意、有没有授权、有没有说谎、该不该被骂——这些都是人的问题,得靠人读、靠事实核对。
我们自己的三条读法
- 看方向,不看小数点。 高、中、低三档足够用。为 3% 的差值争论没有意义,不同工具、不同版本、不同压缩程度都能让数字上下跳。
- 先问"这个结论会伤到谁"。 判假一张假图,成本是零;判假一份真声明、一张真照片、一个真人的脸,成本是这个人要花几周自证清白。凡是后一类,一个分数远远不够。
- 拿掉检测结果,你的判断还站得住吗? 如果站得住,说明你本来就有证据,检测只是锦上添花;如果一撤就塌,那你其实什么都没证明,只是找了个数字给情绪撑腰。
做了这么久鉴真,我们越来越确信一件事:检测器最大的价值是让人慢下来去查,而不是替人下判断。它能告诉你这段文字像不像机器写的,答不了这家公司有没有诚意——后者从来不需要检测器,读一遍就知道。