AI 生成内容的 fact check 与事实核查方法

AI 写得越流畅,你越要警惕——它能在最自信的语气里塞进最离谱的错误。

AI 为什么会"一本正经地胡说八道"

大语言模型的本质是预测下一个词。它不区分"事实"和"听起来像事实的表述"。当它不确定某个信息时,不会说"我不知道",而是生成一段看起来合理的文字。这种现象叫"幻觉"(hallucination),是 AI 内容最大的风险。

常见的幻觉类型:

你发布的每一条 AI 辅助内容,如果不做事实核查,都在承担传播错误信息的风险。对自媒体创作者来说,一次严重的事实错误可能毁掉长期积累的信任。

事实核查的三层方法

第一层:内部一致性检查

把 AI 生成的内容整体读一遍,检查前后文有没有自相矛盾。AI 在长文中可能前面说 A 后面说 B,自己打自己脸。

让 AI 自检也是一个方法:

"请检查以下内容中是否有前后矛盾的地方、数据不一致的地方、逻辑跳跃的地方。只列出问题,不修改。"

AI 自检能发现一部分问题,但不能完全依赖——它检查不了自己不知道的错误。

第二层:外部信息交叉验证

所有涉及以下类型的信息,必须通过外部来源验证:

信息类型 核查方式 推荐来源
数据统计 查原始报告 官方报告、权威数据库
人物言论 查原始采访或发言 原始视频、官方文稿
历史事件 查百科和时间线 维基百科、权威媒体
科学结论 查学术论文 Google Scholar、期刊官网
产品信息 查官网 官方网站、官方文档

核查时注意一个原则:找到原始来源,不要依赖二手转载。很多错误就是在转载过程中产生的。

第三层:领域专家确认

如果你写的内容涉及专业领域(医疗、法律、金融等),AI 生成的内容即使看起来合理,也必须经过领域专家确认。这不是小题大做——这些领域的事实错误可能给读者带来实际损害。

如果你自己不是该领域专家,至少做到:找到一位可信的领域专家做审阅,或者在文中明确标注"以上内容不构成专业建议"。

核查的优先级:不是每句话都要查

事实核查很耗时,需要分优先级。以下内容必须核查:

以下内容可以降低核查优先级:

实用的核查工具和技巧

反向搜索。 把 AI 给出的关键论述拿到搜索引擎搜一下。如果搜不到任何来源支撑,大概率是编造的。

引号搜索。 AI 给出的引用,用引号包裹后搜索。如果是真实引用,通常能找到原始出处。

多源交叉。 同一个事实,找至少两个独立来源确认。一个来源可能是错的,两个独立来源都错的概率低很多。

时间戳检查。 AI 引用的报告或研究,查一下发布时间是否对得上。AI 可能引用一份 2020 年的报告来支撑 2024 年的论点。

在内容中标注不确定性

不是所有事实都能 100% 确认。对于核查后仍不确定的信息,最好的做法是在内容中标注不确定性:

标注不确定性不会降低内容质量,反而增加可信度。读者更信任承认局限性的创作者,而不是事事都斩钉截铁的人。

建立核查习惯

把事实核查纳入内容生产流程,而不是发布前临时抱佛脚。建议在写作阶段就标记需要核查的内容——写到某个数据或引用时,加一个 [核查] 标记,写完后统一处理所有标记。

这个习惯一旦养成,核查的时间成本会大幅降低,因为你在写作时就已经知道哪些地方需要查、查什么。AI 是高效的写作工具,但它不承担事实责任——责任在发布者身上。