单位 5 / 11

虚假信息和合成内容:深度伪造时代的新闻业

收益:

  • 能够识别合成文本、图像、音频和深度伪造视频的类型、线索和传播模式
  • 能够通过源跟踪、元数据、反向搜索和上下文验证来管理合成内容怀疑,并使用人工智能作为防御的组织工具
  • 能够理解检测工具并不是确凿的证据,判断取决于来源,确认消息应该用冷静、透明的语言撰写。

人工智能不仅仅是记者的工具;它也是记者的工具。它也是针对它的威胁的引擎。如今,令人信服的虚假文本、看似真实的照片、不存在的人的面孔以及说出某人从未说过的句子的声音可以在几分钟内生成。这些统称为合成内容(人工制作的媒体);真实模仿人脸或声音的视频/音频类型称为深度伪造。通过这些工具,虚假信息(故意传播虚假信息)变得更便宜、更快。记者的责任加倍:既要阻止这些内容被发表,又要向公众通报这种威胁。在本单元中,我们将介绍如何使用人工智能来理解威胁并防御威胁。基本原则:任何检测工具都不是确凿的证据;对合成内容的怀疑可以通过追溯到来源和上下文的经典验证来解决。

合成内容的类型和技巧

文字。人工智能可以生成流畅但空洞、概括性强、虚构的文本;假“新闻网站”和评论大军由此蓬勃发展。提示:无法证实的来源、过于笼统的陈述、持续的片面框架。

视觉的。在人造图像中,手/手指、牙齿、耳朵、珠宝、背景文本和反射常常不一致;但技术进步很快,“亲眼所见”是一种危险的信任。

声音。未说出口的句子可以由官员的声音产生。提示:呼吸/停顿的自然度、环境声音的一致性,但最可靠的检查是验证内容的来源。

视频(深度伪造)。面部和颈部/光线不匹配、眨眼、唇音同步可能是线索;然而,这并不确定。

注意:“AI检测工具说90%都是假的”并不是发表的理由。这些工具都是错误的;他能把真的说成假的,把假的说成真的。该工具的输出是一条线索;判断归结于源头。

一步一步:管理对合成成分的怀疑

第 1 步——找到来源。谁首先发布了该内容,何时何地?仅追寻原始来源就能破获大多数假货。

第 2 步 — 查看元数据和反向搜索。图像/视频的元数据和反向图像搜索可能会显示以前的版本或原始版本。

步骤 3 — 测试内部一致性。光线、阴影、反射、环境声音、背景现实世界线索(标牌、天气、建筑)是否与声明相符?

第 4 步 — 验证上下文。其他独立来源是否看到过内容中的事件?有很多真实事件的痕迹;单一来源的“重磅炸弹”内容值得怀疑。

第 5 步 — 使用检测工具作为线索。将人工智能检测工具的输出视为辅助信号,而不是证据。

第 6 步 — 透明报告。如果您发布它(作为事实核查),请说明什么是假的/可疑的、原因以及您如何验证它。

在防御中使用人工智能

人工智能也是一种针对合成内容的组织工具:它列出了要在图像中寻找的内容,列出文本可能是人工智能生成的迹象,帮助解析虚假信息活动的叙述,为公众起草解释性事实核查。但决定本身——“这是假的”判决——是通过人的判断和来源验证做出的。

三个迷你箱子

案例 1——假录音。一份官方“辞职”的录音被流传。记者首先查找消息来源:该录音来自一个匿名账户,没有任何其他地方的踪迹。官员团队拒绝接受录音;环境声音也不一致。记者没有公布该录音,而是报道了“无法证实的录音”。后来证明该录音是合成的。

案例 2 — 时间压力和停止反射。地震后“建筑物倒塌”的照片迅速传开。记者进行反向图片搜索:该照片是2年前的另一次活动。 4 分钟的检查阻止了错误图像进入新闻网站;一些竞争对手的网站未经核实就发布了该消息,并发表了否认声明。

案例 3 — 对检测工具过度自信。编辑将真实记者的照片插入检测工具;他说,这辆车“78%是人造的”。编辑正准备将其撤回出版;当高级事实核查员出示照片的拍摄元数据和记者的原始文件时,很明显这张照片是真实的。教训:媒介错误,来源说话。

可复制模板

1)视觉合成检查表:

我怀疑图像可能是人工生成的。制作一个我需要测试的清单:手/手指、牙齿、珠宝、背景文本、反射、光影一致性、反向搜索、元数据。写下如何寻找每件物品。不要肯定地说“假/真”;只是清单。视觉描述:[此处]

2)分析虚假信息叙述:

以下声明可能是虚假信息活动。推断:(1)它针对的情绪是什么,(2)它放大了什么分歧,(3)可验证/不可验证的组成部分,(4)典型的传播模式可能是什么。做出正义的判断;分析。索赔:[此处]

3) 向公众确认的消息草稿:

我已通过主要来源核实以下内容是合成/误导性的:[调查结果摘要]。写一份确认故事的草稿,告知读者,不会散布恐慌,并透明地显示我是如何验证的。不要包含我未提供的任何发现。调查结果:[此处]

4)AI生成的文本标记(提示):

列出以下文本可能是人为生成的线索:来源无法验证、过于笼统、片面框架、重复模式。强调这不是确凿的证据,并写下需要进行哪些事实验证。文本:[此处]

弱提示/强提示

弱提示:“告诉我这张图片是不是假的。”

结果:人工智能给出了看起来精确但不可靠的“是/否”;记者可能会依赖这一裁决并犯下错误。

强烈提示:“列出一张我要检查的迹象清单,看看这张图片可能是人造的,并写下我将如何寻找每一个。不要做出任何最终判断;指出真正的验证是回到源头并进行反向搜索。”

区别在于:强大的提示将人工智能简化为线索生成器,将判断留给消息来源和记者,使该工具的误差范围显而易见。

对比图

内容类型

线索微弱

最可靠的控制

人工智能的作用

文字

一般的、虚构的来源

追本溯源

标志清单

视觉的

手/牙齿/书写差异

反向搜索+元数据

清单

声音

呼吸/环境不一致

来源和上下文确认

寻找什么

视频(深度伪造)

光/同步不匹配

原始来源,交叉确认

分析帮助

常见错误

  • 将检测工具视为证据。将车辆百分比作为发布原因;工具在两个方向上都会出错。
  • “肉眼可见”的信心。合成视觉效果正在迅速改进;仅靠视觉直觉是不够的。
  • 不去源头。当找到发布它们的原始来源时,大多数赝品就会崩溃。跳过这一步是错误的。
  • 传播嫌疑人。分享可疑内容并说“让我们看看它是真是假”是虚假信息。
  • 恐慌的语言。确认消息中危言耸听的语气在纠正的同时传播了新的恐惧;冷静、透明地写作。

扩散速度和“否认陷阱”

虚假信息的真正力量不在于内容本身,而在于其传播的速度。引发愤怒或恐惧的情绪挑衅内容的传播速度比经过验证的新闻要快得多;虽然虚假内容在数小时内就达到了数百万人,但经过编辑的人通常要少得多。这种不对称性赋予了记者特殊的责任:分享有问题的内容,即使是说“看起来多么荒谬”,也可以让记者获得访问权。这被称为“氧化作用”——重复谎言来反驳它实际上会助长谎言。

解决这个问题的方法是事实核查中的“真相三明治”技术:在重复错误的说法之前先说实话,然后说明为什么该说法是错误的,最后再次重复事实。这样,留在读者脑海中的就不是错误,而是真相。人工智能可以根据这种结构帮助起草事实核查故事;但这是编辑决定提出哪些真相并告知语言而不散布恐慌。另一种做法:询问虚假信息填补了什么空白?由于缺乏可靠信息,人们经常接受虚假内容;用快速、准确和易于获取的新闻来填补这一空白是比逐一追查谎言更有效的防御措施。

综上所述

合成内容和深度造假降低并加速了虚假信息的传播;记者的职责是不公开此事并告知公众。检测工具和人工智能提供了线索和组织——但不是明确的证据。判断是通过来源、元数据和反向搜索、内部一致性和独立上下文来做出的。确认消息是用平静、透明的语言写成的,显示了它是如何被验证的。

应用任务

查找您认为可疑的视觉或音频内容。按照“视觉合成检查表”(或音频改编)提示进行操作;真正检查每一项并反向搜索。将结果评价为“真实/虚假/证据不足”,并将其与您仅依靠检测工具做出的决定进行比较。

清单

  • [ ] 我认为检测工具的输出是线索,而不是证据。
  • [ ] 对于任何有问题的内容,我首先寻找原始来源和首次发布。
  • [ ] 我确保反向搜索和元数据检查图像。
  • [ ] 我不会传播未经证实的可疑内容。
  • [ ] 我用平静、透明的语言写确认消息,展示我如何验证它。