收益:
- 能够通过自动语音识别 (ASR) 生成原始转录本,并使用它们来验证时间戳和说话人辨别
- 能够逐字验证新闻中的每一条引言,并优先考虑高错误区域,例如专有名称、数字和行话。
- 能够理解文字记录是原始草稿,引文应逐字保存而不进行更正,并且敏感记录中应从一开始就考虑保密性。
音频是记者最有价值但又最累人的原材料之一:采访录音、新闻发布会、电话交谈、议会听证会、现场直播档案。一个有经验的人需要四到六个小时才能手工转录一小时的对话——用行业术语来说就是转录。基于人工智能的自动语音识别 (ASR) 技术可自动将语音转换为文本,从而将这一时间缩短至几分钟。但文字记录是一份粗略的草稿:姓名、技术术语、重叠的演讲和嘈杂的段落都可能出错。所以规则不会改变:人工智能生成原始转录本;由记者核实引文是否与录音完全一致、谁说了什么以及上下文。每一个进入空气的倒装句如果不与声音进行比较就不能成为新闻。
一步一步:从声音到可靠的报价
第 1 步 — 准备录音并考虑隐私。如果音频文件包含泄露来源的名称或需要保护来源,请注意它上传到哪个工具。对于敏感记录,首选具有数据安全性的离线或企业解决方案。确保录音已获得授权(某些录音有法律限制)。
第 2 步 — 获取原始成绩单。使用 ASR 工具将音频转换为文本。如果可能的话,打开时间戳(每句话说的分钟数)和分类(区分谁说哪个句子)。这些使得验证速度非常快。
步骤 3 — 标记高错误区域。专有名称、机构名称、数字、外来术语以及两个人同时说话的地点是最容易出现错误的领域。将这些放入您的优先事项清单中。
第 4 步 — 将报价与录音进行比较。通过查看时间戳并收听音频来逐字验证新闻中包含的每个句子。即使改变一个词也可能改变含义和法律责任。
第 5 步 — 使用 AI 提取摘要和主题(单独的工作)。清理完文字记录后,你可以向人工智能询问草稿输出,例如“主要主题”、“有新闻价值的段落”、“矛盾”——但这些提供了方向,而不是替代引文。
注意:自动解码可以轻松替换单词:“我们没有”替换为“我们做了”,一个名词替换为另一个名词。请勿在未听音频的情况下广播任何加引号的句子。虚假报价既是违反道德的行为,也是免责声明/诉讼的原因。
影响准确度的因素
转录质量;取决于录音质量(麦克风、噪音、回声)、发言者数量、口音、方言、技术术语和音频重叠。电话录音和拥挤的环境会产生最多的错误。因此,不要被诸如“该工具的准确率是95%”之类的说法所安慰:剩下的5%可能在新闻最关键的地方,比如名字和数字。
三个迷你箱子
情况 1——唯一改变的词。记者自动抄录了一位官员的声明:“我们无法核实这一说法。”笔录上写的是“我们可以核实”——意思恰恰相反。记者听了时间戳,进行了修正。如果这个一字错误没有得到纠正,这个消息就会让这位官员说一些他没有说的话。
案例 2 — 时间增益,议会会议。手动解码 5 小时的会话录音大约需要 25 小时。 ASR 在 40 分钟内提取原始文本;由于发言者分离和时间戳,记者只听取并核实了三位关键发言者的20分钟段落。总时间减少到约 4 小时。
案例 3 — 行话错误。有健康记者注意到,专家采访中提到的一种药物名称在笔录中拼写错误;它与另一种听起来相似的药物混合。他让专家用短信确认了这一点。如果发布了错误的药物名称,这不仅是虚假信息,而且对健康有害。
可复制模板
1)从原始成绩单中提取清单:
以下是自动转录。标记以下内容:(1)专有名称和机构名称,(2)数字和日期,(3)外国/技术术语,(4)句子含义不清楚的地方。这些都会在备案前进行验证。更正文字;只需制作一份清单即可。转录:[此处]
2) 演讲者和主题摘要(来自清理后的文字记录):
使用下面经过验证的成绩单。 (1) 用一句话概括每位发言者的分析。 (2) 用时间戳标记 5 个有新闻价值的段落。 (3)列出发言者之间的矛盾。制作报价;只需显示他们的位置即可。转录:[此处]
3)候选引文提取(待验证):
从这份文字记录中选择 8 条适合新闻的候选简短引言。写下时间戳 [12:04] 和每个发言者。缩短或编辑报价;逐字复制,以便我可以从记录中确认。转录:[此处]
4)噪音/不清晰的通道标记:
列出以下记录中存在“[不明确]”、“...”或缺乏含义的地方。写下每个部分的时间戳,以便我可以再次收听该部分。用猜测填空。转录:[此处]
弱提示/强提示
弱提示:“总结这次采访并找出最好的引述。”
结果:AI认为抄录中的错误是正确的,并“美化”引文、缩短和更改句子;据说是在什么时候丢失的,无从考证。
强烈提示:“从这份文字记录中准确地(逐字)提取 8 个引用候选者,为每个引用添加时间戳和说话者,不要更正或缩短其中任何一个。将不清楚的单独列出,以便我可以从录音中听到它们。”
区别:强提示禁止更改引用,使其可通过时间戳验证,并隔离歧义;记者可以通过语音验证每一条引述。
对比图
特征
它有什么作用?
验证效果
自动解密(ASR)
将音频转换为文本
草稿;都需要确认
时间戳
返回句子的分钟
快速查找并收听报价
扬声器分离
区分谁说的
防止错误归因(需要确认)
自动总结
草稿主题
它给出方向;报价不能替代
自动翻译(过度转录)
翻译国外记录
双重故障的风险;双重验证
常见错误
- 不听就发表这句话。认为转录中的句子是正确的,并用引号引起来;一个单词的错误可能会颠倒意思。
- 信任名称和号码。忘记了专有名称、机构和数字是最容易出现错误的地方。
- 让人工智能“纠正”报价。改变句子,使其更加流畅;引用必须逐字逐字,更正内容在方括号中注明。
- 随意加载敏感记录。将录音发送到泄露来源或未经许可的不受控制的车辆。
- 对说话者歧视的盲目信任。人工智能会让两个人感到困惑;从音频中验证关键属性。
提高转录质量的实用技巧
转录的准确性是在工作一开始、录音时确定的。走进现场的记者只需几个简单的习惯,就可以让人工智能的工作变得更轻松,减轻核查的负担。将麦克风移近扬声器并减少背景噪音(例如风/交通噪音)可显着降低错误率。要求轮流发言可以防止重叠语音(转录的最薄弱环节)。让演讲者在访谈开始时说出他的姓名和头衔,可以更轻松地识别演讲者并随后进行归因。如果要讨论一个技术主题,列出常用名称和经常使用的术语列表,可以让您提前知道转录中最可能出现的错误;当您在录音中听到这些术语时,您首先会检查它们。
第二种做法:以原始形式存档成绩单,并单独保留更正后的版本。如果出现异议或法律程序,能够显示哪个词被更正、何时以及如何纠正可以保护记者。此外,记下您验证的每个报价旁边的时间戳,当您需要在几个月后返回该报价时,可以节省您的搜索时间。一旦文本经过时间戳清理和组织,您就可以安全地在新闻报道、专栏和下一个后续报道中一遍又一遍地使用相同的录音。
综上所述
自动转录是一个强大的加速器,可以将音频原材料从几小时缩短到几分钟;时间戳和说话者分离使验证更容易。但转录是一个蓝图:名称、数字、行话和重叠的言语经常会出错。新闻中的每一条引言均通过逐字收听录音进行验证;报价无法通过人工智能纠正。摘要和主题提取是单独的任务,仅提供方向。在敏感记录中,从一开始就考虑隐私和同意。
应用任务
自动转录录音(您自己的采访或公开演讲)。检索8个候选,提示“引用候选删除”;聆听时间戳中的每一个并标记它是否完全正确。请注意有多少引号包含错误(尤其是名称/数字)以及纠正需要多长时间。
清单
- [ ] 我认为该笔录是草稿;我不会在没有听过他们的情况下发表任何引言。
- [ ] 我首先从记录中确认个人姓名、机构和号码。
- [ ] 不更正引用;我用方括号表示更改。
- [ ] 我使用时间戳和说话者区分来进行验证。
- [ ] 我检查需要敏感或授权的记录中的安全车辆和权限状态。