收益:
- 能够应用保密、保密协议、个人数据 (KVKK/GDPR) 原则并选择正确的工具进行翻译工作
- 能够在机器使用中采用透明度、问责制、版权和原创性责任以及来源验证反射
- 了解为何人工验证不可或缺以及人工智能时代的职业转型
我们结束这个模块不是以技术技能,而是以保护职业诚信的原则。 AI赋予翻译强大力量;但这种权力也带来了有关保密、道德、版权和原创性的新的、严肃的责任。一份错误共享的机密文件、一次隐瞒的机器使用、一次侵犯版权或一项欺诈性的“人工翻译”索赔不仅会摧毁一家企业,还会摧毁一份职业和客户信任。在本单元中,您将了解隐私、职业道德、版权和数据问题、为什么人工验证必不可少,以及人工智能时代该行业的未来。
隐私和数据:不变的原则
译员手中的大多数文件都是保密的,保密是该行业的基本承诺。人工智能时代的四大规则:
- 将机密/个人/未发布的文本输入到数据政策不提供保证的公共工具中。您输入的文本将在外部服务器上进行处理;它可以在训练模型时使用和存储。
- 遵守 NDA(保密协议)。许多工作都带有保密协议;将文本提供给外部工具是直接违法行为,并会导致法律责任。
- 选择正确的工具。企业合同工具不仅可以“存储/训练数据”以用于机密工作;公共工程的通用工具。
- 私下保护个人数据(KVKK/GDPR 范围)。包含姓名、健康、财务和身份信息的文本需要额外小心;需要匿名或安全环境。
KVKK(个人数据保护法 - 土耳其)和 GDPR(欧洲数据保护法规)通过法律确定个人数据的处理方式;违法行为不仅是一个道德问题,也是一个法律问题。
注意:“只是一个快速翻译,没有人会看到它”是侵犯隐私的最常见理由。一旦发出,信息将无法收回。如有疑问,请勿将文本导出到外部工具;选择安全的方式。
道德和透明度:不隐藏机器的使用
人工智能时代职业道德的新轴心是透明度。客户有权知道他的工作是如何完成的。诚实的两条规则:
- 隐藏机的使用。如果您使用 MTPE 进行工作并且客户期望“纯人工翻译”,那么隐藏它是不道德的。定价和期望应相应调整。
- 诚实地陈述你的极限。从事自己专业领域(例如高级法律或医学)之外的工作,认为自己可以用人工智能“处理”,这是有风险的;人工智能并不能缩小你的知识差距。
还有责任:译者对交付的每一篇文本负责。 “人工智能是这样翻译的”不是借口;您对客户负责。
版权、数据和原创性
三个独立但相关的主题:
- 版权:待翻译的文本可能拥有版权;翻译也是一种衍生作品。未经许可翻译、出版作品属于违法行为。人工智能“重写”文本并不能消除版权问题。
- 训练数据和同意:人工智能工具使用公开的文本(有时是受版权保护的文本)进行训练;这是业内颇具争议的道德问题。您的贡献:未经许可,请勿将客户的数据“赠送”来训练模型。
- 原创性和幻觉:特别是在人类/文学文本中,人工智能可以产生虚构的引文、虚假来源、不存在的习语。您提交的文本的每项文化/事实主张都必须经过验证且真实。
提示:给自己设置一个“来源验证”反射:当人工智能给出名称、日期、引用、来源或“已知事实”时,不要在没有独立验证的情况下将其放入文本中。人文学科中捏造的参考文献破坏了整部作品的可信度。
人工验证:不可或缺的最后一环
本模块各单元的共同教训:人工智能加速,人类验证并承担责任。验证不是“额外的步骤”,而是工作的一个组成部分。在高风险文本(法律、医疗、安全、品牌)中,验证比翻译本身更重要。未经人工验证而交付的人工智能输出速度快但容易受到攻击。
该行业的未来:转型,而不是取代
人工智能不会让翻译人员失业;它改变了工作的性质。随着常规、直接、重复的翻译任务转移到机器上,译者的价值转移到机器无法完成的层面,例如译后编辑专业知识、质量判断、文化深度、专家领域知识、创译和验证。未来的翻译家;他是一个熟练使用人工智能的人,但知道哪些地方不值得信任,并凭借他的领域专业知识和文化判断力发挥作用。那些拒绝人工智能的人和那些盲目屈服于人工智能的人将被抛在后面;把它驯服为工具的人是第一位的。
三个迷你箱子
案例 1——透明度建立信任。一名翻译事先向客户解释说,他将使用 MTPE 来完成这项工作,哪些部分需要人力密集型,以及相应的价格。客户对透明度感到满意并提供了正常的业务;如果他隐瞒了这一点,信任就会在第一个问题时就被打破。
案例 2——违反保密规定成为职业风险。一名自由译者在公共工具中签订了一份保密合同;一旦客户发现违反保密协议,业务关系就会终止,参考资料也会丢失。单一的便利就毁掉了长期的信任。
案例 3 — 验证保存了真实性。在一份学术翻译中,人工智能添加了来源中没有的“引文”和虚构的作者姓名。译者的源验证反射抓住了这一点;如果提交,将违反学术诚信并损害声誉。
四个可复制模板
1) 隐私/工具可用性决策:
您的角色:数据隐私顾问。我将描述翻译工作涉及的内容。告诉我(1)该文本是否机密/个人/受版权保护,(2)是否适合在公共人工智能工具中处理它,(3)如果不适合,我应该使用什么安全替代方案。内容:[...]
2) 给客户的透明度说明草稿:
给客户写一篇简短的专业说明,诚实地解释我将如何完成这项工作:机器翻译+人工译后编辑,哪些部分将是人力密集型的,如何进行验证,相应的价格/时间。不要夸大,给信心。工作类型:[...]
3) 来源/事实核查清单:
省略以下翻译中需要验证的所有事实元素:名称、日期、数字、引文、来源/归属、“真相”主张、成语/谚语。将每一项都列为“通过独立来源确认”。不要相信文字,只相信可以验证的。翻译:[...]
4) 道德/版权预检查:
下面我将介绍一下工作。告诉我可能的道德和版权问题:文本的版权状态、翻译的衍生作品、个人数据、客户数据的保护、透明度的需要。列出风险和预防措施。工作:[...]
弱提示/强提示
弱:“翻译这份文件。” (隐藏文本可以转到外部工具,而无需质疑机密性、版权或工具兼容性。)
Güçlü:“首先评估一下:这个文件是一份患者报告,包含个人健康数据。是否应该在公共工具中处理,或者是否需要安全/机构环境?在KVKK方面我应该注意什么?确定合适的环境后给出翻译计划。”
不同之处:强提示从隐私和法律控制开始;确定正确且安全的环境后进行翻译。
道德维度表
尺寸
风险
预防措施
隐私
文件泄露、违反 NDA
安全工具、数据政策
个人资料
违反 KVKK/GDPR
匿名/安全环境
版权
未经授权的衍生作品
检查权限/权限
透明度
隐蔽式机器使用
对客户开放
原创性
幻觉,虚假来源
来源验证
问责制
“人工智能做到了”的借口
承担责任
常见错误
- 将秘密文本输入公共工具“以使其快速”。不可撤销的违规行为。
- 向客户隐藏机器的使用情况。当信任被破坏时,就很难恢复。
- 忽视版权和衍生作品权。法律风险。
- 未经验证就将人工智能编造的出处/引述放入其中。失去原创性和声誉。
- 将责任推给人工智能。所交付作品的所有者是译者。
综上所述
人工智能时代,译者的责任与权力也随之增加。隐私不可侵犯:机密、个人和受版权保护的文本不会进入不安全的介质。道德要求透明度和问责制:机器的使用不被隐藏,责任被接受。版权和原创性受到重视; AI可以组成的来源和短语经过验证。人工验证是工作中不可或缺的最后一个环节。这个职业的未来属于那些熟练使用人工智能但知道其局限性并通过他的文化和专家判断发挥作用的译者。
应用任务
对手头的工作(或样本)进行全面的“负责任的翻译”检查:使用“保密性/工具适用性决策”模板确定正确的工具;通过“道德/版权预检查”列出风险;起草一份“给客户的透明度备忘录”;并在翻译样本中提取“来源/事实核查清单”,并独立验证至少三项。将这四个步骤添加到您自己的标准工作流程中。
清单
- [ ] 我评估了文本是否机密/个人/受版权保护,并选择了正确的工具。
- [ ] 我额外关注了 KVKK/GDPR 范围内的数据。
- [ ] 我对机器的使用和流程向客户保持透明。
- [ ] 我已独立核实 YZ 提供的来源、引述和事实。
- [ ] 我把交付工作的责任留给了我自己,而不是人工智能。
模块考试
1、以下哪项对人工智能在笔译和口译领域的定位最准确?
- A) 人工智能是蓝图、术语和质量工具;意义、语气、文化和最终表达的责任在于人类 ✔
- B)人工智能可以直接提供法律和医学翻译,无需人工批准
- C) 人工智能只起翻译文字的作用,与质量和术语无关
- D)由于人工智能总是比人类更准确,因此所有翻译决定都应留给它。
描述:人工智能;它是翻译草稿、术语、摘要和质量帮助。对意义、语气、文化、创造力和最终交付的责任由有能力的译员负责;未经验证的输出可能会导致合同错误、医疗事故或商标危机。
2. 如果机器翻译输出“流畅但不准确”,这意味着什么?为什么它很危险?
- A) 流利的翻译总是正确的,因此不需要额外的检查
- B) 即使该句子在目标语言中看起来很自然,但也可能错误地传达了含义、数量或否定;流畅并不能保证准确性✔
- C) 不正确的翻译总是在语法上不正确并且很容易被注意到。
- D)流畅性仅在文学文本中很重要,在技术文本中并不重要
解释:即使机器翻译产生了完美、自然的句子,它也可能破坏了源中的数字、否定或含义。流畅并不能保证准确性;因此,数字、日期、专名和否定词应与来源分开核对,不要被流畅性所迷惑。
3. NMT(神经机器翻译)和基于LLM的翻译之间的主要区别是什么?
- A) NMT接受指令,但LLM不能;所以LLM只能逐字翻译
- B) 它们完全相同,没有实际差异
- C) LLM 能够理解语气、术语和受众等指令,并看到更广泛的背景; NMT 快速且一致,但不善于接受指令 ✔
- D) LLM 总是比 NMT 快并且永远不会相加
描述:NMT 快速且一致,但在接受指令和了解更大背景方面较差。另一方面,法学硕士可以理解语气、术语列表和受众等指令,并更广泛地了解上下文,但需要控制幻觉的风险,因为它可以进行补充。
4. 轻度后期编辑和全面后期编辑有什么区别?
- A) 轻度后期编辑质量更好,全面后期编辑只需快速扫描
- B) 两者没有区别,只是名字不同
- C) 全面后期编辑仅用于内部使用的文本,轻度后期编辑用于要出版的文本
- D) 轻度后期编辑使文本准确易懂;全面的译后编辑旨在实现人工翻译质量、可出版的结果✔
点评:轻度后期编辑的目标是使文本准确易懂;无文体风格,适合内部/临时文本。在完整的译后编辑中,目标是使输出与人工翻译没有区别;对于将要发布的具有品牌知名度的文本是必需的。
5. 为什么 MTPE 会出现“过度编辑”问题?
- A) 过度修正总是会让翻译更准确,所以鼓励
- B) 重写正确且适当的句子不必要地破坏了MTPE的时间优势;仅应纠正有缺陷的区域✔
- C) 过度校正只会提高速度,根本不会影响质量
- D) 矫枉过正不仅是机器翻译的问题,也是草稿翻译的问题
解释:矫枉过正是指仅仅出于个人喜好而改写机器给出的正确、恰当的句子。这破坏了MTPE的整个时间优势。规则:如果机器输出准确、可理解且合适,请勿触摸;如果错了就改正吧。
6. 在术语库中指定“禁止条款”(不应使用的翻译)的主要好处是什么?
- A) 没有必要指定禁止响应,因为机器无论如何都不会犯任何错误。
- B) 禁止等同物仅在文学翻译中有用,在技术文本中没有必要
- C) 明确禁止错误的替代品和正确的替代品,防止品牌语言的不一致和扭曲 ✔
- D) 指定禁止的等价物会减慢翻译速度并且没有任何好处。
说明:仅仅写出正确的答案并不能阻止使用不正确但看似合理的替代方案。明确说明禁止的等效项(仅使用“帐户”、“个人资料”、“帐户”的“会员资格”)是避免品牌语言不一致和损坏的最有效方法。
7. 翻译记忆库 (TM) 中应写入哪些内容?为什么?
- A) 每个机器输出都应该写入 TM 而不进行验证,因为速度至关重要
- B) 不应将翻译写入 TM,仅应保留源文本
- C) 不同客户的 TM 应该混合在一起形成一个大 TM
- D) 只能撰写经过验证、认证的翻译;如果原始机器输出进入TM,错误将被转移到未来的作业并传播✔
备注:仅应将经过验证、认证的翻译提交给 TM。将原始机器输出保存到 TM 而不验证它会导致错误反复返回到未来的作业,似乎被信任为“100% 匹配”。垃圾进来,垃圾出去。
8. 本地化时如何处理软件文本中的占位符(例如{name}、%s)?
- A) 占位符按原样保留;仅在必要时才进行翻译、删除、格式化、移动并由 QA 检查✔
- B) 占位符和其他单词一样,必须翻译成目标语言
- C) 应删除占位符,因为它们会损害可读性
- D) 占位符并不重要,在翻译中根本不需要考虑
说明:占位符是运行时填充变量的标志。翻译、删除或格式化它们将导致软件崩溃或显示原始文本。占位符按原样保留;只有占位符可以根据目标语言的语法移动,并且占位符 QA 巡演肯定已经完成。
9. 字幕翻译中的CPS(每秒字符数)限制是什么意思?
- A) 它确定将使用多少种颜色,而不是字幕将在屏幕上保留多少秒。
- B) 仅对配音有效,与字幕无关
- C) 字幕速度限制,以便观众能够轻松阅读;所以字幕需要缩短,同时保留含义✔
- D) CPS越高,字幕越好,无需设置限制
描述:CPS 是观看者舒适地阅读字幕所需的速度限制(成人内容通常约为 17 个字符/秒)。这就是为什么字幕翻译不是逐字翻译,而是在保留意思的情况下进行拟合和缩短;观看者既观看又阅读图像。
10. 为什么在自动语音识别(ASR)生成的转录经过验证之前不应开始翻译?
- A) ASR 总是万无一失,因此验证是浪费时间
- B) ASR 只会出现语法错误,不会扭曲意思
- C) ASR 输出已翻译,无需进一步翻译
- D) ASR 在专有名称、数字、重音和噪音方面尤其容易出现错误;错误的转录必须通过语音进行验证,因为它将被带入翻译中✔
解释:ASR 在噪音、口音、重叠语音、专有名称、数字和技术术语方面经常出现错误。不正确的转录会直接影响到翻译和字幕。因此,特别是专有名称、品牌和数字应通过与声音比较来验证。
11. 像 MQM 这样的错误框架在评估翻译质量方面提供了什么?
- A) 它允许按类别和严重性(关键/主要/次要)对每个错误进行分类,并以客观和可比较的方式对质量进行评分 ✔
- B) 自动纠正翻译,完全消除人工评价
- C)它只捕获数字错误,不处理语义和术语错误
- D) 不衡量质量,只计算翻译的长度
描述:MQM(多维质量指标)将每个错误分配给一个类别(准确性、术语、流畅性、风格、格式)和权重(严重/主要/次要)。这样,可以给出错误分数,而不是“好/坏”主观性,客观地比较翻译器/引擎,并且可以将交付决策与数字阈值联系起来。
12. BLEU 等自动翻译指标的主要限制是什么?
- A)它使得人类评估变得不必要,因为它比人类更好地理解含义
- B) 看着单词重叠,并没有真正理解意思;因此系统可以衡量趋势,但无法决定单个文本的传递✔
- C)他总是完美无缺,并且可以独自决定文本的交付能力
- D) 仅用于口译,与书面翻译无关。
解释:BLEU 根据与人类参考的单词重叠对翻译进行评分,但实际上并不理解其含义。与参考文献不同但正确的翻译可能会获得低分,而与参考文献相似但不正确的翻译可能会获得高分;严重的消极错误对分数影响不大。因此,公制衡量的是趋势,而不是决定单个文本的传递。
13. 人工智能在会议口译中最强大、最合适的作用是什么?
- A) 全面开展现场同声翻译,消除对口译员的需求
- B) 自动将机密会议音频传输至外部服务
- C) 在翻译的任何阶段(包括准备阶段)都没有任何用处。
- D) 充分的赛前准备(简报、双语词汇、号码卡和专有名称卡);实时同声翻译留给人类 ✔
描述:在口译中,大部分工作都是在准备过程中进行的,而这正是人工智能的强大之处:准备现场简报、双语术语表、演讲者语气、号码和专有名称卡。由于延迟、错误、保密性和上下文,实时同声翻译本身是翻译人员的责任。
14. 创译(创意翻译)与其他类型的翻译有何不同?
- A) 忠实于消息来源的情感影响和目的,而不是其文字;人们可以远离源头,在目标文化中创造同样的效果 ✔
- B) 始终逐字翻译源文件,不要更改它
- C) 这是一种仅在法律和医学文本中使用的直译类型。
- D)完全忽略含义并编写新的随机文本
描述:创译,尤其是在广告和品牌文本中,是为了在目标文化中重建来源(而不是文字)的情感影响和目的;有时,人们会故意偏离源头,因为目标不是字面上的保真度,而是相同的效果。人工智能在这里是一个想法倍增器;最终的文化决定是由人类做出的。
15. 翻译机密文件(例如未签署的合同或患者报告)时,正确的做法是什么?
- A)进入最实用的公共翻译工具速度,隐私是事后的想法
- B) 如果文档无论如何都要翻译,保密性并不重要,任何工具都可以使用
- C) 公共车辆不得通行;仅使用不存储数据的安全和企业工具,如有疑问,不会将文本提供给外部工具✔
- D) 如果机密文件仅通过语音翻译,则不存在隐私风险
披露:机密、个人或未发表的文本不会输入到数据政策不提供保证的公共工具中;根据 KVKK/GDPR,这是 NDA/隐私违规和法律风险。仅使用不存储/训练数据的企业和安全工具;如果有疑问,文本不会提供给外部工具。