单位 1 / 11

外交中的人工智能简介:角色、边界、身份验证、隐私和道德

收益:

  • 能够区分人工智能在外交工作流程中哪些地方可以节省时间(摘要、翻译、模式、草稿),以及哪些地方需要由人类做出判断、解释和陈述等决策,具体取决于风险程度。
  • 能够应用一门学科,通过将每个输出链接到源、用独立源确认它以及通过偏差过滤器传递它的步骤来验证每个输出。
  • 了解为什么在外交中从一开始就必须遵守保密、开放世界与机密世界之间的区别以及对偏见的警惕。

国际关系和外交中的人工智能简介:角色、边界、身份验证、隐私和道德

早上,您在外事服务台。一夜之间,一个邻国宣布了选举结果,一个国际组织发布了一项新的制裁决定,以三种不同语言发布了新闻稿,部长正在等待一份两页纸的简报,然后在中午会见对话者。你的办公桌上有数百条新闻、数十份官方文件、不同语言的声明以及大量需要验证的“说法”。外交(国家和国际行为者相互和平互动、谈判和代表其利益的艺术和职业)本质上是一个多语言、多资源、时间压力和高责任领域。人工智能(AI - 可以从历史数据中提取模式并生成或分类文本、翻译、摘要和草稿的软件)可以在如此丰富的信息和时间压力下加速您的工作。但这个模块的一开始就很明确:AI是助手、翻译/摘要工具、大纲生成器;你们是决定一个国家外交政策、谈判立场和最终评价的称职专家和决策者。

在第一个单元中,我们将重点关注纪律,而不是工具。您将了解人工智能在外交工作流程中哪些地方真正节省时间,哪些地方危险,如何验证每项输出,如何保护机密和机密信息,以及如何对偏见保持警惕。如果不奠定这个基础,后续的行动就会悬而未决——因为在外交上,未经证实的输出不仅是一个错误的答案,而且是一个可能导致两国之间误解、谈判削弱或机密信息泄露的错误。

人工智能在外交工作流程中有何用武之地?

让我们将外交事务分为两大类。第一类:大量、重复性、可提取模式和语言密集型任务。数百条新闻和报道的第一份摘要、多语言文件翻译的初稿、过去一年国家声明中反复出现的主题的提取、长篇谈判文本的条款比较、简报的第一个框架、开源信息在时间轴上的排列。在这些工作中,人工智能可以将时间缩短为几分钟,而且不会感到疲劳。

第二组:需要判断、解释、代表和责任的决策。一个国家的真实意图是什么,一份声明在外交上意味着什么,谈判中会做出什么让步,以什么语气向部长提交报告,信息是否可靠,文本是否可以作为官方立场签署。这些决策需要专业知识、政治承诺、背景知识和人类判断。在这里,人工智能会增加选项,生成草稿——但最终决定权和签名是你的。

让我们用一句话来澄清区别:AI 擅长解决“这堆里有什么,第一稿是什么样子”的问题;当涉及“这到底意味着什么以及我可以代表我的州捍卫这一点吗?”等问题时,决定权在您手中。

提示:在将工作外包给人工智能之前,问问自己:“如果这个输出错误,我会损失什么?”如果答案是“几分钟的重构”,请放心地委派。如果答案是“错误的政治信息、谈判错误或信息泄露”,就让人工智能出草案,你来做决定和验证。

隐私权:不可侵犯的原则

外交的核心是信任,而信任是建立在保密基础上的。谈判立场、与对话者的对话内容、情报评估或未经宣布的决定如果落入坏人之手,可能会产生不可逆转的后果。这里的经验法则是:任何机密(秘密、绝密)、个人或尚未公开的信息都不会被输入到未经您的组织批准的公共人工智能工具中。您在公共人工智能服务中输入的文本将在该服务的服务器上进行处理;您无法控制谁可以看到它、它存储在哪里以及是否将其用于训练模型。

因此,外交人工智能的使用在两个不同的世界中运作:通用工具可用于开源世界(公共新闻、官方声明、学术出版物);对于封闭/保密的世界,仅使用数据不会泄漏的内部、安全、经过批准的系统。混淆两者是该模块最危险的错误。

注意:“AI这么说”不是理由,在外交环境中没有任何效力。如果存在误译、捏造的引文或泄露的信息,责任不属于人工智能,而是属于未经验证而使用该输出或将该信息输入工具的外交官。

验证纪律:三步

AI 流畅、自信地生产;这并不意味着这是真的。人工智能偶尔会产生幻觉——也就是说,它把一个不存在的协议条款、一个不存在的声明、一个捏造的日期或一个错误的报价当作事实。在外交简报中,这是灾难性的。对每个输出应用三步反射:

  1. 将其连接到源。人工智能的每项主张都必须基于具体来源(官方声明、新闻、文件)。 “这些信息是在哪份文件中、在什么日期、从谁的口中得到的?”并亲自查看原始来源。
  2. 与独立消息来源确认。至少通过两个独立、可靠的来源验证任何重要的主张。不要依赖单一来源,尤其是有偏见的来源。
  3. 通过解释和偏见的过滤器。产出是否反映了一方的宣传?有替代读物吗?文化/政治背景是否正确?您的专家判断是最终的过滤器。

三个迷你箱子

案例 1 — 摘要节省了时间。危机期间,一个区域服务台总共遇到了 6 种语言的 340 条新闻和声明。由人工智能驱动的摘要将关键主题和政党立场提炼成 40 分钟的大纲;第一次扫描通常需要半天时间,现在已经加快了速度。但发送给部长的每一句话都与原始来源相关联并经过验证。

案例2——验证发现了幻觉。一位专家让人工智能总结了一份峰会声明。 YZ表示,“双方承诺到2030年减排50%”。当专家查看原始说法时,并没有这个数字; AI将两个相似的段落组合在一起,组成了一个不存在的承诺。归因步骤可防止虚假声明进入简报。

案例 3——隐私泄露事件返回。为了加快速度,一名新职员将部长与对话者的机密谈话记录粘贴到公共翻译设备中。这位高级外交官意识到:这是一份机密文件,而且已经泄露了。该事件被报告为安全漏洞;这项工作仅在内部安全系统中重做。

四个可复制模板

1)岗位适宜性评估:

您的角色:高级外交政策顾问。下面我将描述这份工作。告诉我(1)这项工作是可以委托给人工智能的摘要/翻译/起草工作还是需要判断和代表的关键决策,(2)错误输出的外交成本,(3)委托前后我需要做的验证。工作:[在此插入工作]

2) 链接到来源的义务:

我会给你开源文本。必须指定每个声明的来源:文档/新闻名称、日期、发言方。请勿在没有来源的情况下提出任何主张。如果您不确定,请将其标记为“需要验证”。不存在的承诺、日期或报价捏造。

3)隐私预检查:

在处理以下文本之前对其进行评估:它是否包含机密、个人或非公开信息?如果有,是哪些部分?如果不应在公共媒体中按原样处理它,请警告我。文本:[在此处写入文本]

4)偏见/观点控制:

在总结下面的文字时,请指出你代表哪一方的观点。区分文本中的主张和已验证的事实。简要补充对方可能如何看待这起事件。使用来源中的表达方式,而不是您自己的解释。

弱提示/强提示

弱提示:

总结一下这个国家的情况,告诉我们应该做什么。

这个请求是没有上下文的且危险的:不清楚什么资源、什么时间段以及人工智能被要求做出国家的政策决定。人工智能预测,可能有偏见,也可能捏造事实。

强力提示:

您的角色:区域分析师。来源:我将在下面粘贴,12条新闻和3条官方声明,全部公开(日期范围:3月1-15日)。任务:仅根据这些文本中实际包含的信息绘制(a)事件的时间表,(b)全文中明确表达的立场。注明每项的来源和日期。提出政策建议;我来做评价。如果您不确定,请将其标记为“必须验证”。

区别很明显:来源、时间段、“实际通过”约束和“政策主张”约束使输出安全有用。

角色/任务比较表

商业

人工智能的作用

男人的角色

验证

新闻/报道扫描

第一份摘要草案

评论、重要性顺序

链接到来源

翻译

翻译初稿

细微差别,官方语言

双语控制

开源情报综合

图案标记

可靠性判断

交叉焊缝

简报

骨架素描

语气、决定、签名

寻找源映射

谈判准备

剧本制作

战略、让步决策

专家评审

常见错误

  • 将人工智能输出误认为事实。输出始终是有待验证的草稿;请勿在未连接到来源的情况下进入简报。
  • 将机密/机密数据粘贴到开放工具中。一旦泄露,就无法挽回;这是最危险的错误。
  • 不请求资源的请求。如果你不询问来源/日期,人工智能可以编造一个事件、提交或引用。
  • 依赖单一且有偏见的来源。在外交中,每项主张都至少得到两个独立消息来源的证实。
  • 请求人工智能做出政策决定。决策和表达属于人类;人工智能仅生成选项和草稿。

总之

人工智能是外交的有力助手:它总结多语言数据、翻译数据、标记模式、生成草稿。但判断、解释、表达和最终决定属于人类。将两组区别(语言密集型任务与判断/表示决策)、三步验证(链接到来源、独立事实检查、偏见过滤)、隐私意识(开放与封闭世界区别)以及对偏见的警惕作为该模块的支柱。

应用任务

列出您自己(或想象的)办公桌上的 6 项任务。将每个分类为“人工智能可委托的摘要/翻译/草稿”或“人类判断/委托决策”。对于其中一项可转移的,使用上面的“职位适合性评估”模板并得到AI的回复;然后应用三步验证并尝试隐私预检查。

清单

  • [ ] 我将工作分为两类(语言密集/判断-表征决策)。
  • [ ] 我实施了三步验证(来源、独立事实核查、偏见)。
  • [ ] 我确保没有将机密/机密数据导出到公共工具。
  • [ ] 我将人工智能的每一项主张都与至少一个开源链接起来。
  • [ ] 我检查了输出中的政党/观点偏见。