单位 1 / 11

土耳其语言和文学中的人工智能简介:角色、边界、验证、真实性和伦理

收益:

  • 能够区分人工智能在文学和语言研究中哪些地方可以节省时间(摘要、扫描、编辑、草稿),以及哪些地方需要由人类做出解释、审美判断和原创性等决定,具体取决于风险水平。
  • 能够应用一门学科,通过将每个输出连接到文本、通过独立来源确认以及通过原创性过滤器来验证每个输出。
  • 为了能够理解为什么从一开始就应该观察人类领域的幻觉、捏造的来源、原创性和保密性。

想想文学老师、编辑或文学研究员的桌子。一本几百页的小说、一篇需要简化的旧课文、一本考试的诗歌分析、一本需要排版的杂志、一篇需要检查引文的文章、一份要教给学生的教案,都在一周之内摆在桌面上。土耳其语言和文学就其本质而言,涉及文本、语言、解释和文化记忆;这是一个需要大量阅读和大量写作的领域。这正是人工智能(AI - 可以通过从过去的文本数据中提取模式、总结、翻译或分类来生成新文本的软件)可以加快您处理文本丰富度和时间压力的地方。但这个模块一开始就很明确:AI是阅读、总结、起草和编辑的助手;您是决定文本含义、哪种解释有效以及最终审美判断的称职专家。

在第一个单元中,我们将重点关注纪律,而不是工具。您将了解人工智能在文学和语言研究中哪些地方可以节省实时时间,哪些地方是危险的,如何验证每个输出,如何保留原创性,以及为什么没有工具可以在文学解释方面取代人类。如果不奠定这个基础,后续的单位就会停留在空中——因为在人类领域未经验证的结果不仅是一个错误的答案,而且是一个错误的答案。它可能是向学生传达的捏造信息、文章中包含的虚构来源或对作者不公平的评论。

人工智能在文学和语言研究中有何用武之地?

让我们把东西分成两大堆。第一类:大量、重复性、可提取模式和语言密集型任务。长篇小说的逐章摘要、文本中的词频提取、诗歌中的修辞格初稿列表、文章参考书目的格式控制、教学计划的框架、文本的拼写和标点符号扫描、标记数十篇文本中的相似主题。在这些工作中,人工智能可以将时间缩短为几分钟,而且不会感到疲劳。

第二组:需要解释、审美判断、原创性和责任感的决策。一首诗实际上讲了什么,一部小说遵循哪种传统,一篇文章的文学价值,给学生写作的评分,评论是否忠实于作品,句子是用你的声音还是机器的声音写的。这些决定需要经验、阅读文化、理论知识和人类直觉。在这里,人工智能会增加选项,生成草稿——但最终决定权和签名是你的。

让我们用一句话来澄清区别:人工智能擅长解决“文本内容是什么以及第一稿是什么样子”的问题;当涉及到诸如“这段文字的真正含义是什么以及这种解释是否站得住脚?”等问题时,决定权在您手中。

提示:在将工作外包给人工智能之前,问问自己:“如果这个输出错误,我会损失什么?”如果答案是“几分钟的重构”,请放心地委派。如果答案是“错误传授的信息、捏造的来源或对作者不公正”,请让人工智能生成草稿,然后由你做出决定和验证。

人类领域的特殊风险:幻觉和捏造来源

AI 流畅、自信地生产;这并不意味着这是真的。人工智能偶尔会产生幻觉——也就是说,它把一部不存在的作品、一条不存在的台词、一个不正确的出版日期或一篇从未写过的文章呈现为真实的。在文学和语言领域,这种风险尤其高;因为:

  • 人工智能可以从诗人的口中说出“符合他的风格”但不是他自己的诗句,并将其呈现为实际的引用。
  • 他可能会记错小说的情节并虚构一个不存在的人物或结局。
  • 他或她可能会建议一本不存在的书、一本虚构的杂志或一个不正确的页码作为文章的来源。
  • 它可能会混淆文学运动的历史、代表或日期。

因此,在这个领域,来源验证、原创性和引用诚实性是该模块的支柱。永远不要仅仅因为人工智能说了就使用一行、一个日期或一个来源;通过返回主要来源(文本本身、可靠的版本、同行评审的出版物)来验证每个内容。

注意:“AI这么写”并不是理由。如果学生或读者收到了虚构的台词、虚构的来源或不正确的分析,责任不属于人工智能,而是属于未经验证而使用该输出的专家。

验证纪律:三步

对每个 AI 输出应用三步反射:

  1. 链接到文本/来源。人工智能的每一个主张都必须基于具体的文本。 “这句话出现在哪首诗的哪一行?这个来源真的存在吗?它的身份是什么?”亲自询问并了解真相。
  2. 与独立消息来源确认。至少通过两个可靠来源(百科全书、同行评审出版物、权威版本)验证日期、作者或文学评估。
  3. 通过解释和原创性的过滤。这个解释忠实于文本吗?你自己的声音还是机器的陈词滥调?有替代读物吗?您的专家判断是最终的过滤器。

真实性和保密性

原创性意味着文本真实地传达了你的想法和表达。将人工智能生成的草稿作为自己的作品呈现;对于学生来说,意味着抄袭;对于学者来说,意味着违反道德规范;对于作家来说,意味着失声。在整个模块中,我们将人工智能定位为“思考和纠正”工具,而不是“替代”工具。

保密也是不可侵犯的。不要将未出版的小说、学生的个人数据、经过同行评审的论文或出版社的合同手稿输入到您所在机构尚未批准的公共人工智能工具中。您在公共工具中输入的文本将在该服务的服务器上进行处理;您无法控制谁可以看到它以及它的存储位置。

三个迷你箱子

案例 1 — 摘要节省了时间。一位老师在上课前逐章总结了一本420页的小说。第一个人工智能驱动的剧情简介将主要情节和主题缩减为 30 分钟的大纲;第一次扫描通常需要一天的时间,现在已经加快了速度。但讲座中的每一个评论都被老师自己的阅读所证实。

案例2——验证发现了幻觉。一位研究人员向人工智能询问一位诗人的诗句。 AI自信地给出了一句诗并将其归功于诗人。当研究者查看诗人的书时,并没有这样的诗句; AI模仿诗人的风格,编造了一首不存在的诗句。链接到文本的步骤防止了虚构的引用出现在文章中。

案例 3——在最后一刻发现了假消息来源。一名本科生在其论文的参考书目中添加了 YZ 建议的三个“来源”。当他的顾问检查时,他发现其中两本根本不存在,其中一本被归因于错误的期刊。学生学会了根据图书馆目录验证每个来源。

四个可复制模板

1)岗位适宜性评估:

您的角色:高级文学编辑和教师。下面我将描述这份工作。告诉我(1)这个工作是可以委托给人工智能的摘要/扫描/草稿工作,还是需要解释、审美判断和原创性的关键工作,(2)错误输出的成本,(3)委托前后我需要做的验证。工作:[在此插入工作]

2) 链接到文本的义务:

我会给你一篇文学课文。对于您的每项主张,必须引用文本并显示其位置(章节、诗句、页码)。请勿编造任何文中未包含的诗句、事件或引言。将不确定的地方标记为“必须从文字中验证”。文本:[在此处粘贴文本]

3)源完整性检查:

对于您推荐的每个来源,请提供作者、完整标题、出版商/期刊、年份以及页码(如果可能)。不要提供任何您不确定存在的来源;如果不确定,请写“必须验证”。不要制造假印记。如果没有来源,请说“我找不到来源”。

4)真实性/语音控制:

仅为了流畅性和拼写而更正以下段落,保留我的措辞。添加新的想法、陈词滥调或奇特的短语。不要重写句子;保护我的声音。简要列出您更改的地方。段落:[在此处插入段落]

弱提示/强提示

弱:“解释一下这首诗。”

古克吕:“用细读的方法分析下面这首诗。只依靠文中的文字、图像和修辞手法,不要添加任何文中没有的信息。每条评论都引用相关的台词。不要对诗人的生平做出假设。最后,把你不确定的、需要我核实的地方分别列出来。”

强大的提示功能;它重新定义了范围、举证责任、限制和验证点。在微弱的提示下,人工智能用陈词滥调和捏造的内容填补了空白。

角色分配表

商业

人工智能的作用

男人的角色

小说摘要

初稿摘要

评论与验证

词频

计数并列出

有道理

诗歌分析

修辞草图

审美判断,最终评论

采购

建议

确认有

校对

拼写/标点符号扫描

样式和最终批准

课程计划

骨架

成就和教学决定

常见错误

  • 使用 AI 给出的字符串/引用而不进行验证。人类领域最危险的错误;每个引用都可以追溯到主要来源。
  • 将解释完全留给人工智能。审美判断是不可剥夺的;人工智能产生陈词滥调,你进行原创阅读。
  • 将来源添加到参考书目中而不进行确认。人工智能可以产生想象的印记。
  • 将机密/未发布的文本输入公共工具。它会带来原创性和版权风险。
  • 将AI草案作为自己的作品呈现。这意味着抄袭和失声。

综上所述

AI是文学和语言研究的强大阅读、摘要、扫描和编辑助手;但它不能承担解释、审美判断、原创性和最终责任。这方面最大的风险是幻觉和虚构的来源;因此,每个输出都链接到文本,由独立来源验证,并通过原创性过滤器。使用人工智能作为“思考和纠正”而不是“取代”的工具。

应用任务

拿你本周完成的三项任务(例如:文本摘要、分析、文献综述)。每项填写表格:人工智能的作用是什么,人类的作用是什么,错误输出的成本是多少,你会做什么验证?然后用上面的“链接到文本”模板给人工智能一个任务,并验证文本输出的每个断言。

清单

  • [ ] 我将工作分为“可委托的”和“需要判断的”。
  • [ ] 我已经验证了主要来源的每一条引文和每行内容。
  • [ ] 我已经确认每个资源确实存在。
  • [ ] 我没有在公共工具中输入机密/未发布的文本。
  • [ ] 我用自己的声音和判断过滤了输出;我并不拥有它本来的样子。