收益:
- 根据风险级别,能够区分人工智能在心理健康工作中哪些方面可以实时节省时间,哪些方面临床责任和诊断/决策权应由人类专家承担
- 能够应用多层验证规则,根据证据、来源和临床判断来测试每个人工智能输出
- 人工智能不是治疗师、诊断师或督导员;能够内化一个明确的框架,即在发生危机/风险时,人员和紧急干预至关重要。
心理学试图了解一个人的痛苦、故事和内心世界;这是一个建立在信任、关系和责任之上的职业。这项工作的某些部分(编写文本、扫描源、编辑表格、准备材料)可以很快实现自动化。有些零件永远无法转移到机器上,因为它们关系到人的生活。人工智能(简称AI;从大量文本中学习模式并生成新文本、摘要或代码的软件)是这个行业的强大帮助:缩短文献综述的时间、起草报告、简化心理教育手册。但人工智能不是治疗师,而是治疗师。他不了解客户,不承担责任,在危机时刻不站在客户一边,不从道德和法律上追究客户的责任。
我们整个模块的目标是让您成为监督人工智能的心理健康专业人士,而不是依赖人工智能的从业者。在第一个单元中,您将学习在心理学业务中何处使用人工智能,何处绝对应该停止,以及如何验证每个输出。
人工智能在心理学领域能做什么、不能做什么
人工智能的真正力量在于生成语言、模式和轮廓。会议记录的框架、文献摘要的地图、心理教育文本的精简版、研究问卷的项目大纲、约会电子邮件的礼貌用语;所有这一切都在几秒钟内显现出来。在这些任务中,人工智能可以节省您的时间并减轻精神负担。
人工智能无法做的是需要临床判断的决策。做出诊断、评估风险、选择治疗计划、了解客户是否“好转或恶化”;这一切都不能用“通常是这样发生的”逻辑来完成。人工智能产生幻觉是因为它从互联网上的文本中学习:因此看似真实但不存在的来源可能会产生错误的统计数据或虚构的比例项目。在心理学中,这种类型的错误不仅仅是打字错误;而是错误。这意味着客户被误导、有害干预或违反道德规范。
注意:AI输出的是草稿,不是临床意见。诊断、风险评估和治疗决策等安全关键问题是由有能力的专家(心理学家、精神病学家)的判断和责任做出的。人工智能并不能取代这种推理。
按风险等级分为三个区域
安全使用人工智能最实用的方法是根据风险级别将每个任务分为三个区域。这种区别归结为“人工智能应该这样做吗?”快速准确地回答问题。
地区
示例任务
人工智能的作用
验证级别
绿色(低风险)
匿名心理教育文本简化、预约电子邮件、文献标题搜索、演示大纲
免费生产
快速审核
黄色(中等风险)
会议记录草稿、量表解释的语言解释、研究分析计划、主题代码建议
草案+提案
专家检查+来源/数据确认
红色(安全关键)
诊断、自杀/危机风险评估、治疗/药物决定、法医意见
仅提醒/清单
有能力的专家判断和责任是强制性的
在绿色区域要快。在黄色区域使用人工智能,但要验证每一个信息、数字和来源。在红色区域,AI永远没有最终决定权;顶多就是一个提醒,让专家脑海中浮现出一个控制项。
三个迷你箱子
案例 1 — 节省时间的使用。学校心理学家将为 40 名家长准备一本题为“青少年考试焦虑”的信息手册。如果手写的话,大约需要3个小时。通过让人工智能撰写匿名草稿、自我检查基于证据的内容并验证来源,他在 45 分钟内完成了这本小册子。大约节省了75%的时间,而且他对最终的内容负责。
情况 2 — 应该停止的地方。一位专家将客户的 3 次会议记录交给 AI,并询问:“这个人是否患有边缘性人格障碍?”他问道。 “症状是一致的,”人工智能自信地说。然而,AI没有见过客户,不知道病史,无法权衡鉴别诊断。如果专家使用此输出作为诊断,他或她将犯一个严重的错误;输出最多可以是“在面试中进一步评估这些领域”的形式的提醒。
案例 3——幻觉的代价。一位研究人员向 AI 请求了 10 个来源作为他的论文介绍。 AI产生10次引用;他们看起来都很完美。当研究人员检查时,他发现其中 4 个实际上并不存在,其中 2 个为真实文章指定了错误的年份/作者。这意味着 60% 的引用是错误的。如果他没有检查,他就会在论文中加入虚假来源。
多层验证纪律
验证不是可以因为“我稍后再看”而推迟的事情,它是工作流程的一部分。可靠的验证由五层组成:
- 回到证据。如果人工智能给出了结果、评级或建议,请通过主要来源(同行评审的文章、官方指南、量表手册)进行验证。
- 通过临床判断进行测试。输出对于这个客户、这个环境和这个文化来说真的有意义吗?用您自己的专家眼光来衡量。
- 与多个数据进行比较。不要依赖单个句子、单个分数或单个症状;让故事、观察和测量一起说话。
- 道德和隐私过滤器。此输出是否会伤害客户、侮辱客户、违反保密规定?
- 留下你的印记。记录哪些输出被验证以及如何验证;稍后再检查一下。
提示:“人工智能说”不是理由。临床或研究决策的基本原理始终是证据、测量、专业标准或有能力的专家判断。人工智能可以帮助你准备这些理由,但它不会取代它们。
可复制的提示和模板
以下模板使人工智能发挥安全作用。用您自己的(匿名)上下文填写方括号。
角色:你是一名起草助理,协助心理学专业的学生。您不做出诊断、进行风险评估或做出治疗决定。您的任务只是起草文本并分享您的想法。如有疑问,请写“专家验证”。任务:[任务]。限制:匿名数据;不得使用侮辱性语言;如果有来源声明,请标记“需要确认”。
从三个方面检查以下草稿,并逐项反馈:1)包含临床上不正确或过度主张的句子,2)尽管需要出处却没有来源的主张,3)污名化或评判性语言。如果您不确定自己的准确性,请写“未经验证”。文字:[文字]
将以下任务置于风险区域(绿色/黄色/红色),并用一句话写出理由。然后列出适合该区域的验证步骤。任务:[职位描述]
本文中的哪些陈述包含事实/统计声明?将每一项列为单独的行,作为“声明待验证”;我会从主要来源进行检查。文字:[文字]
弱提示/强提示
弱提示:“根据这位客户的症状,他的诊断是什么?”
该提示会调用 AI 执行其无法执行的工作(诊断),不会保护客户数据,并会导致自信但不准确的输出。
强有力的提示:“以下是匿名访谈摘要。不要做出诊断。相反,请建议我在临床访谈中应进一步评估的领域以及我应该记得问的问题作为检查清单。标记您不确定的地方。”
这个提示将AI置于正确的角色(提醒),保护数据,并将责任留给专家。
常见错误
- 将大纲误认为是临床意见。 AI 流利且自信的语言并不能证明其准确性;最有说服力的一句话,可能也是最错误的一句话。
- 将红色区域交给AI。让人工智能询问诊断、风险和治疗决策是试图将责任转移给软件;这既是道德错误,也是法律错误。
- 跳过验证。是否说“无论如何我都会检查一下”是报告中产生幻觉的第一个方式。
- 粘贴客户数据而不对其进行保护。向 AI 提供真实姓名和详细信息是对隐私的侵犯(请参阅第 2 单元)。
- 让AI充当监督者。人工智能会进行案例排练,但实际控制、问责和道德监督是人类主管的工作。
综上所述
在心理学中,人工智能是一种强大的辅助工具,可以生成语言和轮廓,但它不是治疗师、诊断师或督导员。将每个任务划分为绿色/黄色/红色风险区域;在红色区域(诊断、危机、治疗),临床判断和责任始终由人类专家承担。通过层层证据、临床判断、多重数据、道德过滤器和可追溯性筛选每个结果。 “人工智能说”从来都不是一个理由。
应用任务
根据您自己的实践(或想象的实践)写出 6 个典型任务:例如预约电子邮件、会议记录草稿、诊断问题、危机评估、文献综述、心理教育讲义。将每个区域放在绿色/黄色/红色区域中,并为每个区域编写一句话验证规则。最终结果是您自己的“人工智能风险地图”。
清单
- [ ] 我将任务放在绿/黄/红区域。
- [ ] 我没有将红色区域中的任何决定留给AI。
- [ ] 我对客户数据进行了匿名处理。
- [ ]我明确写出了对AI的“诊断/风险评估”限制。
- [ ] 我将输出通过了五层验证。
- [ ] 我承认我对最终内容负责并留下了我的印记。