单位 8 / 10

数据主权、KVKK/EU 和隐私:您将数据委托给谁?

收益:

  • 了解数据主权、国际传输和数据保留的概念
  • 了解 KVKK 和欧盟法规对型号选择的具体影响
  • 能够实施通过区域托管、零保留和开放权重来增强数据控制的方法

我们学习了模型选择的技术方面(阶段、背景、成本)。但也许企业决策中最重要的方面不是技术,而是法律和道德:您将数据委托给谁、在哪里以及以什么保证?对于每一个处理个人数据的机构来说,这个问题不是一个选择,而是一个法律义务。错误的选择可能会导致罚款、声誉损失和客户信任的丧失。在本单元中,您将学习数据主权、国际传输和数据保留的概念;您将看到 KVKK 和欧盟法规对模型选择的具体影响,并能够实施加强数据控制的方法。

三个基本概念

  • 数据主权:数据受处理所在国法律管辖的原则。无论您的数据在何处处理,都适用该国家/地区的规则。那么“我的模型处理效率在哪里?”这个问题是战略性的。
  • 国外数据传输(跨境传输):在您所在国家/地区之外的服务器上处理或存储个人数据。将文本发送到封闭模型通常意味着将数据传输到提供商的服务器(通常是国外)。
  • 数据保留:提供商保留您发送的数据的时间及其用途。一些提供商提供根本不存储数据的选项(“零保留”);有些人将其保留一段时间。
提示:在与任何提供商合作之前,请澄清三个问题:(1) 数据在哪里处理? (2) 保存期限是多久? (3) 模型是用我的数据训练的吗?这三个问题的答案决定了您的隐私立场。

KVKK 的关键点:国际转账

土耳其的个人数据处理受 KVKK(个人数据保护法)监管。向国外的人工智能提供商发送包含个人数据的文本被视为“国外数据传输”,并受 KVKK 关于此主题的特殊条件的约束。这些条件;它包括相关人员的明确同意、转让所在国家是否存在充分的保护或提供适当的保障措施(例如承诺书、标准合同条款)等条件。

实际上,这意味着不假思索地将客户姓名、TR ID 号、健康信息、财务数据等个人数据发送给海外模特可能会让您面临法律风险。如果您在欧盟运营,则 GDPR(欧洲数据保护法规)也适用类似的原则,并且国际传输也受到严格的规则的约束。

注意:说“我们的数据已经是匿名的”并不像人们通常想象的那么安全。即使您从文本中删除姓名,上下文仍然可以识别该人。真正的匿名化需要专业知识;无论如何,您不确定,最安全的方法是接受这些数据作为个人数据并采取相应的行动。这是您需要与法律/合规团队合作的事情。

加强数据控制的方法

如果您正在处理个人或机密数据,可以采取具体方法来增强控制:

方法

它是如何运作的

适合谁?

区域托管

特定地理位置(例如欧盟)的数据处理

区域法律合规要求

零数据保留

提供商根本不存储数据

隐私敏感度高的机构

企业/API协议

承诺您的数据不会用于模型训练

处理商业秘密的人

开放权重+自己的服务器

数据永不离开

要求绝对保密

数据屏蔽/提取

发送前删除个人字段

几乎所有场景中的附加层

这些方法并不相互排斥;一般来说,几种一起使用是最健康的。例如,遮蔽个人区域和使用具有零保留合同的提供商都提供了两层保护。

为什么原产国很重要?

  1. 在该单元中,我们列出了提供者的原籍国;原因如下。提供商所在的国家/地区决定其遵守哪些法律以及处理您的数据所依据的法律框架。虽然欧洲的提供商(例如 Mistral)为希望留在欧盟境内的组织提供了天然优势,但不同司法管辖区的提供商可能需要额外的合规工作。原产地不是营销细节;这是一个法律和战略标准。

三个现实案例

案例1——医院的线路。一家医院希望利用人工智能来总结患者病历。患者数据属于最敏感的个人数据类别。由于他们无法承担将其发送到海外云的法律风险,因此他们在自己的数据中心运行开放权重模型。数据永远不会离开机构; KVKK 和患者的信任都受到保护。他们牺牲了便利,但他们做了正确的事。

案例 2 — 电子商务中的屏蔽。一家电子商务公司希望通过人工智能回复客户支持电子邮件,但电子邮件包含客户姓名、地址和订单信息。在将其发送到模型之前,他们在预处理步骤中用占位符替换个人字段(例如“[CUSTOMER]”而不是“Ayşe Yılmaz”)。该模型会在不丢失上下文的情况下生成响应草案,但个人数据永远不会发送给提供商。他们还通过选择零托管协议的提供商来加倍保护。

案例 3 — 欧盟金融的区域托管。一家总部位于法兰克福的金融科技公司希望利用人工智能分析交易数据,但不希望数据因 GDPR 的原因而离开欧盟。他们采用欧盟托管模式,并签订企业协议和区域加工保证。法律团队用标准合同条款和交易记录记录整个过程;他们留下一条踪迹以供检查。

弱提示/强提示:兼容性评估

弱提示:

使用该模型与 KVKK 兼容吗?

没有上下文;该模型只能提供一般性答案,不能替代法律建议。

强力提示:

您的角色:具有数据保护意识的人工智能顾问(初步分析,不是法律建议)。状态:我们是土耳其的一家健康技术公司。我们正在考虑将患者预约记录(姓名、电话号码、投诉)发送给国外的模型进行总结。我们受制于KVKK。任务:列出该场景中的对外转移风险。为了降低风险,请考虑屏蔽、零存储、区域托管和开放权重选项以确保适用性。最后,将“必须咨询律师”的要点收集在单独的标题下。

强烈的提示清晰地给出了场景和法律框架,并要求模型不是提供法律建议,而是向律师提供初步分析;这种区别至关重要。

可复制模板

1、数据流向图:

逐步描述以下工作流程,并标记每一步哪种数据类型的去向:[工作流程]。将包含个人数据的步骤标记为红色,将不包含个人数据的步骤标记为绿色。还标明出国的每一个点。

2. 遮蔽方案:

以下文本类型 [示例文本] 中的哪些字段是个人数据?在将它们发送到模型之前,提出一个规则列表来屏蔽它们(哪个字段将被替换为什么)。展示如何在不破坏上下文的情况下进行屏蔽。

3. 提供商隐私清单:

我正在评估以下提供商 [PROVIDER]。我需要索取哪些文件(隐私政策、数据处理协议、保留期限)来回答这些问题?为每个问题添加“为什么它很重要”注释。还要提到原产国效应。

4、初步拟合分析:

我们在[行业]字段中处理[数据类型],并且[法律框架:KVKK/GDPR]适用。初步分析强调了使用外国模式的法律障碍和可能的解决方案(明确同意、适当的保障措施、区域处理)。解释这不是法律建议,哪些要点应咨询专家。

常见错误

  • 不假思索地发送个人数据:将姓名、ID、健康、财务数据等信息发送给海外模型,无需进行预处理。
  • 假设“匿名”:误认为删除名字就是完全匿名;背景仍然可以定义这个人。
  • 不阅读存储策略:在不知道提供商存储了多少数据以及是否在训练中使用这些数据的情况下开始。
  • 忽略原产国:在做出决定时不考虑提供者须遵守哪项法律。
  • 将人工智能置于律师的立场:将模型的拟合分析误认为是明确的法律建议;跳过对关键决策的专家确认。

综上所述

  • 数据主权意味着您的数据受处理所在国家/地区的法律约束; “产量在哪里处理?”这是一个战略问题。
  • 就 KVKK 而言,将个人数据发送到海外模型是“数据传输到国外”,并且受到特殊条件的约束。
  • 区域托管、零保留、企业协议、显式加权和屏蔽;它们是增强数据控制的方法,可以一起使用。
  • AI的合规性分析只是第一步;关键决策必须由法律/合规团队做出。

应用任务

  1. 获取您在单元中提取的来源/许可说明以及包含您工作中的数据的流。使用本单元中的模板 1(数据流图),绘制出数据的去向并标记包含个人数据的步骤。然后使用第二个模板(屏蔽计划)确定在发送这些步骤之前将屏蔽哪些字段。记下生成的地图并计划与您所在机构的合规负责人共享。

清单

  • [ ] 我可以解释数据主权、国际传输和数据保留的概念。
  • [ ] 我知道在 KVKK 中向外国模特发送个人数据会触发什么。
  • [ ] 我可以匹配五种增加数据控制的方法以及它们适合谁。
  • [ ] 我可以对工作流程进行数据映射并标记风险点。
  • [ ] 我了解人工智能合规分析不能替代法律建议,并且专家验证至关重要。