Yksikkö 7 / 12

Tietojen käsittely, tallennus, minimointi ja anonymisointi

Voitot:

  • Ota tekoälynäkökohdat huomioon datan elinkaaren kaikissa vaiheissa
  • Aseta säilytysajat ja sisällytä tekoälykeskusteluhistoriat tuhoamiskäytäntöön
  • Anonymisoinnin ja pseudonymisoinnin eron soveltaminen

Tietojen "jälkeen" osa tietosuojavastaava jättää usein huomiotta. Kun teksti on syötetty tekoälyyn, näyttää siltä, ​​että työ on tehty; Ne tiedot kuitenkin tallennetaan jonnekin, ehkä käytetään mallikoulutuksessa, ehkä se kerääntyy chat-historiaan kuukausia. Tässä osiossa käsittelemme henkilötietojen elinkaarta askel askeleelta; Opimme säilytysajoista, tekoälykeskusteluhistorian tuhoamisesta ja kahden kriittisen tekniikan – anonymisoinnin ja pseudonymisoinnin – erottamisesta. Tavoitteena on hallita tietoja koko sen elinkaaren ajan, ei vain sen syöttämisen aikana.

Datan elinkaari ja tekoäly

Henkilötiedot kulkevat elinkaaren ajan; Jokaisessa vaiheessa on tekoälykohtaisia ​​huomiopisteitä.

Vaihe

Mitä tapahtuu?

AI huomiopiste

kokoelma

Tietoja saadaan

Onko tarkoitus ja perusteet selvät? Onko se minimoitu?

Käyttö/käsittely

Syötetty tekoälyyn, käsitelty

Onko naamiointi tehty? Hyväksytty ajoneuvo?

varastointi

Tiedot säilytetään

Kuinka kauan chat-historia kestää?

siirto

menee jollekin muulle

Kansainvälinen palvelin? Onko asianmukainen vakuutus?

Tuhoaminen

Poistaminen/anonymisointi

Poistettiinko se, kun tarkoitus oli suoritettu? Onko varaosia mukana?

Kaksi eniten laiminlyötyä vaihetta ovat varastointi ja hävittäminen. Tiedot "unohdetaan" ja kerääntyvät edelleen järjestelmään - mikä sekä rikkoo KVKK-periaatetta että lisää vahinkoa rikkomuksen sattuessa.

Säilytysaika: kuinka kauan voit säilyttää sen?

KVKK:n säilytysperiaate on selvä: henkilötietoja ei saa säilyttää pidempään kuin on tarpeen sen tarkoituksen kannalta, jota varten niitä käsitellään. Kun tarkoitus ei ole enää käytettävissä, tiedot on poistettava, tuhottava tai anonymisoitava. Laitos laatii varastointi- ja hävittämispolitiikan; määrittää kunkin tietoluokan säilytettävän määrän.

Tekoälyä koskeva kriittinen kohta: AI-chat-historiat ovat myös tallennettuja tietoja. Jos työntekijä on syöttänyt asiakastietoja samaan chattiin kuukausia, historiasta tulee tietovarasto. Tätä varten:

  • Määritä tietojen säilytysasetukset yrityksen tekoälytyökaluissa (poista historia automaattisesti, jos mahdollista tai poista käyttö mallikoulutuksessa).
  • Sisällytä chat-historia tuhoamisaikatauluusi.
  • Varmista yrityssopimuksessa vaihtoehto "Älä käytä mallikoulutuksessa" (opt-out).
Huomio: Tietojen poistaminen ei ole vain niiden poistamista näytöltä. Varmuuskopiot, lokit ja kopiot palveluntarjoajan palvelimella tulee myös harkita. Kun sanot "poistettu", varmista, että poistamaasi on todella peruuttamaton.

Anonymisointi vai pseudonymisointi?

Nämä kaksi termiä sekoitetaan usein, mutta niiden oikeudelliset seuraukset ovat täysin vastakkaiset.

  • Anonymisointi: Tietojen tekeminen niin, ettei niitä voida millään tavalla yhdistää henkilöön. Oikein tehtynä tulos ei ole enää henkilötietoja eikä se kuulu KVKK:n soveltamisalaan. Esimerkki: Yksittäisten rivien poistaminen 10 000 henkilön tietojoukosta ja jäljelle jää vain koostetilastot, kuten "Keskimääräinen kulutus 25–34-vuotiaiden ikäryhmässä Istanbulissa".
  • Pseudonymisointi: Identiteettitiedot korvataan koodilla/tunnisteella, mutta ne voidaan palauttaa henkilölle "avaimella". Esimerkki: kirjoitetaan "Asiakas-4471" "Ahmet Yılmaz" sijaan, mutta pidetään taulukkoa siitä, mikä koodi kenelle kuuluu. Nämä ovat edelleen henkilötietoja ja kuuluvat KVKK:n piiriin.

ominaisuus

Anonymisointi

Pseudonymisointi

Voidaanko henkilöä palauttaa?

Ei (jos tehty oikein)

Kyllä, avaimella

Onko se edelleen henkilötietoja?

ei

Kyllä

KVKK laajuus

ulkopuolella

sisään

Päästäksesi tekoälyyn

Turvallisin tapa

Jälleen vaaditaan peruste/sääntö

Vinkki: "Onko se palautuva?" ennen tietojen syöttämistä tekoälyyn. kysyä. Jos siinä on avain/osuma, se on pseudonyymi ja silti henkilötietoja. Todellinen anonymisointi on kootun tuloksen jakamista, ei yksittäisten rivien jakamista.

kolme minilaukkua

Tapaus 1 – Väärä nimettömyys. Terveydenhuoltoyritys antaa tekoälylle joukon dataa, jonka se sanoo olevansa "anonymisoinut" analysointia varten. Mutta sarja sisältää syntymäajan, piirikunnan ja harvinaisen diagnoosin; tämä kolmikko voi tarkoittaa yksittäistä henkilöä pienessä läänissä. Tämä ei ole anonymisointia; tiedot ovat edelleen henkilökohtaisia. Oikea tapa: muuntaa syntymäaika ikäjakaumaksi, yleistää läänin mukaan, ryhmitellä harvinaiset diagnoosit – toisin sanoen todellinen aggregaatio.

Tapaus 2 – Keskustelu kasaantuu. Puhelinkeskuksessa kuusi agenttia syöttää asiakastiedot samalle yrityksen tekoälytilille 4 kuukauden ajan. Kukaan ei tyhjennä menneisyyttä; lopulta yli 12 000 asiakasvuorovaikutusta kertyi yhteen paikkaan. Auditoinnissa tämä kasautuminen on merkitty suureksi riskiksi. Ratkaisu: asetus poistaa historian automaattisesti 30 päivän välein, sääntö kirjautua ulos, kun työ on valmis, ja lauseke, joka koskee säilytyskäytäntöä.

Tapaus 3 – Oikea pseudonymisointi. Kun analysoidaan työntekijöiden suorituskykyä tekoälyllä, HR-tiimi koodaa nimet, kuten "Employee-001", ja pitää vastaavuustaulukon erillisessä, rajoitetussa tiedostossa. Tämä on pseudonymisointi; Tiedot ovat edelleen henkilökohtaisia, mutta riski on pienempi. Tiimi on tietoinen siitä, että tämä ei ole anonymisointia, ja määrittää sen oikeusperustan ja säilytysajan sen mukaisesti.

Kopioitavat mallit

MALLI 1 – Säilytys- ja tuhoamiskäytäntörivi: "Ehdota säilytys- ja tuhoamiskäytäntöriviä seuraavalle tietokategorialle: [luokka]. Kentät: säilytysaika (perusteltu tarkoituksella), tuhoamismenetelmä (poisto/tuhoaminen/anonymisointi), onko tekoälyn keskusteluhistoria mukana, vastuullinen rooli. Muistuta, onko laillinen säilytysvelvollisuus."

MALLI 2 – Anonymisoinnin tarkistus: "Arvioi, onko seuraava tietojoukko todella anonyymi: [luettelokentät]. Mitkä kenttien yhdistelmät voisivat tehdä henkilön tunnistettavissa uudelleen (esim. syntymäaika + postinumero + harvinainen ominaisuus)? Ehdota yleistystä jokaiselle riskialueelle (kuten ikähaarukka, maakuntataso) anonymiteetin vahvistamiseksi."

MALLI 3 — Peitto + palautusnäppäimen erotus: "Salanimellä seuraava teksti: koodaa henkilötiedot (kuten [NIMI]->K001), mutta anna minulle täsmäytystaulukko ERITYISESTI. Älä jätä todellista identiteettiä itse tekstiin. Huomaa, että vastaavuustaulukko on 'henkilötietoa' ja se tulee tallentaa erikseen."

MALLI 4 – AI-työkalun tiedontallennustarkastus: "Valmistele luettelo kysymyksistä tarkastaaksesi käyttämämme tekoälytyökalun tiedontallennuskäyttäytymistä: kuinka kauan historiaa säilytetään, voidaanko se poistaa, käytetäänkö mallikoulutuksessa, onko käytössä opt-out, missä tietoja käsitellään, mitkä ovat varmuuskopiot? Kirjoita odotettu "suojattu" vastaus jokaiseen kysymykseen."

Heikko kehote / Vahva kehote

HEIKKO: "Anonymisoi nämä tiedot." (koodaa ja jättää nimet)-> Vain lempinimet; Uudelleentunnistusriskit säilyvät, kuten syntymäaika, harvinainen piirre; Se luo illuusion "nimettömästä". GÜÇLÜ: "Etsi tästä joukosta kenttien yhdistelmiä, jotka voivat tunnistaa henkilön uudelleen; yleistä jokainen niistä (ikäjakauma, maakuntataso). Tavoitteeni ei ole yksittäinen tietue, vaan kootut tilastot. Tämän seurauksena ketään ei voida erottaa yksittäisenä henkilönä ja varmistaa tämä." -> Malli pyrkii todelliseen anonymisaatioon, mikä vähentää uudelleentunnistumisen riskiä.

Yleisiä virheitä

  • Pseudonymisoinnin sekoittaminen anonymisaatioon; unohtaa, että se pysyy henkilötiedona.
  • Nimien poistaminen ja kuvaavien yhdistelmien jättäminen, kuten syntymäaika + sijainti + harvinainen piirre.
  • Tekoälykeskusteluhistoriaan ei sovelleta säilytys-/tuhoamissääntöä; kertyy loputtomiin.
  • Sopimuksen "Älä käytä mallikoulutuksessa" (opt-out) -lausekkeen varmistamatta jättäminen.
  • Kun sanon poistamisen, tarkoitan vain näytön tyhjentämistä ja varmuuskopioiden ja lokien unohtamista.
  • Säilytysajan pitäminen pidempään "varmuuden vuoksi" mieluummin kuin tarkoitukseen.
  • Ohitetaan, että siirto ja tallennus tapahtuu myös palveluntarjoajan palvelimella.

Yhteenvetona

  • Henkilötiedot kulkevat elinkaaren ajan; Laiminlyötyimmät vaiheet ovat varastointi ja hävittäminen.
  • Tietoja ei saa säilyttää pidempään kuin on tarpeen tarkoitukseen; Laitoksen olisi laadittava varastointi- ja hävittämispolitiikka.
  • AI-chat-historiat ovat myös tallennettuja tietoja; tulee sisällyttää hävitysaikatauluun ja varastointiasetuksiin.
  • Anonymisointi poistaa tiedot KVKK:sta; Pseudonymisointi jättää tiedot silti henkilökohtaisiksi.
  • Nimen poistaminen ei ole anonymisointia; Kaikki uudelleentunnistumisvaarassa olevat yhdistelmät tulee yleistää.

Sovellustehtävä

Valitse dataluokka, jota organisaatiosi käsittelee tekoälyllä (esimerkiksi asiakastuen tietueet). Kirjoita säilytys- ja tuhoamiskäytäntörivi tälle luokalle: säilytysaika (perusteltu), tuhoamismenetelmä, onko tekoälyn keskusteluhistoria mukana ja vastuullinen rooli. Ota sitten näytetietue samasta tiedosta ja pseudonyymi se ensin (pidä vastaavuustaulukko erillään), kirjoita sitten, mitkä kentät yleistät ja kuinka tämä tietue saatetaan todelliseen anonymisointiin. Valmistele lopuksi viisi kysymystä, jotka ohjaavat käyttämäsi tekoälytyökalun tietojen tallennuskäyttäytymistä, ja lisää kuhunkin odottamasi "suojattu" vastaus.

tarkistuslista

  • [ ] Olen määrittänyt tietokategorialle säilytysajan ja tuhoamistavan.
  • [ ] Olen sisällyttänyt AI-chat-historian tuhoamisaikatauluun.
  • [ ] Valitsin "Älä käytä mallikoulutuksessa" -vaihtoehdon.
  • [ ] Totesin eron pseudonymisoinnin ja anonymisoinnin välillä.
  • [ ] Minulla on yleisiä kenttäyhdistelmiä, jotka ovat vaarassa tunnistaa uudelleen.
  • [ ] Sisällytin myös varmuuskopiot ja lokit poiston piiriin.
  • [ ] Tarkastin tekoälytyökalun tiedontallennuskäyttäytymistä.