Dobički:
- Sposobnost razločevanja podatkov, zaradi katerih je nosečnica neposredno ali posredno prepoznavna, in deidentificiranja, preden jih predamo umetni inteligenci
- Sposobnost uporabe minimizacije podatkov in pridobivanje navade uporabe le orodij, odobrenih institucij v okviru KVKK
- 'Ali je to osebo mogoče najti v tem besedilu?' Sposobnost obvladovanja tveganja ponovne identifikacije z uporabo testa
Babištvo je poklic, ki se dotika najbolj zasebnih informacij ljudi: kako pride do nosečnosti, preteklih nosečnosti, spontanih splavov, izgub, odnosov, duševnega stanja, spolnega zdravja. Ko te informacije padejo v napačne roke, povzročijo nepopravljivo škodo – domačo krizo, družbeno stigmo, izgubo zaupanja. Zato zaupnost v babištvu ni »dodatno pravilo«, temveč temelj poklica. Ko uvedete umetno inteligenco v svoje podjetje, se odpre nova meja zasebnosti: vse, kar vnesete v pomočnika za klepet, je lahko izpod vašega nadzora. Ta enota vas od konca do konca nauči, kako zaščititi podatke o nosečnosti pri uporabi umetne inteligence — zlasti v okviru KVKK (Zakon o varstvu osebnih podatkov; zakon, ki ureja obdelavo osebnih podatkov v Turčiji).
Osnovno načelo je v enem stavku: Kakršna koli informacija, po kateri je nosečnica prepoznavna, ne sme nikoli priti v orodje umetne inteligence. Učenje tega pravila ima prednost pred vsemi drugimi veščinami v modulu; Ker enkrat razkritih podatkov ni več mogoče pridobiti.
Pozor: besedilo, ki ga vnesete v orodje AI, gre na strežnike te storitve; lahko shranite, obdelate in v nekaterih primerih uporabite za usposabljanje modelov. Če rečete "želel sem samo povzetek", se podatki ne vrnejo. Edini varen način je, da nikoli ne vnesete poverilnice.
Kaj so osebni podatki, kateri podatki omogočajo njihovo identifikacijo?
Osebni podatek je vsak podatek, na podlagi katerega je oseba neposredno ali posredno določljiva. V babištvu so ti še posebej v posebni kategoriji (kot so zdravstveni podatki, ki so v zakonu najvišje zaščiteni). Razmislite o informacijah, ki zagotavljajo prepoznavanje, v dveh skupinah:
Neposredni identifikatorji: Ime-priimek, ID številka TR, številka spisa/protokola, telefon, naslov, e-pošta, datum rojstva, račun na družbenem omrežju, fotografija.
Posredni deskriptorji (združeni za prepoznavnost): »Edina nosečnost s trojčki v tej soseščini«, »edina 44-letnica v zavodu s prvo nosečnostjo«, redka bolezen + majhno naselje, delovno mesto + gestacijska starost. Nekaj podrobnosti, ki se same po sebi zdijo nedolžne, lahko ob združitvi kažejo na osebo. To se imenuje tveganje ponovne identifikacije.
Deidentifikacija je postopek odstranjevanja teh identifikatorjev iz besedila. Dobro opravljena deidentifikacija počisti neposredne in posredne identifikatorje.
Korak za korakom: Deidentifikacija pred posredovanjem podatkov AI
- Izbrišite neposredne identifikatorje: ime, ID, telefonsko številko, številko datoteke, naslov, datum — odstranite vse. Zamenjajte ga s posplošitvami, kot so "Noseča A", "približno 38 let", "drugo trimesečje".
- Zabrišite posredne namige: spremenite natančno starost v obseg (npr. "zgodnja 40-a"), natančno lokacijo v regijo, redke kombinacije v splošne.
- Zavrzite nepotrebne podrobnosti: Podajte minimalne informacije, potrebne za AI, da opravi svoje delo (minimizacija podatkov). Anamneza nosečnice ni obvezna za pisanje kartona za dojenje.
- Preverite politiko ustanove: Nekatere ustanove definirajo odobrena/institucionalna orodja AI; lahko prepove vnašanje pacientovih podatkov v osebna/brezplačna orodja. Upoštevajte pravila vaše ustanove.
- Končno branje: Preden pošljete poziv "ali je to osebo mogoče najti v tem besedilu?" Preberi še enkrat.
Najtežji od teh petih korakov je drugi – zamegljevanje posrednih namigov – ker je brisanje neposrednih identifikatorjev enostavno in najprej pride na misel, vendar večina prepoznave dejansko izhaja iz kombinacije posrednih podrobnosti. Kombinacija poklica, starosti, kraja bivanja in redke bolezni lahko zmanjša osebo na eno samo osebo, tudi če ni omenjeno ime. Zato deidentifikacije ne bi smeli razumeti kot "brisanje imen", ampak kot "zagotavljanje, da nihče, ki bere to besedilo, ne more uganiti osebe." Ta mentalni okvir radikalno zmanjša tveganje ponovne identifikacije.
Namig: Dober test: Če deidentificirano besedilo pokažete kolegici, ki pozna to nosečnico, ali bi rekla "to je tako in tako"? Če lahko to reče, pomeni, da ga niste dovolj razidentifikirali.
trije mini kovčki
1. primer – posredno prepoznavanje: ko je babica zahtevala AI za povzetek zgodovine, je izpustila ID, pustila pa besedno zvezo »edina nosečnost s štirikratniki v našem mestu«. Ta en sam stavek neposredno kaže na osebo v tem majhnem kraju. Njegov kolega opazi in opozori; Babica izraz posploši kot »večplodna nosečnost«. Nauk: posredni identifikatorji so prav tako nevarni kot neposredni identifikatorji.
Primer 2 – Zmanjšanje podatkov: druga babica običajno prilepi celotno datoteko nosečnice v AI, namesto da bi samo natisnila brošuro o "prehrani v nosečnosti". Velja: za brošuro niso potrebni osebni podatki. Vzame brošuro, ne da bi izročil datoteko, samo napiše zadevo. Najbolj varni podatki so tisti, ki se nikoli ne delijo.
Primer 3 – Napačno orodje: V tretjem primeru je babica na tem, da vnese podatke o pacientu v naključno aplikacijo na svojem osebnem telefonu, ko se spomni pravilnika ustanove: podatke o pacientih je mogoče obdelovati le brez identifikacije in z orodji, ki jih je odobrila ustanova. Ne uporablja osebne aplikacije. Puščanje podatkov pogosto nastane zaradi takšnega trenutka "udobja" in ne zaradi tehnične napake.
Kopirane predloge
Vloga: Ste asistent za nadzor deidentifikacije. Naloga: Označite vsak izraz v spodnjem besedilu, ki bi lahko NEPOSREDNO ali POSREDNO identificiral osebo: - Neposredno: ime, ID, telefon, naslov, številka datoteke, točen datum, fotografija. - Posredno: redka kombinacija, majhno mesto + posebna situacija, natančna starost, delovno mesto, edinstvena/edinstvena kakovost. Predlagajte varnejšo GENERALIZACIJO za vsakega. Besedilo: [besedilo]
Vloga: Ste svetovalec za minimizacijo podatkov. Naloga: Želim opravljati to delo: [delo]. Kakšne so minimalne informacije, ki ti jih MORAM dati, da lahko to storim? Označite nepotrebne podatke o pacientu kot "[NE NAVEDI]".
Vloga: Vi ste pomočnik za varne povzetke. Naloga: Povzemite spodnjo zgodbo DIDIDENTIFIED. Če v besedilu vidite identifikacijske podatke, ne povzemajte; namesto tega napišite "Zaznal sem poverilnice, prosim počistite in znova pošljite." Zgodba: [zgodba]
Kontrolni seznam opomnikov o institucionalni politiki (vprašajte se): – Ali je to orodje odobrila moja ustanova? – Ali so v podatkih, ki sem jih vnesel, kakršni koli podatki, ki omogočajo osebno identifikacijo? – Ali so te informacije res potrebne za to delovno mesto? – Ali lahko nekdo, ki ga poznam, najde osebo, če prebere besedilo? – Ali bom dodal identifikacijske podatke, ko shranjujem izpis?
Šibek poziv/močan poziv
Slab: "Ayşe Y., 39, tretja nosečnost, v naslednji bolnišnici, številka datoteke 4412; povzeti njeno zgodovino."
Ta poziv je poln neposrednih identifikatorjev; Zasebni podatki so pricurljali takoj, ko so bili poslani.
Močno:
Vloga: pomočnik za varne povzetke. Povzemite naslednjo anonimno zgodovino. "Noseča A, v poznih 30-ih, tretja nosečnost, [povezani zdravstveni podatki anonimni]." Če v besedilu vidite identifikacijske podatke, ne povzemajte, opozorite.
Razlika: v močni različici ni neposrednih/posrednih identifikatorjev; za opravljanje dela je potreben samo kontekst brez identitete. Varnost se začne, preden je poziv napisan.
Kaj deliti in česa ne
Vrsta informacije
Ali spada v AI?
alternativa
Ime, TR ID, telefon, naslov, številka datoteke
nikoli
"Noseča A"
Točna starost / točen datum
št
Starostno obdobje/trimesečje
Redka kombinacija + majhen kraj
št
posplošiti
Splošni zdravstveni kontekst (anonimno)
Da, če je potrebno
Uporabite minimizacijo podatkov
Fotografija/slika
Ne (obraz/znak)
ni potrebno
Vozilo ni odobreno s strani institucije
Ni podatkov o bolniku
Odobreno vozilo
Pogoste napake
- Samo brisanje imena in puščanje posrednih namigov: Tveganje ponovne identifikacije ostaja.
- Lepljenje celotne datoteke zaradi "priročnosti": Krši načelo minimiziranja podatkov.
- Vnos pacientovih podatkov v osebne/neodobrene naprave: Lahko je v nasprotju z institucionalno politiko in KVKK.
- Skupna raba fotografije/posnetka zaslona: obraz, ime in številka datoteke na sliki lahko ostanejo zaupni.
- Dodajanje ID-ja med shranjevanjem izhoda: dodajanje ID-ja izhodu, ki prihaja brez ID-ja, povrne tveganje.
- Ob predpostavki, da "se vseeno izbriše": ne veste, kateri so podatki; Edina garancija je, da ne pošljete ničesar.
Če povzamem
Pri uporabi umetne inteligence je zasebnost predpogoj, ne tehnična stvar. Vse informacije, zaradi katerih je nosečnica neposredno (ime, osebna izkaznica, telefon) ali posredno (redka kombinacija + majhna lokacija) prepoznavna, ne smejo vstopiti v orodje AI. Vadite minimiziranje podatkov — zagotovite minimalne informacije, potrebne za opravljanje dela — in uporabljajte samo orodja, ki jih je odobrila vaša organizacija. Brez pošiljanja poziva "ali je to osebo mogoče najti v tem besedilu?" naredi test. Ko podatki uhajajo, jih ni več mogoče pridobiti; Zato se varnost začne, preden je poziv napisan.
Aplikacijska naloga
Vzemite resnično zgodovino nosečnosti (na papirju) in korak za korakom očistite besedilo s pomočjo deidentifikacije: najprej neposredni, nato posredni identifikatorji. Pokažite počiščeno besedilo kolegu in vprašajte "kdo bi to lahko bil?" vprašati; Če ga lahko prepoznate, ga še posplošite. Poiščite tudi svojo ustanovo politiko AI/podatkov, jo povzemite v enem stavku in zabeležite, katera orodja so odobrena.
kontrolni seznam
- [ ] Odstranil sem vse neposredne identifikatorje (ime, ID, telefon, naslov, številka datoteke).
- [ ] Posplošil sem posredne deskriptorje (redka kombinacija, majhna lokacija, točna starost).
- [ ] Navedel sem le minimalne podatke, potrebne za opravljanje dela.
- [ ] Uporabil sem samo orodje, ki ga je odobrila moja ustanova.
- [ ] "Ali je to osebo mogoče najti v tem besedilu?" Naredil sem test.
- [ ] Izpisu pozneje nisem dodal nobenih poverilnic.