Enota 10 / 11

Zaščita virov, zasebnost in digitalna varnost

Dobički:

  • Prepoznajte neposredne in posredne identifikatorje, metapodatke in digitalne sledi, ki lahko razkrijejo vir, in se vprašajte, koliko ljudi bi ta opis ustrezal? Možnost uporabe anonimizacije s testom
  • Pridobite disciplino izbire samo varnostno preverjenih orodij za občutljivo delo, uporabe načela najmanj podatkov in čiščenja sledi
  • Sposobnost razumeti, da KVKK in poklicna zaupnost zahtevata to disciplino tako pravno kot moralno in da enkrat razkrite identitete ni več mogoče vzeti nazaj

V novinarstvu je vir oseba, ki govori, pogosto zelo tvegana: javni uslužbenec, ki razkriva korupcijo, delavec, ki opisuje nepravilnosti, nekdo, ki bi lahko izgubil službo, svobodo ali celo varnost, če bi bila njegova identiteta razkrita. Zaščita vira – načelo ohranjanja zaupnosti identitete informatorja – je ena najsvetejših dolžnosti poklica in je zaščitena v večini pravnih sistemov. Doba umetne inteligence (AI) poenostavlja to nalogo in prinaša nova tveganja: orodje, ki ga uporabljate za razumevanje dokumenta, lahko ta dokument skrije; Če ne uspete anonimizirati, lahko sledi, ki jih pustite v AI, razkrijejo vir. Načelo te enote je jasno: noben podatek, ki bi lahko izdal vir, ne vstopi v nezavarovano orodje AI; Anonimizacija in digitalna higiena se izvajata pred uporabo AI, ne po njej. Ko identiteta pricurlja, ni več mogoče pridobiti.

Kakšne so sledi, ki oddajajo vir?

Zaščita virov ni samo "no name". Identiteto lahko razkrijejo tudi naslednje sledi:

  • Neposredni identifikatorji: ime, telefon, e-pošta, TR ID, naslov, enota zaposlitve.
  • Posredni deskriptorji: opisi, kot je "edina inženirka, ki dela v krogu treh"; Nanaša se na eno osebo v majhni skupini.
  • Metapodatki dokumenta: ime avtorja, zgodovina urejanja, datum ustvarjanja, lokacija GPS, sled tiskalnika, vdelana v datoteko.
  • Kontekstualni namigi: kdo ima dostop do dokumenta; čas puščanja; določen dogodek v pripovedi.
  • Digitalna sled: iz katere naprave, iz katerega omrežja, s katerim računom je bil opravljen stik.

Kritično tveganje za AI: vstavljanje katere koli od teh sledi v orodje vam odvzame podatke izpod nadzora. Večina brezplačnih/javnih orodij AI shranjuje vnose ali jih lahko uporabi pri izpopolnjevanju modela.

Korak za korakom: Uporaba AI ob varčevanju z viri

1. korak — Razvrstite vozilo. Za občutljivo delo se uporabljajo samo orodja s preverjenimi varnostnimi pogoji in pogoji za obdelavo podatkov (po možnosti korporativna, brez shranjevanja podatkov ali brez povezave). Občutljivi podatki se ne vnašajo v javna/brezplačna orodja.

2. korak — Očistite metapodatke. Izbrišite metapodatke, preden izvozite dokument v orodje; Če je mogoče, pretvorite dokument v golo besedilo ali ročno povzeti vsebino in jo anonimizirajte namesto posnetka zaslona.

3. korak — Anonimiziraj. Posplošite vse neposredne in posredne identifikatorje: »Vir A«, »javni uradnik«, zameglite datume in lokacije. Spremenite recepte, ki se nanašajo na samske ljudi v majhnih skupinah.

4. korak — Politika minimalnih podatkov. Dajte AI le tisto, kar delo zahteva. Namesto povzemanja celotnega dokumenta navedite ustrezen razdelek brez identifikacije.

5. korak — Preverite in shranite. Preizkusite ustreznost anonimizacije s korakom preverjanja (spodnja predloga). Ohranite komunikacijo z virom na ločenih, varnih kanalih.

6. korak — Očistite sledi. Ko je delo končano, počistite zgodovino/sejo v orodju; Varno shranite ali izbrišite občutljive datoteke.

Pozor: reči "Anonimiziral sem" ni dovolj; V majhni skupini že en sam posreden opis razkrije identiteto. Anonimizacijo lahko uporabite, da vprašate "Koliko ljudi bi ta recept ustrezal?" Preizkusite z vprašanjem. Če je odgovor "ena", vir ni zaščiten.

KVKK in poklicna zaupnost

V Turčiji KVKK (Zakon o varstvu osebnih podatkov) ureja osebne podatke; Informacije, kot so zdravstveno in politično mnenje, so posebni podatki in zahtevajo večjo zaščito. Posredovanje podatkov vira poljubnemu orodju lahko povzroči tako etično kot pravno odgovornost. Poklicna zaupnost je častna dolžnost, neodvisna od zakona.

trije mini kovčki

Primer 1 – Preprečeno uhajanje metapodatkov. Novinar je hotel povzeti poročilo, ki je pricurljalo v javnost; V zadnjem trenutku je ugotovil, da je ime organizatorja vdelano v metapodatke datoteke. Uporabil ga je po pretvorbi dokumenta v golo besedilo in odstranitvi imena. Če bi naložili neobdelano datoteko, bi metapodatki neposredno razkrili vir.

Primer 2 – Nevarnost posrednega identifikatorja. Novinar je pri posvetovanju z YZ uporabil besedno zvezo in vir opisal kot "edinega zaposlenega invalida na sedežu." Ne glede na to, ali je AI nekje shranil besedilo, je ta opis kazal na eno osebo. Urednik je opazil, spremenil opis v "uslužbenec agencije." V majhni skupini je bil posredni opis enako nevaren kot ime.

Primer 3 – Izbira varnega vozila. Pri analizi zelo občutljive serije dokumentov se je preiskovalna skupina odločila za uporabo rešitve brez podatkov/brez povezave namesto splošnega orodja AI; dokumente dodatno anonimiziral. Analiza je bila nekoliko počasnejša, vendar varnost vira ni bila v nobenem trenutku ogrožena.

Kopirane predloge

1) Preizkus usposobljenosti za anonimizacijo:

V spodnjem besedilu označite vse elemente, ki bi lahko razkrili identiteto vira: neposredne identifikatorje (ime, naslov, enota) in posredne identifikatorje (opisi, ki kažejo na eno osebo v majhni skupini, določene dogodke, datum/lokacijo). Za vsak znak, "koliko ljudi bi ta opis ustrezal?" Zastavite vprašanje in predlagajte varnejše posplošitve. Spremeni besedilo. Besedilo: [tukaj]

2) Preverjanje pred skupno rabo dokumenta:

Naredite varnostni kontrolni seznam, ki ga moram narediti, preden vložim dokument v orodje AI: čiščenje metapodatkov, neposredno/posredno skeniranje identifikatorja, politika minimalnih podatkov, varnostni razred orodja, čiščenje zgodovine. Za vsako postavko dodajte en stavek »kako«.

3) Ocena tveganja komunikacije vira:

Kontaktiral bom občutljiv vir. Ustvarite kontrolni seznam digitalnih varnostnih ukrepov, ki bodo zaščitili vašo identiteto in komunikacijo (izbira kanala, brez sledi, metapodatki, higiena naprave). Podajte konkretne in uporabne predloge; ne obljubljajo absolutne varnosti.

4) Nadzor zaščite vira pred objavo:

V naslednje novice, pripravljene za objavo, vključite vse podrobnosti, ki bi lahko identificirale vir: posredne opise, čas pripisa, število ljudi, ki so imeli dostop do dokumenta, podrobnosti o določenem dogodku. Označite vsako tvegano mesto in predlagajte, kako ga zamegliti. Novice: [tukaj]

Šibek poziv/močan poziv

Šibek poziv: "Povzemite ta dokument." (z nalaganjem občutljivega dokumenta vira metapodatkov, kot je)

Rezultat: metapodatki in posredni identifikatorji so izven vašega nadzora; Vir je lahko ogrožen, ne da bi se tega zavedali.

Močan poziv: najprej pretvorite dokument v golo besedilo in izbrišite metapodatke, posplošite neposredne/posredne identifikatorje, podajte samo ustrezni del: "Povzemite naslednje anonimizirano besedilo; označite tudi vse preostale namige identitete v njem."

Razlika: Močan pristop čisti podatke, ne da bi jih posredoval vozilu, deli minimalno količino podatkov in uporablja AI kot dodatno plast nadzora; vir je zaščiten.

primerjalna tabela

tip proge

primer

Tveganje

previdnost

Neposredni identifikator

Ime, telefon, enota

visoka

Zbriši/posploši

posredni identifikator

"Edina inženirka"

Visoko (skrito)

"Koliko ljudi ustreza?" test

metapodatki

Avtor datoteke/datum/GPS

visoka

Pretvori v navadno besedilo, jasno

Kontekstualni namig

Čas puščanja

srednje

Zameglitev časa/kraja

digitalna sled

Naprava, omrežje, račun

Srednje visoka

Varen kanal, higiena

Pogoste napake

  • Pozabljanje metapodatkov. Nalaganje datoteke, kot je, in uhajanje vdelanih informacij o avtorju/datumu/lokaciji.
  • Samo izbrišite ime. Ignoriranje tega, da posredni identifikatorji razkrivajo tudi identiteto.
  • Izvoz občutljivih podatkov v javno orodje. Vnos izvornih podatkov v orodja, ki podatke shranjujejo/uporabljajo pri usposabljanju modela.
  • Delite preveč podatkov. Povečanje površine tveganja z zagotavljanjem več dokumentov/podrobnosti, kot zahteva delo.
  • Brez čiščenja prog. Puščanje zgodovine sej in občutljivih datotek, ko je delo opravljeno.

Varna izbira vozila: na kaj iskati?

Odločitev, ali je orodje AI »varno« za občutljivo delo, je tehnična pismenost, ki jo mora pridobiti novinar. Glavna vprašanja, ki si jih je treba ogledati, so: Ali orodje shranjuje podatke, ki jih vnesete, kako dolgo in kje? Ali se vaši vložki uporabljajo pri usposabljanju modelov (da v večini brezplačnih potrošniških orodij, pogosto ne v različicah za podjetja)? V kateri državi se podatki obdelujejo in po kateri zakonodaji? Ali lahko orodje deluje brez povezave (na vaši napravi, brez pošiljanja podatkov v internet)? Ali ima vaša organizacija pogodbo o obdelavi podatkov s tem orodjem? Vnašanje občutljivih podatkov o virih v orodje, ne da bi poznali odgovore na ta vprašanja, s slepim zaupanjem ogroža vir.

Koristna je splošna hierarhija: za najbolj občutljive dokumente so prednostne rešitve, ki delujejo brez povezave ali na vaši lastni infrastrukturi; pogodbena orodja za podjetja, ki ne shranjujejo podatkov za srednjo natančnost; Generična potrošniška orodja se lahko uporabljajo le za neidentificirano, javno dostopno ali anonimizirano vsebino. Če to razvrstitev izvedete na začetku, preprečite napako »v naglici vnašate napačne podatke v napačno orodje«. Poleg tega v korporativni redakciji ta odločitev ne bi smela biti prepuščena posameznim poročevalcem, ampak bi morala biti standardizirana s pisnim seznamom odobritev orodja; ker ena sama napaka ene same osebe lahko uniči izvor celotne preiskave. Varnost vozil je tehnični steber zaščite virov in jo je treba jemati enako resno kot anonimizacijo.

Če povzamem

Zaščita virov predstavlja nova tveganja v dobi umetne inteligence: orodja lahko skrijejo podatke, metapodatki in posredni identifikatorji lahko razkrijejo identiteto. Varen način; izbira orodja glede na varnostni razred, čiščenje metapodatkov, anonimiziranje vseh neposrednih in posrednih identifikatorjev (test "koliko ljudi ustreza temu opisu?"), uporaba načela najmanj podatkov in čiščenje sledi. KVKK in poklicna zaupnost zahtevata to disciplino tako pravno kot moralno. Ko identiteta pricurlja, ni več mogoče pridobiti.

Aplikacijska naloga

Vzemite resničen ali izmišljen izvorni dokument/zapisek. Najprej sledite pozivu »Anonymization proficiency test«; Označite vsak neposredni in posredni deskriptor, ki se pojavi, in vprašajte "koliko ljudi bi ustrezal?" Oceni z vprašanjem. Nato dokument varno anonimizirajte in enkrat ročno uporabite seznam »Preverjanje pred skupno rabo dokumenta«.

kontrolni seznam

  • [ ] Za občutljivo delo uporabljam samo varnostno preverjena orodja.
  • [ ] Pred izvozom dokumenta počistim metapodatke.
  • [ ] Uporablja vse neposredne in posredne deskriptorje kot "koliko ljudi ustreza?" Anonimiziram ga s testom.
  • [ ] Sledi načelu najmanj podatkov; Delim samo nujni del.
  • [ ] Po delu počistim zgodovino sej in občutljive datoteke; Upoštevam KVKK in poklicno zaupnost.