Vienība 10 / 11

Resursu aizsardzība, privātums un digitālā drošība

Ieguvumi:

  • Atpazīt tiešus un netiešus identifikatorus, metadatus un digitālās pēdas, kas varētu norādīt avotu, un jautāt: "cik cilvēkiem šis apraksts atbilstu?" Spēja piemērot anonimizāciju ar testu
  • Iegūstiet disciplīnu, izvēloties tikai drošības pārbaudītus rīkus sensitīvam darbam, piemērojot vismazāko datu principu un notīrot pēdas
  • Spēja saprast, ka KVKK un profesionālajai konfidencialitātei ir nepieciešama šī disciplīna gan juridiski, gan morāli un ka vienreiz nopludinātu identitāti nevar atgūt

Žurnālistikā avots ir persona, kas runā, bieži pakļauta lielam riskam: valsts darbinieks, kurš atklāj korupciju, strādnieks, kurš apraksta pārkāpumus, kāds, kurš varētu zaudēt darbu, brīvību vai pat drošību, ja viņa identitāte tiks atklāta. Avotu aizsardzība — informācijas sniedzēja identitātes konfidencialitātes saglabāšanas princips — ir viens no profesijas svētākajiem pienākumiem, un tas ir aizsargāts lielākajā daļā tiesību sistēmu. Mākslīgā intelekta (AI) laikmets gan vienkāršo šo uzdevumu, gan rada jaunus riskus: rīks, ko izmantojat, lai izprastu dokumentu, var paslēpt šo dokumentu; Ja neizdodas anonimizēt, pēdas, ko atstājat AI, var atklāt avotu. Šīs vienības princips ir skaidrs: nenodrošinātā AI rīkā netiek ievadīti dati, kas varētu norādīt avotu; Anonimizēšana un digitālā higiēna tiek veikta pirms AI lietošanas, nevis pēc. Kad identitāte ir nopludināta, to nevar izgūt.

Kādas ir pēdas, kas atklāj avotu?

Resursu aizsardzība nav tikai "nav vārda". Identitāti var atklāt arī šādas pēdas:

  • Tiešie identifikatori: vārds, tālruņa numurs, e-pasts, TR ID, adrese, nodarbinātības vienība.
  • Netiešie deskriptori: apraksti, piemēram, “vienīgā sieviete inženiere, kas strādā trīs cilvēku lokā”; Tas attiecas uz vienu personu nelielā grupā.
  • Dokumenta metadati: autora vārds, rediģēšanas vēsture, izveides datums, GPS atrašanās vieta, failā iegultais printera celiņš.
  • Kontekstuālās norādes: kam ir piekļuve dokumentam; noplūdes laiks; konkrēts notikums stāstījumā.
  • Digitālā izsekošana: no kuras ierīces, no kura tīkla, ar kuru kontu tika sazināties.

Kritisks mākslīgā intelekta risks: ielīmējot kādu no šīm pēdām rīkā, dati tiek izslēgti no jūsu kontroles. Lielākā daļa bezmaksas/publisko AI rīku saglabā ievades datus vai var tos izmantot modeļa pilnveidošanai.

Soli pa solim: AI izmantošana, taupot resursus

1. darbība — klasificējiet transportlīdzekli. Sensitīvam darbam tiek izmantoti tikai rīki ar pārbaudītiem drošības un datu apstrādes nosacījumiem (vēlams korporatīvi, ne-datu glabāšana vai bezsaistē). Sensitīvi dati netiek ievadīti publiskajos/bezmaksas rīkos.

2. darbība — notīriet metadatus. Dzēst metadatus pirms dokumenta eksportēšanas uz rīku; Ja iespējams, pārveidojiet dokumentu par vienkāršu tekstu vai manuāli apkopojiet saturu un padariet to anonīmu, nevis ekrānuzņēmumu.

3. darbība — anonimizēt. Vispāriniet visus tiešos un netiešos identifikatorus: “avots A”, “valsts amatpersona”, aizmiglojiet datumus un atrašanās vietas. Mainiet receptes, kas attiecas uz vientuļiem cilvēkiem mazās grupās.

4. darbība — minimālā datu politika. Dodiet AI tikai to, kas nepieciešams darbam. Tā vietā, lai apkopotu visu dokumentu, norādiet attiecīgo neidentificējošo sadaļu.

5. darbība — pārbaudiet un saglabājiet. Pārbaudiet anonimizācijas atbilstību, veicot pārbaudes darbību (veidne tālāk). Sazinieties ar avotu atsevišķos, drošos kanālos.

6. darbība. Notīriet sliedes. Kad darbs ir paveikts, rīkā notīriet vēsturi/sesiju; Droši glabājiet vai dzēsiet sensitīvos failus.

Uzmanību: nepietiek ar to, ka pasaku "Es padarīju anonīmu"; Mazā grupā pat viens netiešs apraksts atklāj identitāti. Varat izmantot anonimizāciju, lai jautātu “cik daudziem cilvēkiem šī recepte būtu piemērota?” Pārbaudiet to ar jautājumu. Ja atbilde ir "viens", resurss nav aizsargāts.

KVKK un profesionālā konfidencialitāte

Tirkijā KVKK (Personas datu aizsardzības likums) regulē personas datus; Tāda informācija kā veselība un politiskie uzskati ir īpaši dati, un tiem nepieciešama augstāka aizsardzība. Avota datu nodošana patvaļīgam rīkam var izraisīt gan ētisku, gan juridisku atbildību. Profesionālā konfidencialitāte ir no likuma neatkarīgs goda pienākums.

trīs mini futrāļi

1. gadījums — novērsta metadatu noplūde. Reportieris gatavojās apkopot nopludinātu ziņojumu; Pēdējā brīdī viņš saprata, ka faila metadatos ir iestrādāts organizatora vārds. Viņš to izmantoja pēc tam, kad pārveidoja dokumentu par vienkāršu tekstu un noņēma nosaukumu. Ja neapstrādātais fails tiktu augšupielādēts, metadati tieši norādītu avotu.

2. gadījums — netiešā identifikatora briesmas. Žurnālists izmantoja frāzi, konsultējoties ar YZ, aprakstot avotu kā "vienīgo invalīdu galvenajā mītnē". Neatkarīgi no tā, vai AI kaut kur saglabāja tekstu, šis apraksts norādīja uz vienu personu. Redaktors pamanīja, mainīja aprakstu uz "aģentūras darbinieks". Mazajā grupā netiešais apraksts bija tikpat bīstams kā nosaukums.

3. gadījums — droša transportlīdzekļa izvēle. Analizējot ļoti sensitīvu dokumentu sēriju, izmeklēšanas grupa izvēlējās izmantot bezdatu/bezsaistes risinājumu, nevis vispārēju AI rīku; papildus anonimizēja dokumentus. Analīze bija nedaudz lēnāka, taču resursa drošība nevienā brīdī netika apdraudēta.

Kopējamas veidnes

1) Anonimizācijas prasmes pārbaude:

Tālāk tekstā atzīmējiet katru elementu, kas varētu atklāt avota identitāti: tiešie identifikatori (vārds, nosaukums, vienība) un netiešie identifikatori (apraksti, kas norāda uz vienu personu mazajā grupā, konkrēti notikumi, datums/atrašanās vieta). Katrai zīmei “cik cilvēkiem šis apraksts atbilstu?” Uzdodiet jautājumu un iesakiet drošākus vispārinājumus. Mainīt tekstu. Teksts: [šeit]

2) Pārbaude pirms dokumentu koplietošanas:

Izveidojiet drošības kontrolsarakstu, kas būtu jāizdara pirms dokumenta ievadīšanas AI rīkam: metadatu tīrīšana, tiešā/netiešā identifikatora skenēšana, minimālā datu politika, rīka drošības klase, vēstures tīrīšana. Katram vienumam pievienojiet vienu teikumu "kā to darīt".

3) Avota komunikācijas riska novērtējums:

Es sazināšos ar sensitīvu avotu. Izveidojiet digitālās drošības pasākumu kontrolsarakstu, kas aizsargās jūsu identitāti un sakarus (kanālu izvēle, neatstājiet pēdas, metadati, ierīces higiēna). Sniedziet konkrētus un praktiskus ieteikumus; absolūtu drošību nesola.

4) Avota aizsardzības kontrole pirms publicēšanas:

Šajās publicēšanai gatavajās ziņās iekļaujiet jebkādu informāciju, kas varētu identificēt avotu: netiešie apraksti, attiecinājuma laiks, personu skaits, kurām bija piekļuve dokumentam, konkrēta notikuma informācija. Izceliet katru riskanto vietu un iesakiet, kā to aizmiglot. Ziņas: [šeit]

Vāja uzvedne / spēcīga uzvedne

Vāja uzvedne: "Apkopojiet šo dokumentu." (augšupielādējot sensitīvu metadatu avota dokumentu, kāds tas ir)

Rezultāts: metadatus un netiešos identifikatorus jūs nevarat kontrolēt; Avots var tikt apdraudēts, jums par to nezinot.

Spēcīga uzvedne: vispirms konvertējiet dokumentu par vienkāršu tekstu un izdzēsiet metadatus, vispāriniet tiešos/netiešos identifikatorus, norādiet tikai atbilstošo daļu: "Apkopojiet šo anonimizēto tekstu; atzīmējiet tajā arī visas atlikušās identitātes norādes."

Atšķirība: spēcīga pieeja attīra datus, nenododot tos transportlīdzeklim, koplieto minimālu datu daudzumu un izmanto AI kā papildu kontroles līmeni; resurss ir aizsargāts.

salīdzināšanas diagramma

trases veids

piemērs

Risks

piesardzība

Tiešais identifikators

Vārds, tālrunis, vienība

augsts

Dzēst/vispārināt

netiešais identifikators

"Vienīgā sieviete inženiere"

Augsts (slēpts)

"Cik cilvēkiem tas atbilst?" pārbaudi

metadati

Faila autors/datums/GPS

augsts

Konvertēt uz vienkāršu tekstu, notīrīt

Kontekstuāls pavediens

Noplūdes laiks

vidējs

Aizmiglot laiku/vietu

digitālā izsekošana

Ierīce, tīkls, konts

Vidēji augsts

Drošs kanāls, higiēna

Biežas kļūdas

  • Aizmirstot metadatus. Augšupielādējot failu, kā tas ir, un nopludinot iegulto autora/datuma/atrašanās vietas informāciju.
  • Vienkārši izdzēsiet vārdu. Ignorējot, ka netiešie identifikatori arī atklāj identitāti.
  • Sensitīvu datu eksportēšana uz publisko rīku. Avota datu ievadīšana rīkos, kas glabā datus/izmanto to modeļu apmācībā.
  • Pārāk daudz datu kopīgošana. Palielināt riska virsmu, nodrošinot vairāk dokumentu/detaļu, nekā nepieciešams darbam.
  • Netīra sliedes. Sesijas vēstures un sensitīvo failu atstāšana, kad darbs ir pabeigts.

Droša transportlīdzekļa izvēle: ko meklēt?

Izlemšana, vai mākslīgā intelekta rīks ir “drošs” jutīgam darbam, ir tehniskā lietpratība, kas žurnālistam jāapgūst. Galvenie jautājumi, kas jāņem vērā, ir šādi: vai rīks saglabā ievadītos datus, cik ilgi un kur? Vai jūsu sniegtā informācija tiek izmantota modeļu apmācībā (jā lielākajā daļā bezmaksas patērētāju rīku, bieži vien nē uzņēmuma versijās)? Kurā valstī dati tiek apstrādāti un saskaņā ar kādiem tiesību aktiem? Vai rīks var darboties bezsaistē (jūsu ierīcē, nenosūtot datus uz internetu)? Vai jūsu organizācijai ir datu apstrādes līgums ar šo rīku? Sensitīvu resursu datu ievadīšana rīkā, nezinot atbildes uz šiem jautājumiem, ar aklu uzticību apdraud resursu.

Noderīga ir vispārēja hierarhija: visjutīgākajiem dokumentiem priekšroka tiek dota risinājumiem, kas darbojas bezsaistē vai jūsu infrastruktūrā; noslēgti uzņēmuma rīki, kas neuzglabā datus vidējai precizitātei; Vispārējus patērētāju rīkus var izmantot tikai neidentificētam, publiski pieejamam vai anonimizētam saturam. Veicot šo klasifikāciju sākumā, tiek novērsta kļūda "nepareizu datu ievadīšana nepareizajā rīkā steigā". Turklāt korporatīvajā informatīvajā telpā šo lēmumu nevajadzētu atstāt atsevišķu reportieru ziņā, bet gan standartizēt ar rakstisku rīku apstiprinājumu sarakstu; jo viena viena cilvēka kļūda var iznīcināt visas izmeklēšanas avotu. Transportlīdzekļa drošība ir resursu aizsardzības tehniskais pīlārs, un tas ir jāuztver tikpat nopietni kā anonimizācija.

Rezumējot

Resursu aizsardzība AI laikmetā rada jaunus riskus: rīki var paslēpt datus, metadati un netiešie identifikatori var izpaust identitāti. Drošs veids; rīka atlase atbilstoši tā drošības klasei, metadatu tīrīšana, visu tiešo un netiešo identifikatoru anonimizācija (tests "cik cilvēku atbilst šim aprakstam?"), piemērojot vismazāko datu principu un notīrot pēdas. KVKK un profesionālā konfidencialitāte pieprasa šo disciplīnu gan juridiski, gan morāli. Kad identitāte ir nopludināta, to nevar izgūt.

Lietojumprogrammas uzdevums

Paņemiet īstu vai izdomātu avota dokumentu/piezīmi. Vispirms izpildiet uzvedni "Anonimizēšanas prasmes pārbaude"; Atzīmējiet katru tiešo un netiešo deskriptoru, kas parādās, un jautājiet "cik cilvēkiem tas atbilstu?" Novērtējiet ar jautājumu. Pēc tam droši anonimizējiet dokumentu un vienu reizi manuāli lietojiet sarakstu "Dokumenta iepriekšējas koplietošanas pārbaude".

kontrolsaraksts

  • [ ] Sensitīvam darbam izmantoju tikai drošības pārbaudītus rīkus.
  • [ ] Pirms dokumenta eksportēšanas es notīru metadatus.
  • [ ] Izmanto visus tiešos un netiešos deskriptorus kā "cik cilvēkiem tas atbilst?" Es to anonimizēju ar testu.
  • [ ] Ievēro vismazāko datu principu; Dalos tikai ar nepieciešamo daļu.
  • [ ] Es notīru sesiju vēsturi un sensitīvos failus pēc darba; Es ievēroju KVKK un profesionālo konfidencialitāti.