Unità 11 / 12

Etica, diritto d'autore, privacy e sensibilità culturale

Guadagni:

  • Possibilità di eseguire la scansione della privacy e selezionare il metodo appropriato (anonimizzazione, strumento chiuso) prima di caricare dati personali sensibili su strumenti basati su cloud
  • Capacità di chiarire lo stato del diritto d'autore e la sensibilità culturale di un materiale prima dell'uso
  • Capacità di riconoscere che l'intelligenza artificiale riproduce pregiudizi nelle fonti, aggiungere un quadro critico e dichiarare in modo trasparente l'uso dell'intelligenza artificiale

Il materiale storico e d'archivio non è una massa neutra di dati. Un registro civile può contenere informazioni personali di persone viventi, un fascicolo giudiziario può contenere vite private sensibili, materiali culturali considerati sacri da una comunità, opere ancora protette da copyright. Poiché l’intelligenza artificiale semplifica la manipolazione di questo materiale, le conseguenze del suo uso improprio aumentano. Questa unità approfondisce il quadro etico che circonda l'intero modulo: privacy, diritto d'autore, sensibilità culturale, trasparenza e autenticità nell'uso dell'intelligenza artificiale.

Queste questioni non sono tecniche, ma sono importanti almeno quanto le questioni tecniche; Perché una violazione della privacy, una violazione del copyright o ignorare la sensibilità di una comunità crea sia conseguenze legali che una perdita irreparabile di fiducia.

Privacy: i diritti dei vivi e dei morti

I documenti d'archivio spesso contengono dati personali: nomi, indirizzi, informazioni sanitarie, atti giudiziari, origine religiosa/etnica. Alcuni di essi appartengono a persone viventi e sono soggetti alla legislazione sulla protezione dei dati personali (come KVKK in Turchia, GDPR in Europa).

  • Persone viventi: il caricamento di documenti contenenti dati sensibili identificabili su strumenti di intelligenza artificiale pubblici basati su cloud potrebbe rappresentare una grave violazione. Questi strumenti possono archiviare dati, utilizzarli nell'istruzione o divulgarli.
  • Persone decedute: la responsabilità etica rimane anche se diminuisce la tutela giuridica; Rivelare inutilmente il delicato passato di una persona può nuocere alla sua dignità e a quella della sua famiglia.
  • Restrizioni di accesso: molti archivi impongono restrizioni di accesso ai documenti sensibili per un certo periodo di tempo. L’“efficienza” dell’IA non può essere una giustificazione per superare questi vincoli.
Attenzione: prima di caricare un documento su uno strumento di intelligenza artificiale basato su cloud, chiedi sempre: "Chi verrebbe danneggiato se questo contenuto venisse diffuso su Internet?" Se la risposta è “uno di questi”, cerca innanzitutto l’approvazione aziendale, l’anonimizzazione dei dati e, se possibile, uno strumento locale/chiuso. Il caricamento indiscriminato di dati personali è irreversibile.

Copyright: non tutti i documenti sono disponibili al pubblico

Solo perché un documento è fisicamente nell'archivio non significa che puoi utilizzarlo liberamente. Il diritto d'autore è il diritto appartenente al creatore dell'opera che fornisce protezione per un certo periodo di tempo.

  • Pubblico dominio: le opere il cui diritto d'autore è scaduto possono essere utilizzate liberamente. La durata varia a seconda del paese e del lavoro.
  • Opere protette da copyright: lettere, fotografie, articoli inediti possono essere protetti da copyright; Darli ad AI o pubblicarli può costituire una violazione dei diritti.
  • AI e diritto d'autore: far sì che l'IA elabori un testo protetto da copyright significa trasferirlo al sistema di una terza parte (fornitore di strumenti); Ciò potrebbe causare problemi sia in termini di copyright che di contratto.

Sensibilità culturale e diritti della comunità

Alcuni materiali storici toccano la memoria, le credenze o l'identità di determinate comunità. Ciò include documenti del periodo coloniale, materiali appartenenti a comunità indigene/minorarie e documenti considerati sacri. Il principio guida qui è rispettare la voce e i diritti della comunità che ha prodotto il materiale o che rappresenta. La proposta “più efficiente” dell’IA non può ignorare l’opinione di una comunità sulla propria storia. Inoltre, l’intelligenza artificiale può inconsapevolmente riprodurre un linguaggio parziale, dispregiativo o esclusivo nelle fonti storiche; È necessario essere attenti a questo linguaggio.

Trasparenza e autenticità

Nelle discipline umanistiche, l'originalità (che un'opera è veramente il prodotto del proprio lavoro) e la trasparenza (comunicare chiaramente i propri metodi) sono valori fondamentali.

  • Dichiarare l'uso dell'intelligenza artificiale: se una trascrizione, metadati o traduzione sono stati prodotti con l'aiuto dell'intelligenza artificiale, registrarli. I successivi ricercatori dovrebbero essere in grado di verificare.
  • Limite di proprietà del lavoro: è contrario all’onestà accademica presentare un commento o un testo prodotto dall’intelligenza artificiale come una propria idea originale.
  • Seguire le linee guida istituzionali e di pubblicazione: molte istituzioni e riviste hanno stabilito regole su come dichiarare l’uso dell’intelligenza artificiale.

Oggetto

domanda fondamentale

Conseguenze se va male

Privacy

Chi identificano questi dati?

Violazione legale, danno alla privacy

diritto d'autore

Ho il diritto di usarlo?

Violazione dei diritti, causa

Sensibilità culturale

Di chi è questo ricordo?

Perdita di fiducia e rispetto

trasparenza

Ho già detto che utilizzo l'intelligenza artificiale?

Violazione dell'integrità accademica

pregiudizio

Di chi è la voce distorta/mancante?

distorsione della storia

tre mini custodie

Caso 1: cartella clinica caricata. Un ricercatore ha caricato e trascritto direttamente in uno strumento di intelligenza artificiale disponibile al pubblico una cartella clinica ospedaliera del 20° secolo (comprese le informazioni che identificano i discendenti di persone viventi). Il responsabile della protezione dei dati dell'istituzione si è accorto della situazione; il documento conteneva dati personali sensibili e il caricamento costituiva una violazione. Lezione: i dati personali sensibili non vengono caricati senza uno strumento chiuso/approvato.

Caso 2 — Foto protetta da copyright. Per una pubblicazione, una foto protetta da copyright proveniente da un archivio è stata migliorata con l'intelligenza artificiale e pubblicata. Gli eredi del fotografo hanno denunciato una violazione dei diritti. Essere nell'archivio non concedeva i diritti di utilizzo. Lezione: lo stato del copyright di ciascun materiale viene chiarito prima dell'uso.

Caso 3 — Riproduzione del pregiudizio. Uno studente ha chiesto a YZ di riassumere un documento dell'era coloniale. Il riassunto riproduceva senza dubbio il linguaggio dispregiativo e la visione unilaterale della fonte; La prospettiva di quella comunità era completamente assente. Su avvertimento del suo relatore, lo studente ha riesaminato la fonte con un quadro critico e ha aggiunto l'audio mancante. Lezione: l'intelligenza artificiale copia i pregiudizi della fonte; È compito del ricercatore aggiungere il quadro critico e la voce mancante.

Quattro modelli copiabili

1) Controllo privacy pre-installazione:

Esegui un controllo della privacy PRIMA di caricare il seguente testo del documento in uno strumento di intelligenza artificiale: (1) Sono presenti dati sensibili (salute, religione, etnia, indirizzo) che identificano individui viventi o recenti? (2) Se sì, quali sezioni? (3) È possibile l'anonimizzazione? La decisione finale è mia; Contrassegni le aree a rischio. Testo: [qui]

2) Valutazione dello stato del copyright:

Le informazioni sul tipo, sulla data stimata e sull'autore del materiale di seguito sono le seguenti: [informazioni]. Elenca quali domande sul copyright dovrei porre e cosa dovrei chiarire prima dell'uso. DARE una sentenza legale definitiva; Fornire punti da verificare.

3) Bias e controllo del volume mancante:

Nel riepilogo della fonte storica riportato di seguito: (1) dove sono riprodotti i pregiudizi/il linguaggio dispregiativo della fonte, (2) quale gruppo/prospettiva manca? Evidenziateli e suggerite come possono essere inquadrati criticamente. Sommario: [qui]

4) Bozza di dichiarazione sull'uso dell'IA:

In uno studio, ho utilizzato l'intelligenza artificiale in: [trascrizione/traduzione/metadati/riepilogo]. Scrivere una bozza di "dichiarazione sull'uso dell'intelligenza artificiale" che possa essere utilizzata per la trasparenza accademica: in quale lavoro, con quale strumento, come viene eseguita la verifica umana. Esagerazione; Sii onesto e chiaro.

Prompt debole / Prompt forte

Debole:

Elabora questo documento di archivio ed estrai il suo contenuto per me.

Lo stato di riservatezza, diritto d'autore e sensibilità del documento viene comunicato direttamente all'AI senza essere interrogato; Il rischio di violazione rimane invisibile.

Forte:

Prima di elaborare questo documento: contrassegnare eventuali aree che potrebbero rappresentare un rischio in termini di dati personali sensibili, copyright e sensibilità culturale. Se c'è una parte rischiosa, rivedrò il mio metodo di elaborazione (anonimizzazione, conferma, strumento chiuso). Estrai solo i contenuti approvati. Documento: [qui]

La differenza: lo screening dei rischi prima dell'elaborazione, la segnalazione dei contenuti rischiosi e la revisione del metodo prevengono in primo luogo le violazioni etiche.

Errori comuni

  • Caricamento indiscriminato di dati sensibili. I dati personali non verranno caricati senza uno strumento chiuso/approvato e l'anonimizzazione, se necessaria.
  • Supponendo che "è negli archivi, posso usarlo". L'accesso fisico non conferisce diritto d'autore; la situazione è chiarita.
  • Ignorare la sensibilità culturale. Il diritto di una comunità ad avere voce in capitolo nella propria storia è rispettato.
  • Copiare i pregiudizi senza dubbio. Il linguaggio unilaterale della fonte viene affrontato con un quadro critico e viene aggiunta la voce mancante.
  • Nascondere l’uso dell’intelligenza artificiale. La trasparenza è un requisito dell’onestà accademica; viene dichiarato l'utilizzo.

In sintesi

L'etica è il quadro che circonda le unità tecniche di questo modulo. La privacy include la protezione dei dati personali sensibili; Chiarire il diritto d'autore e i diritti d'uso; sensibilità culturale, rispettando il diritto delle comunità ad avere voce in capitolo nella propria storia; La trasparenza e l’autenticità richiedono di dichiarare onestamente l’uso dell’intelligenza artificiale. L’intelligenza artificiale riproduce anche pregiudizi nelle fonti; È responsabilità del ricercatore aggiungere il quadro critico e la voce mancante a questo. L’efficienza non può mai essere una giustificazione per superare questi principi. Con l’aumento del potere tecnico, deve aumentare anche l’attenzione etica.

Compito dell'applicazione

Seleziona un documento che intendi elaborare. Per prima cosa, cerca i dati sensibili con il modello “controllo privacy pre-installazione” e contrassegna le sezioni rischiose. Quindi rimuovi le domande che devono essere chiarite prima dell'uso con la "valutazione dello stato del copyright". Infine, esamina un riepilogo della fonte con un "controllo dei bias e del volume mancante". Prendi una decisione ragionata sull'opportunità di caricare il documento su uno strumento basato su cloud.

lista di controllo

  • [ ] Ho eseguito la scansione dei dati personali sensibili prima del caricamento.
  • [ ] Ho chiarito lo stato di copyright del materiale.
  • [ ] Ho osservato la sensibilità culturale e i diritti della comunità.
  • [ ] Ho affrontato i pregiudizi della fonte con un quadro critico.
  • [ ] Ho dichiarato in modo trasparente il mio utilizzo dell'intelligenza artificiale.