Unité 11 / 12

Éthique, droit d'auteur, confidentialité et sensibilité culturelle

Gains :

  • Possibilité d'analyser la confidentialité et de sélectionner la méthode appropriée (anonymisation, outil fermé) avant de télécharger des données personnelles sensibles vers des outils basés sur le cloud
  • Capacité à clarifier le statut du droit d'auteur et la sensibilité culturelle d'un matériel avant utilisation
  • Capacité à reconnaître que l'IA reproduit les biais dans les sources, à ajouter un cadre critique et à déclarer de manière transparente l'utilisation de l'IA

L’histoire et les archives ne constituent pas une masse neutre de données. Un registre d'état civil peut contenir des informations personnelles sur des personnes vivantes, un dossier judiciaire peut contenir des vies privées sensibles, des éléments culturels considérés comme sacrés par une communauté, des œuvres encore protégées par le droit d'auteur. À mesure que l’IA facilite la manipulation de ce matériel, les conséquences d’une mauvaise utilisation s’accroissent. Cette unité approfondit le cadre éthique qui entoure l'ensemble du module : confidentialité, droit d'auteur, sensibilité culturelle, ainsi que transparence et authenticité dans l'utilisation de l'IA.

Ces questions ne sont pas techniques, mais elles sont au moins aussi importantes que les questions techniques ; Parce qu'une violation de la vie privée, une violation du droit d'auteur ou le fait d'ignorer la sensibilité d'une communauté engendre à la fois des conséquences juridiques et une perte de confiance irréparable.

Vie privée : les droits des vivants et des morts

Les documents d'archives contiennent fréquemment des données personnelles : noms, adresses, informations de santé, dossiers judiciaires, origine religieuse/ethnique. Certains d'entre eux appartiennent à des personnes vivantes et sont soumis à la législation sur la protection des données personnelles (comme le KVKK en Turquie, le RGPD en Europe).

  • Personnes vivantes : le téléchargement de documents contenant des données sensibles identifiables vers des outils d’IA publics basés sur le cloud pourrait constituer une violation grave. Ces outils peuvent stocker des données, les utiliser à des fins éducatives ou les divulguer.
  • Personnes décédées : la responsabilité éthique demeure même si la protection juridique diminue ; Révéler inutilement le passé sensible d’une personne peut nuire à sa dignité et à celle de sa famille.
  • Restrictions d'accès : De nombreuses archives imposent des restrictions d'accès aux documents sensibles pendant une certaine période. L’« efficacité » de l’IA ne peut justifier le dépassement de ces contraintes.
Attention : avant de télécharger un document vers un outil d'IA basé sur le cloud, demandez toujours : « À qui serait-il lésé si ce contenu était divulgué sur Internet ? » Si la réponse est « l’un d’entre eux », recherchez d’abord l’approbation de l’entreprise, l’anonymisation des données et un outil local/fermé si possible. Le téléchargement aveugle de données personnelles est irréversible.

Copyright : tous les documents ne sont pas accessibles au public

Ce n’est pas parce qu’un document se trouve physiquement dans les archives que vous pouvez l’utiliser librement. Le droit d'auteur est le droit appartenant au créateur de l'œuvre qui assure une protection pendant une certaine période.

  • Domaine public : les œuvres dont le droit d'auteur a expiré peuvent être utilisées librement. La durée varie selon le pays et le travail.
  • Œuvres sous droit d'auteur : Les lettres, photographies, articles inédits peuvent être sous droit d'auteur ; Les donner à AI ou les publier peut constituer une violation des droits.
  • IA et droit d'auteur : Faire traiter par AI un texte protégé par le droit d'auteur signifie le transférer vers le système d'un tiers (fournisseur d'outils) ; Cela peut poser des problèmes à la fois en termes de droits d'auteur et de contrat.

Sensibilité culturelle et droits communautaires

Certains documents historiques touchent à la mémoire, aux croyances ou à l'identité de certaines communautés. Cela comprend les archives de la période coloniale, les documents appartenant aux communautés autochtones/minoritaires et les documents considérés comme sacrés. Le principe directeur ici est de respecter la voix et les droits de la communauté qui a produit le matériel ou qu’il représente. La proposition « la plus efficace » d’IA ne peut ignorer le mot à dire d’une communauté sur sa propre histoire. De plus, l’IA peut, sans le savoir, reproduire un langage biaisé, désobligeant ou d’exclusion dans des sources historiques ; Il faut être attentif à ce langage.

Transparence et authenticité

Dans les sciences humaines, l’originalité (qu’une œuvre soit véritablement le produit de votre propre travail) et la transparence (communiquer clairement vos méthodes) sont des valeurs fondamentales.

  • Déclarez l’utilisation de l’IA : si une transcription, des métadonnées ou une traduction ont été produites à l’aide de l’IA, enregistrez-la. Les chercheurs ultérieurs devraient pouvoir le vérifier.
  • Limite de propriété du travail : il est contraire à l’honnêteté académique de présenter un commentaire ou un texte produit par l’IA comme votre propre idée originale.
  • Suivez les directives institutionnelles et de publication : de nombreuses institutions et revues ont établi des règles sur la manière de déclarer l’utilisation de l’IA.

Sujet

question fondamentale

Conséquences en cas de problème

Confidentialité

Qui ces données identifient-elles ?

Violation de la loi, atteinte à la vie privée

droit d'auteur

Ai-je le droit de l'utiliser ?

Violation des droits, procès

Sensibilité culturelle

À qui appartient ce souvenir ?

Perte de confiance et de respect

transparence

Ai-je mentionné que j’utilise l’IA ?

Violation de l'intégrité académique

préjugé

Quelle voix est déformée/manquante ?

déformation de l'histoire

trois mini-cases

Cas 1 — Dossier de santé téléchargé. Un chercheur a chargé et transcrit un dossier hospitalier du XXe siècle (comprenant des informations identifiant les descendants de personnes vivantes) directement dans un outil d’IA accessible au public. Le délégué à la protection des données de l'institution s'est rendu compte de la situation ; le document contenait des données personnelles sensibles et le téléchargement constituait une violation. Leçon : les données personnelles sensibles ne sont pas téléchargées sans un outil fermé/approuvé.

Cas 2 – Photo protégée par le droit d’auteur. Pour une publication, une photo protégée par le droit d’auteur provenant d’une archive a été améliorée grâce à l’IA et publiée. Les héritiers du photographe ont dénoncé une violation de ses droits. Le fait d'être dans les archives n'accordait pas de droits d'utilisation. Leçon : le statut de droit d'auteur de chaque matériel est clarifié avant utilisation.

Cas 3 — Reproduction d'un préjugé. Un étudiant a demandé à YZ de résumer un dossier de l’époque coloniale. Le résumé reproduisait sans conteste le langage désobligeant et la vision unilatérale de la source ; La perspective de cette communauté était complètement absente. Avec l'avertissement de son conseiller, l'étudiant a réexaminé la source avec un cadre critique et a ajouté l'audio manquant. Leçon : l'IA copie le parti pris de la source ; C'est le travail du chercheur d'ajouter le cadre critique et la voix manquante.

Quatre modèles copiables

1) Vérification de la confidentialité avant l'installation :

Effectuez une vérification de la confidentialité AVANT de charger le texte du document suivant dans un outil d'IA : (1) Existe-t-il des données sensibles (santé, religion, origine ethnique, adresse) qui identifient des individus vivants ou récents ? (2) Si oui, quelles sections ? (3) L'anonymisation est-elle possible ? La décision finale m'appartient ; Vous marquez les zones à risque. Texte : [ici]

2) Évaluation du statut du droit d'auteur :

Les informations sur le type, la date estimée et le créateur du matériel ci-dessous sont les suivantes : [informations]. Énumérez les questions de droit d'auteur que je devrais poser et ce que je devrais clarifier avant utilisation. DONNER un jugement juridique définitif ; Précisez les points à vérifier.

3) Biais et contrôle du volume manquant :

Dans le résumé de la source historique ci-dessous : (1) où les propres préjugés/langage désobligeant de la source sont-ils reproduits, (2) la voix de quel groupe/perspective manque ? Mettez-les en évidence et suggérez comment ils peuvent être formulés de manière critique. Résumé : [ici]

4) Projet de déclaration d'utilisation de l'IA :

Dans une étude, j'ai utilisé l'IA dans : [transcription/traduction/métadonnées/résumé]. Rédigez un projet de « Déclaration d'utilisation de l'IA » qui peut être utilisé pour la transparence académique : dans quel travail, avec quel outil, comment la vérification humaine est effectuée. Exagération; Soyez honnête et clair.

Invite faible/Invite forte

Faible :

Traitez ce document d'archive et extrayez-moi son contenu.

Le statut de confidentialité, de droit d'auteur et de sensibilité du document est communiqué directement à l'IA sans être remis en question ; Le risque de violation reste invisible.

Fort:

Avant de traiter ce document : marquez toutes les zones pouvant présenter un risque en termes de données personnelles sensibles, de droit d'auteur et de sensibilité culturelle. S'il y a une partie à risque, je reverrai mon mode de traitement (anonymisation, confirmation, outil fermé). Extrayez uniquement le contenu approuvé. Document : [ici]

La différence : l’analyse des risques avant le traitement, le signalement des contenus à risque et la révision de la méthode permettent d’éviter en premier lieu les violations éthiques.

Erreurs courantes

  • Téléchargement de données sensibles sans discernement. Les données personnelles ne seront pas téléchargées sans un outil fermé/approuvé et une anonymisation si nécessaire.
  • En supposant que "c'est dans les archives, je peux l'utiliser". L'accès physique ne confère pas de droit d'auteur ; la situation est clarifiée.
  • Ignorer la sensibilité culturelle. Le droit d'une communauté à avoir son mot à dire sur sa propre histoire est respecté.
  • Copier les préjugés sans aucun doute. Le langage unilatéral de la source est abordé avec un cadre critique, et la voix manquante est ajoutée.
  • Cacher l’utilisation de l’IA. La transparence est une exigence de l’honnêteté académique ; l'usage est déclaré.

En résumé

L'éthique est le cadre entourant les unités techniques de ce module. La confidentialité comprend la protection des données personnelles sensibles ; Clarifier le droit d'auteur, les droits d'utilisation ; la sensibilité culturelle, dans le respect du droit des communautés à avoir leur mot à dire sur leur propre histoire ; La transparence et l’authenticité nécessitent de déclarer honnêtement l’utilisation de l’IA. L’IA reproduit également les biais dans les sources ; Il appartient au chercheur d’y ajouter le cadre critique et la voix manquante. L’efficacité ne peut jamais justifier le dépassement de ces principes. À mesure que le pouvoir technique augmente, l’attention éthique doit également augmenter.

Tâche de candidature

Sélectionnez un document que vous avez l'intention de traiter. Tout d’abord, recherchez les données sensibles avec le modèle « vérification de confidentialité pré-installation » et signalez les sections à risque. Supprimez ensuite les questions qui doivent être clarifiées avant utilisation avec « l'évaluation du statut du droit d'auteur ». Enfin, examinez un résumé de la source avec une « vérification des biais et des volumes manquants ». Prenez une décision motivée quant à l’opportunité de télécharger le document sur un outil basé sur le cloud.

liste de contrôle

  • [ ] J'ai recherché des données personnelles sensibles avant de les télécharger.
  • [ ] J'ai clarifié le statut de droit d'auteur du matériel.
  • [ ] J'ai observé la sensibilité culturelle et les droits communautaires.
  • [ ] J'ai abordé le parti pris de la source avec un cadre critique.
  • [ ] J'ai déclaré en toute transparence mon utilisation de l'IA.