Единица 8 / 11

Исследовательская этика, конфиденциальность и анонимизация

Прибыль:

  • Способность применять принципы информированного согласия, непричинения вреда и конфиденциальности к социальным исследованиям.
  • Возможность надлежащей анонимизации данных путем очистки всех прямых и косвенных идентификаторов перед передачей их искусственному интеллекту.
  • Возможность запрашивать политику хранения данных используемого инструмента искусственного интеллекта и использовать только утвержденные носители для конфиденциальных данных.

Социальные исследования проводятся с участием людей, и это налагает большую ответственность. Люди рассказывают вам о своей жизни, своих мнениях, иногда о самых хрупких переживаниях. Этика исследования — это набор правил для поддержания этого доверия: не причинять вред участнику, получать его согласие, защищать свою личность и не злоупотреблять своими данными. В эпоху искусственного интеллекта эта ответственность возросла еще больше, поскольку вставка данных участников в инструмент искусственного интеллекта теперь может означать неосознанную утечку этих данных. В этом модуле вы узнаете основные принципы исследовательской этики, как защитить конфиденциальность при использовании ИИ и как правильно анонимизировать данные (делая человека неузнаваемым).

Три основных принципа лежат в основе любого социального исследования. Информированное согласие: участник должен понимать, что представляет собой исследование и как его данные будут использоваться, и свободно сказать «да». Непричинение вреда: исследование не должно причинять физический, психологический или социальный вред участнику. Конфиденциальность и конфиденциальность: личность и данные участника должны быть защищены. Инструменты ИИ могут облегчить выполнение этих политик (например, составление текста согласия, контроль анонимности) или скомпрометировать их (например, загрузка в облако стенограммы, позволяющей идентифицировать личность). Разница в том, находится ли пользователь в сознании или нет.

Шаг за шагом: этические и безопасные исследования

1. Получите этическое одобрение. В большинстве учреждений (университетов, институтов) исследования с участием людей требуют одобрения комитета по этике (комитета, который гарантирует, что исследование не причинит вреда участнику). ИИ помогает составить текст заявки; Само одобрение принадлежит учреждению.

2. Четко напишите текст согласия. Участника следует информировать на понятном ему языке, а не на тяжелом юридическом языке. ИИ составляет простой и полный текст согласия; Вы подтверждаете каждый пункт.

3. Анонимизируйте данные, прежде чем передавать их ИИ. Имя, адрес, номер телефона, место работы и идентификационные данные должны быть удалены. Простого удаления имени часто бывает недостаточно; Такое описание, как «единственный фармацевт в районе X, у которого трое детей», также выдает личность.

4. Знайте, какой инструмент хранит данные и как. Данные, которые вы вставляете в инструмент искусственного интеллекта, обрабатываются на серверах этого инструмента и могут использоваться при обучении в некоторых сервисах. Для конфиденциальных данных это может быть неприемлемо; Используйте инструменты с гарантией защиты данных, одобренные вашим учреждением.

5. Надежно храните данные и своевременно удаляйте их. Соблюдайте срок хранения и обязательства по удалению, которые вы обещали в своем согласии.

Внимание: вставка необработанных данных участников, содержащих личную информацию (имя стенограммы, контактную информацию, конфиденциальные личные данные), в любой инструмент искусственного интеллекта является серьезным этическим и юридическим нарушением. Сначала обезличьте данные; Если вы не можете анонимизировать их, никогда не передавайте эти данные внешнему инструменту.

три мини-кейса

Случай 1 — Недостаточная анонимизация. Исследователь удалил имена из стенограмм и передал их ИИ. Но один участник сказал: «В прошлом году, будучи единственной женщиной-инспектором в муниципалитете...»; Одно только это определение выдало человека. Когда ИИ приказал «найти идентифицирующие детали в каждой стенограмме», появилось 11 таких скрытых идентификаторов, которые были обобщены.

Случай 2. Упрощенный текст согласия. Форма согласия одной команды была написана тяжелым юридическим языком; Участники подписывали, не понимая. YZ сократил текст до уровня чтения 8-го класса и сделал каждую статью простым турецким языком. Участники теперь действительно поняли и дали согласие; Комитет по этике также одобрил это.

Случай 3 — Выбор транспортного средства предотвратил кризис. Аспирант собирался загрузить конфиденциальные интервью с жертвами в общий инструмент искусственного интеллекта, чтобы обобщить их. Его советник напомнил, что данные не были анонимизированы и политика хранения данных автомобиля неизвестна. Данные сначала были полностью анонимизированы и обрабатывались только в среде с гарантированной защитой данных, утвержденной учреждением.

Четыре копируемых шаблона

1) Контроль анонимизации:

Отметьте в тексте КАЖДУЮ деталь, которая могла бы прямо или косвенно идентифицировать человека: имя, местонахождение, место работы, уникальные роли («единственные в своем роде»), дату, родство, заболевание, редкие характеристики. Предложите каждому анонимный ответ (например, «Участник 7», «Округ X»). Текст: [здесь]

2) Проект информированного согласия:

Составьте текст информированного согласия на исследование простым языком (уровень 8-го класса). Оно включает в себя: цель исследования, что будет сделано, продолжительность, добровольность и право на отзыв, как данные будут храниться/удаляться, обеспечение конфиденциальности, коммуникация. Избегайте юридического жаргона. Тема: [х]

3) Проверка этического риска:

План моего исследования: [резюме]. Участники: [кто]. Перечислите возможные этические риски: потенциальный вред, дисбаланс власти, уязвимая группа, риск конфиденциальности, вопросы согласия. Дайте рекомендации по смягчению каждого риска. Если есть нестабильные группы, укажите особые моменты внимания.

4) Контроль безопасности транспортных средств с использованием искусственного интеллекта:

У меня есть следующий тип данных: [тип]. Придумайте контрольный список контрольных вопросов, которые я должен задать перед обработкой этого в инструменте искусственного интеллекта: где хранятся данные, используются ли они в образовании, анонимны ли они, есть ли одобрение институциональной структуры, являются ли это конфиденциальными данными. Предложите критерии принятия решения.

Слабая подсказка / Сильная подсказка

Слабая подсказка:

Кратко опишите эту запись интервью: «Я Айше Йылмаз, учительница в Кадыкее, моя жена была в прошлом году...» [текст с полным именем, удостоверением личности]

При этом учетные данные передаются непосредственно внешнему инструменту, что является серьезным нарушением конфиденциальности. Данные совершенно не анонимизированы.

Мощная подсказка:

Обобщите приведенный ниже текст. Текст был предварительно анонимизирован: имена заменены кодами типа «Участник 3», локации заменены общими фразами типа «Округ X», идентифицирующие детали опущены. Добавление нового идентификатора; не делайте выводов, нарушающих анонимность. Текст: [анонимный текст]

Разница: при втором подходе личность участника вообще не доходит до инструмента; Конфиденциальность защищена с самого начала.

Этические принципы и практика искусственного интеллекта

принцип

Значение

риск с ИИ

защита

Информированное согласие

Информированное свободное согласие

Простой текст согласия

не навреди

Никакого вреда участнику

неправильное приписывание

Аудит лояльности

Конфиденциальность

Личность защищена

утечка данных

Анонимизация

Безопасность данных

Безопасное хранение

облачная обработка

Одобренный автомобиль

честность

Нет примерки

галлюцинация

проверка источника

Распространенные ошибки

  • Кажется, я просто удалил имя и анонимизировал его. Косвенные дескрипторы («единственный») выдают человека.
  • Вставка необработанных данных идентификатора во внешний инструмент. Это одно из самых серьезных нарушений конфиденциальности.
  • Написание текста согласия на жаргоне. Согласие, которое не понято, не является настоящим согласием.
  • Незнание политики использования данных автомобиля. Узнайте, где хранятся и используются ваши данные.
  • Относиться к этическому одобрению как к формальности. Комитет по этике защищает участника; отнеситесь к этому серьезно.

В заключение

Сердцем социальных исследований является ответственность перед участником. Информированное согласие, отсутствие вреда и конфиденциальность являются основой каждого исследования. ИИ; Это может помочь в упрощении текста согласия, проверке этических рисков и контроле анонимности. Но передача необработанных идентификационных данных инструменту ИИ является серьёзным нарушением; Сначала полностью анонимизируйте данные, удалите косвенные идентификаторы, используйте только безопасные инструменты, одобренные вашим учреждением, и соблюдайте все данные вами обещания. Этика – не украшение исследования, а его необходимое условие.

Задача приложения

Подготовьте краткий образец стенограммы (отредактируйте самостоятельно), включающую идентифицирующую информацию. Найти и обобщить все прямые и косвенные идентификаторы от ИИ с помощью шаблона «управление анонимизацией»; Посчитайте, сколько секретных идентификаторов выйдет. Затем создайте простой текст согласия, используя «проект информированного согласия», и попросите друга прочитать его, чтобы проверить, действительно ли он понятен.

контрольный список

  • [ ] Я проверил требования и процедуру этического одобрения.
  • [ ] Текст согласия я написал простым и понятным языком.
  • [ ] Я удалил все прямые и косвенные идентификаторы перед передачей данных ИИ.
  • [ ] Я ознакомился с политикой хранения данных используемого мной инструмента искусственного интеллекта.
  • [ ] Для хранения конфиденциальных данных я использовал только одобренные и безопасные носители.