Единицы
1. Новый партнер журналистики: роли, границы и рефлекс проверки 2. Анализ данных в журналистских расследованиях: превращаем стопки документов в новости 3. Транскрипция и анализ аудио/видео: интервью в текст, текст в новости 4. Проверка и подтверждение источника (факт-чек): от утверждения к доказательствам 5. Дезинформация и синтетический контент: журналистика в эпоху дипфейков 6. Написание новостей: от черновика к публикации, от перевернутой пирамиды к заголовку 7. Подведение итогов, брифинг и переупаковка контента 8. Многоязычная журналистика: перевод, локализация и ее ограничения 9. Этика, честность и прозрачность: политика искусственного интеллекта в редакции новостей 10. Защита ресурсов, конфиденциальность и цифровая безопасность 11. Комплексный рабочий процесс: полное путешествие новостей с помощью искусственного интеллекта
Единица 10 / 11

Защита ресурсов, конфиденциальность и цифровая безопасность

Прибыль:

  • Распознайте прямые и косвенные идентификаторы, метаданные и цифровые следы, которые могут выдать источник, и спросите: «Скольким людям подойдет это описание?» Возможность применить анонимизацию с помощью теста
  • Приобретите дисциплину выбора только проверенных на безопасность инструментов для конфиденциальной работы, применения принципа наименьшего количества данных и очистки следов.
  • Способность понимать, что КВКК и профессиональная конфиденциальность требуют этой дисциплины как с юридической, так и с моральной точки зрения, и что однажды утекшую личность невозможно вернуть обратно.

В журналистике источником является человек, который говорит, часто подвергаясь большому риску: государственный служащий, разоблачающий коррупцию, работник, описывающий правонарушения, человек, который может потерять работу, свободу или даже безопасность, если его личность будет раскрыта. Защита источника — принцип сохранения конфиденциальности личности информатора — является одним из самых священных обязательств профессии и защищается в большинстве правовых систем. Эпоха искусственного интеллекта (ИИ) одновременно упрощает эту задачу и создает новые риски: инструмент, который вы используете для понимания документа, может скрыть этот документ; Если вам не удастся выполнить анонимизацию, следы, которые вы оставите на ИИ, могут раскрыть источник. Принцип этого модуля ясен: никакие данные, которые могли бы выдать источник, не попадают в незащищенный инструмент искусственного интеллекта; Анонимизация и цифровая гигиена выполняются до использования ИИ, а не после. После утечки личность невозможно восстановить.

Какие следы выдают источник?

Защита ресурсов – это не просто «без названия». Следующие следы также могут выявить личность:

  • Прямые идентификаторы: имя, телефон, электронная почта, TR ID, адрес, место работы.
  • Косвенные дескрипторы: такие описания, как «единственная женщина-инженер, работающая в кругу из трех человек»; Это относится к одному человеку в небольшой группе.
  • Метаданные документа: имя автора, история изменений, дата создания, местоположение GPS, трек принтера, встроенные в файл.
  • Контекстные подсказки: кто имеет доступ к документу; время утечки; конкретное событие в повествовании.
  • Цифровая трассировка: с какого устройства, из какой сети, с какой учетной записью осуществлялся контакт.

Критический риск для ИИ: внесение любого из этих следов в инструмент выводит данные из-под вашего контроля. Большинство бесплатных/публичных инструментов искусственного интеллекта хранят входные данные или могут использовать их при уточнении модели.

Шаг за шагом: использование ИИ и экономия ресурсов

Шаг 1 — Классифицируйте транспортное средство. Для конфиденциальной работы используются только инструменты с проверенными условиями безопасности и обработки данных (желательно корпоративные, без хранения данных или оффлайн). Конфиденциальные данные не вводятся в общедоступные/бесплатные инструменты.

Шаг 2 — Очистите метаданные. Удалите метаданные перед экспортом документа в инструмент; Если возможно, преобразуйте документ в обычный текст или вручную суммируйте содержимое и анонимизируйте его вместо снимка экрана.

Шаг 3 — Анонимизация. Обобщить все прямые и косвенные идентификаторы: «Источник А», «должностное лицо», размыть даты и места. Измените рецепты, относящиеся к одиночным людям в небольших группах.

Шаг 4 — Минимальная политика данных. Давайте ИИ только то, что требует работа. Вместо краткого изложения всего документа дайте соответствующий неидентифицирующий раздел.

Шаг 5 — Проверьте и сохраните. Проверьте адекватность анонимизации с помощью этапа проверки (шаблон ниже). Поддерживайте связь с источником по отдельным безопасным каналам.

Шаг 6 — Очистите дорожки. После завершения работы очистите историю/сессию в инструменте; Надежно храните или удаляйте конфиденциальные файлы.

Внимание: сказать «Я анонимизировал» недостаточно; В небольшой группе даже одно косвенное описание раскрывает идентичность. Вы можете использовать анонимизацию, чтобы спросить: «Скольким людям подойдет этот рецепт?» Проверьте это с помощью вопроса. Если ответ «один», ресурс не защищен.

КВКК и профессиональная тайна

В Турции персональные данные регулируются KVKK (Закон о защите персональных данных); Такая информация, как здоровье и политические взгляды, является особыми данными и требует более строгой защиты. Передача данных источника произвольному инструменту может повлечь за собой как этическую, так и юридическую ответственность. Профессиональная конфиденциальность является обязанностью чести, независимой от закона.

три мини-кейса

Случай 1 — Утечка метаданных предотвращена. Репортер собирался подвести итог просочившемуся отчету; В последний момент он понял, что имя организатора заложено в метаданных файла. Он использовал его после преобразования документа в обычный текст и удаления имени. Если бы был загружен необработанный файл, метаданные напрямую указали бы источник.

Случай 2 — Опасность косвенного идентификатора. Репортер использовал эту фразу во время консультации с YZ, назвав источник «единственным сотрудником-инвалидом в штаб-квартире». Независимо от того, хранил ли ИИ где-то текст, это описание указывало на одного человека. Редактор заметил, изменил описание на «сотрудник агентства». В небольшой группе косвенное описание было так же опасно, как и имя.

Случай 3 — Выбор безопасного транспортного средства. При анализе высококонфиденциальной партии документов группа расследований предпочла использовать автономное решение без данных, а не универсальный инструмент искусственного интеллекта; дополнительно обезличили документы. Анализ шел немного медленнее, но безопасность ресурса ни разу не была нарушена.

Копируемые шаблоны

1) Тест на знание анонимности:

Отметьте в тексте ниже каждый элемент, который может раскрыть личность источника: прямые идентификаторы (имя, должность, подразделение) и косвенные идентификаторы (описания, указывающие на одного человека в небольшой группе, конкретные события, дату/место). Для каждого знака: «Скольким людям подойдет это описание?» Задайте вопрос и предложите более безопасные обобщения. Изменить текст. Текст: [здесь]

2) Проверка перед обменом документами:

Составьте контрольный список безопасности, который мне следует выполнить перед отправкой документа в инструмент искусственного интеллекта: очистка метаданных, прямое/косвенное сканирование идентификаторов, минимальная политика данных, класс безопасности инструмента, очистка истории. Добавьте одно предложение «как» для каждого пункта.

3) Оценка рисков исходной коммуникации:

Я свяжусь с секретным источником. Создайте контрольный список мер цифровой безопасности, которые защитят вашу личность и общение (выбор канала, отсутствие следов, метаданные, гигиена устройства). Давать конкретные и действенные предложения; не обещайте стопроцентной безопасности.

4) Контроль защиты источника перед публикацией:

Включите в следующие готовые к публикации новости любые детали, которые могут идентифицировать источник: косвенные описания, время атрибуции, количество людей, имевших доступ к документу, детали конкретного события. Выделите каждое рискованное место и предложите, как его размыть. Новости: [здесь]

Слабая подсказка / Сильная подсказка

Слабая подсказка: «Резюмируйте этот документ». (путем загрузки конфиденциального исходного документа метаданных как есть)

Результат: метаданные и косвенные идентификаторы находятся вне вашего контроля; Источник может быть скомпрометирован без вашего ведома.

Настоятельная подсказка: сначала преобразуйте документ в обычный текст и удалите метаданные, обобщите прямые/косвенные идентификаторы, дайте только соответствующую часть: «Обобщите следующий анонимный текст; также отметьте в нем все оставшиеся признаки идентификации».

Отличие: сильный подход очищает данные, не передавая их в транспортное средство, передает минимальный объем данных и использует ИИ в качестве дополнительного уровня контроля; ресурс защищен.

сравнительная таблица

тип трека

пример

Риск

предосторожность

Прямой идентификатор

Имя, телефон, подразделение

высокий

Удалить/обобщить

косвенный идентификатор

«Единственная женщина-инженер»

Высокий (скрытый)

«Сколько человек вмещается?» тест

метаданные

Автор файла/дата/GPS

высокий

Преобразовать в обычный текст, очистить

Контекстуальная подсказка

Время утечки

средний

Размытие времени/места

цифровая трассировка

Устройство, сеть, учетная запись

Средне-высокий

Безопасный канал, гигиена

Распространенные ошибки

  • Забываем метаданные. Загрузка файла как есть и утечка встроенной информации об авторе/дате/местоположении.
  • Просто удалите имя. Игнорирование того, что косвенные идентификаторы также раскрывают личность.
  • Экспорт конфиденциальных данных в общедоступный инструмент. Ввод исходных данных в инструменты, которые хранят данные/используют их при обучении модели.
  • Передача слишком большого количества данных. Увеличение поверхности риска за счет предоставления большего количества документов/деталей, чем требуется для работы.
  • Не чистит дорожки. Оставление истории сеансов и конфиденциальных файлов после завершения работы.

Безопасный выбор автомобиля: на что обратить внимание?

Решение о том, является ли инструмент ИИ «безопасным» для деликатной работы, — это техническая грамотность, которую должен приобрести журналист. Основные вопросы, на которые следует обратить внимание: хранит ли инструмент введенные вами данные, как долго и где? Используются ли ваши данные при обучении моделей (да, в большинстве бесплатных потребительских инструментов, часто нет в корпоративных версиях)? В какой стране обрабатываются данные и в соответствии с каким законодательством? Может ли инструмент работать в автономном режиме (на вашем устройстве, без отправки данных в Интернет)? Есть ли у вашей организации соглашение об обработке данных с помощью этого инструмента? Ввод конфиденциальных данных о ресурсах в инструмент без знания ответов на эти вопросы подвергает ресурс риску слепого доверия.

Полезна общая иерархия: для наиболее конфиденциальных документов предпочтительны решения, работающие в автономном режиме или в вашей собственной инфраструктуре; контрактные корпоративные инструменты, которые не хранят данные средней точности; Общие потребительские инструменты можно использовать только для неидентифицированного, общедоступного или анонимного контента. Выполнение этой классификации в начале предотвращает ошибку «поспешного ввода неправильных данных в неправильный инструмент». Кроме того, в корпоративном отделе новостей это решение не должно оставляться на усмотрение отдельных репортеров, а должно быть стандартизировано с помощью письменного списка утвержденных инструментов; потому что одна ошибка одного человека может уничтожить источник всего расследования. Безопасность транспортных средств является технической основой защиты ресурсов, и к ней следует относиться так же серьезно, как и к анонимизации.

В итоге

Защита ресурсов создает новые риски в эпоху искусственного интеллекта: инструменты могут скрывать данные, метаданные и косвенные идентификаторы могут выдать личность. Безопасный путь; выбор инструмента по классу безопасности, очистка метаданных, анонимизация всех прямых и косвенных идентификаторов (тест «сколько человек подходит под это описание?»), применение принципа наименьшего количества данных и очистка следов. КВКК и профессиональная конфиденциальность требуют соблюдения этой дисциплины как с юридической, так и с моральной точки зрения. После утечки личность невозможно восстановить.

Задача приложения

Возьмите реальный или вымышленный исходный документ/заметку. Сначала следуйте подсказке «Проверка уровня анонимности»; Отметьте каждый появившийся прямой и косвенный дескриптор и спросите: «Сколько людей он поместится?» Оцените с помощью вопроса. Затем надежно анонимизируйте документ и вручную примените список «Проверка предварительного обмена документами» один раз.

контрольный список

  • [ ] Для конфиденциальной работы я использую только проверенные на безопасность инструменты.
  • [ ] Я очищаю метаданные перед экспортом документа.
  • [ ] Использует все прямые и косвенные дескрипторы типа «Сколько человек подойдет?» Я анонимизирую его с помощью теста.
  • [ ] Соблюдается принцип наименьшего количества данных; Делюсь только необходимой частью.
  • [ ] Я очищаю историю сеансов и конфиденциальные файлы после работы; Соблюдаю КВКК и профессиональную тайну.