Единица 1 / 11

Введение в искусственный интеллект в библиотечном деле и управлении информацией: роли, границы, аутентификация, конфиденциальность и этика

Прибыль:

  • Возможность различать, где искусственный интеллект экономит время в библиотечном рабочем процессе (метаданные, резюме, поиск, предложения), а где точность, надежность источника и решения о конфиденциальности оставляются на усмотрение людей, в зависимости от уровня риска.
  • Способность применять дисциплину, которая проверяет каждый результат, связывая его с источником, подтверждая его в независимом источнике и пропуская через фильтр смещения.
  • Понимание того, почему галлюцинации, сфабрикованные источники и конфиденциальность пользователей являются рисками, которые необходимо учитывать в этой профессии с самого начала.

Когда утром специалист по каталогизации садится за свой стол, у него могут быть десятки вновь прибывших книг, сотни документов из коллекции пожертвований и архивная коробка, ожидающая оцифровки. Справочный библиотекарь (эксперт, который помогает пользователям находить информацию) в течение дня отвечает на вопросы типа «где находится надежный источник по этой теме?» Информационный менеджер отвечает за обеспечение доступности и надежности тысяч документов организации. В этом модуле мы выясним, где именно искусственный интеллект (сокращенно ИИ; большие языковые модели и подобные инструменты) экономит время в этих задачах, а где суждение, выбор и ответственность остаются за человеком.

Начнем с определения: искусственный интеллект, под которым мы подразумеваем программные инструменты, генерирующие язык и распознающие образы, обученные на больших объемах текста. Эти инструменты суммируют, переводят, предлагают классификацию, генерируют черновой текст и отмечают шаблоны в больших объемах данных. Но он не знает, существует ли источник на самом деле, верна ли информация или защищена ли конфиденциальность пользователя. Вот почему в библиотечном деле и управлении информацией ИИ является помощником, а не лицом, принимающим решения.

Где искусственный интеллект работает, а где не работает?

Давайте разделим библиотечный рабочий процесс на три уровня. Первый уровень — это механические и повторяющиеся задачи: извлечение черновых метаданных из подписи книги, подведение итогов длинного отчета, перевод текста с одного языка на другой, очистка таблицы данных. Искусственный интеллект здесь очень силен и экономит время.

Второй слой — квазисудебная работа: какую предметную рубрику дать документу, включать ли ресурс в коллекцию, какой ресурс рекомендовать пользователю. ИИ здесь выдвигает предложения, но последнее слово остается за экспертом, который знает политику учреждения и реальные потребности пользователя.

Третий уровень — это чистое суждение и ответственность: подтверждение точности информации, принятие решения об авторских правах, раскрытие конфиденциальных личных данных, подтверждение надежности источника. На этом уровне выходные данные ИИ — это всего лишь отправная точка; Ответственность полностью лежит на людях.

Совет: прежде чем давать задание ИИ, спросите себя: «Что произойдет, если этот результат окажется неправильным?» Если ответ «Я потрачу время», смело используйте ИИ. Если ответ — «распространяется ложный источник, пользователь введен в заблуждение или произошла утечка личных данных», обязательно проверьте вывод.

Галлюцинации: самая большая опасность библиотекаря

Галлюцинация — это когда ИИ выдает несуществующую информацию, источник или цитату, как если бы они были реальными, и на чрезвычайно убедительном языке. Это особенно опасно для библиотечного дела и управления информацией; ведь суть нашей профессии – это подлинность и достоверность источника.

Когда вы просите ИИ «предложить пять научных статей по этой теме», он может генерировать названия, авторов и названия журналов, которые кажутся реальными, но не существуют вообще. Эти сфабрикованные источники настолько убедительны, что посетитель или даже библиотекарь может добавить их в библиографию, не проверяя их. В гуманитарных и социальных науках опасность еще выше: когда «тот документ 1897 года» фабрикуется для историка или «то решение суда» для юриста, результатом является серьезная дезинформация.

Внимание: никакие ссылки на источники, цитаты или ссылки, созданные ИИ, не должны передаваться куда-либо без проверки в реальном каталоге, базе данных или самом источнике. То, что это «выглядит убедительно», не означает, что это правда.

Дисциплина проверки: три шага

Основная дисциплина, которую должен соблюдать библиотекарь при работе с ИИ, заключается в следующем:

1. Подключитесь к источнику. Каждый факт, цифра, дата и отпечаток должны быть основаны на первоисточнике. Спросите ИИ «скажите, из какого источника вы получили эту информацию» и проверьте этот источник самостоятельно.

2. Самостоятельно подтвердить. Проверьте критически важную информацию хотя бы в одном надежном источнике за пределами ИИ (аутентичный каталог, официальная база данных, первичный документ).

3. Пропустите его через фильтр смещения. ИИ несет в себе предвзятость данных, на которых он обучается. Предлагаемая тема, список предложений или резюме могут подчеркнуть одни точки зрения и затмить другие. Спросите, кто остался в стороне, какой точки зрения не хватает.

Конфиденциальность и конфиденциальность пользователей

Одним из наиболее фундаментальных этических принципов библиотечной профессии является конфиденциальность пользователей: то, что человек читает, что он ищет и какой предмет его интересует, является конфиденциальным. Ввод данных в инструменты ИИ, особенно общедоступные инструменты, работающие через Интернет, которые включают в себя идентификационные данные пользователей, историю поиска или заимствованные ресурсы, может нарушить этот принцип; потому что эти данные могут попасть в сторонние системы.

Аналогично, в организации несекретные, но конфиденциальные документы (кадровая информация, контракты, внутренняя переписка) не должны загружаться в общий инструмент ИИ. Для обработки данных такого типа предпочтительны инструменты, работающие в собственной безопасной закрытой системе учреждения.

Совет: прежде чем вводить какие-либо данные в ИИ, спросите: «Является ли эта информация общедоступной?» просить. Если ответ отрицательный или вы не уверены, поместите эти данные в обезличенный анонимный формат или используйте только безопасные инструменты, одобренные учреждением.

три мини-кейса

Случай 1 — Проект метаданных для 400 документов. Университетской библиотеке пришлось каталогизировать архив из 400 документов, подаренных профессором. Эксперт извлек с помощью ИИ черновой вариант названия, даты и темы с первой страницы каждого документа: среднее время на один документ сократилось с 12 минут до 4 минут. Но каждый проект оттиска сравнивался с первоначальным документом и одобрялся экспертом; На этом этапе было обнаружено 17 неправильных дат, придуманных ИИ.

Случай 2 — Обнаружен фейковый источник. Библиотекарь-консультант получил от YZ 6 предложений по статьям при поиске ресурсов по «климатической миграции» для студента бакалавриата. Библиотекарь пересмотрел их все в базе данных учреждения: 2 из 6 статей вообще не существовало. Этап проверки не позволил студенту получить сфабрикованный источник.

Случай 3 — Предотвращено нарушение конфиденциальности. Библиотека рассматривала возможность использования общего инструмента искусственного интеллекта для анализа того, «какой пользователь какой темой интересуется» на основе записей оформления заказа. Информационный менеджер понял, что раскрытие этих данных вместе с идентификатором пользователя будет нарушением конфиденциальности; данные сначала были анонимизированы и обрабатывались исключительно как агрегированные обезличенные статистические данные.

Четыре копируемых шаблона

1) Начните определять роли и границы:

Ваша роль: опытный помощник специалиста по каталогизации и управлению информацией. Ваша задача: составить черновик из информации в источнике, который я вам дал. Правила: (1) Используйте только информацию из текста, который я вам дал, не добавляйте свою собственную информацию. (2) Отметьте «[должно быть проверено]», если вы не уверены. (3) Не выдумывайте никаких дат, имен или отпечатков. Если вы поняли, начните. Источник: [здесь]

2) Вопрос для проверки:

List each factual claim (date, name, number, source citation) in the text below. По каждому: откуда в тексте вы взяли эту информацию? Если в тексте это неясно, напишите «нет в тексте». Текст: [здесь]

3) Проверка предвзятости и отсутствия перспективы:

Какие точки зрения освещаются в следующем резюме/рекомендациях, а какие не учитываются? Какие группы, регионы или представления могут отсутствовать? Просто полагайтесь на текст, не предполагайте. Текст: [здесь]

4) Предварительная проверка конфиденциальности:

Содержит ли текст ниже личные данные (имя, идентификационный номер, контакт, историю чтения/поиска) или конфиденциальную корпоративную информацию? Если да, перечислите его и предложите, как его можно анонимизировать. Текст: [здесь]

Слабая подсказка / Сильная подсказка

Слабая подсказка:

Найдите мне несколько ресурсов по этой теме.

Эта подсказка предлагает ИИ генерировать поддельные ресурсы. Здесь нет ролей, границ, правил проверки и ресурсов. ИИ может создавать правдоподобные, но несуществующие теги.

Мощная подсказка:

Ваша роль: помощник библиотекаря-справочника. Выберите из представленного ниже каталога те, которые связаны с темой «климатическая миграция», и объясните, почему они актуальны. Не добавляйте источники, которых нет в списке, не фабрикуйте источники. Если вы не уверены, скажите: «В списке нет подходящих источников». Записи каталога: [здесь]

Разница очевидна: сильная подсказка заставляет ИИ работать из заданного реального источника, а не из собственной памяти, и предотвращает фальсификацию.

Таблица слоев и ответственности

бизнес-уровень

пример задачи

Роль ИИ

мужское решение

механический

Проект метаданных, резюме, перевод

Быстро делает черновики

проверка, одобрение

квазисудебный

Название темы, предложение источника

предлагает предложения

Выбор по политике

чистое суждение

Аутентификация, решение об авторских правах

Только предварительная информация

Вся ответственность лежит на человеке

Распространенные ошибки

  • Замена выхода AI на источник. ИИ — помощник, а не ресурс; Каждый вывод проверяется.
  • Принятие сфабрикованного источника как убедительного. То, что это выглядит хорошо, не означает, что это правильно.
  • Ввод личных/конфиденциальных данных в общедоступный инструмент. Конфиденциальность пользователей и корпоративная конфиденциальность соблюдаются с самого начала.
  • Игнорирование предрассудков. ИИ несет в себе перспективы данных, на которых он обучается; Спросите, чего не хватает.
  • Оставляя решение ИИ. Решения о точности, авторских правах и конфиденциальности принадлежат людям.

В заключение

искусственный интеллект; Это мощный помощник для обобщения, составления, перевода и разметки шаблонов в библиотечном деле и управлении информацией. Это экономит много времени при механической работе; дает консультации по квазисудебным вопросам; Но проверка точности, надежности источника, конфиденциальности пользователей и этических решений принадлежит людям. Галлюцинации представляют собой величайшую опасность для этой профессии: никакие источники или цитаты не используются без проверки. Запускайте ИИ с четкими правилами роли, границ и проверки; Подтвердите каждый критический результат с помощью независимого источника.

Задача приложения

Выберите реальную тему из вашей области. Попросите у ИИ рекомендации по пяти ресурсам по этой теме, затем найдите каждый из них в реальном каталоге или базе данных и отметьте, сколько из них существует на самом деле. Затем с помощью шаблона «Стартап, определяющий роли и границы» попросите ИИ работать только на основе предоставленного вами текста и сравните результаты двух подходов. Напишите, какой подход мешает примерке.

контрольный список

  • [ ] Я определил, на каком уровне (механическом, полусудебном, чистом суждении) находится задача.
  • [ ] «Что произойдет, если эти выходные данные неверны?» Я задал вопрос.
  • [ ] Я сверил каждую ссылку и цитату с независимым источником.
  • [ ] Я проверил, что в данных, поступающих в AI, нет личной/конфиденциальной информации.
  • [ ] Окончательное решение и ответственность я оставил на свое усмотрение.