Прибыль:
- Возможность снизить юридические риски, оценивая статус авторских прав на входные данные и условия данных инструмента и ставя под сомнение права на выходные данные.
- Возможность защитить личные данные посредством анонимизации и минимизации, а также обеспечить конфиденциальность, будучи прозрачным для пользователя.
- Способность создать структуру управления для учреждения, включающую утвержденные инструменты, запрещенные данные и правила проверки, а также протестировать ее использование с учетом библиотечных ценностей.
Библиотекарь и информационный менеджер — это тот, кто не только организует и представляет информацию, но и защищает ее: защищая права создателя, конфиденциальность пользователя и ответственность учреждения. Искусственный интеллект бросает вызов всем трем областям, задавая новые и сложные вопросы. Является ли загрузка документа в AI нарушением авторских прав? Нарушает ли передача пользовательских данных инструменту искусственного интеллекта конфиденциальность? Как организация должна управлять использованием ИИ? В этом заключительном разделе мы создадим структуру, которая объединит этические и юридические темы, которые мы затронули на протяжении всего модуля.
Давайте определимся с понятиями. Авторское право — это законное право, предоставленное создателю произведения на использование его произведения; Несанкционированное копирование или использование может рассматриваться как нарушение авторских прав. Персональными данными является любая информация, которая прямо или косвенно идентифицирует человека и подлежит правовой защите. Управление — это система правил, политик и подотчетности, которая регулирует использование ИИ в организации. Эти три концепции составляют правовую и этическую основу для ответственного использования ИИ.
Шаг за шагом: ответственное и законное использование ИИ
1. Оцените статус авторских прав записи. Прежде чем загружать текст, книгу или статью в инструмент искусственного интеллекта, рассмотрите статус авторских прав на эту работу и условия использования инструмента. Передача защищенной авторским правом работы инструменту, который использует загружаемые вами данные в своих целях, может представлять собой нарушение прав.
2. Опросить права выхода. Статус авторских прав на текст, созданный ИИ, может быть неопределенным, и ИИ может неосознанно воспроизводить контент, защищенный авторским правом, в обучающих данных. Прежде чем публиковать результаты ИИ, оцените их оригинальность и возможные нарушения.
3. Защитите личные данные. Личность пользователей, история чтения/поиска и личная информация не должны вноситься в какой-либо инструмент искусственного интеллекта без явного согласия и строгой защиты. Анонимизация и минимизация данных (только столько данных, сколько необходимо) имеют важное значение.
4. Обеспечьте прозрачность и согласие. Пользователи должны знать, как обрабатываются их данные и взаимодействия; Если речь идет об искусственном интеллекте, это должно быть четко указано. Использование скрытого ИИ подрывает доверие.
5. Создайте структуру управления. Организация должна установить в письменной политике, какие инструменты одобрены, какие данные можно вводить, кто несет ответственность и как будут проверяться результаты.
Совет: Создайте простой лист «Правила использования ИИ» для вашей организации: какие инструменты одобрены, какие данные никогда не вводятся (личные/собственные/конфиденциальные), как проверяется каждый результат и кто несет ответственность. Четкое руководство на одной странице более осуществимо, чем длинная политика.
Этические принципы и ценности библиотечного дела
Глубоко укоренившиеся ценности библиотечной профессии служат компасом в эпоху искусственного интеллекта: равный доступ к информации, свобода мысли, конфиденциальность пользователей, интеллектуальная честность и беспристрастность. ИИ может либо поддерживать, либо угрожать этим ценностям. Это может расширить доступ, но усилить предрассудки; может ускорить обслуживание, но может поставить под угрозу конфиденциальность; Это может облегчить обнаружение, но может и распространить дезинформацию.
Ответственный библиотекарь проверяет каждое использование ИИ на соответствие следующим значениям: «Уравнивает ли это использование доступ или исключает группу? Защищает ли оно конфиденциальность? Предоставляет ли оно точную и честную информацию?» ИИ — это инструмент; Ценности, с которыми вы будете его использовать, составляют суть профессии. Технологии меняются, но эти ценности являются неизменным компасом библиотечного дела.
Внимание: фразы «все его используют» или «это быстро» не оправдывают использование ИИ. Даже если использование законно, оно может быть неэтичным; Не применяйте практику, которая вредна с точки зрения авторского права, конфиденциальности и справедливости, только потому, что это легко. Основная ответственность лежит не на инструменте, а на профессионале, использующем его.
три мини-кейса
Случай 1 — Загрузка, защищенная авторским правом, остановлена. Одна команда планировала загрузить весь справочник, защищенный авторским правом, в общий инструмент искусственного интеллекта для создания сводок. Информационный менеджер счел это рискованным как с точки зрения авторских прав, так и с точки зрения условий использования данных инструмента; вместо этого оно изучалось только в кратких, авторитетных отрывках и в закрытой системе учреждения.
Случай 2 — Персональные данные обезличены. Библиотека хотела проанализировать отзывы пользователей с помощью ИИ; но отзыв содержал имена пользователей и контактную информацию. Перед анализом команда анонимизировала данные; обрабатывались только анонимные, коллективные тенденции. Конфиденциальность сохранена, понимание восстановлено.
Случай 3 — Устранение пробелов в управлении. В одной организации сотрудники без присмотра использовали различные инструменты искусственного интеллекта, иногда вводя конфиденциальные документы. Информационный администратор опубликовал одностраничную политику, определяющую одобренные инструменты, запрещенные типы данных и правила проверки; Неопределенность и риск значительно снизились.
Компетентность персонала и корпоративная культура
Политика управления сильна настолько, насколько сильны люди, которые ее реализуют. Даже самое лучшее правило остается на бумаге, если сотрудники не понимают рисков, связанных с ИИ. Таким образом, прочной основой ответственного использования ИИ является компетентность персонала: понимание каждым сотрудником того, что такое галлюцинация, какие данные никогда не следует вводить и почему выходные данные следует проверять. Библиотеки и информационные учреждения играют в этом отношении двойную роль; Он должен как обучать собственный персонал, так и распространять эту грамотность среди пользователей. Хорошая корпоративная культура — это та, которая сообщает об ошибке ИИ, а не скрывает ее, и считает нормальным говорить: «Я не уверен в этих результатах, давайте проверим». В среде, где ошибки скрываются из-за страха наказания, сфабрикованный источник или нарушение конфиденциальности распространяются незаметно. Кроме того, поскольку технологии и инструменты быстро меняются, политику и обучение следует обновлять регулярно, а не разово. Управление; Это живая система, в которой правила, инструменты, образование и культура работают вместе. В центре этой системы стоит компетентный человек, который берет на себя ответственность и принимает окончательное решение, а не автомобиль.
Совет: прежде чем внедрять новый инструмент искусственного интеллекта, проведите небольшой пилотный проект: опробуйте его с ограниченной командой, выполняя реальные задачи с низким уровнем риска, фиксируя ошибки и риски. Это одновременно повышает компетентность и выявляет уязвимости политики перед внедрением инструмента во всей организации.
Четыре копируемых шаблона
1) Предварительная оценка авторских прав:
Помогите мне оценить следующий контент на предмет авторских прав перед загрузкой его в инструмент искусственного интеллекта: может ли контент быть защищен авторским правом, какой способ использования рискован, какая альтернатива (выдержка, разрешение, общественное достояние) безопаснее? Тип контента: [здесь]
2) Сканирование персональных данных:
Содержит ли следующий текст личные данные (имя, контакт, личность, историю чтения/поиска, информацию, касающуюся здоровья/верований)? Отметьте каждое, классифицируйте и предложите, как его анонимизировать. Текст: [здесь]
3) Проект политики использования ИИ:
Набросайте одностраничные рекомендации по использованию ИИ для нашей организации: (1) утвержденные политики инструментов, (2) типы данных никогда не вводились, (3) правила проверки выходных данных, (4) подотчетность и прозрачность, (5) политики авторского права и конфиденциальности. Держите его кратким и действенным. Контекст: [здесь]
4) Запрос по этическому контролю:
Проверьте следующее запланированное использование ИИ на соответствие библиотечным ценностям: справедливость доступа, конфиденциальность, точность/целостность, риск предвзятости и пометить проблемы, если таковые имеются. Использование: [здесь]
Слабая подсказка / Сильная подсказка
Слабая подсказка:
Стоит ли мне выложить это на ИИ, чтобы подвести итог этой книге?
В вопросе не учитываются авторские права, данные условия инструмента и альтернативы; Ответ «да» может привести к нарушению прав.
Мощная подсказка:
Ваша роль: помощник консультанта по авторским правам и конфиденциальности. Я рассматриваю возможность использования следующего контента в инструменте искусственного интеллекта. Перечислите возможные проблемы с точки зрения статуса авторских прав, использования данных транспортных средств и риска персональных данных; предложите более безопасные альтернативы (короткая цитата, разрешение, общественное достояние, закрытая система). Заявляйте о правовой определенности, демонстрируйте риски. Содержание и контекст: [здесь]
Мощная подсказка; Он рассматривает решение с точки зрения авторских прав, состояния данных и аспектов конфиденциальности и предлагает безопасные альтернативы.
Таблица параметров управления
Размер
основной вопрос
предосторожность
авторское право
Есть ли какие-либо нарушения ввода/вывода?
Разрешение, общественное достояние, краткая выдержка
конфиденциальность
Защищены ли персональные данные?
Анонимизация, минимизация
прозрачность
Знает ли пользователь?
Четкая информация, согласие
Ответственность
Кто несет ответственность?
Письменная политика, одобрение людей
Ценности
Защищены ли доступ и целостность?
Этическая проверка, проверка предвзятости
Распространенные ошибки
- Загружаем контент, защищенный авторским правом, не задумываясь. Существует риск нарушения авторских прав и состояния данных.
- Внесение личных данных в общедоступный инструмент. Вторжение в частную жизнь и юридический риск.
- Сокрытие использования ИИ. Без прозрачности доверие подорвано.
- Путать «законное» с «этическим». Законное использование может быть неэтичным.
- Не создание структуры управления. Неконтролируемое использование создает непредсказуемые риски.
В итоге
Авторское право, конфиденциальность и этика являются основой ответственности библиотечного дела в эпоху искусственного интеллекта. Оценить статус авторских прав на запись и условия данных инструмента; подвергнуть сомнению права вывода; защитить персональные данные с помощью анонимизации и минимизации; быть прозрачным для пользователя и получать согласие; Создайте четкую структуру управления в организации. Глубоко укоренившиеся ценности библиотечного дела (равный доступ, конфиденциальность, целостность, беспристрастность) являются компасом, который проверяет каждое использование ИИ. Технологические изменения; Ответственность и ценности не меняются, и окончательная ответственность всегда лежит на человеке.
Задача приложения
Подготовьте одностраничный документ с правилами использования для вашей организации (или вымышленной организации) с шаблоном «Проект политики использования ИИ»: утвержденные инструменты, данные, которые никогда не следует вводить, правила проверки, ответственность. Затем протестируйте реальное использование ИИ, которое вы планируете, на предмет доступа, конфиденциальности, точности и предвзятости с помощью шаблона «Запрос по этическому контролю» и напишите, как вы будете решать любые возникающие проблемы.
контрольный список
- [ ] Я оценил статус авторских прав на запись и условия данных инструмента.
- [ ] Я анонимизировал личные данные и использовал только то, что было необходимо.
- [ ] Я открыто рассказал пользователю об использовании ИИ и уважаю его согласие.
- [ ] Я разработал для организации письменную политику использования ИИ.
- [ ] Я тестировал использование с библиотечными ценностями и возложил ответственность на человека.
Модульный экзамен
1. Что из перечисленного является наиболее точным позиционированием искусственного интеллекта в библиотечном деле и управлении информацией?
- А) ИИ — помощник по сводке, метаданным, поиску и рекомендациям; Ответственность за точность, надежность источников и этические решения лежит на людях ✔
- Б) Искусственный интеллект может надежно проверить подлинность и точность источника.
- В) Искусственный интеллект работает только при каталогизации книг и не имеет ничего общего с другой библиотечной работой.
- Г) Поскольку искусственный интеллект более беспристрастен, чем люди, решения по предметам и классификации следует оставить на его усмотрение.
Описание: Искусственный интеллект; Это помощник, который составляет метаданные, обобщает их, переводит, отмечает закономерности и указывает на источник. Компетентный эксперт отвечает за задачи, имеющие серьезные последствия, такие как проверка точности, решения по темам и классификации, достоверность источника, а также решения об авторских правах и конфиденциальности; Непроверенные данные могут привести к распространению сфабрикованного источника или нарушению конфиденциальности.
2. Почему «галлюцинация» особенно опасна для библиотекаря?
- А) Результаты искусственного интеллекта производятся очень медленно и тратят время
- Б) Искусственный интеллект умеет убедительно выдавать несуществующие источники и цитаты, а суть профессии в достоверности источника ✔
- В) Галлюцинация возникает только при обработке изображений, к тексту она не имеет никакого отношения.
- Г) Галлюцинации наблюдаются только в очень старых инструментах искусственного интеллекта, но не в современных.
Пояснение: Галлюцинация — это когда искусственный интеллект чрезвычайно убедительно выдает несуществующий источник, цитату или информацию. Поскольку сутью профессии является подлинность и достоверность источника, то если сфабрикованный отпечаток или цитата будет передан библиографии или пользователю без проверки, произойдет серьезная дезинформация.
3. Что из перечисленного является областью с наибольшим риском фальсификации при создании метаданных с помощью искусственного интеллекта и как с этим следует бороться?
- А) Языковая область является зоной наибольшего риска и не нуждается в проверке.
- Б) Поле заголовка несет в себе самый высокий риск и должно быть заполнено прогнозом.
- C) ISBN и год публикации несут наибольший риск фальсификации и должны быть дословно проверены с первоисточником ✔
- Г) Ни одно поле не является рискованным, поскольку искусственный интеллект всегда правильно создает метаданные.
Пояснение: ИИ очень легко подделывает точные числовые поля, такие как ISBN и год публикации; ИИ может генерировать разумно выглядящий номер вместо неизвестного ему ISBN. Эти поля должны быть дословно сверены с первоисточником (штрих-код, выходные данные/колофон).
4. Какова основная цель использования «контролируемой лексики» при присвоении тематического термина?
- А) Обеспечение единообразия и доступности терминологии во всех записях; Не позволяем искусственному интеллекту создавать бесплатные условия ✔
- Б) Автоматически добавлять в каталог каждый новый термин, запрошенный искусственным интеллектом.
- В) Полностью исключить предметные термины и осуществлять поиск только по названию.
- Г) Замедление каталогизации и написание каждой записи разными терминами.
Описание: Контролируемый словарь представляет собой список утвержденных и стандартных терминов. Если одна и та же тема записана разными терминами в разных записях, пользователь найдет одно и пропустит другое. Предоставляя ИИ этот список и говоря ему «просто выбрать из списка», сохраняется согласованность и возможность поиска; Новый термин, не включенный в список искусственного интеллекта, не следует добавлять в каталог.
5. Каков правильный подход при получении классификационного номера документа от искусственного интеллекта?
- А) Точное число, данное искусственным интеллектом, следует принимать непосредственно, не заглядывая в официальную таблицу.
- Б) Классификационные номера не следует использовать вообще, источники следует раскладывать по полочкам в случайном порядке.
- В) Предложение мастер-класса следует рассматривать как предварительное, точные этапы сверять с официальной классификационной таблицей ✔
- Г) Поскольку искусственный интеллект не может классифицировать, эту задачу следует полностью пропустить.
Объяснение: ИИ часто может найти правильный основной класс, но может пропустить подуровни (например, историю болезни вместо медицины) или выдать неправильные цифры, которые кажутся разумными. Поэтому предложение мастер-класса следует рассматривать как начало, а точные этапы следует сверять с официальной классификационной таблицей.
6. Какое утверждение верно при сравнении семантического поиска и поиска по ключевым словам?
- А) Семантический поиск должен заменять поиск по ключевым словам во всех случаях.
- Б) Семантический поиск находит семантически связанные ресурсы; Поиск по ключевому слову по точному названию или ISBN более надежен ✔
- В) Поиск по ключевым словам находит источники с различными терминами, которые семантически связаны лучше, чем семантический поиск.
- Г) Семантический поиск работает только с числовыми данными, а не с текстом.
Описание. Семантический поиск находит ресурсы, состоящие из разных слов, но связанных между собой, например «проблемы со сном» и «расстройство сна», поскольку они соответствуют значению слов (посредством векторов внедрения). Напротив, при поиске точного ISBN, полного названия или номера закона более надежным является поиск по ключевому слову/домену. Лучше всего использовать оба вместе.
7. Каковы обязанности библиотекаря по предотвращению риска возникновения «пузыря фильтров» в персонализированных рекомендациях ресурсов?
- А) Укрепите «пузырь», рекомендуя пользователю только наиболее похожие ресурсы.
- Б) Полностью отказаться от внушений
- В) Открытый доступ к истории чтения пользователя
- Г) Сознательно добавлять источники с разными точками зрения и горизонтами и открыто заявлять об этом ✔
Объяснение: Пузырь фильтров — это когда система рекомендаций постоянно блокирует пользователя на одном и том же контенте и удерживает его от новых и разных точек зрения. Ценность библиотеки — равный и разнообразный доступ; Таким образом, библиотекарь сознательно разрывает этот пузырь, добавляя по-другому выглядящие, открывающие глаза ресурсы и открыто заявляя об этом.
8. Какая практика является правильной с точки зрения «подлинности и целостности» при обработке архивного документа с помощью искусственного интеллекта?
- А) «украсить» документ искусственным интеллектом, дополнить его недостающими частями и заменить оригинал
- Б) Удаление необработанного оригинала и сохранение только версии, улучшенной с помощью искусственного интеллекта.
- В) OCR должно исправлять только ошибки распознавания, содержание не должно изменяться, исходный оригинал должен быть сохранен, а производные должны быть четко обозначены ✔
- D) Примите результат распознавания как «чистый текст» без каких-либо исправлений и откройте его для поиска.
Описание: Суть архивной работы заключается в обеспечении уверенности в том, что документ получен из заявленного источника и что его содержание не было изменено. OCR-коррекция должна только удалять ошибки распознавания, а не изменять контент; «Восстановление» ИИ не заменяет реальные доказательства, поскольку оно может восполнить недостающие части. Необработанный (исходный) скан всегда следует сохранять, производные должны быть четко обозначены.
9. Что из перечисленного необходимо для ответственного построения библиотечного информационного бота?
- А) Бот быстро дает ответы на каждый вопрос, исходя из своих общих знаний и не цитирует источники.
- Б) Бот опирается только на проверенную корпоративную информацию, приводит факты и задает деликатные вопросы эксперту/человеку ✔
- В) Бот напрямую дает точные консультации по медицинским и юридическим вопросам
- Г) Скрытие от пользователя того, с ботом он разговаривает или с человеком
Пояснение: бот-консультант должен полагаться только на проверенную текущую информацию и список источников учреждения, а не на свою общую память, должен сообщать факты, цитируя источник, не должен давать советы по медицинским/юридическим/деликатным вопросам, должен направлять их эксперту и при необходимости передавать их человеку. Таким образом, бот не заменяет человека, а становится прослойкой, облегчающей бремя.
10. Какой метод в библиометрии является правильным для определения количества цитирований или индекса Хирша автора?
- А) Спросить ИИ напрямую, потому что цифры, которые он дает, всегда верны
- Б) Получение цифр из реальной базы цитирования; Использование искусственного интеллекта только для организации и интерпретации этих данных ✔
- В) Оцените цифры и используйте их при принятии решений о трансляции.
- Г) Рассмотрение количества цитирований как прямого показателя качества работы автора.
Пояснение: Искусственный интеллект может создавать такие значения, как количество цитирований и индекс Хирша, не обращаясь к реальным данным (например, он может выдать значение 42, хотя на самом деле оно равно 19). Поэтому цифры и цитаты необходимо брать из реальной базы цитирования; ИИ следует использовать только для кластеризации, сортировки и интерпретации этих реальных данных.
11. Что верно в отношении пределов библиометрических показателей (количество цитирований, индекс Хирша, импакт-фактор)?
- А) Метрики напрямую измеряют качество и сопоставимы по областям
- Б) Критерии можно безопасно использовать отдельно при принятии решений о найме и продвижении по службе.
- В) Метрики указывают на использование, а не на качество; нельзя сравнивать между областями и необходимо сбалансировать с качественной оценкой ✔
- Г) Результаты гуманитарных наук полностью и полностью представлены в базах цитирования.
Раскрытие информации. Эти показатели указывают на использование и видимость, но не являются прямыми показателями качества. Поскольку культура цитирования в разных областях (например, в медицине и философии) различна, их нельзя сравнивать напрямую; Объемные книги по гуманитарным наукам недостаточно представлены в базах данных. Таким образом, критерии не должны использоваться сами по себе для оценки отдельных лиц, а должны быть сбалансированы с качественной оценкой.
12. В чем ключевое преимущество подхода RAG (производство с расширенным доступом) перед обычным ИИ?
- А) Значительно уменьшить галлюцинацию за счет привязки ответа к реальным документам учреждения и ссылки на источник ✔
- Б) Всегда отлично отвечаем, независимо от качества документальной базы
- В) Сделать галлюцинации полностью и навсегда невозможными.
- Г) Открытие всех документов для всех без необходимости контроля доступа
Пояснение: При ответе на вопрос RAG сначала находит соответствующие фрагменты в собственных документах учреждения и дает ответ только на основе этих фрагментов со ссылкой на источник. Таким образом, ответ связан с реальной и отслеживаемой документацией, и галлюцинации значительно уменьшаются. Однако ТРЭГ не устраняет галлюцинации полностью, поскольку ответ все равно может быть неправильным, если будет поднят не тот фрагмент.
13. В гуманитарных и социальных науках какой метод является наиболее надежным для проверки цитаты, переданной ИИ пользователю?
- А) Убедитесь, что цитата выглядит правдоподобной и свободной.
- Б) Просто попросите ИИ воспроизвести ту же цитату
- В) Проверьте цитату, найдя ее в реальной работе автора ✔
- Г) Принятие того факта, что цитата принадлежит известному имени, достаточно.
Описание: Искусственный интеллект может генерировать полностью вымышленные цитаты, приписываемые реальному автору; Тот факт, что цитата кажется дословно точной и убедительной, не является доказательством ее точности. Самый надежный метод — проверить цитату, найдя ее в реальном произведении автора; Логики «этот автор мог бы сказать что-то подобное» недостаточно.
14. Какой принцип использования искусственного интеллекта верен с точки зрения авторских прав, конфиденциальности и этики?
- А) Данные, защищенные авторским правом, и персональные данные можно вводить в общедоступные инструменты, не задумываясь, поскольку это происходит быстро.
- Б) Если использование законно, оно определенно этически и никакой дальнейшей оценки не требуется.
- В) Когда искусственный интеллект выдает результат, ответственность полностью переходит к инструменту, а не к человеку.
- D) Авторские права и конфиденциальность должны соблюдаться с самого начала; анонимность, прозрачность и согласие имеют важное значение, и основная ответственность лежит на человеке ✔
Пояснение: Импульсивный ввод защищенного авторским правом контента и личных данных (идентификатор пользователя, история чтения/поиска) в общие инструменты искусственного интеллекта может привести к нарушению прав и конфиденциальности; Анонимизация, минимизация данных, прозрачность и согласие имеют важное значение. Кроме того, даже если использование законно, оно может быть неэтичным; «все этим пользуются» или «это происходит быстро» не оправдывают практику, и окончательная ответственность лежит на эксперте, а не на инструменте.