Прибуток:
- Можливість зменшити юридичні ризики шляхом оцінки статусу авторського права вхідних даних і стану даних інструменту та перевірки прав на вихідні дані
- Можливість захисту особистих даних шляхом анонімізації та мінімізації та забезпечення конфіденційності шляхом прозорості для користувача
- Здатність створити структуру управління для установи, яка включає схвалені інструменти, заборонені дані та правила перевірки, а також перевірити їх використання з бібліотечними цінностями.
Бібліотекар та інформаційний менеджер – це той, хто не лише організовує та представляє інформацію, але й захищає її: захищаючи права творця, конфіденційність користувача та відповідальність установи. Штучний інтелект кидає виклик усім трьом сферам, ставлячи нові та складні питання. Чи є завантаження документа в AI порушенням авторських прав? Чи порушує конфіденційність надання даних користувача інструменту ШІ? Як організація повинна керувати використанням ШІ? У цьому заключному розділі ми створимо структуру, яка об’єднує етичні та правові теми, яких ми торкалися протягом усього модуля.
Давайте визначимося з поняттями. Авторське право — це законне право, надане творцю твору на використання його твору; Несанкціоноване копіювання або використання може вважатися порушенням. Персональними даними є будь-яка інформація, яка прямо чи опосередковано ідентифікує особу та підлягає правовому захисту. Управління – це система правил, політики та підзвітності, яка регулює використання ШІ в організації. Ці три концепції формують правову та етичну основу для відповідального використання ШІ.
Крок за кроком: відповідальне та законне використання ШІ
1. Оцініть статус авторського права на запис. Перш ніж завантажувати текст, книгу чи статтю в інструмент штучного інтелекту, зверніть увагу на статус авторського права на цю роботу та умови використання інструменту. Передача захищеного авторським правом твору інструменту, який використовує завантажені вами дані для власних цілей, може вважатися порушенням прав.
2. Опитайте права на вихід. Статус авторського права тексту, створеного штучним інтелектом, може бути невизначеним, і штучний інтелект може несвідомо відтворити захищений авторським правом вміст у навчальних даних. Перш ніж публікувати результат ШІ, оцініть його оригінальність і можливі порушення.
3. Захист персональних даних. Ідентичність користувачів, історія читання/пошуку та особиста інформація не повинні входити в будь-який інструмент штучного інтелекту без явної згоди та надійного захисту. Анонімізація та мінімізація даних (тільки стільки даних, скільки необхідно) є важливими.
4. Забезпечте прозорість і згоду. Користувачі повинні знати, як обробляються їхні дані та взаємодії; Якщо використовується ШІ, це має бути чітко зазначено. Використання прихованого ШІ підриває довіру.
5. Створіть структуру управління. Організація повинна визначити в письмовій політиці, які інструменти схвалені, які дані можна вводити, хто несе відповідальність і як будуть перевірятися результати.
Порада. Створіть прості «правила використання штучного інтелекту» на одному аркуші для вашої організації: які інструменти схвалено, які дані ніколи не вводяться (особисті/власні/конфіденційні), як перевіряється кожен результат і хто несе відповідальність. Чітке керівництво на одній сторінці є ефективнішим, ніж довга політика.
Етичні принципи та цінності бібліотечної справи
Глибоко вкорінені цінності професії бібліотекаря служать компасом в епоху ШІ: рівний доступ до інформації, свобода думки, конфіденційність користувачів, інтелектуальна чесність і неупередженість. ШІ може або підтримувати, або загрожувати цим цінностям. Це може розширити доступ, але посилити упередження; може прискорити обслуговування, але може поставити під загрозу конфіденційність; Це може полегшити відкриття, але може поширити дезінформацію.
Відповідальний бібліотекар перевіряє кожне використання штучного інтелекту на відповідність цим значенням: «Чи це використання вирівнює доступ або виключає групу? Чи захищає воно конфіденційність? Чи надає воно точну та чесну інформацію?» AI — це інструмент; Цінності, з якими ви будете його використовувати, є суттю професії. Технології змінюються, але ці цінності є постійним компасом бібліотечної справи.
Застереження: «Усі використовують це» або «це швидко» не виправдовує використання ШІ. Навіть якщо використання законне, воно може бути неетичним; Не використовуйте практику, яка є шкідливою з точки зору авторського права, конфіденційності та справедливості, лише тому, що це легко. Основна відповідальність лежить не на інструменті, а на професіоналі, який його використовує.
три міні-чохла
Випадок 1. Завантаження, захищене авторським правом, зупинено. Одна команда планувала завантажити цілий довідник, захищений авторським правом, у загальний інструмент штучного інтелекту для створення підсумків. Менеджер інформації визнав це ризикованим як з точки зору авторського права, так і умов використання даних інструменту; натомість його вивчали лише в коротких, авторизованих уривках і в закритій системі установи.
Випадок 2 — Персональні дані анонімні. Бібліотека хотіла аналізувати відгуки користувачів за допомогою ШІ; але відгук містив імена користувачів і контактну інформацію. Команда анонімізувала дані перед аналізом; опрацьовувалися лише анонімні, колективні тенденції. Конфіденційність збережено, розуміння відновлено.
Випадок 3 — ліквідовано прогалину в управлінні. В одній організації співробітники використовували різні інструменти штучного інтелекту без нагляду, іноді вводячи конфіденційні документи. Адміністратор інформації опублікував односторінкову політику, в якій визначено дозволені інструменти, заборонені типи даних і правила перевірки; Невизначеність і ризик значно зменшилися.
Компетентність персоналу та корпоративна культура
Політика управління настільки сильна, наскільки сильні люди, які її здійснюють. Навіть найкраще написане правило залишається на папері, якщо працівники не розуміють ризики ШІ. Таким чином, стійкою основою для відповідального використання штучного інтелекту є компетентність персоналу: розуміння кожним працівником того, що таке галюцинація, які дані ніколи не можна вводити та чому результат слід перевіряти. Бібліотеки та інформаційні установи відіграють у цьому відношенні подвійну роль; Він повинен навчати власний персонал і поширювати цю грамотність серед користувачів. Хороша корпоративна культура – це така, яка повідомляє про помилку штучного інтелекту, а не приховує її, і вважає нормальним сказати: «Я не впевнений щодо цього результату, давайте перевіримо». У середовищі, де помилки приховуються через страх покарання, сфабриковане джерело або порушення конфіденційності поширюється непомітно. Крім того, оскільки технології та інструменти швидко змінюються, політику та навчання слід оновлювати регулярно, а не одноразово. управління; Це жива система, де правила, інструменти, освіта та культура працюють разом. У центрі цієї системи стоїть компетентна особа, яка бере на себе відповідальність і приймає остаточне рішення, а не транспортний засіб.
Порада: перш ніж використовувати новий інструмент штучного інтелекту, проведіть невеликий пілотний тест: спробуйте його з обмеженою командою, виконуючи реальні завдання з низьким рівнем ризику, записуючи помилки та ризики. Це підвищує компетентність і виявляє вразливі місця в політиці перед розгортанням інструменту в усій організації.
Чотири шаблони, які можна копіювати
1) Попередня оцінка авторського права:
Допоможіть мені оцінити такий вміст на предмет авторського права перед завантаженням його в інструмент ШІ: чи може вміст бути захищеним авторським правом, який спосіб використання є ризикованим, яка альтернатива (уривок, дозвіл, суспільне надбання) безпечніша? Тип вмісту: [тут]
2) Сканування персональних даних:
Чи містить наступний текст особисті дані (ім’я, контакт, особистість, історію читання/пошуку, інформацію про стан здоров’я/переконання)? Позначте кожен, класифікуйте його та запропонуйте, як його анонімізувати. Текст: [тут]
3) Проект політики використання ШІ:
Проект односторінкових інструкцій щодо використання штучного інтелекту для нашої організації: (1) схвалена політика інструментів, (2) типи даних, які ніколи не вводилися, (3) правило перевірки вихідних даних, (4) підзвітність і прозорість, (5) політика авторського права та конфіденційності. Будьте короткими та дієвими. Контекст: [тут]
4) Запит про етичний контроль:
Перевірте таке заплановане використання штучного інтелекту на відповідність бібліотечним цінностям: справедливий доступ, конфіденційність, точність/цілісність, ризик упередженості та позначте проблеми, якщо є. Використання: [тут]
Слабка підказка / Сильна підказка
Слабка підказка:
Чи варто мені використовувати ШІ, щоб узагальнити цю книгу?
Питання не враховує авторські права, умови даних інструменту та альтернативи; Відповідь «так» може призвести до порушення прав.
Потужна підказка:
Ваша роль: помічник радника з авторських прав і конфіденційності. Я розглядаю можливість надання наступного вмісту інструменту ШІ. Перелічіть можливі проблеми щодо статусу авторського права, використання даних транспортного засобу та ризику персональних даних; запропонувати безпечніші альтернативи (коротка цитата, дозвіл, суспільне надбання, закрита система). Вимагайте правової визначеності, демонструйте ризики. Вміст і контекст: [тут]
Потужна підказка; Він розглядає рішення з точки зору аспектів авторського права, стану даних і конфіденційності та пропонує безпечні альтернативи.
Таблиця параметрів управління
Розмір
основне питання
запобіжний захід
авторське право
Чи є порушення введення/виведення?
Дозвіл, суспільне надбання, короткий уривок
конфіденційність
Чи захищені персональні дані?
Анонімізація, мінімізація
прозорість
Чи знає користувач?
Чітка інформація, згода
Відповідальність
Хто несе відповідальність?
Письмова політика, людське схвалення
Цінності
Чи захищено доступ і цілісність?
Етична перевірка, перевірка упередженості
Поширені помилки
- Завантаження захищеного авторським правом вмісту без роздумів. Існує ризик порушення авторських прав і стану даних.
- Введення особистих даних у публічний інструмент. Вторгнення в приватне життя та юридичний ризик.
- Приховування використання ШІ. Без прозорості довіра руйнується.
- Плутання «законного» з «етичним». Законне використання може бути неетичним.
- Не встановлює структуру управління. Неконтрольоване використання створює непередбачувані ризики.
Підсумовуючи
Авторське право, конфіденційність і етика є основою відповідальності бібліотечної справи в епоху ШІ. Оцініть статус авторського права запису та умови даних інструменту; питання прав на вихід; захист персональних даних за допомогою анонімізації та мінімізації; бути прозорим для користувача та отримати згоду; Встановіть чітку структуру управління в організації. Глибоко вкорінені цінності бібліотечної справи (рівний доступ, конфіденційність, чесність, неупередженість) є компасом, який перевіряє кожне використання ШІ. Технологічні зміни; Відповідальність і цінності не змінюються, і остаточна відповідальність завжди лежить на людині.
Аплікаційне завдання
Підготуйте односторінковий документ з правилами використання для вашої організації (або фіктивної організації) із шаблоном «Проект політики використання штучного інтелекту»: схвалені інструменти, дані, які ніколи не вводяться, правило перевірки, відповідальність. Потім перевірте реальне використання штучного інтелекту, яке ви плануєте, щодо доступу, конфіденційності, точності та упередженості за допомогою шаблону «Запит про етичний контроль» і напишіть, як ви будете вирішувати будь-які проблеми, що виникають.
контрольний список
- [ ] Я оцінив статус авторського права запису та умови даних інструменту.
- [ ] Я анонімізував персональні дані та використовував лише необхідне.
- [ ] Я був прозорим для користувача щодо використання ШІ та поважав згоду.
- [ ] Я створив письмову політику використання ШІ для організації.
- [ ] Я перевірив використання бібліотечних цінностей і поклав відповідальність на людей.
Модульний екзамен
1. Що з наведеного є найточнішим позиціонуванням штучного інтелекту в бібліотечній справі та управлінні інформацією?
- A) ШІ – це резюме, метадані, помічник з пошуку та рекомендацій; Відповідальність за точність, надійність джерела та етичні рішення лежить на людях ✔
- B) Штучний інтелект може надійно перевірити автентичність і точність джерела
- C) Штучний інтелект працює лише в каталогізації книг, він не має нічого спільного з іншою бібліотечною роботою
- D) Оскільки штучний інтелект є більш неупередженим, ніж люди, рішення щодо предмета та класифікації слід залишити йому.
Опис: Штучний інтелект; Це помічник, який створює проекти метаданих, узагальнює їх, перекладає, позначає шаблон і вказує на джерело. Компетентний експерт відповідає за важливі завдання, такі як перевірка точності, рішень щодо теми та класифікації, достовірності джерела, а також рішень щодо авторського права та конфіденційності; Неперевірений результат може призвести до поширення сфабрикованого джерела або порушення конфіденційності.
2. Чому «галюцинація» особливо небезпечна для бібліотекаря?
- A) Вихідні дані штучного інтелекту виробляються дуже повільно та витрачають час
- Б) Штучний інтелект може переконливо продукувати неіснуючі джерела та цитати, а суть професії – достовірність джерела ✔
- В) Галюцинація виникає лише при обробці зображення, вона не має нічого спільного з текстом
- D) Галюцинації спостерігаються лише в дуже старих інструментах штучного інтелекту, а не в сучасних інструментах.
Пояснення: галюцинація — це коли штучний інтелект створює неіснуюче джерело, цитату чи інформацію надзвичайно переконливим способом. Оскільки суть професії полягає в автентичності та надійності джерела, якщо сфабрикований відбиток або цитата буде передано бібліографії чи користувачеві без перевірки, виникне серйозна дезінформація.
3. Що з наведеного нижче є областю з найвищим ризиком фальсифікації під час створення метаданих за допомогою штучного інтелекту та як це слід вирішити?
- A) Мовна область є зоною найбільшого ризику, і її не потрібно перевіряти
- B) Поле заголовка несе в собі найбільший ризик і має бути заповнене прогнозом
- C) ISBN і рік публікації несуть найвищий ризик фальсифікації та мають бути дослівно перевірені з першоджерелом ✔
- D) Жодне поле не є ризикованим, тому що штучний інтелект завжди створює метадані правильно
Пояснення: ШІ дуже легко підробляє точні числові поля, такі як ISBN і рік публікації; Штучний інтелект може згенерувати прийнятний на вигляд номер замість номера ISBN, який він не знає. Ці поля необхідно дослівно звірити з першоджерелом (штрих-код, вихідні дані/колофон).
4. Яка основна мета використання «контрольованої лексики» під час призначення терміну теми?
- A) Забезпечення узгодженості термінології та доступності всіх записів; Перешкода штучному інтелекту вигадувати безкоштовні умови ✔
- B) Автоматично додавати до каталогу кожен новий термін, який вимагає штучний інтелект
- C) Повністю вилучіть предметні терміни та шукайте лише за назвою
- D) Уповільнення каталогізації та написання кожного запису з різними термінами
Опис: контрольований словник - це список затверджених і стандартних термінів. Якщо одна й та сама тема написана різними термінами в різних записах, користувач знайде один і пропустить інший. Надавши штучному інтелекту цей список і сказавши йому «просто вибрати зі списку», послідовність і можливість пошуку зберігаються; Новий термін, який не внесено до списку штучного інтелекту, не слід додавати до каталогу.
5. Який правильний підхід до отримання класифікаційного номера документа від штучного інтелекту?
- A) Точне число, дане штучним інтелектом, слід приймати безпосередньо, не дивлячись на офіційну таблицю
- B) Класифікаційні номери не повинні використовуватися взагалі, джерела мають бути розкладені випадковим чином
- C) Пропозицію про майстер-клас слід розглядати попередньо, точні кроки слід перевірити за офіційною таблицею класифікації ✔
- D) Оскільки штучний інтелект не може класифікувати, це завдання слід повністю пропустити
Пояснення: штучний інтелект часто може знайти правильний основний клас, але може пропустити підрівні (наприклад, історію хвороби замість медицини) або видавати неправильні числа, які здаються розумними. Тому пропозицію майстер-класу слід вважати початком, а точні кроки слід перевірити за офіційною таблицею класифікації.
6. Яке твердження вірне при порівнянні семантичного пошуку та пошуку за ключовими словами?
- A) Семантичний пошук повинен замінити пошук за ключовими словами в усіх випадках
- B) Семантичний пошук знаходить семантично пов'язані ресурси; Пошук за ключовим словом за точною назвою або ISBN є надійнішим ✔
- C) Пошук за ключовими словами знаходить джерела з різними термінами, які семантично пов’язані краще, ніж семантичний пошук
- D) Семантичний пошук працює лише з числовими даними, а не з текстом
Опис: семантичний пошук знаходить різні слова, але пов’язані ресурси, як-от «проблема зі сном» і «розлад сну», оскільки він відповідає значенню слів (через вектори вбудовування). Навпаки, якщо шукати точний ISBN, повну назву чи номер статуту, пошук за ключовим словом/доменом є більш надійним. Найкраще використовувати обидва разом.
7. Який обов’язок бібліотекаря щодо ризику появи «міхура фільтра» в персоналізованих рекомендаціях ресурсів?
- A) Зміцнюйте бульбашку, рекомендуючи користувачеві лише найбільш схожі ресурси
- Б) Повністю відмовитися від пропозицій
- C) Публічний доступ до історії читання користувача
- D) Свідоме додавання джерел з різними перспективами та горизонтами та прозоре зазначення цього ✔
Пояснення. Бульбашка фільтра — це коли система рекомендацій постійно замикає користувача на схожий вміст і не дозволяє йому бачити нові й інші точки зору. Цінністю бібліотеки є рівноправний і різноманітний доступ; Тому бібліотекар свідомо розриває бульбашку, додаючи різні на вигляд, цікаві ресурси та прозоро заявляючи про це.
8. Яка практика є правильною з точки зору «автентичності та цілісності» при обробці архівного документа за допомогою штучного інтелекту?
- А) «прикрасити» документ за допомогою штучного інтелекту, доповнити його, додавши відсутні частини, і замінити оригінал
- B) Видалення необробленого оригіналу та збереження лише версії, покращеної за допомогою штучного інтелекту
- C) OCR має лише виправляти помилки розпізнавання, вміст не можна змінювати, необроблений оригінал має бути збережено, а похідні мають бути чітко позначені ✔
- D) Прийміть вихід OCR як «чистий текст» без будь-яких виправлень і відкрийте його для пошуку.
Опис: суть архівної роботи полягає в впевненості в тому, що документ походить із заявленого джерела і що його зміст не було змінено. Виправлення OCR має лише видаляти помилки розпізнавання, а не змінювати вміст; «Відновлення» штучного інтелекту не замінює реальні докази, оскільки воно може компенсувати відсутні частини. Необроблений (оригінал) скан завжди повинен зберігатися, похідні мають бути чітко позначені.
9. Що з перерахованого необхідно для відповідальної побудови бібліотечного інформаційного бота?
- А) Бот швидко дає відповіді на кожне запитання на основі своїх загальних знань і не посилається на джерела
- Б) Бот покладається лише на перевірену корпоративну інформацію, наводить факти та направляє делікатні запитання експерту/людині ✔
- В) Бот безпосередньо дає точні поради з медичних та юридичних питань
- D) Приховування від користувача, чи спілкується він з ботом чи людиною
Пояснення: бот-консультант повинен покладатися лише на перевірену поточну інформацію та список джерел установи, а не на свою загальну пам’ять, повинен надавати факти, посилаючись на джерело, не повинен давати поради з медичних/юридичних/делікатних питань, повинен спрямовувати їх до експерта та повинен передавати їх людині, коли це необхідно. Таким чином, бот не замінює людину, а скоріше стає шаром, який полегшує тягар.
10. Який правильний метод визначення кількості цитувань або h-індексу автора в бібліометрії?
- A) Запитувати безпосередньо ШІ, тому що цифри, які він дає, завжди правильні
- Б) Отримання чисел із фактичної бази даних цитувань; Використання штучного інтелекту лише для організації та інтерпретації цих даних ✔
- C) Оцініть цифри та використовуйте їх у рішеннях щодо трансляції
- Г) Вважати кількість цитувань прямим показником якості роботи автора.
Пояснення: Штучний інтелект може створювати такі значення, як кількість цитувань і h-індекс без доступу до реальних даних (наприклад, він може давати значення 42, коли воно насправді дорівнює 19). Тому цифри та цитати мають бути взяті з реальної бази даних цитат; ШІ слід використовувати лише для кластеризації, сортування та інтерпретації цих реальних даних.
11. Що вірно щодо межі бібліометричних показників (кількість цитувань, h-індекс, імпакт-фактор)?
- A) Показники безпосередньо вимірюють якість і порівнюються між доменами
- B) Критерії можуть безпечно використовуватися самостійно при прийнятті рішень про прийом на роботу та просування по службі.
- C) Показники показують використання, а не якість; не можна порівнювати між доменами та повинні бути збалансовані за допомогою якісної оцінки ✔
- Г) Результати гуманітарних наук цілком і повністю представлені в базах даних цитування
Розкриття інформації: ці показники вказують на використання та видимість, вони не є прямими показниками якості. Оскільки культура цитування галузей різна (наприклад, медицина та філософія), їх не можна прямо порівнювати; У базах даних недостатньо представлено книжкову продукцію з гуманітарних наук. Таким чином, критерії не повинні використовуватися окремо для оцінювання окремих осіб, а повинні бути збалансовані з якісною оцінкою.
12. Яка ключова перевага підходу RAG (виробництво з доповненим доступом) перед загальним ШІ?
- A) Значне зменшення галюцинації шляхом пов’язування відповіді з реальними документами установи та посилання на джерело ✔
- Б) Відповідати завжди бездоганно, незалежно від якості документальної бази
- C) Зробити галюцинацію повністю та назавжди неможливою
- D) Відкриття всіх документів для всіх без необхідності контролю доступу
Пояснення: відповідаючи на запитання, RAG спочатку знаходить відповідні фрагменти у власних документах установи та дає відповідь лише на основі цих фрагментів із посиланням на джерело. Таким чином відповідь пов’язується з реальною документацією, яку можна відстежити, і галюцинації значно зменшуються. Однак RAG не усуває повністю галюцинацію, оскільки відповідь все одно може бути неправильною, якщо підняти не той фрагмент.
13. Який у гуманітарних і соціальних науках є найнадійнішим методом перевірки цитати від ШІ для користувача?
- А) Переконайтеся, що цитата виглядає правдоподібно та вільно
- B) Просто попросіть ШІ відтворити ту саму цитату
- В) Перевірте цитату, знайшовши її в справжньому творі автора ✔
- D) Визнати, що достатньо, щоб цитата приписувалася відомому імені
Опис: Штучний інтелект може генерувати повністю сфабриковані цитати, приписувані справжньому автору; Той факт, що цитата виглядає дослівно точною та переконливою, не є доказом її точності. Найнадійніший метод — перевірити цитату, знайшовши її в справжньому творі автора; Логіки «цей автор міг сказати щось подібне» недостатньо.
14. Який принцип є правильним у використанні штучного інтелекту з точки зору авторського права, конфіденційності та етики?
- A) Дані, захищені авторським правом, і особисті дані можна вводити в загальнодоступні інструменти без роздумів, оскільки це швидко
- B) Якщо використання є законним, воно однозначно є етичним і не потребує подальшої оцінки.
- C) Коли штучний інтелект дає результат, відповідальність повністю переходить до інструменту, а не до людини.
- D) Авторські права та конфіденційність повинні поважатися з самого початку; анонімність, прозорість і згода є важливими, і остаточна відповідальність лежить на людині ✔
Пояснення: імпульсивне введення захищеного авторським правом вмісту та персональних даних (ідентифікатор користувача, історія читання/пошуку) у загальні інструменти штучного інтелекту може призвести до порушення прав і конфіденційності; Анонімність, мінімізація даних, прозорість і згода є важливими. Крім того, навіть якщо використання законне, воно може бути неетичним; «усі використовують це» або «це відбувається швидко» не виправдовує практику, і остаточна відповідальність лежить на експерті, а не на інструменті.