Добивки:
- Способност да се намалат правните ризици со евалуација на статусот на авторските права на влезот и условите за податоци на алатката и преиспитување на правата на излезот
- Способност да се заштитат личните податоци преку анонимизација и минимизирање и да се обезбеди приватност со тоа што ќе се биде транспарентен за корисникот
- Способност да се воспостави рамка за управување за институцијата која вклучува одобрени алатки, забранети податоци и правила за верификација и тестирање на неговата употреба со библиотекарските вредности.
Библиотекар и менаџер на информации е некој кој не само што ги организира и презентира информациите, туку и ги штити: ги штити правата на создавачот, приватноста на корисникот и одговорноста на институцијата. Вештачката интелигенција ги предизвикува сите три полиња со нови и сложени прашања. Дали прикачувањето документ на вештачка интелигенција е прекршување на авторските права? Дали давањето кориснички податоци на алатка за вештачка интелигенција ја нарушува приватноста? Како организацијата треба да управува со употребата на ВИ? Во оваа завршна единица, ќе воспоставиме рамка која ги обединува етичките и правните нишки што ги допревме низ модулот.
Ајде да ги дефинираме концептите. Авторското право е законско право дадено на создавачот на делото врз користењето на неговото дело; Неовластено дуплирање или користење може да се смета за прекршување. Лични податоци се секоја информација која директно или индиректно идентификува лице и е предмет на правна заштита. Управувањето е рамка на правила, политики и одговорност што ја регулира употребата на вештачката интелигенција од страна на организацијата. Овие три концепти ја формираат правната и етичката основа за одговорна употреба на ВИ.
Чекор по чекор: одговорна и законска употреба на вештачката интелигенција
1. Оценете го статусот на авторските права на записот. Пред да вчитате текст, книга или статија во алатка за вештачка интелигенција, разгледајте го статусот на авторските права на тоа дело и условите за користење на алатката. Давањето дело заштитено со авторски права на алатка која ги користи податоците што ги поставувате за свои цели може да претставува повреда на правата.
2. Прашајте ги правата на аутпутот. Статусот на авторските права на текстот произведен од вештачката интелигенција може да биде несигурен, а вештачката интелигенција може несвесно да репродуцира содржина заштитена со авторски права во податоците за обуката. Пред да објавите излез на вештачка интелигенција, проценете ја неговата оригиналност и потенцијалните прекршувања.
3. Заштитете ги личните податоци. Идентитетот на корисниците, историјата на читање/пребарување и личните информации не треба да влегуваат во која било алатка за вештачка интелигенција без експлицитна согласност и силна заштита. Анонимизацијата и минимизирањето на податоците (само онолку податоци колку што е потребно) се од суштинско значење.
4. Обезбедете транспарентност и согласност. Корисниците треба да знаат како се обработуваат нивните податоци и интеракции; Онаму каде што е вклучена вештачката интелигенција, тоа треба јасно да се наведе. Употребата на прикриена вештачка интелигенција ја поткопува довербата.
5. Воспоставете рамка за управување. Организацијата треба да утврди во писмена политика кои алатки се одобрени, кои податоци може да се внесат, кој е одговорен и како ќе се проверат резултатите.
Совет: Создадете едноставни „правила за употреба на вештачка интелигенција“ во еден лист за вашата организација: кои алатки се одобрени, кои податоци никогаш не се внесени (лични/комерцијални/доверливи), како се проверува секој излез и кој е одговорен. Јасен водич на една страница е поприменлив отколку долга политика.
Етички принципи и вредности на библиотекарството
Длабоко вкоренетите вредности на библиотекарската професија служат како компас во ерата на вештачката интелигенција: еднаков пристап до информации, слобода на мислата, приватност на корисниците, интелектуална искреност и непристрасност. ВИ може или да ги поддржи или да ги загрози овие вредности. Може да го прошири пристапот, но да ги зајакне предрасудите; може да ја забрза услугата, но може да ја загрози приватноста; Тоа може да го олесни откривањето, но може да шири дезинформации.
Одговорниот библиотекар ја тестира секоја употреба на вештачка интелигенција според овие вредности: "Дали оваа употреба го изедначува пристапот или исклучува група? Дали ја штити приватноста? Дали обезбедува точни и искрени информации?" ВИ е алатка; Вредностите со кои ќе го користите се суштината на професијата. Технологијата се менува, но овие вредности се постојаниот компас на библиотекарството.
Внимание: „Сите го користат“ или „брзо е“ не ја оправдува употребата на вештачка интелигенција. Дури и ако употребата е легална, таа може да биде неетичка; Не прифаќајте практика која е штетна во однос на авторските права, приватноста и правдата, само затоа што е лесна. Крајната одговорност не лежи во алатката, туку кај професионалецот што ја користи.
три мини футроли
Случај 1 — Преземањето заштитено со авторски права е прекинато. Еден тим планираше да вчита цела референтна книга заштитена со авторски права во општа алатка за вештачка интелигенција за да генерира резимеа. Менаџерот со информации смета дека ова е ризично, како во однос на авторските права, така и во однос на условите за користење податоци на алатката; наместо тоа, се проучуваше само во кратки, авторизирани извадоци и во затворениот систем на институцијата.
Случај 2 - Личните податоци се анонимизирани. Библиотека сакаше да ги анализира повратните информации од корисниците со вештачка интелигенција; но повратните информации содржеле кориснички имиња и информации за контакт. Тимот ги анонимизираше податоците пред анализата; беа обработени само анонимни, колективни тенденции. Приватноста е зачувана, увидот е вратен.
Случај 3 - Јазот во владеењето е затворен. Во една организација, вработените користеа различни алатки за вештачка интелигенција без надзор, понекогаш внесувајќи доверливи документи. Администраторот на информации објави политика на една страница која ги дефинира одобрените алатки, забранетите типови на податоци и правилата за верификација; Неизвесноста и ризикот значително се намалија.
Кадровска компетентност и корпоративна култура
Политиката на владеење е исто толку силна колку и луѓето што ја спроведуваат. Дури и најдобро напишаното правило останува на хартија доколку вработените не ги разбираат ризиците од вештачката интелигенција. Оттука, трајната основа за одговорна употреба на вештачката интелигенција е компетентноста на персоналот: разбирањето на секој вработен за тоа што е халуцинација, кои податоци никогаш не треба да се внесуваат и зошто треба да се потврди резултатот. Библиотеките и информативните институции имаат двојна улога во овој поглед; Мора да обучи свој персонал и да ја шири оваа писменост на корисниците. Добра корпоративна култура е онаа која пријавува грешка со вештачка интелигенција наместо да ја крие, и смета дека е нормално да се каже „Не сум сигурен за овој излез, ајде да провериме“. Во средина каде што грешките се кријат поради страв од казна, измислен извор или нарушување на приватноста се шири незабележано. Дополнително, бидејќи технологијата и алатките брзо се менуваат, политиката и обуката треба да се ажурираат редовно наместо еднократно. Управување; Тоа е жив систем каде правилата, алатките, образованието и културата работат заедно. Во центарот на овој систем стои надлежното лице, кое ја презема одговорноста и ја носи конечната одлука, а не возилото.
Совет: Пред да усвоите нова алатка за вештачка интелигенција, направете мал пилот: обидете се со ограничен тим, на реални, но ризични задачи, снимање грешки и ризици. Ова истовремено ја гради компетентноста и ги открива ранливостите на политиките пред да ја објави алатката низ целата организација.
Четири шаблони за копирање
1) Прелиминарна проценка за авторски права:
Помогнете ми да ја проценам следнава содржина за авторски права пред да ја вчитам во алатка за вештачка интелигенција: дали содржината може да биде заштитена со авторски права, кој начин на користење е ризичен, која алтернатива (извадок, дозвола, јавен домен) е побезбедна? Тип на содржина: [тука]
2) Скенирање на лични податоци:
Дали следниов текст содржи лични податоци (име, контакт, идентитет, историја на читање/пребарување, информации што имплицираат здравје/верување)? Обележете го секој од нив, класифицирајте го и предложете како да го анонимизирате. Текст: [тука]
3) Нацрт политика за користење вештачка интелигенција:
Нацртајте упатства за употреба на вештачка интелигенција на една страница за нашата организација: (1) одобрени политики за алатки, (2) типови на податоци никогаш не внесени, (3) правило за валидација на излезот, (4) одговорност и транспарентност, (5) политики за авторски права и приватност. Чувајте го краток и активен. Контекст: [тука]
4) Прашање за етичка контрола:
Тестирајте ја следнава планирана употреба на вештачка интелигенција во однос на библиотекарските вредности: рамноправен пристап, приватност, точност/интегритет, ризик од пристрасност и загриженост за знамето доколку ги има. Употреба: [тука]
Слаб промпт / Силен промпт
Слаба навестување:
Дали треба да го ставам на вештачка интелигенција за да ја сумира оваа книга?
Прашањето не ги зема предвид авторските права, условите за податоци на алатката и алтернативите; Одговорот со „да“ може да резултира со повреда на правата.
Моќен потсетник:
Вашата улога: помошник советник за авторски права и приватност. Размислувам да ја дадам следнава содржина на алатка за вештачка интелигенција. Наведете ги можните проблеми во однос на статусот на авторските права, користењето на податоците за возилото и ризикот од личните податоци; предложи побезбедни алтернативи (краток цитат, дозвола, јавен домен, затворен систем). Побарајте правна сигурност, покажете ризици. Содржина и контекст: [тука]
Моќен потсетник; Ја разгледува одлуката во однос на аспектите на авторските права, состојбата на податоците и приватноста и става безбедни алтернативи на маса.
Табела со димензии на управување
Големина
основно прашање
претпазливост
авторски права
Дали има некој влез/излезен прекршок?
Дозвола, јавен домен, краток извадок
приватноста
Дали се заштитени личните податоци?
Анонимизација, минимизирање
транспарентност
Дали корисникот знае?
Јасни информации, согласност
Одговорност
Кој е одговорен?
Пишана политика, човечко одобрување
Вредности
Дали пристапот и интегритетот се заштитени?
Етичка проверка, проверка на пристрасност
Вообичаени грешки
- Поставување содржина заштитена со авторски права без размислување. Постои ризик од прекршување на авторските права и состојба на податоците.
- Внесување лични податоци во јавната алатка. Нарушување на приватноста и правен ризик.
- Сокривање на употребата на вештачка интелигенција. Без транспарентност, довербата е нарушена.
- Збунувачки „правно“ со „етичко“. Законската употреба може да биде неетичка.
- Не воспоставување рамка за управување. Неконтролираната употреба создава непредвидливи ризици.
Сумирано
Авторското право, доверливоста и етиката се основата на одговорноста на библиотекарството во ерата на вештачката интелигенција. Оценете го статусот на авторските права на записот и условите за податоци на алатката; ги доведуваат во прашање правата на аутпутот; заштита на личните податоци со анонимизација и минимизирање; да биде транспарентен за корисникот и да добие согласност; Воспоставете јасна рамка за управување во организацијата. Длабоко вкоренетите вредности на библиотекарството (еднаков пристап, приватност, интегритет, непристрасност) се компасот што ја тестира секоја употреба на ВИ. Технолошки промени; Одговорноста и вредностите не се менуваат, а крајната одговорност секогаш лежи кај човечкото суштество.
Задача за апликација
Подгответе документ за правила за користење на една страница за вашата организација (или за фиктивна организација) со шаблонот „Нацрт политика за користење на вештачка интелигенција“: одобрени алатки, податоци што никогаш не треба да се внесуваат, правило за валидација, одговорност. Потоа, тестирајте ја вистинската употреба на вештачката интелигенција што ја планирате за пристап, приватност, точност и пристрасност со шаблонот „Прашање за етичка контрола“ и напишете како ќе ги решите сите грижи што ќе се појават.
листа за проверка
- [ ] Го оценив статусот на авторските права на записот и условите за податоци на алатката.
- [ ] Ги анонимизирав личните податоци и го користев само она што беше неопходно.
- [ ] Бев транспарентен кон корисникот за употребата на вештачка интелигенција и почитувана согласност.
- [ ] Создадов писмена политика за користење на вештачка интелигенција за организацијата.
- [ ] Ја тестирав употребата со библиотекарски вредности и ја задржав одговорноста на човекот.
Модул испит
1. Кое од наведеното е најточно позиционирање на вештачката интелигенција во библиотекарството и управувањето со информации?
- А) ВИ е асистент за резиме, метаподатоци, пребарување и препораки; Одговорноста за точноста, доверливоста на изворот и етичките одлуки лежи кај луѓето ✔
- Б) Вештачката интелигенција може со сигурност да ја потврди автентичноста и точноста на изворот
- В) Вештачката интелигенција работи само во каталогизација на книги, нема никаква врска со други библиотекарски работи
- Г) Бидејќи вештачката интелигенција е понепристрасна од луѓето, одлуките за предметот и класификацијата треба да се препуштат на неа.
Опис: Вештачка интелигенција; Тоа е асистент кој изготвува метаподатоци, ги сумира, ги преведува, ја означува шемата и ја посочува кон изворот. Надлежниот експерт е одговорен за задачи со високи последици како што се верификација на точноста, одлуки за тема и класификација, кредибилитет на изворот и одлуки за авторски права и приватност; Непроверениот резултат може да доведе до ширење на фабрикуван извор или повреда на приватноста.
2. Зошто „халуцинацијата“ е особено опасна за библиотекарот?
- А) Излезот на вештачката интелигенција се произведува многу бавно и губи време
- Б) Вештачката интелигенција може убедливо да произведе непостоечки извори и цитати, а суштината на професијата е автентичноста на изворот ✔
- В) Халуцинацијата се јавува само при обработка на слики, нема никаква врска со текстот
- Г) Халуцинацијата се гледа само во многу стари алатки за вештачка интелигенција, не и во сегашните алатки.
Објаснување: Халуцинација е кога вештачката интелигенција произведува непостоечки извор, цитат или информација на крајно убедлив начин. Бидејќи суштината на професијата е автентичноста и веродостојноста на изворот, доколку фабрикуваниот отпечаток или цитат се пренесе на библиографија или корисник без проверка, ќе дојде до сериозни дезинформации.
3. Која од следниве е област со најголем ризик од изработка при производство на метаподатоци со вештачка интелигенција и како треба да се реши тоа?
- А) Јазичната област е најзагрозена област и не треба да се проверува
- Б) Полето за наслов носи најголем ризик и треба да се пополни со предвидување
- В) ISBN и годината на објавување носат најголем ризик од изработка и треба да се проверат дословно со оригиналниот извор ✔
- Г) Ниту едно поле не е ризично бидејќи вештачката интелигенција секогаш правилно произведува метаподатоци
Објаснување: Точните, нумерички полиња како што се ISBN и годината на објавување се многу лесно фалсификувани со вештачка интелигенција; ВИ може да генерира разумен број наместо ISBN што не го знае. Овие полиња мора да се проверат дословно со оригиналниот извор (баркод, отпечаток/колофон).
4. Која е главната цел на користење на „контролиран речник“ при доделување на термин за тема?
- А) Обезбедување конзистентност и достапност на терминологијата низ записите; Спречување на вештачката интелигенција да создава бесплатни термини ✔
- Б) Автоматски додајте го секој нов термин што го бара вештачката интелигенција во каталогот
- В) Целосно елиминирајте ги термините за темата и барајте само по наслов
- Г) Забавување на каталогизацијата и пишувањето на секој запис со различни термини
Опис: Контролиран речник е список на одобрени и стандардни термини. Ако истиот предмет е напишан со различни поими во различни записи, корисникот ќе го најде едниот и ќе го пропушти другиот. Со давање на оваа листа на вештачката интелигенција и велејќи и да „само изберете од списокот“, се одржува конзистентноста и пронаоѓањето; Нов термин што не е наведен од вештачката интелигенција не треба да се додава во каталогот.
5. Кој е правилниот пристап кога се добива класификациски број на документ од вештачка интелигенција?
- А) Точниот број даден од вештачката интелигенција треба да се прифати директно без да се гледа во официјалната табела
- Б) Класификациските броеви воопшто не треба да се користат, изворите треба да се чуваат по случаен избор
- В) Предлогот за мастер класа треба да се смета за прелиминарен, точните чекори треба да се проверат со официјалната табела за класификација ✔
- Г) Бидејќи вештачката интелигенција не може да класифицира, оваа задача треба целосно да се прескокне
Објаснување: вештачката интелигенција често може да ја најде вистинската главна класа, но може да пропушти поднивоа (на пр. медицинска историја наместо медицина) или да произведе неточни бројки што изгледаат разумни. Затоа, предлогот за мастер класа треба да се смета за почеток и точните чекори треба да се проверат со официјалната табела за класификација.
6. Која изјава е точна кога се споредува семантичкото пребарување и пребарувањето на клучни зборови?
- А) Семантичкото пребарување треба да го замени пребарувањето со клучни зборови во сите случаи
- Б) Семантичкото пребарување наоѓа семантички поврзани ресурси; Пребарувањето на клучни зборови за точен наслов или ISBN е посигурно ✔
- В) Пребарувањето со клучни зборови наоѓа извори со различни поими кои се семантички поврзани подобро од семантичкото пребарување
- Г) Семантичкото пребарување работи само на нумерички податоци, а не на текст
Опис: Семантичкото пребарување наоѓа ресурси со различни зборови, но поврзани, како што се „проблем со спиење“ и „нарушување на спиењето“, бидејќи се совпаѓа со значењето на зборовите (преку вградување вектори). Спротивно на тоа, кога барате точен ISBN, целосен наслов или статутен број, пребарувањето на клучен збор/домен е посигурно. Најдобрата практика е да се користат и двете заедно.
7. Која е должноста на библиотекарот против ризикот од „филтер меур“ во препораките за персонализирани ресурси?
- А) Зајакнете го балонот само со тоа што ќе му препорачате на корисникот најмногу слични ресурси
- Б) Да се откаже целосно од давањето предлози
- В) Јавно споделување на историјата на читање на корисникот
- Г) Свесно додавање извори со различни перспективи и хоризонти и тоа транспарентно ✔
Објаснување: Меурот за филтри е кога системот за препораки постојано го заклучува корисникот во слична содржина и го држи подалеку од нови и различни перспективи. Вредноста на библиотеката е еднаков и разновиден пристап; Затоа, библиотекарката свесно го крши балонот со додавање на ресурси со различен изглед, кои ги отвораат очите и тоа транспарентно го кажува.
8. Која практика е точна во однос на „автентичноста и интегритетот“ при обработка на архивски документ со вештачка интелигенција?
- А) „разубавете“ го документот со вештачка интелигенција, пополнете го со надополнување на деловите што недостасуваат и заменете го оригиналот
- Б) Бришење на необработениот оригинал и задржување само на верзијата подобрена со вештачка интелигенција
- В) OCR треба да ги коригира само грешките при препознавање, содржината не треба да се менува, суровиот оригинал треба да се зачува и дериватите треба да бидат јасно означени ✔
- Г) Прифатете го излезот OCR како „чист текст“ без никакви корекции и отворете го за пребарување.
Опис: Суштината на архивската работа е уверувањето дека документот доаѓа од тврдениот извор и дека неговата содржина не е изменета. Корекцијата на OCR треба само да ги отстрани грешките при препознавање, а не да ја менува содржината; „Реставрацијата“ на вештачката интелигенција не е замена за вистинските докази бидејќи може да сочинува делови што недостасуваат. Необработеното (оригинално) скенирање секогаш треба да се зачува, дериватите треба да бидат јасно означени.
9. Што од следново е неопходно за одговорна конструкција на библиотечно информациски бот?
- А) Ботот произведува одговори на секое прашање брзо од своето општо знаење и не наведува извори
- Б) Ботот се потпира само на проверени корпоративни информации, цитира факти и насочува чувствителни прашања до експерт/човек ✔
- В) Ботот директно дава прецизни совети за медицински и правни прашања
- Г) Криење од корисникот без разлика дали зборува со бот или човек
Објаснување: Ботот за советување треба да се потпира само на проверените тековни информации и изворниот список на институцијата, а не на неговата општа меморија, треба да ги дава фактите со наведување на изворот, да не дава совети за медицински/правни/чувствителни прашања, да ги насочува до експертот и да ги пренесува на човекот кога е потребно. Така, ботот не го заменува човекот, туку напротив станува слој кој го олеснува товарот.
10. Во библиометријата, кој е правилниот метод за да се дознае бројот на цитати на авторот или h-индексот?
- А) Прашање директно од вештачката интелигенција, бидејќи бројките што ги дава се секогаш точни
- Б) Добивање на бројките од вистинската база на цитати; Користење на вештачка интелигенција само за организирање и толкување на овие податоци ✔
- В) Проценете ги бројките и користете ги во одлуките за емитување
- Г) Сметајќи го бројот на цитати како директна мерка за квалитетот на авторското дело.
Објаснување: Вештачката интелигенција може да состави вредности како што се број на цитати и h-индекс без пристап до вистински податоци (на пример, може да даде вредност од 42 кога всушност е 19). Затоа, броевите и цитатите мора да се преземат од вистинска база на цитати; ВИ треба да се користи само за групирање, сортирање и интерпретација на овие реални податоци.
11. Што е точно за границата на библиометриски мерки (број на цитати, h-индекс, фактор на влијание)?
- А) Метриките директно го мерат квалитетот и се споредливи низ домени
- Б) Критериумите можат безбедно да се користат сами при одлуките за вработување и унапредување.
- В) Метриката укажува на употреба, а не на квалитет; не може да се споредува низ домени и мора да се избалансира со квалитативно оценување ✔
- Г) Резултатите од хуманистичките науки се целосно и целосно претставени во бази на податоци за цитати
Обелоденување: овие метрики укажуваат на употреба и видливост, тие не се директни мерки за квалитет. Бидејќи културата на цитирање на полињата е различна (како што се медицината и филозофијата), тие не можат директно да се споредат; Во базите на податоци се недоволно застапени резултатите од големиот број книги во хуманистичките науки. Затоа, критериумите не треба да се користат сами за оценување на поединците, туку треба да се избалансираат со квалитативната евалуација.
12. Која е клучната предност на пристапот RAG (проширено производство со пристап) во однос на општата вештачка интелигенција?
- А) Значително намалување на халуцинацијата со поврзување на одговорот со вистинските документи на институцијата и наведување на изворот ✔
- Б) Секогаш одговарајте совршено, без оглед на квалитетот на основата на документите
- В) Да се направи халуцинацијата целосно и трајно невозможна
- Г) Отворање на сите документи за секого без потреба од контрола на пристап
Објаснување: Кога одговара на прашање, РАГ најпрво ги наоѓа релевантните делови од сопствените документи на институцијата и го произведува одговорот само врз основа на овие делови, наведувајќи го изворот. На овој начин одговорот е поврзан со реална и следлива документација и халуцинацијата е значително намалена. Сепак, RAG не ја елиминира целосно халуцинацијата, бидејќи одговорот сепак може да биде погрешен ако се изнесе погрешно парче.
13. Во хуманистичките и општествените науки, кој е најсигурниот метод за проверка на понуда од вештачка интелигенција до корисник?
- А) Погрижете се цитатот да изгледа веродостојно и течно
- Б) Само барајќи од вештачката интелигенција да го репродуцира истиот цитат
- В) Потврдете го цитатот така што ќе го најдете во вистинското дело на авторот ✔
- Г) Прифаќање дека е доволно цитатот да му се припише на познато име
Опис: Вештачката интелигенција може да генерира целосно измислени цитати кои му се припишуваат на вистински автор; Фактот што цитатот изгледа од збор до збор точен и убедлив не е доказ за неговата точност. Најсигурен метод е да се потврди цитатот со негово наоѓање во вистинското дело на авторот; Логиката „овој автор можеби рекол вакво нешто“ не е доволна.
14. Кој принцип е правилен при користење на вештачката интелигенција во однос на авторските права, приватноста и етиката?
- А) Авторските и личните податоци може да се внесат во јавни алатки без размислување бидејќи се брзи
- Б) Ако користењето е легално, тоа е дефинитивно етичко и не е потребна дополнителна евалуација.
- В) Кога вештачката интелигенција произведува резултат, одговорноста целосно преминува на алатката, а не на човекот.
- Г) Авторското право и приватноста мора да се почитуваат од самиот почеток; анонимизацијата, транспарентноста и согласноста се од суштинско значење, а крајната одговорност е на човекот ✔
Објаснување: Импулсивното внесување на содржина заштитена со авторски права и лични податоци (кориснички ID, историја на читање/пребарување) во општите алатки за вештачка интелигенција може да резултира со повреда на правата и приватноста; Од суштинско значење се анонимизацијата, минимизирањето на податоците, транспарентноста и согласноста. Дополнително, дури и ако употребата е легална, таа може да биде неетичка; „сите го користат“ или „тоа се случува брзо“ не ја оправдува практиката и крајната одговорност е на експертот, а не на алатката.