одиниця 11 / 12

Автентифікація, межі, конфіденційність і етика

Прибуток:

  • Розуміє, що модель може викликати галюцинації, і що кожен результат має бути перевірений
  • Знає ризики та безпечні альтернативи розміщення конфіденційних і особистих даних у підказці
  • Застосовує етичні норми, авторські права та обмеження відповідальності при використанні штучного інтелекту

Недостатньо освоїти, як писати підказки; Також необхідно навчитися відповідально використовувати штучний інтелект. Ця одиниця є рівнем безпеки, який слід поставити на вершину технічних навичок. AI дає швидкі, переконливі та часто точні відповіді; Але іноді він видає абсолютно неправдиву інформацію з такою самою впевненістю, може поставити під загрозу конфіденційні дані та розсунути етичні межі. У цьому розділі ми розглянемо перевірку результатів, обмеження моделі, конфіденційність та етичну відповідальність. Без цього знання всі інші техніки залишаються незавершеними.

Галюцинація: відповідність моделі

Галюцинація - це коли модель видає нереальну інформацію впевненою мовою. Прикладами цього є неіснуюче джерело, неправильна дата, сфабрикована статистика чи закон, який ніколи не писався. чому це відбувається Тому що модель створена не для того, щоб «пізнати істину», а для того, щоб «генерувати можливе продовження» (згадайте логіку в першому блоку). Те, що речення є граматично можливим, не означає, що воно насправді правдиве.

Практичний підтекст цього зрозумілий: кожен факт, створений ШІ, є заявою, а не фактом, доки не буде перевірено незалежно. Зокрема, завжди перевіряйте:

  • Цифри та статистика
  • Імена, дати, назви місць
  • Цитати та посилання на джерела
  • Юридичні положення, технічні стандарти, медична/фінансова інформація

Звичка перевірки

Ви можете зменшити, але не скинути перевірку за допомогою оперативної техніки. Робота в два шари:

  1. Рівень підказок: надайте обмеження моделі, наприклад «покладайтеся лише на надане мною джерело, не додавайте інформацію, якої не існує, пишіть «Я не знаю», якщо ви не впевнені, показуйте джерело кожної заяви». Це зменшує прилягання.
  2. Людський рівень: перевірте кожен критичний факт самостійно з джерела. Цей крок не підлягає обговоренню; Це особливо обов’язково для вмісту, який буде опубліковано, стане основою для прийняття рішень або впливатиме на інших.

Обмеження: що модель не робить добре

область

Ризик

правильний підхід

поточні події

Дані про навчання можуть бути застарілими

Перевірте з датованого/поточного джерела

точні цифри

Є велика ймовірність примірки

Перевірте за допомогою калькулятора/джерела

Юридичні/медичні/фінансові

Ризик серйозної шкоди

Зверніться до справжнього фахівця, не покладайтеся лише на нього

Джерело/цитата

Може виробляти неіснуючі ресурси

Перевірте достовірність джерела самостійно

Рідкісна/спеціальна тема

Поверхневі або неточні

Порівняйте з експертними знаннями

Модель – помічник, а не останній авторитет. Відповідальність завжди лежить на особі, яка його використовує.

Конфіденційність і особисті дані

Текст, який ви вводите в загальнодоступний інструмент штучного інтелекту, підпадає під дію політики обробки цього інструменту та може бути поза контролем вашої організації. Тому бездумне введення конфіденційних і особистих даних є серйозним ризиком. Обробка персональних даних у Туреччині регулюється KVKK (Закон про захист персональних даних); Установи також часто мають власні політики щодо даних.

Безпечні способи роботи:

  • Анонімність/маскування: напишіть «клієнт» замість справжнього імені, «[номер рахунку]» замість справжнього номера. У більшості випадків слово «3-річний корпоративний клієнт» спрацює.
  • Використовуйте схвалений установою інструмент: деякі установи пропонують контрактні/інституційні інструменти, які не призводять до витоку даних. Обробляйте конфіденційні дані лише на них.
  • Не віддавайте те, що непотрібне: не включайте жодних конфіденційних деталей, які насправді не є важливими для виконання завдання.
  • Ознайомтеся з політикою: ознайомтеся з правилами використання штучного інтелекту вашої організації та дотримуйтеся їх.

Етика та авторське право

Відповідальне використання не закінчується конфіденційністю. Три принципи:

  1. Прозорість: якщо цього вимагає контекст (наприклад, там, де очікується людська праця), належним чином зазначайте вміст, створений ШІ. Уникайте оманливого використання.
  2. Авторські права та оригінальність: вихід моделі може нагадувати інші роботи. Перевірте оригінальність і статус прав перед комерційним використанням; Не наслідуйте чужий бренд/роботу.
  3. Незловмисність: не використовуйте для створення контенту, який вводить в оману, дискримінаційний, маніпулятивний або цільовий. Сила інструменту підвищує відповідальність.

Чотири шаблони, які можна копіювати

1) Фітинг обмеження обмеження:

Просто покладайтеся на джерело нижче. Не додавайте інформацію, якої немає в джерелі. Напишіть «немає в джерелі», де ви не впевнені. Біля кожного важливого твердження вкажіть рядок, на якому воно базується. Джерело: [текст]

2) Витягнути перевірочний список:

Перелічіть усі факти (номер, дата, назва, вимога), які необхідно перевірити, у тексті нижче. Коротко запропонуйте, як я можу перевірити для кожного. Текст: [вихід]

3) Анонімізація:

Замаскуйте всі особисті/конфіденційні дані в такому тексті: імена [ОСОБА], компанія [КОМПАНІЯ], номери [НОМЕР]. Надайте анонімну версію з незмінним значенням. Текст: [текст]

4) Етичний огляд:

Етично оцініть цей вміст перед публікацією: чи він вводить в оману, дискримінаційний чи несправедливий? Позначте це, якщо так, і запропонуйте виправлення. Зміст: [текст]

Слабка підказка / Сильна підказка

Слабкий (ризикований):

Знайдіть проблеми в контракті Ахмета Їлмаза (TC: ...) і порівняйте його із середніми показниками по галузі.

Сильний (безпечний):

Знайдіть ризиковані пункти в тексті договору нижче. - Використання персональних даних; Нехай сторони будуть називатися [КОМПАНІЯ-А] та [ОСОБА].- Покладайтеся лише на те, що написано в тексті; складений середній показник по галузі, напишіть «дані недоступні».- Показуйте кожен ризик разом із його елементом. Текст (анонімний): [текст]

Потужна версія одночасно захищає особисті дані та блокує підроблені галузеві дані; Результат готовий для розгляду юридичною групою.

Три міні-чохли

Випадок 1 — Сфабриковане джерело. Дослідник помістив у презентацію 3 «академічні джерела», надані моделлю, не перевіривши їх; Два джерела взагалі були недоступні. Колега помітив це ще до презентації. Після цього команда взяла на озброєння правило «знаходити і відкривати кожен ресурс особисто перед публікацією».

Випадок 2 — Конфіденційність. Співробітник вставив фактичний клієнтський договір без змін у загальнодоступний інструмент і попросив надати короткий опис. Коли група інформаційної безпеки закладу виявила це, процес було переглянуто; Конфіденційні документи тепер обробляються лише в корпоративному інструменті, затвердженому установою, і анонімні.

Випадок 3 — Відповідальність за прийняття рішення. Власник малого бізнесу збирався вжити заходів на основі податкової інтерпретації, наданої моделлю; Коментар не відповідав чинному законодавству. Помилку виявив, коли він проконсультувався зі своїм фінансовим радником. Урок зрозумілий: AI готує, експерт і людина вирішують.

Порада: візьміть за звичку позначати факт як «неперевірений». Поставте позначку біля кожного числа та джерела у виведених даних, доки ви не підтвердите це; Ця проста дисципліна запобігає тихому поширенню дезінформації.
Застереження: «AI так сказав» не є виправданням. Ви несете відповідальність за будь-який вміст, який ви публікуєте, надсилаєте або на основі якого приймаєте рішення. Швидкість транспортного засобу не звільняє вас від обов’язку перевірки.

Поширені помилки

  • Приймаючи плавний вихід за правильний. Приймаючи переконливу мову за доказ істини.
  • Використання джерела без його перевірки. Публікація неіснуючого джерела.
  • Введення конфіденційних даних без роздумів. Вставлення конфіденційних документів без їх анонімізації.
  • Залишаючи експертизу лише моделі. Нездатність перевірити юридичні/медичні/фінансові рішення.
  • Покладання відповідальності на транспортний засіб. Ухилення від контролю, кажучи «ШІ сказав».

Підсумовуючи

  • Галюцинація - це коли модель впевнено продукує те, що не є реальним; Будь-який факт є претензією, поки не буде підтверджено.
  • Перевірка є подвійною: оперативні обмеження зменшують виготовлення, перевірка людиною виловлює це.
  • Модель обмежена поточними, точними, юридичними/медичними/фінансовими питаннями; не є остаточним авторитетом.
  • Анонімізувати конфіденційні та персональні дані або обробляти лише в затвердженому закладом інструменті (КВКК та політика закладу).
  • Дотримуватися етичних принципів, принципів авторського права та принципів нешкідливості; Відповідальність за зміст завжди лежить на людині.

Аплікаційне завдання

Візьміть роздруківку, яку ви нещодавно зробили, і витягніть із неї всі факти (номер, дата, ім’я, джерело, твердження) як список перевірки. Запишіть спосіб перевірки для кожного та перевірте принаймні три з них. Крім того, перевірте, чи є конфіденційні/особисті дані у вхідних даних того самого виходу, і за необхідності знеособіть їх.

контрольний список

  • [ ] Я можу пояснити, що таке галюцинація і чому вона виникає.
  • [ ] Я перевіряю факти з незалежного джерела.
  • [ ] Я анонімізую конфіденційні/персональні дані або обробляю їх у безпечному інструменті.
  • [ ] Я консультую справжнього експерта з юридичних/медичних/фінансових питань.
  • [ ] Я погоджуюся з тим, що несу відповідальність за вміст.