Прибуток:
- Здатність розуміти та реалізувати той факт, що дані дитини є спеціальними даними і вони повинні бути анонімними в рамках КВКК та конфіденційності та потребують згоди сім’ї.
- Здатність оцінити інструменти штучного інтелекту з точки зору безпеки даних, зберігання та використання в моделях навчання та вибрати безпечний
- Здатність підтримувати етичні межі, такі як діагностичний авторитет, стигма, дискримінація та найкращі інтереси дитини в робочому процесі
Картотека розвитку дитини містить найінтимнішу інформацію про дитину: історію розвитку, сімейну ситуацію, результати скринінгу, спостереження, а іноді й медичну інформацію. Коли ця інформація потрапляє в чужі руки або зловживає нею, вона може завдати шкоди дитині на довгі роки: ярлик, клеймо, дискримінація. Тому захист даних дітей є одним із найсерйозніших обов’язків спеціаліста з розвитку дитини; В епоху штучного інтелекту ця відповідальність зростає в рази, оскільки вставлення даних в інструмент займає кілька секунд і не може бути скасовано. У цьому розділі ми розглянемо правовий статус даних дітей, оцінку інструментів штучного інтелекту з точки зору конфіденційності та етичні межі.
По-перше, правова основа: у Туреччині KVKK (Закон про захист персональних даних) регулює обробку персональних даних. Дані про стан здоров'я та розвиток дитини відносяться до категорії спеціальних персональних даних; Ця категорія підлягає найвищому рівню захисту. У Європі його еквівалентом є GDPR. У випадку з дитиною чутливість ще більша, оскільки дитина не може дати дійсну згоду на власні дані; Згода (інформована явна згода) отримується від законного представника, тобто сім'ї. У кожному рішенні превалює принцип «найкращих інтересів дитини».
Анонімізація: найпростіший і потужний крок
Найпростішим і найпрактичнішим кроком, який захищає конфіденційність під час роботи зі штучним інтелектом, є анонімізація: видалення всієї ідентифікаційної інформації (ім’я, прізвище, номер TR ID, дата народження, назва школи/установи, адреса, номер протоколу/файлу, прізвище) із даних і використання лише неідентифікованої інформації, необхідної для вашого завдання. Напис "3 роки та 2 місяці дівчинці" замість "Еліф Кая, 3 роки та 2 місяці, дитячий садок Папатія" виконує роботу з даними, але зберігає ідентичність.
Застереження: ідентичність може з’явитися знову, коли з’єднуються кілька дрібних деталей (це називається повторною ідентифікацією). Наприклад, такі деталі, як «Єдиний близнюк у селі X, його батько — староста» можуть ідентифікувати особу, навіть якщо немає імені. Тому потрібно не тільки видалити назву, а й узагальнити деталі, які роблять її унікальною.
Необроблений (не можна поділитися)
Анонімно (для спільного використання)
Еліф Кая, ТК 123..., 12.03.2022 р.н.
Дівчинка 3 роки 2 місяці
Папатя дитячий садок 3-А кл
дошкільний заклад
Його мати — Айше, а батько — Мухтар.
батьки
Номер справи 2024/187
(видалено)
Увага: завантаження інформації про особу дитини, повного звіту чи фото в загальнодоступний інструмент штучного інтелекту є порушенням КВКК та конфіденційності та не може бути відкликано. Дані надходять на зовнішній сервер, і деякі інструменти можуть використовувати їх для навчання моделі. Завжди анонімізуйте перед завантаженням.
Вибір інструменту та життєвий цикл даних
Не кожен інструмент ШІ має однаковий рівень конфіденційності. Оцінюючи інструмент, запитайте: чи використовує він ефективність у навчанні моделі? Де він зберігає дані та як довго? Чи пропонується угода про обробку даних (для корпоративного використання)? Де їхні сервери? Корпоративні, контрактні та навчальні інструменти, які не використовують ваші дані, безпечніші за загальнодоступні безкоштовні інструменти. Однак навіть у найбезпечнішому інструменті не повідомляйте непотрібні облікові дані — анонімізація є першим захистом за будь-яких обставин.
Розгляньте життєвий цикл даних: збирайте дані (перевіряйте), обробляйте (за потреби), зберігайте (захищено, за часом), діліться (лише авторизовано, анонімно) і видаляйте (після завершення). Усе, що ви вкладаєте в інструменти ШІ, ризикує вийти за межі цього циклу.
Порада: поставте жорстке правило вгорі своїх улюблених підказок: «Я не повідомлятиму жодної інформації, яка ідентифікує дитину чи сім’ю в цій розмові». Перетворення цього контрольного рефлексу запобігає найпоширенішому порушенню (неуважному вставленню ідентифікатора).
Етичні межі: діагноз, стигма, дискримінація
Конфіденційність — це технічне питання, але етика — це ширше. Критичними є три межі. Діагностичний орган: фахівець з розвитку дитини проводить скринінг та оцінку розвитку; Остаточний діагноз є роботою відповідного лікаря/клінічної групи. Штучний інтелект не знає цієї межі; захистиш. Стигма: позначення дитини раннім і постійним ярликом (у файлі, у сім’ї, у вашій свідомості) є несправедливим щодо дитини та може негативно вплинути на її розвиток. Дискримінація та упередження: штучний інтелект може відображати упередження в навчальних даних; Це може дати упереджені результати щодо певної культури, статі чи соціально-економічної групи. Експерт повинен це помітити і виправити. Понад усе це стоїть принцип найкращих інтересів дитини: чи кожне рішення йде на благо дитини?
Чотири підказки, які можна копіювати
1) Запит на анонімізацію:
Я дам вам текст. Видалити будь-яку інформацію, яка може розкрити особу дитини або сім’ї (ім’я, прізвище, ідентифікаційний номер, дата народження, школа/заклад, адреса, номер справи, унікальні дані); замінити загальним виразом([дівчинка], [дошкільний заклад]). Узагальніть не лише ім’я, а й унікальні деталі, які можуть ідентифікувати особу. Перелічіть, що ви видалили. Текст: [необроблений]
2) Підказка щодо оцінки конфіденційності автомобіля:
Дайте мені контрольний перелік запитань щодо конфіденційності, які я маю поставити, щоб вирішити, чи можу я використовувати інструмент штучного інтелекту з дочірніми даними (чи дані використовуються в освіті, утриманні, контракті, розташуванні сервера, видаленні). Не вигадуйте відповіді; просто перелічіть питання.
3) Етика/обмеження контролю над повноваженнями:
Перегляньте наступний текст з етичної точки зору: (1) чи встановлює/натякає він на діагноз? (2) чи є клеймо, що клеймить? (3) чи існують культурні/гендерні/соціально-економічні упередження? Виділіть кожну проблему та запропонуйте виправлену, обережну альтернативу. Текст: [чернетка]
4) Текст інформації про згоду сім’ї:
Напишіть короткий текст ПОВІДОМЛЕННЯ/ЗГОДИ для сім’ї, який просто пояснює, як я буду використовувати та захищати дані дитини. Він включає: які дані, з якою метою, як вони захищені, з ким ними ділиться, право на відкликання. Надання юридичних консультацій; Зауважте, що це проект і має бути затверджений установою.
три міні-чохла
Випадок 1 — Порушення завантаження ідентифікаційної інформації. Під час напруженого дня фахівець вставляє звіт про розвиток дитини разом із повним ім’ям та ідентифікатором у публічний інструмент і каже «підсумуйте». Дані покинули установу, а згода родини не була отримана. Правильним способом було анонімізувати дані за допомогою першого запиту та використовувати лише анонімну інформацію в безпечному інструменті. Це порушення є як юридичною, так і етичною проблемою, і її неможливо відмінити.
Випадок 2 — Повторна ідентифікація. Експерт видаляє ім’я, але залишає деталь «єдина трійня в селі, батько — імам». Ця деталь ідентифікує дитину навіть без імені. Експерт поглиблює анонімізацію для узагальнення унікальних деталей: «дитина багатоплідної вагітності, яка проживає в сільській місцевості». Ідентичність тепер захищена.
Випадок 3 — Корекція зсуву. ШІ створює упереджене припущення, імпліцитне в контенті, про сім’ю з низьким рівнем доходу, наприклад, «залучення в таких сім’ях часто є недостатнім». Експерт вловлює це за допомогою третьої підказки; визнає заяву необґрунтованою, стигматизуючою та дискримінаційною та знімає її. Він переписує вміст мовою, яка розглядає кожну сім’ю як рівну та шановану.
Слабка підказка / Сильна підказка
Слабка підказка:
Я вставляю сюди повний звіт Еліф, оцінюю та рекомендую діагноз.
Проблема: розповсюджується інформація про особу (порушення КВКК), запитується діагностика (перевищення повноважень), згоди немає, безпечний автомобіль не запитується.
Потужна підказка:
Відредагуйте наступне АНОНІМНЕ резюме розробки (ідентифікаційну інформацію видалено) для оцінювального ЧЕРНЕТКА. Постановка діагнозу; використання тавруючих ярликів; Уникайте упереджених припущень. Позначте [нехай експерт оцінить] там, де ви не впевнені. Резюме: [анонімно]
Поширені помилки
- Завантаження облікових даних: найпоширеніше та найсерйозніше порушення; завжди анонімні.
- Поверхнева анонімізація: просто видалити ім’я недостатньо; також узагальнювати унікальні деталі.
- Не ставте під сумнів конфіденційність інструментів: уникайте інструментів, які використовують ваші дані для навчання.
- Перетин діагностичної межі: оцінка не є діагнозом; Повноваження покладено на лікаря/команду.
- Невизнання упередженості: виправте стигматизаційні/дискримінаційні припущення ШІ.
Підсумовуючи
Дані дитини - це спеціальні персональні дані; Це потребує найвищого рівня захисту в рамках КВКК та конфіденційності та отримання згоди від родини. Найсильнішим захистом при роботі з ШІ є анонімізація — узагальнюйте не лише ім’я, але й унікальні деталі, які можуть ідентифікувати особу. Оцініть інструменти для конфіденційності; Виберіть безпечний, який не використовує ваші дані під час навчання. Дотримуйтеся етичних меж (діагностичний авторитет, стигма, дискримінація/упередженість) і враховуйте найкращі інтереси дитини в кожному рішенні.
Аплікаційне завдання
Візьміть неанонімний (автентичний, з ваших власних записів) запис про хід виконання; Не відображаючи його на екрані, зробіть його анонімним вручну за логікою першого запиту та перерахуйте кожну інформацію, яку ви витягли. Оцініть інструмент штучного інтелекту, який ви використовуєте, з точки зору конфіденційності за допомогою 2-го запиту. Перевірте чернетку на наявність етики/упередженості за допомогою підказки 3. Зверніть увагу на щонайменше три виправлення, які ви внесли (одна анонімізація, одна етика, одна упередженість).
контрольний список
- [ ] Я анонімізував дані; Я також узагальнив унікальні деталі.
- [ ] Я оцінив використовуваний інструмент з точки зору конфіденційності; Я вибрав безпечний.
- [ ] За потреби я отримав згоду сім’ї.
- [ ] Я зберіг ліміт діагностичних повноважень; Я застосував оцінно-діагностичне розрізнення.
- [ ] Я видалив теги та дискримінаційні/упереджені вислови.
- [ ] У кожному рішенні я враховував найкращі інтереси дитини.
- [ ] Я не завантажив облікові дані до жодного автомобіля.