Печалби:
- Възможност за разграничаване на данните, които правят бременната жена пряко или непряко разпознаваема и деидентифициране, преди да бъдат предоставени на изкуствен интелект
- Възможност за прилагане на минимизиране на данните и придобиване на навика да се използват само одобрени от институцията инструменти в рамките на KVKK
- „Може ли този човек да бъде намерен от този текст?“ Възможност за управление на риска от повторна идентификация чрез прилагане на теста
Акушерството е професия, която засяга най-личната информация на хората: как възниква бременността, минали бременности, спонтанни аборти, загуби, взаимоотношения, психическо състояние, сексуално здраве. Когато тази информация попадне в грешни ръце, тя причинява необратими вреди – вътрешна криза, социална стигма, загуба на доверие. Следователно поверителността не е „допълнително правило“ в акушерството, а основата на професията. След като въведете AI във вашия бизнес, се отваря нова граница на поверителността: всичко, което въвеждате в асистент за чат, може да бъде извън вашия контрол. Този модул ви учи от край до край как да защитавате данните за бременни жени, когато използвате AI — особено в рамките на KVKK (Закон за защита на личните данни; законът, регулиращ обработката на лични данни в Турция).
Основният принцип е в едно изречение: Всяка информация, която прави една бременна жена разпознаваема, никога не трябва да влиза в инструмент с изкуствен интелект. Научаването на това правило има предимство пред всички други умения в модула; Тъй като веднъж изтекли данни не могат да бъдат извлечени.
Внимание: Текстът, който въвеждате в AI инструмент, отива до сървърите на тази услуга; могат да се съхраняват, обработват и в някои случаи използват за обучение на модели. Казването на „Исках само резюме“ не връща данните. Единственият безопасен начин е никога да не въвеждате идентификационните данни на първо място.
Какво представляват личните данни, каква информация ги прави разпознаваеми?
Лични данни са всяка информация, която прави дадено лице пряко или непряко идентифицирано. В акушерството те са особено в специалната категория (като здравни данни, които получават най-висока защита в закона). Разгледайте информацията, която осигурява разпознаване в две групи:
Директни идентификатори: Име-фамилия, ТР ID номер, номер на файл/протокол, телефон, адрес, електронна поща, дата на раждане, акаунт в социална мрежа, снимка.
Косвени дескриптори (комбинирани, за да се разпознае): „Единствената триплодна бременност в този квартал“, „единствената 44-годишна в институцията с първа бременност“, рядко заболяване + малко населено място, работно място + гестационна възраст. Няколко детайла, които сами по себе си изглеждат невинни, могат да насочат към човек, когато се съберат заедно. Това се нарича риск от повторна идентификация.
Деидентификацията е процесът на премахване на тези идентификатори от текста. Добре направената деидентификация изчиства както преките, така и непреките идентификатори.
Стъпка по стъпка: Деидентификация преди даване на данни на AI
- Изтрийте директни идентификатори: Име, ID, телефонен номер, номер на файл, адрес, дата — премахнете ги всички. Заменете го с обобщения като „Бременна А“, „около 38 години“, „втори триместър“.
- Замъгляване на косвени улики: Превърнете точната възраст в диапазон (напр. „ранните 40 години“), точното местоположение в регион, редките комбинации в общи.
- Изхвърлете ненужните подробности: Дайте минималната информация, необходима на AI, за да свърши работата си (минимизиране на данните). Анамнезата на бременна жена не е задължителна за писане на карта за кърмене.
- Проверете политиката на институцията: Някои институции дефинират одобрени/институционални инструменти за ИИ; може да забрани въвеждането на данни за пациента в лични/безплатни инструменти. Следвайте правилата на вашата институция.
- Окончателно четене: Преди да изпратите подканата "може ли този човек да бъде намерен от този текст?" Прочетете го още веднъж.
Най-трудната от тези пет стъпки е втората — замъгляване на косвени улики — тъй като изтриването на директни идентификатори е лесно и първо идва на ум, но по-голямата част от разпознаването всъщност идва от комбинацията от косвени подробности. Комбинацията от професия, възраст, място на пребиваване и рядко заболяване може да сведе човек до един човек, дори и да не се споменава име. Следователно деидентификацията не трябва да се разглежда като „изтриване на имена“, а като „гаранция, че никой, който чете този текст, не може да отгатне лицето“. Тази ментална рамка радикално намалява риска от повторна идентификация.
Съвет: Добър тест: Ако покажете деидентифицирания текст на колега, който познава тази бременна жена, ще каже ли тя „това е така и така“? Ако той може да каже това, това означава, че не сте го разпознали достатъчно.
три мини калъфа
Случай 1 — Непряко разпознаване: Когато поиска от AI резюме на историята, акушерка пропусна идентификационния номер, но остави фразата „единствената бременност с четиризнаци в нашия град“. Това единствено изречение директно сочи към човека на това малко място. Колегата му забелязва и предупреждава; Акушерката обобщава израза като "многоплодна бременност". Урок: непреките идентификатори са също толкова опасни, колкото и преките идентификатори.
Случай 2 — Минимизиране на данните: Втора акушерка обикновено поставя цялото досие на бременната жена в AI, вместо просто да отпечата брошура „хранене по време на бременност“. Сигурно е: не са необходими лични данни за брошурата. Той взема брошурата, без да предава файла, само пише темата. Най-сигурните данни са тези, които никога не се споделят.
Случай 3 — Грешен инструмент: В третия пример акушерка е на път да въведе информация за пациента в произволно приложение на личния си телефон, когато си спомня институционалната политика: данните за пациента могат да се обработват само без идентифициране и с помощта на одобрени от институцията инструменти. Не използва личното приложение. Течът на данни често възниква от такъв момент на „удобство“, а не от техническа грешка.
Копируеми шаблони
Роля: Вие сте асистентът за контрол на деидентификацията. Задача: Маркирайте всеки израз в текста по-долу, който би могъл ПРЯКО или НЕПРЯКО да идентифицира лице: - Директно: име, лична карта, телефон, адрес, номер на файл, точна дата, снимка. - Непряко: рядка комбинация, малко място + специална ситуация, точна възраст, работно място, уникално/уникално качество. Предложете по-безопасно ОБОБЩЕНИЕ за всеки. Текст: [текст]
Роля: Вие сте консултант по минимизиране на данни. Задача: Искам да върша тази работа: [работа]. Каква е минималната информация, КОЯТО ТРЯБВА ДА ВИ дам, за да направя това? Маркирайте ненужната информация за пациента като „[НЕ ПРЕДОСТАВЯЙТЕ]“.
Роля: Вие сте сигурният асистент за обобщение. Задача: Обобщете DIDIDENTIFIED историята по-долу. Ако видите идентификационна информация в текста, не обобщавайте; вместо това напишете „Открих идентификационни данни, моля, изчистете и изпратете отново.“ История: [история]
Контролен списък за напомняне за институционална политика (запитайте се): - Този инструмент одобрен ли е от моята институция? - Има ли информация, позволяваща идентифициране на личността, във въведените от мен данни? - Тази информация наистина ли е необходима за тази работа? - Може ли някой, когото познавам, да намери лицето, ако прочете текста? - Ще добавя ли идентификационна информация, когато запазвам резултата?
Слаба подкана / Силна подкана
Слаб: "Айше Й., 39 г., трета бременност, в следната болница, номер на досие 4412; обобщете нейната история."
Тази подкана е пълна с директни идентификатори; Личните данни са изтекли веднага след изпращането им.
Силен:
Роля: асистент за сигурно резюме. Обобщете следната анонимна история. „Бременна А, в края на 30-те, трета бременност, [свързани медицински подробности анонимни].“ Ако видите идентифицираща информация в текста, не обобщавайте, предупреждавайте.
Разлика: В силната версия няма преки/непреки идентификатори; има само контекст без идентичност, необходим за извършване на работата. Защитата започва преди да бъде написана подканата.
Какво да споделим и какво да не споделим
Тип информация
В AI попада ли?
алтернатива
Име, TR ID, телефон, адрес, номер на файл
никога
"Бременна А"
Точна възраст / точна дата
не
Възрастова група/триместър
Рядка комбинация + малко място
не
обобщавам
Общ медицински контекст (анонимен)
Да, ако е необходимо
Прилагане на минимизиране на данните
Снимка/изображение
Не (лице/знак)
не е необходимо
Превозното средство не е одобрено от институцията
Няма данни за пациенти
Одобрено превозно средство
Често срещани грешки
- Само изтриване на името и оставяне на косвени улики: рискът от повторна идентификация остава.
- Поставяне на целия файл за "удобство": Нарушава принципа за минимизиране на данните.
- Въвеждане на пациентски данни в лични/неодобрени устройства: Може да е в противоречие с институционалната политика и KVKK.
- Споделяне на снимка/екранна снимка: Лицето, името и номерът на файла в изображението могат да останат поверителни.
- Добавяне на ID при запазване на изхода: Добавянето на ID към изхода, който идва без ID, връща риска обратно.
- Ако приемем, че „все пак се изтрива“: не знаете какви са данните; Единствената гаранция е да не изпращате нищо.
В обобщение
Когато използвате изкуствен интелект, поверителността е предпоставка, а не технически елемент. Всяка информация, която прави бременна жена директно (име, лична карта, телефон) или косвено (рядка комбинация + малко местоположение) разпознаваема, не трябва да влиза в AI инструмент. Практикувайте минимизиране на данните — осигурете минималната информация, необходима за извършване на работата — и използвайте само инструменти, одобрени от вашата организация. Без изпращане на подканата "може ли този човек да бъде намерен от този текст?" направи теста. Веднъж изтекли, данните не могат да бъдат извлечени; Следователно защитата започва преди да бъде написана подканата.
Задача за приложение
Вземете истинска история на бременността (на хартия) и изчистете текста стъпка по стъпка, като използвате шаблона за деидентификация: първо преки, след това непреки идентификатори. Покажете изчистения текст на колега и попитайте "кой може да е това?" питам; Ако можете да го разпознаете, обобщете го допълнително. Също така намерете политиката за AI/данни на вашата институция, обобщете я в едно изречение и отбележете кои инструменти са одобрени.
контролен списък
- [ ] Премахнах всички директни идентификатори (име, ID, телефон, адрес, номер на файл).
- [ ] Обобщих непреки дескриптори (рядка комбинация, малко местоположение, точна възраст).
- [ ] Предоставих само минималната информация, необходима за извършване на работата.
- [ ] Използвах само инструмент, одобрен от моята институция.
- [ ] „Може ли този човек да бъде намерен от този текст?“ Направих теста.
- [ ] След това не добавих идентификационни данни към изхода.