Добивки:
- Способност да се разликуваат податоците што ја прават бремената жена директно или индиректно препознатлива и да ги деидентификува пред да ги даде на вештачката интелигенција
- Способност за примена на минимизирање на податоците и стекнување навика да се користат само алатки одобрени од институција во рамките на KVKK
- „Може ли оваа личност да се најде од овој текст? Способност за управување со ризикот од повторна идентификација со примена на тестот
Акушерството е професија која ги допира најприватните информации на луѓето: како настанува бременост, минати бремености, спонтани абортуси, загуби, врски, ментална состојба, сексуално здравје. Кога оваа информација ќе падне во погрешни раце, предизвикува неповратна штета - домашна криза, социјална стигма, губење на довербата. Затоа, доверливоста не е „дополнително правило“ во акушерството, туку основа на професијата. Откако ќе ја воведете вештачката интелигенција во вашиот бизнис, се отвора нова граница на приватност: сè што пишувате во асистент за разговор може да биде надвор од ваша контрола. Оваа единица ве учи од крај до крај како да ги заштитите податоците за бремените при користење на вештачка интелигенција - особено во рамките на KVKK (Закон за заштита на лични податоци; законот кој ја регулира обработката на личните податоци во Турција).
Основниот принцип е во една реченица: Секоја информација што ја прави препознатлива трудницата никогаш не треба да влезе во алатка за вештачка интелигенција. Учењето на ова правило има предност пред сите други вештини во модулот; Бидејќи еднаш протечените податоци не можат да се вратат.
Внимание: Текстот што го внесувате во алатката за вештачка интелигенција оди до серверите на таа услуга; може да се складира, обработи и во некои случаи да се користи за обука на модели. Кажувањето „Само сакав резиме“ не ги враќа податоците. Единствениот безбеден начин е никогаш да не ги пишувате акредитивите на прво место.
Што се лични податоци, кои информации ги прават препознатливи?
Лични податоци се секоја информација што го прави лицето директно или индиректно препознатливо. Во акушерството, тие се особено во посебната категорија (како здравствените податоци, кои добиваат највисока заштита во законот). Размислете за информациите што обезбедуваат препознавање во две групи:
Директни идентификатори: Име-презиме, TR ID број, број на датотека/протокол, телефон, адреса, е-пошта, датум на раѓање, сметка на социјалните мрежи, фотографија.
Индиректни дескриптори (комбинирани за да ја направат препознатлива): „Единствената тројна бременост во таа населба“, „единствената 44-годишна во институцијата со првата бременост“, ретка болест + мала населба, работно место + гестациска старост. Неколку детали кои сами по себе изгледаат невини можат да укажат на некоја личност кога ќе се соберат. Ова се нарекува ризик за повторна идентификација.
Деидентификацијата е процес на отстранување на овие идентификатори од текстот. Добро направената деидентификација ги брише и директните и индиректните идентификатори.
Чекор по чекор: Деидентификување пред давање податоци на ВИ
- Избришете ги директните идентификатори: Име, ИД, телефонски број, број на датотека, адреса, датум - отстранете ги сите. Заменете го со генерализации како „бремена А“, „околу 38 години“, „втор триместар“.
- Заматете ги индиректните индиции: претворете ја точната возраст во опсег (на пр. „рани 40-ти“), прецизна локација во регион, ретките комбинации во општи.
- Отфрлете ги непотребните детали: дајте ги минималните информации потребни за вештачката интелигенција да ја заврши својата работа (минимизирање на податоците). Не е потребна анамнеза на бремена жена за да се напише картичка за доење.
- Проверете ја политиката на институциите: Некои институции дефинираат одобрени/институционални алатки за вештачка интелигенција; може да забрани внесување податоци за пациентот во лични/бесплатни алатки. Следете го правилото на вашата институција.
- Завршно читање: Пред да го испратите промптот „може ли оваа личност да се најде од овој текст?“ Прочитајте го уште еднаш.
Најтешкиот од овие пет чекори е вториот - замаглување на индиректните индиции - бидејќи бришењето на директните идентификатори е лесно и прво ми доаѓа на ум, но најголемиот дел од препознавањето всушност доаѓа од комбинацијата на индиректни детали. Комбинацијата на професија, возраст, место на живеење и ретка состојба може да го намали човек на самец, дури и ако не се споменува име. Затоа, деидентификацијата не треба да се смета како „бришење имиња“, туку како „обезбедување дека никој што го чита овој текст не може да ја погоди личноста“. Оваа ментална рамка радикално го намалува ризикот од повторна идентификација.
Совет: Добар тест: Дали ако го покажете деидентификуваниот текст на колешката што ја познава таа трудница, дали таа ќе каже „ова е така-и-тоа“? Ако може да го каже тоа, тоа значи дека не сте го деидентификувале доволно.
три мини футроли
Случај 1 - Индиректно препознавање: Кога побарала од вештачката интелигенција резиме на историјата, една бабица ја изоставила личната карта, но ја оставила фразата „единствената четворократна бременост во нашиот град“. Оваа единствена реченица директно укажува на личноста на тоа мало место. Неговиот колега забележува и предупредува; Акушерката го генерализира изразот како „повеќе бременост“. Поука: индиректните идентификатори се исто толку опасни како и директните идентификатори.
Случај 2 - Минимизирање на податоците: втора акушерка вообичаено ја залепува целата датотека на трудницата во вештачката интелигенција наместо само да ја испечати брошурата за „храна за бременост“. Тоа стои: не се потребни лични податоци за брошурата. Ја зема брошурата без да го предаде досието, само ја пишува темата. Најбезбедни податоци се податоците што никогаш не се споделуваат.
Случај 3 - Погрешна алатка: Во третиот пример, бабица ќе ги впише информациите за пациентот во случајна апликација на нејзиниот личен телефон кога ќе се сети на институционалната политика: податоците за пациентот може да се обработуваат само деидентификувани и со помош на алатки одобрени од институцијата. Не ја користите личната апликација. Протекување податоци често произлегува од таков момент на „погодност“, а не од техничка грешка.
Шаблони за копирање
Улога: Вие сте помошник за контрола на деидентификација. Задача: Обележете го секој израз во текстот подолу што може ДИРЕКТНО или ИНДИРЕКТНО да идентификува лице:- Директно: име, лична карта, телефон, адреса, број на датотека, точен датум, фотографија.- Индиректно: ретка комбинација, мало место + посебна ситуација, точна возраст, работно место, единствен/уникатен квалитет.
Улога: Вие сте консултант за минимизирање податоци. Задача: Сакам да ја работам оваа работа: [работа]. Која е минималната информација што МОРАМ ДА ВИ ДАВАМ за да го направите ова? Обележете ги непотребните информации за пациентот како „[НЕ Обезбедувај]“.
Улога: Вие сте безбеден асистент за резиме. Задача: Сумирајте ја ДИДИДЕНТИФИРАНАТА приказна подолу. Ако видите информации за идентификација во текстот, не резимирајте; наместо тоа, напишете „Ги открив ингеренциите, ве молам исчистете и повторно испратете“. Приказна: [приказна]
Список за проверка за потсетник за институционална политика (запрашајте се):- Дали оваа алатка е одобрена од мојата институција?- Дали има лична идентификација во податоците што ги внесов?- Дали овие информации навистина се потребни за оваа работа?- Може ли некој што го познавам да го најде лицето ако го прочита текстот?- Дали ќе додадам информации за идентификација при зачувување на излезот?
Слаб промпт / Силен промпт
Слаба: „Ајше Ј., 39, трета бременост, во следната болница, досие број 4412; резимирајте ја нејзината историја“.
Овој промпт е полн со директни идентификатори; Приватните податоци протекоа веднаш штом беа испратени.
Силно:
Улога: безбеден асистент за резиме. Сумирајте ја следната анонимна историја. „Бремена А, доцни 30-ти, трета бременост, [поврзани медицински детали анонимни]. Ако видите информации за идентификација во текстот, не резимирајте, предупредувајте.
Разлика: Нема директни/индиректни идентификатори во силната верзија; има само контекст без идентитет кој е потребен за да се заврши работата. Безбедноста започнува пред да се напише барањето.
Што да споделите, а што да не споделите
Тип на информации
Дали спаѓа во ВИ?
алтернатива
Име, TR ID, телефон, адреса, број на датотека
никогаш
„Бремена А“
Точна возраст / точен датум
бр
Возрасен опсег/триместар
Комбинација на ретки + мало место
бр
генерализираат
Општ медицински контекст (анонимен)
Да, ако е потребно
Примени минимизирање на податоците
Фотографија/слика
Не (лице/знак)
не е потребно
Возилото не е одобрено од институцијата
Нема податоци за пациентот
Одобрено возило
Вообичаени грешки
- Само бришење на името и оставање индиректни индиции: Ризикот од повторна идентификација останува.
- Вметнување на целата датотека за „погодност“: Го нарушува принципот на минимизирање на податоците.
- Внесување податоци за пациентот во лични/неодобрени уреди: Тоа може да биде спротивно на институционалната политика и KVKK.
- Споделување фотографија/скриншот: Лицето, името и бројот на датотеката на сликата може да останат доверливи.
- Додавање ID при зачувување на излезот: Додавањето ID на излезот што доаѓа без ID го враќа ризикот.
- Претпоставувајќи "се брише во секој случај": не знаете кои се податоците; Единствената гаранција е да не се испрати ништо.
Сумирано
При користење на вештачка интелигенција, приватноста е предуслов, а не технички. Секоја информација што прави бремена жена директно (име, лична карта, телефон) или индиректно (ретка комбинација + мала локација) препознатлива не треба да влегува во алатка за вештачка интелигенција. Вежбајте минимизирање на податоците - обезбедете ги минималните информации потребни за извршување на работата - и користете само алатки одобрени од вашата организација. Без праќање на промптот „може ли оваа личност да се најде од овој текст?“. направи го тестот. Откако ќе протече, податоците не може да се вратат; Затоа, безбедноста започнува пред да се напише барањето.
Задача за апликација
Земете вистинска историја на бременост (на хартија) и исчистете го текстот чекор по чекор користејќи го шаблонот за деидентификација: прво директни, а потоа индиректни идентификатори. Покажете го исчистениот текст на колега и прашајте „кој би можел да биде ова? прашај; Ако можете да го препознаете, генерализирајте го дополнително. Пронајдете ја и политиката за вештачка интелигенција/податоци на вашата институција, резимирајте ја во една реченица и забележете кои алатки се одобрени.
листа за проверка
- [ ] Ги отстранив сите директни идентификатори (име, лична карта, телефон, адреса, број на датотека).
- [ ] Ги генерализирав индиректните дескриптори (ретка комбинација, мала локација, точна возраст).
- [ ] Ги дадов само минималните информации потребни за извршување на работата.
- [ ] Користев само алатка одобрена од мојата институција.
- [ ] "Дали може да се најде оваа личност од овој текст?" Го направив тестот.
- [ ] Не додадов никакви ингеренции на излезот потоа.