Добици:
- Способност класификације података који садрже тајне, личне податке и поверљиве пословне имовине и препознавање црвених линија
- Маскирање, анонимизација и обезбеђење синтетичким подацима пре уноса података
- Одобрен избор алата, минимизација контекста и могућност примене рефлекса ротације кључа у случају цурења
Све што залепите у помоћник за кодирање потенцијално је ван ваше контроле. АПИ кључ, думп базе података корисника, власнички изворни код који тек треба да буде објављен или запис о пацијенту — они могу постати неповратно цурење када уђу у неодобрени алат. Највећи ризик од вештачке интелигенције за софтверске тимове не долази од грешке у линији, већ од немарног копирања и лепљења. Ова јединица се бави безбедним копирањем и лепљењем.
Овде разликујемо три ствари: које податке никада не треба уносити, који алати се могу користити уз које мере заштите и како обезбедити податке пре уношења (маскирање, синтетички подаци, рад локално). Ово није опционо „било би лепо“; То је уговорна и законска обавеза у већини институција.
Зашто је тако критично?
Подаци које шаљете АИ алату; обрађени на серверима добављача, понекад ускладиштени на одређени временски период, могу се користити за побољшање модела у неким подешавањима производа. Рећи „Избрисао сам ћаскање“ често није довољно; У тренутку када подаци напусте мрежу, настаје ризик. Штавише, цена цурења је висока: процурели кључ у облаку може се злоупотребити у року од неколико минута, процурели подаци о клијентима могу довести до обавештења и казни према прописима као што су КВКК/ГДПР, а процурели приватни изворни код може уништити конкурентску предност.
Дакле, правило је једноставно: не уносите ништа у неодобрено возило што не можете приуштити да изгубите. Ако сумњате, немојте улазити.
Опрез: Менталитет „само једном, брзо“ је најчешћи узрок цурења. Лепљење дневника производње или конфигурационе датотеке онако како јесте када се решава хитна грешка је управо оно што се дешава са таквим одлукама донетим под притиском. Хитност не суспендује правило поверљивости.
Шта никада не треба уносити (црвена линија)
- Тајне: АПИ кључеви, лозинке, кључеви за приступ облаку, приватни сертификати, токени, низови везе.
- Лични подаци (ПИИ): Име-презиме, ТР ИД број, е-маил, телефон, адреса, здравствени/финансијски подаци, подаци о клијентима.
- Поверљива пословна имовина: Неоткривени изворни код, власнички алгоритми, интерне тајне архитектуре, детаљи уговора.
- Регулисани подаци: Посебне заштићене категорије као што су здравство, платне картице (ПЦИ), личне финансије.
Корак по корак: Безбедан ток употребе
- Класификујте податке. Коју категорију имате — јавно, интерно, поверљиво, регулисано?
- Изаберите возило по класи. Поверљиви/регулисани подаци се обрађују само у институционално одобреним алатима који обезбеђују сигурност података (некоришћење у образовању, ограничење задржавања, регионална обрада).
- Обезбедите пре уласка. Уклоните тајне, маскирајте/анонимизирајте ПИИ, користите синтетичке (измишљене, али реалне) податке умјесто стварних ако је могуће.
- Минимизирајте контекст. Сведите свој проблем на најмањи пример који се може репродуковати који не укључује осетљиве делове.
- Такође проверите излаз. Проверите да нема чврсто кодиране тајне или остатка ваших података у коду који генерише АИ.
Три мини кућишта
Случај 1 — Налепљени кључ је поништен. Програмер је налепио целу конфигурациону датотеку у АИ док је поправљао грешку; Датотека је садржала активни АПИ кључ треће стране. Када је тим приметио, одмах су поништили (ротирали) кључ и произвели нови; Није било злоупотребе, али је то био 'јефтин' инцидент. Поука: уклоните глазуру пре лепљења — и одмах окрените кључ ако је цурио.
Случај 2 — Синтетички подаци су спасили посао. Тим је имао грешку у рашчлањивању стварних података о клијентима. Уместо да унесу стварне податке, произвели су 20 линија синтетичких података са истом структуром али потпуно лажним, репродуковали грешку са њима и решили је помоћу вештачке интелигенције. Ни ПИИ није процурио нити је дијагноза успорила; синтетички подаци су били и сигурни и довољни.
Случај 3 — Скривена тајна у испису. Приликом генерисања узорка конфигурације, АИ је у њега уградио „узорак“ кључ реалног изгледа и убацио га у код, а да програмер није приметио; Скенирање базе кода (тајни скенер) је ово ухватило и упозорило. Непроменљива тајна никада није требало да уђе у шифру; Исправан начин је био да се користи променљива окружења или менаџер тајни. Лекција: скенирајте и излаз за тајне.
Четири шаблона за копирање
Маскирање контролне листе пре уласка (самостално):
Пре него што дате овај текст АИ, уверите се да сам уклонио следеће и заменио оно што сте пронашли са [МАСКИРАНИ]: АПИ кључ, лозинка, токен, низ везе, име-презиме, е-пошта, телефон, ИД број, подаци о клијентима. Текст:{{тект}}
Генерисање синтетичких тестних података:
Генеришите ПОТПУНО измишљене (неповезане са стварном особом/институцијом) {{Н}}податке за тестирање реда у складу са шемом испод. Нека изгледа реалистично, али немојте користити никакве праве ПИИ. Шема: {{поља и типови}}Укључује ивичне случајеве (празно, ивица, лош формат).
Поправљен тајни лов (у коду):
Потражите чврсто кодирану тајну у овом коду/конфигурацији: кључ, лозинка, токен, прилагођени УРЛ. Ако га пронађете, наведите његову локацију и предложите исправан метод (променљива окружења / тајни менаџер). Код:{{цоде}}
Оцењивање усаглашености возила (према класама података):
Имам следећи тип података: {{класа: јавни / интерни / поверљиви / регулисани}}. Алат који намеравам да користим је: {{алат}}. Које мере заштите (чување, некоришћење у образовању, регион, приступ) треба да потврдим пре обраде ових података у овој алатки? Дајте контролну листу. Одлука је моја; Појасните критеријуме.
Слаби промпт / Јаки промпт
Слабо: (Лепљење 200 правих корисничких редова извучених из производне базе података) „Зашто постоји грешка при рашчлањивању ових података?“
Снажно: "Испод је 15 редова са истом структуром као стварни подаци, али потпуно синтетички (без ПИИ). парсе_усер() баца ВалуеЕррор на 3, 8 и 12 ових редова. Шта би могао бити уобичајени образац, како да га поправим?"
Јака верзија не садржи праве личне податке уз очување структуре потребне за репродукцију грешке. Дијагноза остаје иста, ризик се ресетује.
Класа података
Може ли се обрадити у АИ?
Предуслов
јавности
Да
—
Унутрашња употреба (непрецизна)
Генерално
Придржавајте се корпоративне политике
Поверљиво (изворни код, пословна тајна)
Само одобрено возило
Корпоративно осигурање + минимизација
ПИИ / регулисано
По правилу бр
Маскирајте/анонимизирајте или користите синтетичке
Усклађеност са политиком и праћење
Сигурно коришћење је више од обичне личне навике, то је корпоративни систем: који алати су одобрени, која класа података где може да иде и шта треба учинити у случају кршења треба да буде дефинисано у писаној политици. Ако је тајна процурила, најважнији први корак није паничарити, већ да одмах вратите (откажете и генеришете нову) процурели акредитив и пријавите инцидент. Ако не знате листу одобрених алата и правила класификације података ваше организације, ваш први задатак је да их научите.
Савет: Дефинишите листу „игноре“ специфичну за пројекат (нпр. .енв, скривене фасцикле, датотеке идентитета) у свом алату Едитор/ЦЛИ тако да ове датотеке не буду случајно укључене у контекст помоћника. Превенција је увек јефтинија од чишћења.
Уобичајене грешке
- Лепљење осетљивих података „само једном“. Хитност не обуставља црвену линију; Овде се најчешће јавља цурење.
- Размишљајући „Избрисаћу разговор“. У тренутку када подаци напусте мрежу, настаје ризик; Брисањем се то не поништава.
- Избор возила без гледања на његову класу. Обрада поверљивих корпоративних података са личним налогом представља озбиљан прекршај.
- Не скенира се излаз. АИ може да угради непроменљиву тајну у код; Такође проверите производњу са тајним скенером.
- Не окрећући га када тајна процури. Ако не опозовете кључ који је процурео, цурење се претвара у експлоатацију уживо.
Укратко
Највећи ризик од вештачке интелигенције у софтверу је цурење приватности, а већина тога произилази из одлуке о копирању и лепљењу донете под принудом. Правило је јасно: тајне, лични подаци, поверљива пословна имовина и регулисани подаци се не уносе у неодобрене алате. Класификујте податке пре уноса, изаберите агента према класи, издвојите тајне, маскирајте ПИИ или користите синтетичке податке, минимизирајте контекст и скенирајте излаз за тајне. Ако постоји цурење, прва ствар: вратите акредитив и пријавите га.
Задатак апликације
Узмите део кода/дневника/података који сте недавно дали (или размишљате да дате) АИ. Прво, идентификујте тајне и ПИИ кандидате унутар шаблона „маскирајуће контролне листе“. Затим, ако садржи стварне податке, направите верзију идентичну шаблону „генерисање синтетичких тестних података“, али потпуно направљену, и учините свој проблем поновљивим са њим. Коначно, пронађите и прочитајте одобрену листу алата ваше институције и политику класификације података; У супротном, обратите пажњу на овај пропуст.
контролна листа
- [ ] Класификујем податке пре него што их унесем (отворени/интерни/поверљиви/подложни прописима).
- [ ] Никада не уносим тајне, ПИИ и поверљиву пословну имовину у неодобрене алате.
- [ ] Користим маскирање или синтетичке податке кад год је то могуће уместо стварних података.
- [ ] Сводим контекст на најмањи пример који не укључује осетљиве делове.
- [ ] Скенирам АИ излаз у потрази за тврдо закопаном тајном.
- [ ] Знам да ћу, ако тајна процури, одмах вратити идентификационе податке и пријавити инцидент.