Бірлік 11 / 12

Адамның бақылауы, ашықтық, біржақтылық және этика

Табыстар:

  • Адамды басқарудың үш моделін ажырату (циклда, циклде, командада)
  • Жасанды интеллект шығарылымындағы біржақтылық пен кемсітушілік тәуекелдерін тану және азайту
  • Транспаренттілік және түсініктілік принциптерін нақты қолданбаларға аудару

AI жүйесі техникалық тұрғыдан мінсіз жұмыс істеуі мүмкін, бірақ бәрібір қате болуы мүмкін: ол топты жүйелі түрде жоюы, оның шешімінің себебін түсіндірмеуі немесе адамдарды сұрақсыз қабылдауға әкелуі мүмкін. Бұл бөлімде біз басқарудың «жұмсақ», бірақ ең шешуші жағын — адам бақылауын, біржақты басқаруды, ашықтықты және этиканы нақты тәжірибеге аударамыз. Мақсат – «AI-ға сенбеу» сияқты анық емес ұрандар емес; Олар нәтижені тексеруді, біржақтылықты азайтуды және ашықтықты орнатуды көрсететін жұмыс механизмдері.

Адамды басқарудың үш моделі

Адамның қадағалауы адамның АИ қабылдаған шешімдерді бақылауда ұстауын білдіреді. Үш негізгі модель бар және тәуекелге сәйкес дұрыс модельді таңдау қажет.

үлгі

Мағынасы

Қай жерде сәйкес келеді

Циклдегі адам

Адам әрбір шешімді мақұлдайды

Тәуекелділігі жоғары, әсерлі шешімдер

Циклдегі адам

AI жұмыс істейді, адамдар бақылайды және қажет болса араласады

Орташа тәуекел, жоғары көлемді операциялар

Басқарушы адам

Адам жүйені жобалайды, оның шегін белгілейді, оны жаба алады

Жалпы басқару деңгейі

Адамға айтарлықтай әсер ететін шешімдер үшін (жұмыс, несие, денсаулық сақтау) адам-ин-цикл моделіне артықшылық беріледі: AI кеңес береді, бірақ соңғы шешімді құзыретті адам қабылдайды. «AI солай айтты» ешқашан ақтау емес; Жауапкершілік әрқашан адамда.

Назар аударыңыз: адам бақылауының «қағазда» болуы жеткіліксіз. Егер адам AI ұсынысын автоматты түрде мақұлдаса (резеңке штамптау), нақты бақылау болмайды. Аудиттің мәнді болуы үшін оның себебін көре білу, оған сұрақ қою және шын мәнінде «жоқ» деп айту керек.

Алдын ала қарау және кемсітушілік қаупі

Біржақтылық - бұл AI жүйелі түрде белгілі бір топтарға кемшіліктер немесе артықшылықтар. Оның көзі көбінесе оқу деректері болып табылады: егер тарихи деректерде кемсітушілік болса, AI оны үйренеді және сақтайды, тіпті оны масштабтайды.

Біржақтылықты азайтудың практикалық қадамдары:

  1. Сезімтал айнымалыларды қарап шығыңыз: жынысы, жасы, ұлты сияқты өрістердің шешімге әсерін тексеріңіз.
  2. Топтар бойынша сынақ нәтижелері: Жүйе әртүрлі топтарда әртүрлі қабылдамау/қабылдау коэффициенттерін шығарады ма?
  3. Прокси айнымалы мәндерден сақ болыңыз: «көрші» немесе «мектеп» сияқты өрістер этникалық/таптық айырмашылықты білдіруі мүмкін.
  4. Тұрақты мониторингті орнатыңыз: қиғаштық бір рет емес, үздіксіз тексеріледі; Деректер өзгерген кезде ол қайта оралуы мүмкін.

үш шағын іс

1-іс – Резеңке мөртабан. Бір банкте несие мамандары AI баллын оны қайта қараусыз бекітеді; «Жүйе есептеп қойған» дейді. Аудит көрсеткендей, 500 өтініштің 498-інде адам AI сияқты шешім қабылдады, сондықтан нақты шолу жоқ. Шешім: адамдардан дәлелді көруді талап етіңіз, белгілі бір дәрежеде шешімді екінші рет болжаңыз және «неге келісемін/келіспеймін» деген жазуды талап етіңіз.

2-жағдай – жасырын көзқарас. Жалдаушы AI әйел үміткерлерге жынысты мүлде қолданбаса да, төмен ұпай жинайды. Қайдан? Бұрынғы деректер негізінен белгілі бір лауазымдағы ер адамдарды қамтығандықтан, модель «үзіліссіз мансап» сияқты прокси айнымалылар арқылы жанама кемсітуді үйренді. Топтық тестілеу мұны анықтайды; Топ суррогат айнымалыларды шығарып, нәтижені бақылайды.

3-жағдай – Мөлдірлікке сену. Жасанды интеллектпен жұмыс істейтін зиянды бағалау кезінде сақтандыру компаниясы әрбір тұтынушыға «шешім AI-ге негізделген, олар апелляцияға беріп, адам тексеруін сұрай алады» деп хабарлайды. Қарсылық деңгейі күтілгеннен төмен, себебі тұтынушылар процесті түсінеді және сенеді. Транспаренттілік тәуекелді азайта отырып, сенімді арттырады.

Айқындық және түсініктілік

Транспаренттілік – бұл тиісті адамдарға AI жұмыс істеп тұрғанын және оның қалай жұмыс істейтінін түсіндіру. Түсіндіру дегеніміз – шешімнің себебін түсінікті етіп түсіндіре білу. Нақты қолданбалар:

  • Адаммен әрекеттесетін AI туралы "Сіз AI-мен сөйлесіп жатырсыз" хабарландыруы.
  • Автоматты шешімдердегі «Бұл шешім келесі факторларға негізделген» түсіндірмесі.
  • Апелляцияға және адамның тексеруін сұрауға жолды нақты көрсетіңіз.
  • Ішкі командалар үшін: модель не істейтінін құжаттау және жазу.
Нұсқау: AI шешімінен «бұл шешімге әсер еткен негізгі үш фактор қандай болды?» Деп сұраңыз. Оны сұрақпен сынап көріңіз. Егер жүйе мұны түсінікті ете алмаса және шешім адамға айтарлықтай әсер етсе, бұл жүйе жауапты пайдалануға әлі дайын емес.

Автоматтандыруға бейімділік: өз тұзағы

Транспаренттілік пен адамдық бақылау орнатылса да, адам тарапынан жасырын қауіп бар: автоматтандыруға бейімділік. Бұл адамдардың өз пікірінен гөрі машинаның шығарылымына сену үрдісі. Экрандағы AI ұсынысы «объективті және есептелген» болып көрінетіндіктен, оны күмәнсіз қабылдауға азғырылады - бұл резеңке мөрдің психологиялық шығу тегі.

Мұны азайтудың нақты жолдары бар. Алдымен қарсы пікірді көтеріңіз: шешімді мақұлдайтын адамнан «Неліктен мен AI-мен келіспеуім мүмкін?» Деп сұраңыз. Оған сұрақ бойынша ойлануын сұраңыз. Содан кейін сенімділік көрсеткішін көрсетіңіз: AI қаншалықты сенімді екенін көрсетіңіз; Төмен сенімді шығыстарды бөлек белгілеңіз. Содан кейін қақтығыс туралы ескертуді орнатыңыз: AI ұсынысы мекеме ережесін немесе адамға қолжетімді деректерді бұзса, жүйе мұны ерекшелейді. Соңында, екі адамдық принципті сыни шешімдерге қолданыңыз; Жалғыз мақұлдаушы автоматтандыруға бейім болады.

Ескерту: «Адамның рұқсаты бар» деп айту автоматтандырудың бұрмалануынан құтылуды білдірмейді. Адамда AI-ға күмән келтіру үшін өкілеттік, уақыт және дұрыс ақпарат болуы керек. Мақұлдаушыны 3 секундта 200 шешім қабылдауға мәжбүрлейтін жүйе шын мәнінде адамдық бақылауды ұсынбайды.

Көшіретін үлгілер

1-ҮЛГІ — Адамның басқару үлгісін таңдау: "Келесі AI пайдалану үшін адам басқаруының қай моделі сәйкес келеді [пайдалануды сипаттаңыз]: циклде, циклде немесе командада? Тәуекелді және жеке адамға әсерін ескере отырып, негіздеумен ұсыныңыз. Резеңке мөртабан қаупін болдырмау үшін қандай бақылауды қосу керектігін көрсетіңіз."

2-ҮЛГІ — Бейтараптық тестілеу жоспары: "Келесі шешімдерді қолдау AI үшін [пайдалануды сипаттау] сынау жоспарын жасаңыз: қандай топтарды салыстыруым керек, қандай метриканы өлшеуім керек (қабылдау/қабылдау коэффициенті, т.б.), қандай суррогат айнымалыларды іздеуім керек, сынақты қаншалықты жиі қайталауым керек? Оны кезең-кезеңімен жазыңыз."

3-ҮЛГІ — Шешімді сипаттау мәтіні: "Жекелендірілген автоматтандырылған шешім үшін қарапайым сипаттама мәтінін жазыңыз: шешім AI күшімен болды ма, шешімге әсер ететін негізгі факторлар, шағымдану және адамның қайта қарауына сұрау салу тәсілі. Айыптаусыз, құрметті үн, 120 сөз немесе одан аз."

4-ҮЛГІ — Этикалық шолуды тексеру тізімі: "AI қолдануын жарияламас бұрын этикалық шолуды тексеру парағын дайындаңыз: әділдік/кемсітушілік, ашықтық, адам бақылауы, жеке өмірге қол сұғылмаушылық, қауіпсіздік, есеп беру. Әрбір тақырыпта жауап беретін 1-2 анық сұрақты қосыңыз."

Әлсіз шақыру / Күшті шақыру

ƏЛСІЗ: «Бұл AI жалдау əділ ме?»-> Модель «əділ болуы керек» сияқты жалпы жауап береді; сыналатын әдісті және қиғаштықты өлшеуді қамтамасыз етпейді. STRONG: "Осы жұмысқа қабылдауға қолдау көрсету үшін AI тестілеу жоспарын орнатыңыз: жыныс пен жас топтары бойынша қабылдау коэффициенттерін салыстыру әдісі, қарастырылатын прокси айнымалылар, қолайлы айырмашылық шегі және бақылау жиілігі. Сондай-ақ адамның түпкілікті шешім қабылдауын қамтамасыз ету үшін бақылауды қосыңыз." -> Модель өлшенетін, қайталанатын әділеттілік механизмін шығарады.

Жалпы қателер

  • Адамның бақылауын «қағазда» қалдыру және AI ұсынысын автоматты түрде бекіту (резеңке мөр).
  • Адамға айтарлықтай әсер ететін шешімдерді циклде емес, бақылаусыз қалдыру.
  • «Мен сезімтал айнымалыны жойдым» себебі ғана шешілген ауытқуды қарастыру; прокси айнымалы мәндерін өткізіп жіберу.
  • Бақылауды бір рет сынау және оны үнемі қадағаламау.
  • Мөлдірлікті өткізіп жіберу, себебі «бұл техникалық деталь, пайдаланушы түсінбейді».
  • Сыни шешімдерде шешімнің себебін түсіндіре алмайтын жүйені пайдалану.
  • «Кейін көреміз» деп, этикалық бағалауды жарияланғаннан кейін қалдыру.

Қысқаша айтқанда

  • Адамның бақылауы үш модельде жүзеге асырылады; Адамдарға әсер ететін шешімдерде циклде адамдарға артықшылық беріледі.
  • Бақылау мағыналы болуы керек; Резеңке мөртабан (автоматты түрде бекіту) нақты аудит емес.
  • Біржақтылық көбінесе жаттығу деректерінен туындайды; Сезімтал және суррогат айнымалылар тексеріліп, үнемі бақылануы керек.
  • Мөлдірлік пен түсініктілік пайдаланушыға AI ойында екенін және шешімнің себебін нақты көрсетуді талап етеді.
  • Этикалық шолу жарияланғанға дейін орын алады; Жауапкершілік әрқашан адамда, «AI солай айтты» деген сылтау емес.

Қолданбалы тапсырма

Ұйымыңыздағы адамдарға әсер ететін AI шешім қабылдау процесін таңдаңыз (мысалы, қолданбаны бағалау). Негіздемемен осы процесс үшін адам бақылауының сәйкес үлгісін анықтаңыз және резеңке штамптаудың алдын алу үшін нақты бақылауды жобалаңыз (мысалы, негіздеуді көру талабы, үлгіні қарау). Содан кейін біржақты тестілеу жоспарын жазыңыз: қай топтарды салыстыратыныңызды, қандай метрикамен, қаншалықты жиі және қай прокси айнымалы мәндерге назар аударатыныңызды көрсетіңіз. Соңында, осы процесс барысында адамға көрсетілетін және апелляциялық/адамдық тексеру жолын қамтитын шешімді түсіндіру мәтінін жасаңыз.

бақылау парағы

  • [ ] Мен процеске сәйкес адам басқару үлгісін таңдадым.
  • [ ] Мен резеңке штампты болдырмайтын нақты басқару құралын жасадым.
  • [ ] Мен біржақты тестілеу жоспарын дайындадым (топтар, метрика, жиілік).
  • [ ] Мен суррогат айнымалылардың тәуекелін бағаладым.
  • [ ] Мен адамға шешімді түсіндіру мәтінін жаздым.
  • [ ] Мен апелляциялық және адамдық тексеру жолын анық көрсеттім.
  • [ ] Жарияланбас бұрын мен этикалық шолуды жүргіздім.