Birlik 11 / 12

Inson nazorati, oshkoralik, tarafkashlik va axloq

Daromadlar:

  • Inson boshqaruvining uchta modelini ajratib ko'rsatish (loopda, pastadirda, buyruqda)
  • AI chiqishida tarafkashlik va kamsitish xavfini tan olish va yumshatish
  • Shaffoflik va tushuntirish tamoyillarini aniq ilovalarga o'tkazish

AI tizimi texnik jihatdan mukammal ishlashi mumkin, ammo baribir noto'g'ri bo'lishi mumkin: u tizimli ravishda guruhni yo'q qilishi, o'z qarorining sababini tushuntirmasligi yoki odamlarni so'roqsiz qabul qilishga olib kelishi mumkin. Ushbu bo'limda biz boshqaruvning "yumshoq", ammo eng hal qiluvchi tomonini - inson nazorati, tarafkashlik boshqaruvi, shaffoflik va axloqni aniq amaliyotga aylantiramiz. Maqsad “AIga ishonmang” kabi noaniq shiorlar emas; Ular ishlab chiqarishni qanday tekshirishni, tarafkashlikni kamaytirishni va shaffoflikni o'rnatishni ko'rsatadigan ishlaydigan mexanizmlardir.

Inson boshqaruvining uchta modeli

Inson nazorati inson AI tomonidan qabul qilingan qarorlar ustidan nazoratni saqlab qolishini anglatadi. Uchta asosiy model mavjud va xavfga qarab to'g'ri modelni tanlash kerak.

model

Ma'nosi

Qaerga mos keladi

Loopda inson

Inson har bir qarorni ma'qullaydi

Yuqori xavfli, ta'sirli qarorlar

Loopda inson

AI ishlaydi, odamlar nazorat qiladi va kerak bo'lganda aralashadi

O'rtacha xavf, katta hajmdagi operatsiyalar

Qo'mondon odam

Inson tizimni loyihalashtiradi, uning chegaralarini belgilaydi va uni yopishi mumkin

Umumiy boshqaruv darajasi

Insonga sezilarli ta'sir ko'rsatadigan qarorlar uchun (ish bilan ta'minlash, kredit, sog'liqni saqlash) "Inson-in-the-loop" modeli afzallik beriladi: AI maslahat beradi, ammo vakolatli odam yakuniy qarorni qabul qiladi. "AI shunday dedi" hech qachon bahona emas; Mas'uliyat har doim odamda.

Diqqat: Inson nazorati "qog'ozda" bo'lishi etarli emas. Agar inson AIning taklifini avtomatik ravishda ma'qullasa (rezina shtamplash), haqiqiy nazorat bo'lmaydi. Audit mazmunli bo'lishi uchun mantiqni ko'rish, unga savol berish va haqiqatan ham "yo'q" deb aytish kerak.

Xurofot va kamsitish xavfi

Tarafsizlik - bu AI tizimli ravishda ma'lum guruhlarga kamchiliklar yoki afzalliklarni keltirib chiqaradi. Uning manbai ko'pincha o'quv ma'lumotlaridir: agar tarixiy ma'lumotlarda kamsitish bo'lsa, AI uni o'rganadi va saqlaydi - hatto uni kengaytiradi.

Noxushlikni kamaytirish uchun amaliy qadamlar:

  1. Nozik o'zgaruvchilarni ko'rib chiqing: jinsi, yoshi, etnik kelib chiqishi kabi sohalarning qarorga ta'sirini tekshiring.
  2. Guruhlar bo'yicha test natijalari: Tizim turli guruhlarda turli rad etish/qabul qilish stavkalarini ishlab chiqaradimi?
  3. Proksi oʻzgaruvchilardan ehtiyot boʻling: “Mahalla” yoki “maktab” kabi maydonlar bilvosita etnik/sinf farqini bildirishi mumkin.
  4. Muntazam monitoringni o'rnatish: tarafkashlik bir marta emas, doimiy ravishda sinovdan o'tkaziladi; Ma'lumotlar o'zgarishi bilan qaytib kelishi mumkin.

uchta mini holat

1-holat - rezina shtamp. Bitta bankda kredit mutaxassislari AI ballini ko'rib chiqmasdan tasdiqlaydilar; Ular "tizim buni allaqachon hisoblab chiqdi" deyishadi. Audit shuni ko'rsatadiki, 500 ta taqdimnomadan 498 tasida inson AI bilan bir xil qaror qabul qilgan - shuning uchun haqiqiy tekshiruv yo'q. Yechim: odamlardan mulohazalarni ko'rishni, qarorni ma'lum darajada taxmin qilishni va "nima uchun rozilik/qo'shilmaslik" yozuvini talab qilish.

2-holat - yashirin tarafkashlik. Ishga qabul qiluvchi sun'iy intellekt ayol nomzodlarga nisbatan pastroq ball oladi, garchi u jinsdan umuman foydalanmasa ham. Qayerdan? O'tgan ma'lumotlar asosan ma'lum bir lavozimdagi erkaklarni o'z ichiga olganligi sababli, model "uzluksiz martaba" kabi proksi o'zgaruvchilar orqali bilvosita kamsitishni o'rgandi. Guruhga asoslangan test buni ochib beradi; Jamoa surrogat o'zgaruvchilarni chiqaradi va natijani kuzatadi.

3-holati - Shaffoflik bilan ishonch. Sug'urta kompaniyasi o'zining sun'iy intellekt asosidagi zararni baholashda har bir mijozga "qaror sun'iy intellektga asoslangan, ular shikoyat qilishlari va odamlar tomonidan ko'rib chiqishni talab qilishlari mumkinligi" haqida xabar beradi. E'tiroz darajasi kutilganidan pastroq, chunki mijozlar jarayonni tushunishadi va ishonishadi. Shaffoflik ishonchni oshiradi, shu bilan birga xavfni kamaytiradi.

Shaffoflik va tushuntirish

Shaffoflik - bu tegishli odamlarga AI ishlayotgani va u qanday ishlashini tushuntirishdir. Tushuntirish qobiliyati - bu qarorning sababini tushunarli tarzda tushuntira olish. Beton ilovalar:

  • Shaxs bilan o‘zaro aloqada bo‘lgan sun’iy intellekt haqida “Siz sun’iy intellekt bilan gaplashyapsiz” bildirishnomasi.
  • Avtomatik qarorlarda "Ushbu qaror quyidagi omillarga asoslandi" tushuntirishi.
  • Apellyatsiya va odamlar tomonidan ko'rib chiqishni talab qilish yo'lini aniq ko'rsating.
  • Ichki jamoalar uchun: model nima qilayotganini hujjatlashtirish va yozib olish.
Maslahat: AI qaroridan so'rang: "Ushbu qarorga ta'sir qilgan uchta asosiy omil nima?" Buni savol bilan sinab ko'ring. Agar tizim buni tushunarli qila olmasa va qaror odamga sezilarli darajada ta'sir qilsa, bu tizim hali mas'uliyatli foydalanishga tayyor emas.

Avtomatlashtirish tarafkashligi: o'z tuzog'i

Shaffoflik va inson nazorati o'rnatilgan bo'lsa ham, inson tomonida makkor xavf mavjud: avtomatlashtirish tarafkashligi. Bu odamlarning o'z fikridan ko'ra mashinaning chiqishiga ko'proq ishonish tendentsiyasidir. Ekrandagi sun'iy intellekt taklifi "ob'ektiv va hisoblangan" ko'rinishga ega bo'lganligi sababli, uni shubhasiz qabul qilish istagi paydo bo'ladi - bu rezina shtampning psixologik kelib chiqishi.

Buni kamaytirishning aniq usullari mavjud. Avval qarama-qarshi fikrni rag'batlantiring: qarorni ma'qullagan odamdan "Nega men AI bilan rozi bo'lmasligim mumkin?" Undan savol haqida o'ylashni so'rang. Keyin ishonch ballini ko'rsating: AI qanchalik ishonchli ekanligini ko'rsating; Kam ishonchli chiqishlarni alohida belgilang. Keyin ziddiyat haqida ogohlantirishni o'rnating: Agar AI tavsiyasi muassasa qoidalarini yoki inson uchun mavjud bo'lgan ma'lumotlarni buzsa, tizim buni ta'kidlaydi. Nihoyat, ikkita insoniy tamoyilni tanqidiy qarorlar uchun qo'llang; Bitta tasdiqlovchi avtomatlashtirish tarafkashligiga ko'proq moyil bo'ladi.

E'tibor bering: "Insonning roziligi bor" deyish avtomatlashtirish tarafdoridan xoli bo'lishni anglatmaydi. Inson AIga shubha qilish uchun ham vakolatga, vaqtga va to'g'ri ma'lumotga ega bo'lishi kerak. Tasdiqlovchini 3 soniya ichida 200 ta qaror qabul qilishga majbur qiladigan tizim aslida insoniy nazoratni taklif qilmaydi.

Nusxalanadigan shablonlar

1-SHABLON — Inson boshqaruvi modelini tanlash: "Quyidagi AI foydalanish uchun inson boshqaruvining qaysi modeli mos keladi [foydalanishni tavsiflang]: halqada, halqada yoki buyruqda? Xavf va shaxsga ta'sirini hisobga olgan holda asosli ravishda tavsiya eting. Kauchuk shtamp xavfidan qochish uchun qanday nazoratni qo'shishim kerakligini ko'rsating."

2-SHABLON — Tarafsizlikni tekshirish rejasi: “Quyidagi qarorlarni qoʻllab-quvvatlash AI uchun [foydalanishni tavsiflash] tarafkashlik sinovi rejasini tuzing: qaysi guruhlarni solishtirishim kerak, qaysi koʻrsatkichni oʻlchashim kerak (rad etish/qabul qilish darajasi va h.k.), qaysi surrogat oʻzgaruvchilarga eʼtibor qaratishim kerak, testni qanchalik tez-tez takrorlashim kerak? Uni bosqichma-bosqich yozing.”

3-SHABLON — Qaror tavsifi matni: "Shaxsiylashtirilgan avtomatlashtirilgan qaror uchun oddiy tavsif matnini yozing: qaror sunʼiy intellektga asoslanganmi, qarorga taʼsir etuvchi asosiy omillar, shikoyat qilish va odamlar tomonidan koʻrib chiqishni talab qilish usuli. Ayblovsiz, hurmatli ohang, 120 soʻz yoki undan kam."

4-SHABLON — Axloqiy tekshiruv roʻyxati: "AIdan foydalanishni nashr etishdan oldin axloqiy tekshiruv roʻyxatini tayyorlang: adolat/kamsitish, shaffoflik, inson nazorati, maxfiylik, xavfsizlik, javobgarlik. Har bir sarlavha ostida javob berilishi kerak boʻlgan 1-2 ta aniq savollarni qoʻshing."

Zaif taklif / Kuchli taklif

ZAF: “Bu AIni ishga olish adolatlimi?”-> Model “adolatli bo‘lishi kerak” kabi umumiy javob beradi; sinovdan o'tkaziladigan usul va tarafkashlik o'lchovini ta'minlamaydi. STRONG: "Ushbu ishga yollash yordami uchun AI test rejasini tuzing: jins va yosh guruhlari bo'yicha qabul stavkalarini solishtirish usuli, hisobga olinadigan proksi o'zgaruvchilar, qabul qilinadigan farq chegarasi va monitoring chastotasi. Shuningdek, inson yakuniy qarorni qabul qilishini ta'minlash uchun nazoratni qo'shing." -> Model o'lchanadigan, takrorlanadigan adolat mexanizmini ishlab chiqaradi.

Umumiy xatolar

  • Inson nazoratini "qog'ozda" qoldirish va AI tavsiyasini avtomatik ravishda tasdiqlash (rezina shtamp).
  • Odamga sezilarli ta'sir ko'rsatadigan qarorlarni loopda emas, balki nazoratsiz qoldirish.
  • "Men sezgir o'zgaruvchini o'chirib tashlaganim" tufayli hal qilingan tarafkashlik hisobga olinsa; proksi o'zgaruvchilarni o'tkazib yuborish.
  • Xayolparastlikni bir marta sinab ko'ring va uni doimiy ravishda kuzatib bormang.
  • Shaffoflikni o'tkazib yuborish, chunki "bu texnik tafsilot, foydalanuvchi tushunmaydi".
  • Tanqidiy qarorlarda qaror sababini tushuntira olmaydigan tizimdan foydalanish.
  • “Keyinroq ko‘ramiz” deb, axloqiy baholashni nashrdan keyin qoldirib.

Xulosa

  • Inson nazorati uchta modelda amalga oshiriladi; Odamlarga ta'sir qiladigan qarorlarda, tsiklda odamlarga afzallik beriladi.
  • Nazorat mazmunli bo'lishi kerak; Kauchuk shtamp (avtomatik tasdiqlash) haqiqiy audit emas.
  • Tarafsizlik ko'pincha mashg'ulot ma'lumotlaridan kelib chiqadi; Nozik va surrogat o'zgaruvchilar sinovdan o'tkazilishi va doimiy ravishda kuzatilishi kerak.
  • Shaffoflik va tushunarlilik foydalanuvchiga AI o'yinda ekanligini va qaror sababini aniq ko'rsatishni talab qiladi.
  • Axloqiy ko'rib chiqish nashrdan oldin sodir bo'ladi; mas'uliyat har doim insonda, "AI shunday dedi" bahona emas.

Ilova vazifasi

Tashkilotingizdagi odamlarga ta'sir qiladigan AI qarorini tanlash jarayonini tanlang (masalan, ilovalarni baholash). Ushbu jarayon uchun tegishli inson nazorati modelini asoslash bilan aniqlang va rezina shtamplashni oldini olish uchun aniq nazoratni loyihalashtiring (masalan, asoslashni ko'rish talabi, namunani ko'rib chiqish). Keyin tarafkashlik sinovi rejasini yozing: qaysi guruhlarni solishtirishingiz, qaysi ko'rsatkich bilan, qanchalik tez-tez va qaysi proksi o'zgaruvchilarga e'tibor berishingizni belgilang. Nihoyat, ushbu jarayon davomida shaxsga ko'rsatiladigan va apellyatsiya/inson ko'rib chiqish yo'lini o'z ichiga olgan qaror tushuntirish matnini tuzing.

nazorat ro'yxati

  • [ ] Men jarayonga mos keladigan inson boshqaruvi modelini tanladim.
  • [ ] Men rezina shtampni oldini oladigan aniq boshqaruvni ishlab chiqdim.
  • [ ] Men tarafkashlik sinovi rejasini tayyorladim (guruhlar, metrikalar, chastotalar).
  • [ ] Men surrogat o'zgaruvchilar xavfini baholadim.
  • [ ] Men shaxs uchun qaror tushuntirish matnini yozdim.
  • [ ] Men apellyatsiya va inson tomonidan ko'rib chiqish yo'lini aniq taqdim etdim.
  • [ ] Men nashrdan oldin axloqiy tekshiruvni o'tkazdim.