Јединице
1. Увод у вештачку интелигенцију у хемији: улоге, границе, валидација и етика 2. Молекуларна заступљеност и хемијска структура: валидација са СМИЛЕС, ИнЦхИ и РДКит 3. Предвиђање и механизам реакције: Предвиђање производа, стања и нежељене реакције 4. Подршка за интерпретацију спектра: НМР, ИР и масена спектрометрија 5. Преглед литературе и планирање синтезе: извор, поступак и мапа пута 6. Хемијска анализа података и Питхон: панде, стехиометрија и калибрација 7. Предвиђање молекуларних својстава и КСАР: Резолуција, пКа и границе модела 8. Лабораторијска документација: Свеска за експерименте, ЕЛН и репродуктивност 9. Процена безбедности и опасности: ГХС, СДС и границе вештачке интелигенције 10. Потврда, халуцинације и научни интегритет 11. Човек у експериментисању: етика, приватност, одговорност и ток рада од краја до краја
Јединица 10 / 11

Потврда, халуцинације и научни интегритет

Добици:

  • Способност да се разуме да је халуцинација инхерентна језичком моделу и да се изабере одговарајући метод верификације за сваку врсту излаза.
  • Проверите критичне вредности на два независна начина са триангулацијом и не бркајте течност са тачношћу
  • Способност примене транспарентности, следљивости, интегритета података и људске одговорности као основе научног интегритета

Једна фраза се враћала изнова и изнова кроз овај модул: „АИ производи, људи верифицирају.“ У овој јединици ту реченицу претварамо у систем. Циљ је да се препозна халуцинација (производња лажних/измишљених информација поузданим језиком), што је најопасније понашање АИ, да се успостави конкретан метод верификације за сваку врсту резултата и да се све то стави у оквире научног интегритета (поштеност, транспарентност, следљивост). Непроверени излаз вештачке интелигенције у хемији није само грешка; То може бити експлодирање експеримента, тровање особе или повлачење папира.

Зашто је халуцинација неизбежна?

Велики језички модел производи „следећу највероватније реч“; Циљ је на оно што је могуће, а не на оно што је истина. Дакле, он може да попуни молекуларну тежину, ДОИ или тачку кључања вредношћу која „изгледа разумна“ - без провере да ли је стварна. Халуцинација није квар, већ последица природе ове технологије. Решење није да „покушате да поправите” модел, већ да направите љуску за валидацију око сваког излаза.

Најподмуклији аспект халуцинације је њен самоуверени језик. Нетачна молекулска тежина је представљена са потпуно истом поузданошћу као и тачна. Дакле, „изгледа самоуверено“ никада не значи „тачно“.

Пажња: Колико течно и самоуверено АИ говори о некој теми није повезано са тачношћу тих информација. Течност убеђује; Само независни извор одређује тачност.

Валидација по типу излаза у хемији

Сваки тип излаза има свој метод верификације. Уместо да запамтите једно правило, користите одговарајући алат за излаз:

Тип излаза

Метода верификације

возила

Молекуларна тежина, формула

Прерачунај из формуле

РДКит / ручно

ОСМЕСИ/структура

Парсирај + каноникализирај

РДКит

Цитирање/ДОИ

Реши у бази података

дои.орг, Цроссреф

Физичка константа (кн, пКа)

Референтна база података

ПубЦхем, приручник

нумерички прорачун

Напиши+покрени код

Питхон

реакција/стање

Потврда књижевности

Реакис, чланак

потраживање обезбеђења

СДС/ГХС

Званични СДС

Додељивање спектра

Мултитехнички + људски

Експериментални спектар

Ова табела је заправо резиме овог модула: свака јединица је један ред.

Триангулација: три независна путања

Најмоћнија техника верификације је „триангулација“: долазак до истог закључка на три независна начина. На пример, за молекуларну тежину: (1) оно што ИЗ каже, (2) РДКит-ов прорачун, (3) израчунавање ручно из формуле. Ако се ова три преклапају, поверење је велико; Ако неко залута, станите и истражите. Никада се не ослањајте на један извор у хемији; Потражите најмање два независна пута.

Корак по корак: ток рада верификације

  1. Класификујте излаз: да ли је то број, структура, атрибуција, безбедносна тврдња?
  2. Изаберите одговарајући алат: Узмите одговарајућу путању за верификацију за тип излаза из горње табеле.
  3. Израчунај/тражи независно: Покрени возило независно од АИ; упореди резултат.
  4. Ако постоји одступање, зауставите се: Ако се вредности не поклапају, немојте наставити без испитивања која је тачна.
  5. Оставите свој траг: Запишите шта сте и како проверили (научни интегритет).
  6. Наведите несигурност: Означите нешто што се не може проверити као „непотврђено“, немојте то сакривати.

Четири шаблона за копирање

1) Самопотврда:

Управо сте дали следећи излаз: [ИЗЛАЗ]. Задатак: Наведите сваку бројчану/чињеничну тврдњу овог резултата у посебном реду. За сваку тврдњу: "како то независно проверити?" метода писања (који алат/база података). НЕ ТВРДИ да је тврдња тачна; само дајте начин да то проверите.

2) Контрола триангулације:

Желим да проверим тежину следећег молекула на три начина: [ОСМЕШИ СЕ].Задатак: 1) Изведи молекулску формулу.2) Прикажи атом по атом израчунавање молекулске тежине (допринос сваког елемента).Напомена: Израчунаћу је и у РДКит-у и треће упоредити са оним који си дао. Ако се ова три не преклапају, упозорите.

3) Ознака нејасноће:

У следећем тексту постоји више чињеничних тврдњи: [ТЕКСТ]Задатак: Ставите ознаку нивоа поузданости поред сваке тврдње: [ПРОВЕРЕНО] / [ПРОВЕРЕНО] / [НЕСИГУРНО]. Не означавајте ништа [ПРОВЕРЕНО] ако нисте сигурни.

4) Унакрсни упит конзистентности:

Поставићу исто питање на два различита начина; Проверите да ли су ваши одговори доследни. Питање А: Која је молекулска формула једињења

Слаби промпт / Јаки промпт

слаба:

Запишите све што знате о овом једињењу.

АИ неселективно меша проверљиве и измишљене информације; Нејасно је који је прави.

Јака:

Наведите информације о овом једињењу, али сваку тврдњу означите као: [ДЕТЕРМИНИСТИЧНО - верификовано инструментом] нпр. молекуларна формула,[ЕКСПЕРИМЕНТАЛНО - потребан цитат] нпр. тачка топљења, [НЕСИГУРНО - нисам сигуран]. Немојте писати никакве неозначене тврдње.

Разлика: приморали смо АИ да означи сопствену несигурност; Учинили смо плански рад на верификацији.

Научни интегритет: поштење и следљивост

Верификација није само технички корак, то је етичко питање. Научни интегритет захтева:

  • Транспарентност: Не кријте да користите АИ; Наведите у складу са политиком ваше публикације/извештаја.
  • Следљивост: Забележите који излаз је дошао од АИ и како је верификован.
  • Интегритет података: „Улепшавање“ резултата помоћу вештачке интелигенције, одбацивање изузетака без оправдања је превара.
  • Одговорност: Ви сте одговорни за крајњи исход; „АИ је тако рекао“ није изговор.
Савет: Прихватите од самог почетка да никада не можете користити фразу „АИ је тако рекао“ у извештају или одбрани. Ово прихватање аутоматски доноси навику верификације сваког излаза.

мини случајеви

Случај 1 — Триангулација је ухватила грешку. Студент је проверио молекуларну тежину на три начина: ИЗ је рекао 178,2, ручно израчунавање је дало 180,16, РДКит је дало 180,16. Два независна пута су се преклапала и елиминисала АИ. Лекција: две независне провере тихо побеђују један лажни излаз.

Случај 2 — Безбедан језик, погрешне информације. АИ је врло самоуверено написао да реакција „тече спонтано на собној температури“. Литература је показала да је за то било потребно загревање и катализатор. Ученик је веровао извору, а не безбедном језику. Лекција: течност није тачност.

Случај 3 — Добијена транспарентност. У делу о методама свог рада, један истраживач је јасно навео у којим корацима је користио АИ (уређивање текста, цртање кода) и написао да је независно проверавао све нумеричке резултате. Судијски процес је протекао глатко. Поука: транспарентност гради поверење, прикривање ствара ризик.

Уобичајене грешке

  • Веровати безбедном језику. Самоуверени тон вештачке интелигенције није показатељ тачности.
  • Ослањајући се на један извор. Прихватање једног излаза без триангулације.
  • Без одвајања типа излаза. Мислећи да сам истим методом „проверио“ број, атрибуцију и безбедносну тврдњу.
  • Скривање неизвесности. Пријавити нешто што се не може проверити као да је извесно.
  • Скривање употребе АИ. Недостатак транспарентности подрива научни интегритет.
  • Делегирање одговорности. Изговор „АИ је тако рекао“ је неважећи; Одговорност је на особи.

Укратко

  • Халуцинација је инхерентна језичком моделу; Решење је да се направи љуска за валидацију око сваког излаза.
  • Сваки тип излаза има свој метод верификације; класификовати излаз и користити одговарајући алат.
  • Триангулација (два независна пута) је најјача контрола; Не верујте једном извору.
  • Течност и самоуверен језик нису повезани са прецизношћу.
  • Научни интегритет захтева транспарентност, следљивост, интегритет података и људску одговорност.

Задатак апликације

Намерно произвести различите резултате у АИ сесији: молекулску тежину, референцу, физичку константу, безбедносну тврдњу, нумерички прорачун. Проверите сваки независно одговарајућим методом (погледајте табелу). Покушајте да ухватите бар једну халуцинацију. Затим припремите „матрицу валидације“: излазне редове, колоне (АИ вредност / независна вредност / да ли се преклапа / како сам то проверио). Како бисте известили ову сесију у смислу научног интегритета?

контролна листа

  • [ ] Разумем зашто су халуцинације неизбежне.
  • [ ] Ја класификујем сваки излаз према његовом типу и проверавам га одговарајућом методом.
  • [ ] Радим триангулацију (две независне путање) на критичним вредностима.
  • [ ] Верујем извору, а не безбедном језику.
  • [ ] Оно што се не може потврдити означавам као „неизвесно“.
  • [ ] Ја сам транспарентан у употреби вештачке интелигенције и сматрам се одговорним за исход.