единици
1. Въведение в изкуствения интелект в химията: роли, граници, валидиране и етика 2. Молекулярно представяне и химическа структура: Валидиране със SMILES, InChI и RDKit 3. Прогноза за реакцията и механизъм: Прогноза за продукт, състояние и нежелана реакция 4. Поддръжка на спектрална интерпретация: NMR, IR и мас спектрометрия 5. Преглед на литературата и планиране на синтез: източник, процедура и пътна карта 6. Анализ на химически данни и Python: pandas, стехиометрия и калибриране 7. Прогноза за молекулярни свойства и QSAR: разделителна способност, pKa и граници на модела 8. Лабораторна документация: Тетрадка за експерименти, ELN и възпроизводимост 9. Оценка на безопасността и опасността: GHS, SDS и границите на изкуствения интелект 10. Потвърждение, халюцинация и научна почтеност 11. Човекът в експеримента: етика, поверителност, отговорност и работен процес от край до край
единица 5 / 11

Преглед на литературата и планиране на синтез: източник, процедура и пътна карта

Печалби:

  • Способност за позициониране на изкуствения интелект като опасен инструмент в производството на мощни, конкретни цитати в концепции, резюмета и стратегия за търсене
  • Възможност за премахване на риска от фалшиви източници чрез проверка на всеки цитат и DOI в базата данни
  • Възможност за установяване на защитен работен процес, в който хората намират истинската статия и обобщават текста към изкуствения интелект

Преглед на литературата и планиране на синтез: Източник, процедура и пътна карта с AI

Всеки проект по химия започва с преглед на литературата: "Това съединение правено ли е преди? По какъв метод? С какъв добив?" AI е страхотен ускорител на този етап; обобщава темата, обяснява ключови понятия, генерира термини за търсене, очертава процедури. Но това е и източникът на най-опасната грешка в химията: фалшивото приписване. AI може да създава статии, автори и DOI, които изглеждат реалистични, но изобщо не съществуват. В тази част ще се научим да използваме AI в планирането на литературата и синтеза, но без да изоставяме дисциплината на цитирането.

Защо дисциплината на цитиране е критична?

Езиковият модел произвежда текст; не прави запитвания към базата данни (освен ако не е посочено друго). „Journal of Organic Chemistry, 2018, 83, 4521, Zhang et al.“ Ресурс на формуляра е просто „набор от думи и числа, които изглеждат възможни“ за модела. Този източник може или не може да бъде реален; моделът не прави разлика между двете. Следователно нито един цитат, даден от YZ, не се използва, без да е потвърден в база данни (DOI анализатор, PubMed, Crossref, сайт на издателя).

Внимание: Само защото AI дава DOI не означава, че този DOI е валиден. Разрешете DOI чрез https://doi.org/; Ако не води до статия, този източник не съществува, дори ако заглавието и авторът изглеждат автентични.

Къде AI е силен и слаб в литературата

  • Мощен: Обясняване на концепция, очертаване на клас реакции, генериране на ключови думи за търсене, очертаване на общите стъпки на процедура, обобщаване на текста на статия (когато я поставите).
  • Слаб: Даване „по памет“ за съществуването на конкретна статия, точна информация за страница/том/DOI, точна стойност на добива. Това са областите, които са най-отворени за производство.

Това разграничение поражда следната стратегия: използвайте AI като инструмент за обработка на текст (обобщаване, класификация), а не като източник на истина. Вие намирате истинската статия, карате AI да я прочете и да я обобщи.

Стъпка по стъпка: безопасна литература + поток на планиране

  1. Научете концепцията: Накарайте AI да обясни темата, класа на реакция, термините. Тук рискът от фабрикуване е нисък.
  2. Генериране на дума за търсене: Помолете AI за 8-10 ключови думи/синоними и възможни списания; Търсете в истинската база данни с тези.
  3. Вземете истинската статия: Намерете статията сами от PubChem/Reaxys/Google Scholar.
  4. Обобщение: Поставете текста на статията в AI и направете структурирано резюме (метод, състояние, добив, ограничение).
  5. Направете план: Създайте обобщена пътна карта за цел; свържете всяко стъпало към действителния източник.
  6. Проверка: Разрешете всеки цитат с DOI; Сравнете всяко критично число с изходния текст.

Четири копируеми шаблона

1) Концепция + генериране на дума за търсене (безопасна зона):

Тема: Установяване на арил-арилна връзка чрез реакция на свързване на Suzuki-Miyaura. Задача: 1) Обяснете реакцията в 5 изречения (дефинирайте термини). 2) Генерирайте 10 ключови думи/синонима за търсене в литература. 3) Препоръчайте 5 списания, където тази тема се публикува често. Правило: НЕ ДАВАЙТЕ конкретна статия/DOI; Ще ги потърся в базата данни.

2) Резюме на статията (вие предоставяте текста):

По-долу поставям експерименталната част на статия.[ТЕКСТ]Задача: Обобщете със следните заглавия:- Целево съединение и неговото значение- Използван метод/реагенти- Условия (температура, време, разтворител)- Добив- Посочени ограничения Не добавяйте никакви числа НЕ в текста; в противен случай напишете "неопределено".

3) Пътна карта за синтез (в зависимост от източника):

Цел: 2-фенилбензимидазол (УСМИВКИ: c1ccc(cc1)c1nc2ccccc2[nH]1). Задача: Дайте чернова на двуетапен план за синтез. За всяка стъпка: реактиви, състояние, метод на пречистване. Правило: За всяка стъпка добавете информация за „типична справка за този тип реакция с коя ключова дума да търсите“; НАПРАВИ ФАЛШИВ.

4) Контролен списък за потвърждение на цитиране:

По-долу има 4 препратки. Създайте контролен списък за проверка на фактите за всяко: кои полета (DOI, списание, том, година, автор) трябва да проверя и къде?[CITATIONS]Забележка: Вие НЕ твърдите, че цитатите са верни; Просто ми кажете стъпка по стъпка как да потвърдя.

Слаба подкана / Силна подкана

Слаб:

Дайте ми 5 източника за синтеза на това съединение.

AI вероятно произвежда реалистични, но непроверени приписвания, някои от които са измислени.

Силен:

Тема: Синтез на съединение I ще намери истинските източници от базата данни; Вие укрепвате стратегията ми за търсене.

Разликата: Насочихме AI към работа, в която е силен (стратегия за търсене, концепция) и го държахме далеч от работа, която е склонна към фабрикуване (конкретно приписване).

Видове източници и надеждност

Източник/инструмент

Какво осигурява

надеждност

Роля

AI (езиков модел) от паметта

Концепция, схема, идея за търсене

Високо ниво на концепция, ниско ниво на референция

идея/резюме

AI + поставен текст

Резюме на дадения текст

Високо (зависи от текста)

обобщаване

Анализатор на DOI (doi.org)

Автентичност на приписването

високо

Потвърждение

PubChem / Reaxys / SciFinder

съединение, реакция, източник

високо

първично търсене

Google Scholar / Crossref

Намиране на статия, цитиране

високо

проверка

мини калъфи

Случай 1 — Три изфабрикувани източника. Изследовател поиска от AI 6 източника по дадена тема. Когато реши DOI един по един, 3 от тях бяха невалидни; Заглавията бяха убедителни, но не и статиите. Проверката отне 25 минути, но предотврати навлизането на 3 фалшиви цитата в статията. Урок: всяка справка се решава една по една.

Случай 2 — Фалшив добив. „Ефективността е 92%“, каза AI, когато очертава процедура. Когато потребителят намери и разгледа оригиналната статия, добивът беше 64%; AI беше измислил числото по памет. Урок: сравнете критичните числа с изходния текст, не се доверявайте на резюмето на AI.

Случай 3 — Стойност в концепцията, риск в справката. Студент накара AI да обясни клас по реакция; Обяснението беше точно и поучително. След това „топ 3 статии?“ каза той; Две от тях бяха измислици. AI беше едновременно много полезен и опасен в една и съща сесия. Поука: едно и също превозно средство показва различна надеждност при различни задачи; Доверете се според задълженията си.

Често срещани грешки

  • Използване на препратки без потвърждение. Най-честата и най-сериозна грешка; може да доведе до оттегляне на статията.
  • Получаване на номера на добива/условието от резюмето. Резюмето на AI понякога отразява „възможната стойност“, а не източника; сравни с оригинала.
  • Грешка AI за търсачка. Освен ако не е посочено друго, езиковият модел не отправя заявки към живата база данни; произвежда от паметта.
  • Търсене на един език. Простото изоставяне на ключови термини от турски/английски означава липса на ресурси; AI помага при генерирането на синоними.
  • Объркващо понятие с източник. Фактът, че AI обяснява правилната концепция, не означава, че препратката, която дава, е правилна.
Съвет: Най-стабилният работен процес е „първо човекът намира, а след това AI обобщава“. Донасяте истинската статия и карате AI да прочете текста. Така че вие ​​използвате силата на AI (обобщаване) и деактивирате неговата слабост (напасване на източника).

В обобщение

  • AI е опасен при създаването на силни, конкретни цитати в концепции, резюмета и стратегии за търсене в литературата.
  • Фалшивото цитиране (измислена статия/DOI) е най-сериозният риск от ИИ в химията; Всяка референция се потвърждава.
  • Най-безопасният поток: човек намира истинската статия, AI обобщава текста.
  • Вземете критични числа, като добив и състояние, от изходния текст, а не от резюмето.
  • Свържете всяка стъпка в плана за синтез с реален източник.

Задача за приложение

Изберете целево съединение. Първо, поискайте от AI само термини за търсене и концептуално резюме (без да искате конкретно приписване). Намерете поне две статии в реална база данни с тези условия. Обобщете текстовете на статиите към AI и сравнете номерата на добива/състоянието с оригинала. Отделно, нарочно попитайте AI за „5 източника“ и дешифрирайте DOI, които дава един по един: колко са били реални? Напишете „доклад за проверка на цитиране“ от една страница.

контролен списък

  • [ ] Позиционирам AI като концепция/инструмент за обобщение, а не търсачка.
  • [ ] Когато искам конкретно цитиране, декодирам всеки DOI от doi.org.
  • [ ] Сравнявам числата за добив/състояние с оригиналния източник.
  • [ ] Намирам истинската статия и карам AI да обобщи текста.
  • [ ] Приписвам всяка стъпка в плана за синтез на източник.
  • [ ] Подготвих поне един доклад за проверка на цитиране.