Vahid 1 / 11

Kimyada Süni İntellektə Giriş: Rollar, Sərhədlər, Qiymətləndirmə və Etika

Qazanclar:

  • Süni intellektin kimya üzrə iş prosesində (ideya, dizayn, təhlil, hesabat) harada vaxta qənaət etdiyini və risk səviyyəsindən asılı olaraq struktur, say, resurs və təhlükəsizlik qərarlarının insanların ixtiyarına verildiyini ayırd edə bilmək.
  • Struktur-Nömrə-Resurs-Təhlükəsizliyin dörd addımı ilə hər bir çıxışı müstəqil şəkildə yoxlayan bir intizam tətbiq etmək bacarığı
  • Uydurma birləşmələrin və rəqəmlərin, yanlış istinadların və təhlükəsizlik səhvlərinin niyə bu peşə üçün risklər olduğunu anlayın və bu, əvvəldən nəzərə alınmalıdır.

Kimya maddənin quruluşunu, çevrilməsini və xassələrini öyrənən eksperimental elmdir. Laboratoriyada kimyaçı çəkir, həll edir, qızdırır və ölçür; İş masasında o, molekulları çəkir, reaksiyaları planlaşdırır, spektrləri şərh edir, ədəbiyyatı skan edir və hesabatlar yazır. Süni intellekt (qısaca süni intellekt, burada xüsusi olaraq böyük dil modelində, yəni kütləvi mətn məlumatlarında öyrədilmiş “növbəti ən çox ehtimal olunan sözü” proqnozlaşdırmaqla mətn yaradan proqram təminatı) bu stolüstü işlərin çoxunu dramatik şəkildə sürətləndirə bilər. Amma o, laboratoriyanı özü qurmur, tərəziləri oxumur və ən əsası: sizin adınıza istehsal etdiyi heç bir rəqəmi, düsturları və ya sitatı təsdiqləmir. Bu modul süni intellektdən kimyada sona qədər, lakin məsuliyyətlə necə istifadə etməyi öyrədir.

Bu ilk bölmədə mən sizin beyninizə bir fikir əkmək istəyirəm: AI kimya üzrə köməkçidir, kimyaçı deyil. Kod yazır, konturlar hazırlayır, retrosintez çərçivəsini qurur, spektrin zirvələrini şərh etməyə kömək edir, ədəbiyyatı ümumiləşdirir. Bununla belə, molekulun həqiqətən sintez oluna biləcəyinə, reaksiyanın təhlükəsiz olub-olmamasına, istinadın həqiqi olub-olmamasına və son məsuliyyətə qərar verən səlahiyyətli kimyaçıdır.

Süni intellekt kimya iş prosesinə harada uyğun gəlir?

Kimya layihəsini təqribən beş mərhələyə ayıraq: (1) ideya və ədəbiyyat, (2) molekul və reaksiya dizaynı, (3) laboratoriya tətbiqi, (4) təhlil və xarakteristikası, (5) hesabat. Süni intellekt bu mərhələlərdə çox fərqli dəyərlər daşıyır.

  • İdeyalar və ədəbiyyat: AI tez bir mövzunu ümumiləşdirir, əsas anlayışları izah edir, axtarış şərtlərini yaradır. Lakin o, atribusiya yarada bilər; Bunu bir azdan görəcəyik.
  • Dizayn: SMILES yaradır (molekulun mətn sətri kimi yazılması forması; bu barədə daha sonra), retrosintez addımlarını təklif edir, reaktiv alternativləri sadalayır. Təklif yaxşıdır, zəmanət deyil.
  • Laboratoriya: AI burada heç nə etmir. Çəki çəkmə, qızdırma və təhlükəsizlik tədbirləri insanlar tərəfindən həyata keçirilir. AI yalnız proseduru yazmağa kömək edir; Bu proseduru yerinə yetirməzdən əvvəl insan təhlükəsizlik üçün ona nəzarət etməlidir.
  • Təhlil: NMR, IR, kütlə spektrini şərh edərkən (bunlar molekulun quruluşunu göstərən ölçmə üsullarıdır), YZ zirvələri qruplaşdırmağa və mümkün strukturları sadalamağa kömək edir. Son tapşırıq sizindir.
  • Hesabat: Eksperimental dəftər, məqalə layihəsi, təhlükəsizlik forması layihəsi hazırlayır. Çox güclüdür; amma rəqəmlər sizinkinizə uyğun olmalıdır.
İpucu: Süni intellektdən istifadə etmək üçün ən təhlükəsiz yer "nəsə səhv olarsa, dərhal qeyd olunacaq və düzəldiləcək" sahələrindədir: qaralama mətn, kod skeleti, terminin təsviri. Ən riskli yerlər "yalan varsa, səssizcə yayılır" sahələridir: sabitlər, istinadlar, təhlükəsizlik təsdiqləri, ədədi nəticələr.

Niyə diqqətli olmalıyıq? Üç struktur riski

Böyük dil modeli kalkulyator və ya kimya mühərriki deyil. Statistik olaraq "ehtimal olunan" mətn hazırlayır. Bu, kimyada üç konkret riskə gətirib çıxarır:

  1. Uydurma (hallüsinasiya): Model olmayan birləşməni, mövcud olmayan reaksiyanı və ya yanlış molekulyar çəkisini əminliklə yaza bilir. Məsələn, "X birləşməsinin molekulyar çəkisi 154,2 q/mol", düzgün dəyər isə 168,2-dir.
  2. Saxta sitat: "Smith et al., 2019, Journal of Organic Chemistry" kimi real görünən, lakin ümumiyyətlə mövcud olmayan mənbə verə bilər. O, hətta DOI nömrəsi də yarada bilər.
  3. Təhlükəsizlik yanlışlığı: Reagentlərin təhlükəli birləşməsini (məsələn, oksidləşdirici və uyğun olmayan nisbətdə üzvi həlledici) "problem yoxdur" kimi təqdim edə bilər.

Bu üç risk bu modulun hər bir vahidində təkrar-təkrar görünəcək. Həll yolu AI-dən qaçmaq deyil, hər bir çıxışı müstəqil mənbə ilə yoxlamaq intizamını qurmaqdır.

mini hallar

1-ci hal – Uyğun molekulyar çəki. Bir aspirant AI-dən para-nitrofenolun molekulyar çəkisini soruşdu. "139,11 q/mol" dedi AI. Tələbə əmin idi və 0,05 mol üçün 6,96 q çəkməyi planlaşdırırdı. Bununla belə, para-nitrofenolun molekulyar çəkisi 139,11 q/mol-dur və bu dəfə bu düzgün idi – lakin tələbə heç vaxt yoxlamamışdı. Növbəti birləşmədə (para-aminofenol, faktiki dəyər 109,13 q/mol) YZ “123,15” dedi; Bu dəfə tələbə onu (C6H7NO2) düsturundan əl ilə hesablayaraq tutdu: 6×12,011 + 7×1,008 + 14,007 + 2×15,999 = 109,13. Dərs: düstur olmadan hər molekulyar çəki hesablayın.

Case 2 - Saxta DOI. Tədqiqatçı ədəbiyyat araşdırmasında süni intellektdən 5 mənbə istədi. Beşdən ikisinin DOI-si kliklədikdə "tapılmadı" olaraq döndü; Başlıqlar faktiki idi, amma məqalələr yox idi. 40 dəqiqə vaxt itkisi. Dərs: verilənlər bazasında (DOI, PubMed, Reaxys) yoxlanılmadan hər sitat istifadə edilməməlidir.

3-cü hal - Təhlükəsiz görünən təhlükə. Bir istifadəçi AI-dən təmizləmə proseduru haqqında soruşdu; Süni intellekt dolayı yolla hipoxlorit tərkibli məhlulun turşu məhlulu ilə qarışdırılması təklifini irəli sürdü - xlor qazını buraxa bilən birləşmə. Xoşbəxtlikdən istifadəçi təhlükəsizlik məlumat vərəqinə (SDS) baxdı və dayandı. Dərs: hər bir prosedur həyata keçirilməzdən əvvəl SDS və təhlükə baxımından insan tərəfindən yoxlanılır.

Zəif məlumat / Güclü göstəriş

Zəif çağırış:

Bu molekulu sintez edin.

Bu iddia qeyri-müəyyəndir: hansı molekul, hansı başlanğıc material, hansı miqyas, hansı məhdudiyyətlər? AI boşluqları düzəldir.

Güclü göstəriş:

Rol: Siz üzvi sintezdə təcrübəli köməkçisiniz. Hədəf molekul: 4-metoksiasetofenon (GÜLÜŞ: COc1ccc(cc1)C(C)=O). Başlanğıc material olaraq anizolumuz var. Tapşırıq: 2 addımlı retrosintez təklifi verin. Hər bir addım üçün: reagentlər, şərtlər (temperatur, həlledici) və MÜMKÜN yan reaksiyalar. Məhdudiyyət: Əmin olmadığınız yerdə "DOĞRULA" işarələyin, uyğundur. Çıxış: nömrələnmiş addımlar + yoxlanılacaq xalların siyahısı.

Fərq: rol, dəqiq hədəf (SMILES ilə), kontekst, addımların sayı, çıxış formatı və "uyğun" məhdudiyyət. Bunlar kimyada yaxşı təşviqin beş komponentidir: rol, dəqiq struktur təmsili, kontekst, tapşırıq, yoxlama məhdudiyyəti.

AI alətlərinin növləri: dil modeli və ya kimya aləti?

Kimyada iki fərqli "AI" ilə qarşılaşırsınız və onları qarışdırmamaq vacibdir:

Janr

Nə edir

etibarlılıq

İstifadə nümunəsi

Ümumi dil modeli

Mətn/kod yaradır, izah edir, qaralamalar yazır

Rəqəmlər az, dil yüksəkdir

Prosedurun təsviri, terminologiyanın izahı

Kimya kitabxanası (RDKit və s.)

Molekulanı deterministik şəkildə emal edir, molekulyar çəkisini hesablayır

Yüksək (qayda əsaslı)

SMILES doğrulaması, MA hesabı

Fərdi proqnoz modeli (retrosintez, xüsusiyyət)

Məlumatlarla öyrədilmiş proqnoz verir

Ərazidən asılı olaraq orta

Retrosintez, həllolma qabiliyyətinin qiymətləndirilməsi

Ədəbiyyat/axtarış vasitəsi

Real verilənlər bazası sorğuları

Mənbədən asılı olaraq yüksək

Atributun təsdiqi, reaksiya axtarışı

Ən möhkəm iş axını bunları birləşdirir: dil modeli ideyanı yaradır, kimya kitabxanası rəqəmi deterministik şəkildə hesablayır, ədəbiyyat aləti atribusiyanı yoxlayır, insan təsdiqləyir. Növbəti bölmələrdə bu zənciri quracağıq.

Doğrulama intizamı: DÖRD addım

Hər bir AI çıxışını laboratoriyaya və ya hesabata daxil etməzdən əvvəl bu dörd addımdan keçin:

  1. Struktur: Molekul/reaksiya qeydi (SMILES/InChI) etibarlıdırmı? Bir alət (RDKit) ilə təhlil edilə bilərmi?
  2. Sayı: Molekulyar çəki, stokiometriya, məhsuldarlığın hesablanması müstəqil olaraq (əl və ya kitabxana ilə) yoxlanılıbmı?
  3. Mənbə: Hər bir iddia və atribut real verilənlər bazasında yoxlanılıbmı?
  4. Təhlükəsizlik: Prosedurda hər bir reagent üçün SDS oxunubmu, təhlükəli birləşmələr varmı?
Qeyd: Bu dörd addım "bəzən" deyil, "həmişə" tətbiq olunur. AI-nin düzgün olduğu 20 vəziyyət onun səhv olduğu 1 vəziyyətə bəraət qazandırmır; çünki kimyada o 1 vəziyyət partlayış, zəhərlənmə və ya geri çəkilmiş məqalə ola bilər.

Ümumi səhvlər

  • AI çıxışını “resurs” kimi qəbul etmək. AI resurs deyil, resursları yadda saxlamağa çalışan generatordur (bəzən səhvdir). Mənbə verilənlər bazasıdır.
  • Nömrəyə güvənmək. Molekulyar çəki, pKa, qaynama nöqtəsi kimi rəqəmləri yoxlamadan istifadə etmək. Bunlar deterministik şəkildə hesablana/axtarıla bilər; Dil modelini soruşmaq ən zəif yoldur.
  • Təhlükəsizliyin süni intellektə həvalə edilməsi. "AI təhlükəli olduğunu demədi" onun təhlükəsiz olduğunu bildirmir. Təhlükənin qiymətləndirilməsi insanın və SDS-nin işidir.
  • Qeyri-müəyyən xəbərdarlıq. Molekulun adı ilə deyil, quruluşu ilə (SMILES/InChI); Bu, ad qarışıqlığı səbəbindən yanlış molekullara gətirib çıxarır.
  • Yalnız bir cəhdə güvənmək. Eyni sualı yenidən fərqli şəkildə vermək və ardıcıllığı yoxlamaq.

Xülasə

  • Süni intellekt kimya üzrə güclü stolüstü köməkçidir: kod, konturlar, təsvirlər, skan skeletləri istehsal edir; lakin laboratoriya bunu etmir və onun çıxışını yoxlamır.
  • Üç xas risk var: saxta birləşmə/nömrə, saxta atribut, təhlükəsizlik yanlışlığı.
  • Ümumi dil modeli və deterministik kimya alətlərini (RDKit, verilənlər bazası) ayırın və birləşdirin.
  • Hər bir çıxışı Struktur-Nömrə-Mənbə-Təhlükəsizliyin dörd addımından keçirin.
  • Yaxşı məlumat: rol, açıq struktur təmsili, kontekst, tapşırıq, doğrulama məhdudiyyəti daxildir.

Tətbiq tapşırığı

Özünüz öyrəndiyiniz molekulu seçin (məsələn, aspirin, SMILES: CC(=O)Oc1ccccc1C(=O)O). AI-dən üç şeyi soruşun: (1) molekulyar çəki, (2) iki istinad sənədi, (3) sintez mərhələsi. Sonra hər birini müstəqil olaraq yoxlayın: düsturdan molekulyar çəkiyi əl ilə hesablayın, sitatları DOI ilə təsdiqləyin, təhlükəsizlik gözü ilə sintez addımını yoxlayın. Hansı çıxış düzgün çıxdı və hansı düzəliş tələb etdi? Yarım səhifəlik “doğrulama jurnalı” saxlayın.

yoxlama siyahısı

  • [ ] Mən başa düşdüm ki, AI kimyaçı deyil, köməkçidir.
  • [ ] Mən misallarla uydurma, yalan atribut və inamsızlığın risklərini tanıyıram.
  • [ ] Mən dil modeli və deterministik kimya vasitələrini ayırd edə bilirəm.
  • [ ] Mən hər bir çıxışa Struktur–Nömrə–Mənbə–Təhlükəsizlik dörd addımını tətbiq edəcəyəm.
  • [ ] Mən molekulları adlarına görə deyil, struktur notasiyasına (SMILES/InChI) görə təsvir edirəm.
  • [ ] Ən azı bir yoxlama jurnalı saxladım.