Vahid 10 / 11

Təsdiq, Halüsinasiya və Elmi Dürüstlük

Qazanclar:

  • Halüsinasiyanın dil modelinə xas olduğunu başa düşmək və hər bir çıxış növü üçün müvafiq yoxlama metodunu seçmək bacarığı.
  • Trianqulyasiya ilə kritik dəyərləri iki müstəqil şəkildə yoxlayın və rəvanlığı dəqiqliklə qarışdırmayın
  • Elmi dürüstlüyün əsası kimi şəffaflığı, izlənilə bilənliyi, məlumat bütövlüyünü və insan məsuliyyətini tətbiq etmək bacarığı

Bu modul boyunca təkrar-təkrar təkrarlanan tək bir ifadə: "AI istehsal edir, insanlar yoxlayır." Bu vahiddə həmin cümləni sistemə çeviririk. Məqsəd süni intellektin ən təhlükəli davranışı olan halüsinasiyanı (etibarlı dillə yalan/uydurma məlumat yaratmaq) tanımaq, hər bir çıxış növü üçün konkret yoxlama metodu yaratmaq və bütün bunları elmi dürüstlük (dürüstlük, şəffaflıq, izlənilmək) çərçivəsində yerləşdirməkdir. Kimyada təsdiqlənməmiş AI çıxışı sadəcə səhv deyil; Bu, eksperimentin partlaması, bir insanın zəhərlənməsi və ya kağızın geri çəkilməsi ola bilər.

Niyə halüsinasiyalar qaçılmazdır?

Böyük dil modeli “növbəti ən çox ehtimal olunan sözü” istehsal edir; O, doğru olanı deyil, mümkün olanı hədəfləyir. Beləliklə, o, molekulyar çəki, DOI və ya qaynama nöqtəsini həqiqi olub-olmadığını yoxlamadan "məqbul görünən" bir dəyərlə doldura bilər. Halüsinasiya nasazlıq deyil, bu texnologiyanın təbiətinin nəticəsidir. Çözüm modeli "düzəltməyə çalışmaq" deyil, hər bir çıxış ətrafında doğrulama qabığı qurmaqdır.

Halüsinasiyanın ən məkrli tərəfi onun inamlı dilidir. Səhv bir molekulyar çəki, düzgün olanla eyni inamla təqdim olunur. Beləliklə, "inamlı görünür" heç vaxt "düzgün" demək deyil.

Diqqət: Süni intellektin bir mövzuda nə qədər səlis və inamlı danışması həmin məlumatın dəqiqliyi ilə əlaqəli deyil. Səlislik inandırır; Dəqiqliyi yalnız müstəqil mənbə müəyyən edir.

Kimyada çıxış növünə görə doğrulama

Hər bir çıxış növünün öz yoxlama metodu var. Bir qaydanı yadda saxlamaq əvəzinə, nəticə üçün müvafiq alətdən istifadə edin:

Çıxış növü

Doğrulama üsulu

nəqliyyat vasitəsi

Molekulyar çəki, formula

Formuladan yenidən hesablayın

RDKit / əl ilə

SMILES/struktur

Parse + kanonikləşdirin

RDKit

Sitat/DOI

Verilənlər bazasında həll edin

doi.org, Crossref

Fiziki sabit (kn, pKa)

İstinad bazası

PubChem, dərslik

ədədi hesablama

Yaz+çalış kodu

Python

reaksiya/şərt

Ədəbiyyatın təsdiqi

Reaxys, məqalə

təhlükəsizlik iddiası

SDS/GHS

Rəsmi SDS

Spektr təyinatı

Çox texniki + insan

Eksperimental spektr

Bu cədvəl əslində bu modulun xülasəsidir: hər bir vahid bir sıradır.

Triangulyasiya: üç müstəqil yol

Ən güclü yoxlama texnikası "üçbucaqlama"dır: eyni nəticəyə üç müstəqil şəkildə gəlmək. Məsələn, molekulyar çəki üçün: (1) YZ nə deyir, (2) RDKit hesablaması, (3) düsturdan əl ilə hesablama. Əgər üçü üst-üstə düşürsə, inam yüksəkdir; Əgər kimsə yoldan çıxırsa, dayan və araşdır. Kimyada heç vaxt tək mənbəyə etibar etməyin; Ən azı iki müstəqil yol axtarın.

Addım-addım: iş axınının yoxlanılması

  1. Nəticəni təsnif edin: Bu rəqəm, struktur, atribusiya, təhlükəsizlik təsdiqidirmi?
  2. Müvafiq aləti seçin: Yuxarıdakı cədvəldən çıxış növü üçün uyğun yoxlama yolunu əldə edin.
  3. Müstəqil olaraq hesablayın/axtarın: Nəqliyyat vasitəsini AI-dən asılı olmayaraq idarə edin; nəticəni müqayisə edin.
  4. Bir sapma varsa, dayandırın: Dəyərlər uyğun gəlmirsə, hansının düzgün olduğunu araşdırmadan davam etməyin.
  5. İzinizi buraxın: Nəyi və necə yoxladığınızı qeyd edin (elmi dürüstlük).
  6. Qeyri-müəyyənliyi göstərin: Təsdiq edilə bilməyən bir şeyi "təsdiqlənməmiş" kimi qeyd edin, onu gizlətməyin.

Dörd kopyalana bilən şablon

1) Özünü yoxlama:

Siz sadəcə olaraq aşağıdakı çıxışı verdiniz: [OUTPUT]. Tapşırıq: Bu çıxışın hər bir ədədi/faktik təsdiqini ayrıca sətirdə qeyd edin. Hər bir iddia üçün: "onu müstəqil olaraq necə yoxlamaq olar?" yazma metodu (hansı alət/verilənlər bazası). İddianın doğru olduğunu İDDİA ETMƏYİN; yalnız onu yoxlamaq üçün bir yol verin.

2) Üçbucaqlılığa nəzarət:

Aşağıdakı molekulun çəkisini üç yolla yoxlamaq istəyirəm: [GÜLÜMƏLƏR].Tapşırıq: 1) Molekulyar düstur çıxarın.2) Molekulyar çəki hesablama atomunu atom üzrə göstərin (hər bir elementin töhfəsi).Qeyd: Mən də RDKit-də hesablayacağam və üçüncü olaraq verdiyiniz molekulla müqayisə edəcəyəm. Əgər üçü üst-üstə düşmürsə, xəbərdarlıq edin.

3) Qeyri-müəyyənlik işarəsi:

Aşağıdakı mətndə çoxlu faktiki iddialar var:[TEXT]Tapşırıq: Hər bir iddianın yanında etimad səviyyəsi etiketi qoyun:[DOĞRULANIB] / [YONAQLANIB] / [QEYRİYYƏTLİ].Əmin deyilsinizsə, heç nəyi [Yoxlanılıb] qeyd etməyin.

4) Ardıcıllıq çarpaz sorğu:

Eyni sualı iki fərqli şəkildə verəcəm; Cavablarınızın uyğun olub olmadığına baxın. Sual A: Birləşmənin molekulyar formulu nədir?

Zəif məlumat / Güclü göstəriş

Zəif:

Bu birləşmə haqqında bildiyiniz hər şeyi yazın.

Süni intellekt yoxlanıla bilən və uydurulmuş məlumatları fərq qoymadan qarışdırır; Hansının real olduğu bəlli deyil.

Güclü:

Bu birləşmə haqqında məlumat verin, lakin hər bir iddianı aşağıdakı kimi etiketləyin:[QƏRƏRÇİ - alətlə yoxlanılır] məs. molekulyar formula,[EKSPERİMENTAL - sitat lazımdır] məs. ərimə nöqtəsi,[QEYDİ - əmin deyiləm]. Heç bir etiketsiz iddia yazmayın.

Fərq: AI-ni öz qeyri-müəyyənliyini qeyd etməyə məcbur etdik; Biz yoxlama işini planlı etdik.

Elmi dürüstlük: dürüstlük və izlənilə bilənlik

Doğrulama sadəcə texniki addım deyil, etik məsələdir. Elmi dürüstlük tələb edir:

  • Şəffaflıq: Süni intellektdən istifadə etdiyinizi gizlətməyin; Nəşr/hesabat siyasətinizə uyğun olaraq qeyd edin.
  • İzləmə: Süni intellektdən hansı çıxışın gəldiyini və onun necə yoxlanıldığını qeyd edin.
  • Məlumatların bütövlüyü: Süni intellekt ilə nəticələri “gözəlləşdirmək”, əsaslandırmadan kənar göstəriciləri silmək saxtakarlıqdır.
  • Məsuliyyət: Siz son nəticəyə görə məsuliyyət daşıyırsınız; "AI belə dedi" bəhanə deyil.
İpucu: Əvvəldən qəbul edin ki, hesabatda və ya müdafiədə heç vaxt “AI belə dedi” ifadəsini işlədə bilməyəcəksiniz. Bu qəbul avtomatik olaraq hər bir çıxışı yoxlamaq vərdişini gətirir.

mini hallar

1-ci hal - Üçbucaqlaşdırma xətasını tutdu. Şagird molekulyar çəkisini üç yolla yoxladı: YZ dedi ki, 178,2, əllə hesablama 180,16, RDKit 180,16 verdi. İki müstəqil yol üst-üstə düşdü və AI-ni aradan qaldırdı. Dərs: iki müstəqil yoxlama səssizcə bir yalançı çıxışı məğlub edir.

Case 2 - Təhlükəsiz dil, yanlış məlumat. Süni intellekt çox əminliklə yazdı ki, reaksiya “otaq temperaturunda kortəbii şəkildə gedir”. Ədəbiyyat bunun isitmə və katalizator tələb etdiyini göstərdi. Tələbə təhlükəsiz dilə deyil, mənbəyə inanırdı. Dərs: səlislik dəqiqlik deyil.

Case 3 – Şəffaflıq əldə edildi. Məqaləsinin metod bölməsində bir tədqiqatçı AI-dan hansı addımlarda istifadə etdiyini (mətn redaktəsi, kod tərtibatı) açıq şəkildə ifadə etdi və bütün rəqəmsal nəticələri müstəqil şəkildə yoxladığını yazdı. Hakim prosesi rahat keçdi. Dərs: şəffaflıq inam yaradır, gizlətmək risk yaradır.

Ümumi səhvlər

  • Təhlükəsiz dilə güvənmək. Süni intellektin inamlı tonu dəqiqliyin göstəricisi deyil.
  • Tək mənbəyə arxalanaraq. Trianqulyasiya olmadan tək çıxışın qəbul edilməsi.
  • Çıxış növünü ayırmamaq. Nömrəni, atribusiyanı və təhlükəsizlik təsdiqini eyni üsulla "yoxladığımı" düşünərək.
  • Qeyri-müəyyənliyi gizlətmək. Yoxlanılması mümkün olmayan bir şeyin sanki əmin olduğu kimi bildirilməsi.
  • Süni intellektdən istifadənin gizlədilməsi. Şəffaflığın olmaması elmi dürüstlüyə xələl gətirir.
  • Məsuliyyəti həvalə etmək. "AI belə dedi" bəhanəsi etibarsızdır; Məsuliyyət insanın üzərinə düşür.

Xülasə

  • Halüsinasiya dil modelinə xasdır; Həll yolu hər bir çıxış ətrafında doğrulama qabığı qurmaqdır.
  • Hər bir çıxış növü öz yoxlama metoduna malikdir; çıxışı təsnif edin və müvafiq alətdən istifadə edin.
  • Trianqulyasiya (iki müstəqil yol) ən güclü nəzarətdir; Bir mənbəyə etibar etməyin.
  • Səlis və özünə inamlı dil dəqiqliklə əlaqəli deyil.
  • Elmi dürüstlük şəffaflıq, izlənilə bilənlik, məlumatların bütövlüyü və insan məsuliyyətini tələb edir.

Tətbiq tapşırığı

AI sessiyasında qəsdən müxtəlif nəticələr çıxarın: molekulyar çəki, istinad, fiziki sabit, təhlükəsizlik iddiası, ədədi hesablama. Hər birini müstəqil olaraq düzgün metodla yoxlayın (cədvələ bax). Ən azı bir halüsinasiya tutmağa çalışın. Sonra "təsdiqləmə matrisi" hazırlayın: sıra çıxışları, sütunlar (AI dəyəri / müstəqil dəyər / üst-üstə düşdü / necə yoxladım). Elmi dürüstlük baxımından bu sessiyanı necə hesabat edərdiniz?

yoxlama siyahısı

  • [ ] Halüsinasiyanın niyə qaçınılmaz olduğunu başa düşürəm.
  • [ ] Mən hər bir çıxışı növünə görə təsnif edirəm və müvafiq metodla yoxlayıram.
  • [ ] Mən kritik dəyərlər üzərində üçbucaqlaşdırma (iki müstəqil yol) edirəm.
  • [ ] Mən təhlükəsiz dilə yox, mənbəyə etibar edirəm.
  • [ ] Təsdiq edilə bilməyənləri "qeyri-müəyyən" olaraq qeyd edirəm.
  • [ ] Mən süni intellektdən istifadə etməkdə şəffafam və nəticəyə görə özümü məsuliyyət daşıyıram.