Qazanclar:
- Süni intellektin riyaziyyatda niyə səhvlər etdiyini (dil modeli olmaq, məntiqi yoxlamaq deyil) və yeddi əsas səhv növünü anlaya bilmək
- Riyaziyyatda səhvin yayıldığını və dəqiqliyin ikili olduğunu başa düşərək hər bir addımı yoxlamağın nə üçün vacib olduğunu izah etmək bacarığı.
- Sağlam düşüncə testi, böyüklüyün yoxlanılması qaydası, yoxlama məbləğləri, çarpaz yoxlama və müstəqil üsullar vasitəsilə çox səviyyəli yoxlama intizamını tətbiq etmək bacarığı
Bu bölmə modulun mərkəzində olan fikri dərinləşdirir: süni intellekt riyaziyyatda niyə və necə səhv edir, bu səhvlərin növləri hansılardır və biz onları sistematik şəkildə necə tuta bilərik? Əvvəlki bölmələrdə biz hər bir mövzu üçün yoxlama üsullarını görmüşük; Burada səhvlərin anatomiyasını bir dam altında toplayırıq. Məsələ burasındadır ki, bir AI çıxışına baxdığınız zaman "burada nə səhv ola bilər?" Bu, refleksiv şəkildə düşünən bir təsdiq zehniyyəti qazanmaqdır.
Xatırlatma: Halüsinasiya süni intellektin əslində doğru olmayan məlumatları inamla istehsal etməsidir. Riyaziyyatda hallüsinasiya tez-tez "inandırıcı, lakin yalan" şəklində görünür. AI niyə səhv edir? Çünki o, məntiq mühərriki deyil, dil modelidir — yəni statistik nümunələrlə mətn yaradır, addımların məntiqi etibarlılığını yoxlayır. "3-rəqəmli vurma" və "etibarlı sübut" onun üçün eyni növ mətn yaratmaq vəzifəsidir; Dəqiqliyə zəmanət verən daxili mexanizm yoxdur.
Riyazi səhvlərin anatomiyası: yeddi növ
Aşağıdakı növlərin siyahısı AI çıxışında qarşılaşacağınız ən ümumi səhvləri və hər biri üçün antidotları ümumiləşdirir.
Səhv növü
Nə kimi görünür
antidot
arifmetik xəta
7×8=54 kimi nömrə xətası
Kalkulyator/SymPy
işarə xətası
−(a−b)=−a−b
Mənim adımı əl ilə açın
Uydurulmuş teorem
mövcud olmayan teorem adı
Mənbədən təsdiq
Qaydanın yanlış tətbiqi
Zəncir qaydasını unutma
"Hansı qayda?" sual
Atlanmış status
Mənfi kökə əhəmiyyət verməyin
Bütün statusları sadalayın
sübut boşluğu
"Buna görə" heç bir əsas olmadan
Hər keçiddə sorğu-sual
Köhnə/yanlış məlumatlar
köhnəlmiş məlumatlar
qaynaq
Niyə riyaziyyat xüsusi diqqət tələb edir?
Əksər sahələrdə kiçik bir səhvin kiçik nəticəsi olur. Riyaziyyatda səhvlər yayılır və böyüyür. Tənliyin birinci sətirindəki işarə xətası sonrakı on sətiri və yekun nəticəni tamamilə səhv edir. Sübutun ortasındakı boşluq bütün sübutu etibarsız edir. Bu “kövrəklik” riyaziyyatda hər bir addımı yoxlamağı zəruri edir – “ümumiyyətlə danışmaq doğru görünür” kifayət deyil.
Üstəlik, riyaziyyatda həqiqət binardır: nəticə ya doğrudur, ya da yanlışdır, bunların arasında heç bir şey yoxdur. Mətnin xülasəsində “səksən faiz dəqiqlik” məqbul sayıla bilər; İnteqralda "səksən faiz düzgün" deyə bir şey yoxdur - ya düzgün nəticədir, ya da deyil. Bu ikili təbiət yoxlamanı həm daha kritik, həm də (xoşbəxtlikdən) daha mümkün edir: nəticə ya yoxlamadan keçir, ya da keçmir.
Addım-addım: sistemli yoxlama intizamı
1. Hər bir ədədi nəticəni alətlə təsdiq edin. Süni intellektə etibar etmək üçün hesabdan heç vaxt ayrılmayın; SymPy, kalkulyator və ya əl ilə.
2. Hər simvolik nəticəni SymPy ilə yoxlayın. İnteqral, törəmə, sadələşdirmə, tənlik - hamısını SymPy ilə yoxlamaq olar.
3. Hər bir teoremi/düsturu mənbədən təsdiq edin. Ad və ifadə düzgündürmü? Uydurulmuş teoremlər ən məkrli tələdir.
4. Hər bir sübutda hər hadisəni sorğu-sual edin. "Bu, həqiqətən əvvəlki addımdan irəli gəlirmi?" Baza hal, gizli fərziyyə, boşluq yoxlaması.
5. Yoxlayın və əks yoxlayın. Tərs əməliyyat, əvəzetmə, limit halları, ölçülü analiz.
6. Bunu sağlam düşüncə sınağına qoyun. Nəticə ağlabatandırmı? Əgər ehtimal 1-dən böyükdürsə, uzunluq mənfi olarsa, xəta var.
İpucu: Ən sürətli sağlam düşüncə testi "böyüklük sırası" yoxlamasıdır. Nəticə təxminən gözlənilən diapazondadırmı? Sinif ortalaması 250 (100-dən) və ya ehtimal 3.5 olarsa, detallara baxmadan səhvin olduğunu biləcəksiniz. Bu 5 saniyəlik yoxlama qönçədə çoxlu gülünc nəticələri aradan qaldırır.
üç mini qutu
Hal 1 - Zəncir işarəsi xətası. Bir tələbə tapdı ki, 8 sətirli cəbri sadələşdirmədə 2-ci sətirdə AI-nin etdiyi işarə xətası növbəti 6 sətirə yayılır. Yekun nəticə tamamilə səhv idi, lakin AI onu tam əminliklə təqdim etdi. Tələbə onu SymPy ilə sıfırdan sadələşdirdikdə düzgün nəticə əldə edildi və AI-yə 2-ci sətirdəki səhvi tapmağa imkan verdi. Tək bir işarə 6 sətri təkzib etdi.
Case 2 - Sağlam düşüncə testi xilas etdi. Müəllimin süni intellektlə ehtimal problemini həll etməsi var idi; Nəticə 1,4 oldu. Təfərrüatlara baxmadan müəllim "ehtimal 1-dən çox ola bilməz" dedi və səhvi axtardı: AI diskret olmayan hadisələri sanki diskret kimi toplamışdı. Sağlam düşüncə testi səhvi saniyələr ərzində göstərdi.
3-cü vəziyyət - Uydurma düstur. Mühəndis süni intellektdən ardıcıl məbləğ üçün "qapalı düstur" istədi. AI inandırıcı bir formula verdi. Mühəndis düsturu həm düsturla, həm də əl ilə əlavə etməklə kiçik n (n=3) dəyəri üçün sınaqdan keçirdi; Nəticələr uyğun gəlmədi. Formula düzəldilmişdir. Bir az düzəliş saatlarla sui-istifadənin qarşısını aldı.
Dörd kopyalana bilən şablon
1) Çox qatlı doğrulama sorğusu:
Tapdınız: [nəticə]. İndi bu ÜÇ fərqli yolla yoxlayın: (1) onu tərsinə çevirmək, (2) sadə fərdi dəyəri sınamaq, (3) SymPy ilə yoxlamaq üçün bəzi kod (çıxışı görəcəyəm). Hər üç yolun ardıcıl olub olmadığını deyin; Əgər yoxsa, hansı addımda xətanın olduğunu göstərin.
2) Sağlam düşüncə/rütbə testi:
Tapdınız: [nəticə]. Bu nəticənin MÜQAVİLLİ olub-olmadığını görmək üçün onu sağlam düşüncə sınağına qoyun: gözlənilən miqyas sırası nədir, işarə düzgündürmü, limitlər daxilindədirmi (məsələn, ehtimal 0-1)? Ağlabatan deyilsə, harada səhv ola biləcəyini araşdırın.
3) Teorem/düsturun təsdiqi:
İstifadə etdiyiniz [teorem/düstur] həqiqətən standart və düzgündürmü? Onun standart ifadəsini və şərtlərini yazın. Bunu kiçik bir nümunə ilə yoxlayan hesabı göstərin (məsələn, n=3). Əgər bu, uydurulmuş bir düsturdursa və ya əmin olmadığınız bir şeydirsə, bunu açıq şəkildə söyləyin.
4) Səhv rejimi diaqnozu:
Aşağıdakı həlldə bir səhv olduğunu bilirəm. Bu xəta növlərini bir-bir yoxlayın: arifmetik, işarə, səhv qayda, atlanmış şərt, domen. Bunun hansı növ səhv olduğunu və hansı mərhələdə olduğunu söyləyin. Həll yolu: [burada]
Zəif məlumat / Güclü göstəriş
Zəif: "Bu nəticə doğrudurmu?" [nəticəni yapışdırın]
Nəticə: Süni intellekt tez-tez “bəli doğru” deyir (öz çıxışını təsdiqləmək meyli); müstəqil audit olmadığı üçün etibarsızdır.
Güclü: "Bu nəticəni müstəqil şəkildə yoxlayın: fərqli həll yolu istifadə edin və ya SymPy kodu ilə yoxlayın (kodu işlədəcəm). Yalnız "doğru/yanlış" deməyin; hansı yoxlamanı etdiyinizi və nəticəni göstərin. Yoxlama məbləği uğursuz olarsa, xətanı tapın."
Nəticə: Müstəqil nəzarət metoduna etiraz edilir; AI-nin öz məhsulunu kor-koranə təsdiqləməsinin qarşısı alınır.
Ümumi səhvlər
- Öz çıxışını təsdiqləmək üçün AI əldə etmək. "Bu doğrudurmu?" AI çox vaxt öz səhvini təsdiqləyir; Müstəqil üsul tələb olunur.
- Sağlam düşüncə testindən keçmək. Ehtimalın 1-dən böyük olması və uzunluğun mənfi olması kimi cəfəngiyatları təfərrüatlara baxmadan tutmaq olar.
- Tək yoxlamaya əsaslanaraq. Kritik nəticələr üçün çoxlu müstəqil yollardan istifadə edin (heşlər + SymPy + xüsusi dəyər).
- Kiçik nümunələrlə düsturları sınaqdan keçirməyin. Hazırlanmış düsturlar n=2, n=3 kimi kiçik dəyərlərdə dərhal çökür.
- Səhvlərin yayıldığını unutmaq. Birinci sətirdəki səhv bütün nəticəni korlayır; Səhv tapsanız, onu əvvəldən yoxlayın.
Diqqət: Süni intellektin etibarlılığı ilə onun dəqiqliyi arasında heç bir əlaqə yoxdur. Ən qətiyyətli, ən axıcı, ən “əmin” görünən cümlə tamamilə səhv ola bilər. Tona deyil, müstəqil yoxlamaya etibar edin. Nəticəni yalnız əl ilə və ya deterministik alətlə təsdiqlədiyiniz zaman "doğru" hesab edin - AI "əmin" dediyi üçün deyil.
Xülasə
Süni intellekt riyaziyyatda səhvlərə yol verir, çünki o, məntiqi idarə edən bir mühərrik deyil, statistik olaraq mətn istehsal edən bir dil modelidir. Səhvlər yeddi əsas növə bölünür: arifmetik, işarə, uydurma teorem, qaydanın səhv tətbiqi, buraxılmış vəziyyət, sübut boşluğu, köhnəlmiş məlumatlar. Riyaziyyatda səhv yayılır və böyüyür, həqiqət ikilidir - buna görə də hər addım yoxlanılmalıdır. Sistemli nizam-intizam: SymPy ilə hər bir ədədi aləti, hər simvolik nəticəni, mənbədən gələn hər bir teoremi, hər bir sübutu sorğu ilə yoxlayın; Yoxlama, əks yoxlama və sağlam düşüncə testini tətbiq edin. Süni intellektin özünə inamı dəqiqliyin sübutu deyil.
Tətbiq tapşırığı
Orta uzunluqlu (ən azı 6-8 addım) həlli olan bir problem seçin və AI həll etsin. Sonra bu bölmənin 1 və 4 nümunələrindən istifadə edərək çoxqatlı yoxlama aparın: (a) sağlam düşüncə/rütbə testi, (b) SymPy ilə yoxlama, (c) xüsusi dəyər üzərində sınaq. Sonra qəsdən "səhv ovlamaq" gözü ilə həll xəttini keçin və yeddi növ səhvdən hansının baş verə biləcəyini yoxlayın. Tapdığınız hər bir səhvi növü ilə birlikdə qeyd edin.
yoxlama siyahısı
- [ ] Mən hər bir ədədi nəticəni deterministik alətlə təsdiqlədim.
- [ ] Mən hər simvolik nəticəni SymPy ilə yoxladım.
- [ ] Mən istifadə olunan teoremi/düsturu mənbədən və ya kiçik nümunə ilə təsdiqlədim.
- [ ] Mən ümumi mənada/böyüklük sırasını tətbiq etdim.
- [ ] Mən onu müstəqil şəkildə yoxladım (AI-nin öz təsdiqinə güvənmədən).
- [ ] Səhv tapdığımda həllini əvvəldən yenidən yoxladım.