ክፍል 9 / 11

ቅዠት፣ የተለመዱ የሂሳብ ስህተቶች እና የማረጋገጫ ተግሣጽ

ትርፍ፡

  • አርቴፊሻል ኢንተለጀንስ ለምን በሂሳብ ላይ ስህተት እንደሚሰራ (የቋንቋ ሞዴል መሆን፣ አመክንዮ አለመፈተሽ) እና ሰባቱን ዋና ዋና የስህተት ዓይነቶች ማወቅ መቻል።
  • ስህተት መስፋፋቱን እና ትክክለኛነት በሂሳብ ሁለትዮሽ መሆኑን በመረዳት እያንዳንዱን ደረጃ ማረጋገጥ ለምን አስፈላጊ እንደሆነ የማብራራት ችሎታ።
  • ባለብዙ ባለ ሽፋን የማረጋገጫ ዲሲፕሊን በተለመደው የማስተዋል ሙከራ፣ የትልቅ ፍተሻ ቅደም ተከተል፣ ቼኮች፣ የፍተሻ ማረጋገጫ እና ገለልተኛ ዘዴዎችን የመተግበር ችሎታ።

ይህ ክፍል በሞጁሉ እምብርት ላይ ያለውን ሀሳብ በጥልቀት ያጠናክራል-ለምን እና እንዴት AI በሂሳብ ውስጥ ስህተቶችን ያደርጋል ፣ የእነዚህ ስህተቶች ዓይነቶች ምንድ ናቸው እና እንዴት በስርዓት እንይዛቸዋለን? በቀደሙት ክፍሎች ውስጥ ለእያንዳንዱ ርዕስ የማረጋገጫ ዘዴዎችን አይተናል; እዚህ በአንድ ጣሪያ ስር የስህተቶችን አናቶሚ እንሰበስባለን. ዋናው ነገር የ AI ውፅዓት ሲመለከቱ "እዚህ ስህተት ምን ሊሆን ይችላል?" ብለው ያስባሉ. በአጸፋዊ ሁኔታ የሚያስብ የማረጋገጫ አስተሳሰብ ለማግኘት ነው።

ማሳሰቢያ፡ ቅዠት ማለት አንድ AI በልበ ሙሉነት እውነት ያልሆነ መረጃ ሲያወጣ ነው። በሂሳብ ውስጥ, ቅዠት ብዙውን ጊዜ "አሳማኝ ግን ውሸት" መልክ ይታያል. ለምን AI ስህተት ይሠራል? የቋንቋ ሞዴል እንጂ የሎጂክ ሞተር ስላልሆነ - ማለትም በስታቲስቲካዊ ቅጦች ላይ ጽሑፍን ያዘጋጃል, የእርምጃዎቹን ምክንያታዊ ትክክለኛነት አያረጋግጥም. "ባለ 3-አሃዝ ማባዛት" እና "ትክክለኛ ማረጋገጫ" ለእሱ አንድ አይነት ጽሑፍ የማዘጋጀት ተግባር ናቸው; ለትክክለኛነት ዋስትና የሚሆን ውስጣዊ አሠራር የለውም.

የሒሳብ ስህተቶች አናቶሚ፡ ሰባት ዓይነት

የሚከተለው የዓይነት ዝርዝር በ AI ውፅዓት ውስጥ የሚያጋጥሟቸውን በጣም የተለመዱ ስህተቶች እና የእያንዳንዳቸውን መድሐኒት ያጠቃልላል።

የስህተት አይነት

ምን ይመስላል

መድሃኒት

የሂሳብ ስህተት

የቁጥር ስህተት እንደ 7×8=54

ካልኩሌተር/SymPy

ምልክት ስህተት

-(a-b)=-a-b

ስሜን በእጅ ክፈት።

የተሰራ ቲዎሪ

የማይገኝ የቲዎሪ ስም

ከምንጩ ማረጋገጫ

አላግባብ መጠቀምን ደንብ

የሰንሰለት ህግን አትርሳ

"የትኛው ደንብ?" ጥያቄ

የተዘለለ ሁኔታ

አሉታዊውን ሥር ችላ በል

ሁሉንም ሁኔታዎች ይዘርዝሩ

የማስረጃ ክፍተት

"ስለዚህ" ያለ ጽድቅ

እያንዳንዱን ማለፊያ መጠይቅ

የድሮ/የተሳሳተ ውሂብ

ጊዜ ያለፈበት መረጃ

ምንጭ

ለምን ሂሳብ ልዩ ትኩረት ያስፈልገዋል?

በአብዛኛዎቹ አካባቢዎች, ትንሽ ስህተት ትንሽ መዘዝ አለው. በሂሳብ ስሕተት ይስፋፋል እና ያድጋል። በመጀመሪያው መስመር ላይ ያለው የምልክት ስህተት ቀጣዮቹን አስር መስመሮች እና የመጨረሻውን ውጤት ሙሉ በሙሉ የተሳሳተ ያደርገዋል። በማረጋገጫው መካከል ያለው ክፍተት ሙሉውን ማስረጃ ዋጋ የለውም። ይህ "ደካማነት" በሂሳብ ውስጥ እያንዳንዱን እርምጃ ማረጋገጥ አስፈላጊ ያደርገዋል - "በአጠቃላይ መናገር እውነት ይመስላል" በቂ አይደለም.

በተጨማሪም ፣ በሂሳብ ውስጥ ያለው እውነት ሁለትዮሽ ነው፡ ውጤቱም እውነት ነው ወይስ ሀሰት ነው፣ በመካከላቸው ምንም የለም። "ሰማንያ በመቶ ትክክል" በጽሁፍ ማጠቃለያ ተቀባይነት እንዳለው ተደርጎ ሊወሰድ ይችላል፤ በአንድ ውህደት ውስጥ "ሰማንያ በመቶ ትክክል" የሚባል ነገር የለም - ትክክለኛው ውጤት ነው ወይም አይደለም. ይህ ድርብ ተፈጥሮ ማረጋገጥ ሁለቱንም የበለጠ ወሳኝ እና (እንደ እድል ሆኖ) የበለጠ የሚቻል ያደርገዋል፡ ውጤቱም ማረጋገጫውን ያልፋል ወይም አያደርገውም።

ደረጃ በደረጃ፡ ስልታዊ የማረጋገጫ ዲሲፕሊን

1. እያንዳንዱን የቁጥር ውጤት በመሳሪያ ያረጋግጡ። በ AI ላይ ለመታመን የሂሳብ ስሌትን በጭራሽ አይተዉት; ሲምፒ፣ ካልኩሌተር ወይም በእጅ።

2. እያንዳንዱን ምሳሌያዊ ውጤት በSymPy ያረጋግጡ። የተዋሃደ፣ ተዋዋይ፣ አቅልሎ፣ እኩልታ - ሁሉም በSymPy ሊረጋገጡ ይችላሉ።

3. እያንዳንዱን ቲዎሬም/ቀመር ከምንጩ ያረጋግጡ። ስሙ እና አገላለጹ ትክክል ናቸው? የተሰሩ ቲዎሬሞች በጣም ተንኮለኛ ወጥመድ ናቸው።

4. በእያንዳንዱ ማስረጃ ላይ እያንዳንዱን ክስተት ይጠይቁ. "ይህ በእርግጥ ካለፈው እርምጃ ይከተላል?" የመሠረት ጉዳይ፣ ግልጽ ያልሆነ ግምት፣ ክፍተት ማረጋገጥ።

5. ያረጋግጡ እና አጸፋውን ያረጋግጡ. የተገላቢጦሽ አሠራር፣ መተኪያ፣ ገደብ ግዛቶች፣ የልኬት ትንተና።

6. ወደ የጋራ አስተሳሰብ ፈተና አስቀምጥ. ውጤቱ ምክንያታዊ ነው? እድሉ ከ 1 በላይ ከሆነ, ርዝመቱ አሉታዊ ከሆነ ስህተት አለ.

ፍንጭ፡ በጣም ፈጣኑ የጋራ ስሜት ፈተና "የትልቅነት ቅደም ተከተል" ቼክ ነው። ውጤቱ በሚጠበቀው ክልል ውስጥ ነው? የክፍል አማካኝ 250 (ከ100) ወይም የመቻል እድሉ 3.5 ከሆነ ዝርዝሩን ሳታዩ ስህተት እንዳለ ያውቃሉ። ይህ የ 5 ሰከንድ ቼክ በቡድ ውስጥ ብዙ አስቂኝ ውጤቶችን ያስወግዳል.

ሶስት ጥቃቅን ጉዳዮች

ጉዳይ 1 - የሰንሰለት ምልክት ስህተት። አንድ ተማሪ በ8-መስመር አልጀብራ ማቅለል፣ በመስመር 2 ላይ AI የተሰራው የምልክት ስህተት ወደ ቀጣዮቹ 6 መስመሮች ተሰራጭቷል። የመጨረሻው ውጤት ሙሉ በሙሉ የተሳሳተ ነበር, ነገር ግን AI ሙሉ በሙሉ በራስ መተማመን አቅርቧል. ተማሪው ከሲምፒ ጋር ከባዶ ሲያቀልለው ትክክለኛው ውጤት ተገኝቷል እና AI በ 2 ኛ መስመር ላይ ስህተቱን እንዲያገኝ ተፈቅዶለታል። ነጠላ ምልክት 6 መስመሮችን ውድቅ አድርጓል።

ጉዳይ 2 - የጋራ አስተሳሰብ ፈተናውን አዳነ። አንድ አስተማሪ የችግሩን ችግር ለመፍታት AI ነበረው; ውጤቱም 1.4 ነበር. ዝርዝሩን ሳይመለከት መምህሩ "መሆኑ እድሉ ከ 1 በላይ ሊሆን አይችልም" እና ስህተቱን ፈልጎታል: AI ያልተወሳሰቡ ክስተቶችን ልክ እንደ ግልጽነት ሰብስቦ ነበር. የጋራ አእምሮ ፈተና ስህተቱን በሰከንዶች ውስጥ ጠቁሟል።

ጉዳይ 3 - የተሰራ ቀመር. አንድ መሐንዲስ AI ለተከታታይ ድምር "የተዘጋ ቀመር" ጠየቀ። AI አሳማኝ ቀመር ሰጥቷል. መሐንዲሱ በቀመር እና በእጅ በመጨመር ለ n (n=3) ትንሽ እሴት ቀመሩን ሞክሯል; ውጤቶቹ አልተዛመዱም። ቀመሩ ተዘጋጅቷል. ትንሽ ማስተካከል የሰዓታት አላግባብ መጠቀምን ከልክሏል።

አራት ሊገለበጡ የሚችሉ አብነቶች

1) የብዝሃ-ንብርብር ማረጋገጫ ጥያቄ፡-

አግኝተዋል፡ [ውጤት]። አሁን ይህንን ሶስት የተለያዩ መንገዶች አረጋግጡ፡ (1) በግልባጭ ሃሽ ማድረግ፣ (2) ቀላል ብጁ እሴትን መሞከር፣ (3) የተወሰነ ኮድ በSymPy ለማረጋገጥ (ውጤቱን አያለሁ)። ሦስቱም መንገዶች ወጥ ከሆኑ ንገረኝ; ካልሆነ የትኛው ደረጃ ስህተት እንዳለበት ያሳዩ።

2) የማስተዋል/የደረጃ ፈተና፡-

አግኝተዋል፡ [ውጤት]። ይህ ውጤት ምክንያታዊ መሆኑን ለማየት ወደ ኮመን አእምሮ ፈተና ውስጥ ያስገቡት፡ የሚጠበቀው የክብደት ቅደም ተከተል ምንድን ነው፣ ምልክቱ ትክክል ነው፣ በገደብ ውስጥ ነው (ለምሳሌ፣ የመቻል እድል 0-1)? ምክንያታዊ ካልሆነ ስህተት ሊኖርበት የሚችልበትን ቦታ ይመርምሩ።

3) ቲዎሬም/ቀመር ማረጋገጫ፡-

እየተጠቀሙበት ያለው (ቲዎሬም/ፎርሙላ) በእርግጥ ደረጃውን የጠበቀ እና ትክክል ነው? መደበኛ መግለጫውን እና ሁኔታዎችን ይፃፉ። ይህንን የሚፈትሽ መለያ በትንሽ ናሙና አሳይ (ለምሳሌ n=3)። የተሰራ ቀመር ወይም እርግጠኛ ካልሆኑት ነገር በግልፅ ይናገሩ።

4) የስህተት ሁነታ ምርመራ;

ከታች ባለው መፍትሄ ውስጥ ስህተት እንዳለ አውቃለሁ. እነዚህን የስህተት ዓይነቶች አንድ በአንድ ያረጋግጡ፡- አርቲሜቲክ፣ ምልክት፣ የተሳሳተ ህግ፣ የተዘለለ ሁኔታ፣ ጎራ። ምን ዓይነት ስህተት እንደሆነ እና በየትኛው ደረጃ ላይ እንዳለ ንገረኝ. መፍትሄ: [እዚህ]

ደካማ ጥያቄ / ጠንካራ ጥያቄ

ደካማ፡ "ይህ መደምደሚያ ትክክል ነው?" [ውጤቱን ይለጥፉ]
ውጤት: AI ብዙውን ጊዜ "አዎ ትክክል" ይላል (የራሱን ውጤት የማረጋገጥ ዝንባሌ); የማይታመን ምክንያቱም ገለልተኛ ኦዲት የለም.
ጠንካራ: "ይህን ውጤት በገለልተኛ መንገድ ያረጋግጡ: የተለየ መፍትሄ ይጠቀሙ ወይም በሲምፒይ ኮድ ያረጋግጡ (ኮዱን እሰራዋለሁ) "እውነት/ሐሰት" ብቻ አትበል፤ የትኛውን ቼክ እንደሰራህ እና ውጤቱን አሳይ። ቼክሱም ካልተሳካ ስህተቱን አግኝ።"
ውጤት: ገለልተኛ የቁጥጥር ዘዴ ተፈትኗል; ኤአይኤው የራሱን ምርት በጭፍን ከማፅደቅ ተከልክሏል።

የተለመዱ ስህተቶች

  • የራሱን ውፅዓት ለማረጋገጥ AI ማግኘት። "ይህ እውነት ነው?" AI ብዙውን ጊዜ የራሱን ስህተት ያረጋግጣል; ገለልተኛ ዘዴ ያስፈልጋል.
  • የጋራ አስተሳሰብ ፈተናን መዝለል። ከ1 በላይ የመሆን እድሎች እና ርዝመታቸው አሉታዊ የመሆን አይነት ዝርዝሩን ሳይመለከቱ ሊያዙ ይችላሉ።
  • በአንድ ማረጋገጫ ላይ መተማመን። በወሳኝ ውጤቶች ላይ ብዙ ገለልተኛ ዱካዎችን (hashes + SymPy + ብጁ እሴት) ይጠቀሙ።
  • በትንሽ ናሙናዎች ቀመሮችን አለመሞከር. የተሰሩ ቀመሮች ልክ እንደ n=2፣ n=3 ባሉ ትናንሽ እሴቶች ይወድቃሉ።
  • ስህተቱ መስፋፋቱን መርሳት. በመጀመሪያው መስመር ላይ ያለ ስህተት ሙሉውን ውጤት ያበላሻል; ስህተት ካገኙ ከመጀመሪያው ያረጋግጡ.
ጥንቃቄ፡ በ AI በራስ መተማመን እና በትክክለኛነቱ መካከል ምንም ግንኙነት የለም። በጣም ቆራጥ፣ አቀላጥፎ፣ በጣም “እርግጠኛ” የሚመስለው ዓረፍተ ነገር ሙሉ በሙሉ የተሳሳተ ሊሆን ይችላል። በድምፅ ሳይሆን በገለልተኛ ማረጋገጫ እመኑ። ውጤቱን በእጅዎ ሲያረጋግጡ ወይም በሚወስነው መሳሪያ ብቻ "እውነት" ብለው ያስቡ - AI "እርግጠኛ" ስላለ አይደለም።

በማጠቃለያው

AI በሂሳብ ውስጥ ስህተት ይሰራል ምክንያቱም በስታቲስቲክስ ጽሑፍን የሚያዘጋጅ የቋንቋ ሞዴል እንጂ አመክንዮ የሚቆጣጠር ሞተር አይደለም። ስህተቶቹ በሰባት ዋና ዋና ዓይነቶች ይወድቃሉ፡ አርቲሜቲክ፣ ምልክት፣ የተሰራ ንድፈ ሃሳብ፣ ደንብ አላግባብ መጠቀም፣ የተተወ ጉዳይ፣ የማረጋገጫ ክፍተት፣ የቆየ መረጃ። በሂሳብ ስህተቱ ይስፋፋል እና ያድጋል፣ እውነት ሁለትዮሽ ነው - ስለዚህ እያንዳንዱ እርምጃ መረጋገጥ አለበት። ሥርዓታዊ ተግሣጽ፡- እያንዳንዱን የቁጥር መሣሪያ፣ እያንዳንዱን ተምሳሌታዊ ውጤት በSymPy፣ እያንዳንዱን ጽንሰ ሐሳብ ከምንጩ፣ እያንዳንዱ ማስረጃ በጥያቄ ያልፋል፤ ቼክ፣ አጸፋዊ ቼክ እና የጋራ ስሜትን መሞከርን ይተግብሩ። የ AI በራስ መተማመን ለትክክለኛነት ማረጋገጫ አይደለም.

የመተግበሪያ ተግባር

በመካከለኛ ርዝመት (ቢያንስ ከ6-8 ደረጃዎች) መፍትሄ ጋር ችግርን ይምረጡ እና AI እንዲፈታ ያድርጉት። ከዚያ ከዚህ ክፍል ስርዓተ-ጥለት 1 እና 4ን በመጠቀም ባለብዙ-ንብርብር ማረጋገጫን ያድርጉ፡ (ሀ) የጋራ ስሜት/የደረጃ ሙከራ፣ (ለ) በSymPy ማረጋገጥ፣ (ሐ) በልዩ እሴት ላይ መሞከር። ከዚያም ሆን ተብሎ "የሳንካ አደን" አይን በመጠቀም የመፍትሄውን መስመር በመስመር ይሂዱ እና ከሰባቱ አይነት ስህተቶች መካከል የትኛው ሊከሰት እንደሚችል ያረጋግጡ። ያገኙትን እያንዳንዱን ስህተት ከአይነቱ ጋር ይመዝግቡ።

የማረጋገጫ ዝርዝር

  • [ ] እያንዳንዱን የቁጥር ውጤት በቆራጥነት መሣሪያ አረጋግጫለሁ።
  • [ ] እያንዳንዱን ምሳሌያዊ ውጤት በSymPy ፈትጬዋለሁ።
  • [] ጥቅም ላይ የዋለውን ቲዎረም/ቀመር ከምንጩ ወይም በትንሽ ምሳሌ አረጋግጫለሁ።
  • [ ] የጋራ ስሜት/የትልቅነት ፈተናን ተጠቀምኩ።
  • [ ] በገለልተኛ መንገድ ኦዲት አድርጌዋለሁ (በ AI በራሱ ፈቃድ ላይ ሳልተማመን)።
  • [ ] ስህተት ሳገኝ ከመጀመሪያው ጀምሮ መፍትሄውን እንደገና አጣራሁ።