ክፍሎች
1. በስርዓት እና በአውታረ መረብ አስተዳደር ውስጥ ወደ አርቲፊሻል ኢንተለጀንስ መግቢያ፡ ሚናዎች፣ ወሰኖች፣ ማረጋገጫ እና ባለስልጣን 2. ራስ-ሰር ስክሪፕቶች፡ Bashን፣ PowerShellን እና Pythonን ደህንነቱ በተጠበቀ ሁኔታ ማመንጨት 3. የምዝግብ ማስታወሻ እና የስር መንስኤ ትንተና፡ ምልክቱን በድምፅ ውስጥ መፈለግ 4. የአቅም እና የአፈጻጸም ክትትል፡ የንባብ መለኪያዎች እና የወደፊት እቅድ ማውጣት 5. የማዋቀር አስተዳደር፡ ማዋቀርን ማመንጨት፣ ማረጋገጥ እና ተንሸራታች መያዝ 6. የመሠረተ ልማት አስተዳደር እንደ ኮድ (IaC): ቴራፎርም, ሊቻል የሚችል እና የእቅድ ቁጥጥር 7. ሰነድ እና መረጃ አስተዳደር፡ Runbook፣ ድህረ-ሞት እና የድርጅት ማህደረ ትውስታ 8. ግምታዊ ጥገና፡ ውድቀቶችን ከመከሰታቸው በፊት ማየት 9. የአስተዳደር ለውጥ፡ የአደጋ ግምገማ፣ መልሶ መመለስ እና የጥገና መስኮት 10. ደህንነት እና መከላከያ፡ ሰው ሰራሽ መረጃን ለመከላከያ አላማዎች መጠቀም እና በስልጣን ገደብ ውስጥ 11. ከጫፍ እስከ ጫፍ ውህደት፡ ክስተትን ከመጀመሪያው እስከ መጨረሻ ማስተዳደር
ክፍል 11 / 11

ከጫፍ እስከ ጫፍ ውህደት፡ ክስተትን ከመጀመሪያው እስከ መጨረሻ ማስተዳደር

ትርፍ፡

  • በአርቴፊሻል ኢንተለጀንስ አማካኝነት የአንድን ክስተት ከጫፍ እስከ ጫፍ ማስተዳደር በምርመራ፣ በምርመራ፣ በመቀነሱ፣ በቋሚ መፍትሄ እና በመማሪያ ደረጃዎች
  • ወደ አርቴፊሻል ኢንተለጀንስ የሚተላለፉ እርምጃዎችን እና በየደረጃው የሰው ውሳኔ የሚሹትን በመለየት በፍርሃት ጊዜም ቢሆን የማረጋገጫ ዲሲፕሊን የማቆየት ችሎታ።
  • አርቴፊሻል ኢንተለጀንስ 'ምን እየሆነ ነው፣ እንዴት እንደሚፃፍ' ከሚሉት ጥያቄዎች ይልቅ ሰው ሰራሽ ዕውቀት ይቀድማል የሚለውን ወርቃማ ህግ የመቀየር ችሎታ እና ሰዎች 'ዋስትና ሰጪው ማን ላደርገው?' ጥያቄዎችን ወደ ንግድ ነክ ነጸብራቅ የመቀየር ችሎታ።

ከጫፍ እስከ ጫፍ ውህደት፡ ከጫፍ እስከ ጫፍ ያለውን ክስተት በ AI ማስተዳደር

በአለፉት አስር ክፍሎች ውስጥ ያሉትን ቁርጥራጮች ተምረሃል፡ ስክሪፕት ማድረግ፣ የምዝግብ ማስታወሻዎች፣ ክትትል፣ ውቅረት፣ IaC፣ documentation፣ ግምታዊ ጥገና፣ ለውጥ አስተዳደር እና ደህንነት። በገሃዱ ዓለም ግን እነዚህ ክፍሎች አንድ በአንድ አይመጡም ነገር ግን በአንድ ክስተት ውስጥ የተሳሰሩ ናቸው። በዚህ የመጨረሻ ክፍል ውስጥ ቁርጥራጮቹን አንድ ላይ እናመጣለን-በእኩለ ሌሊት የጀመረውን ክስተት ከጫፍ እስከ ጫፍ ፣ ከመመርመር እስከ ዋና መንስኤ ፣ ከሽምግልና እስከ ሰነዶች እና በእያንዳንዱ ደረጃ ትክክለኛውን የ AI መጠን እንዴት መጠቀም እንደሚችሉ ሙሉ በሙሉ ይመለከታሉ። ዓላማው አዲስ ዘዴ ማስተማር አይደለም; የተማራችሁትን እንደ መሐንዲስ ሪፍሌክስ አንድ ላይ ማያያዝ፣ በሞጁሉ ውስጥ የተደጋገሙትን አንድ እውነት ማጠናከር፡ AI በሁሉም ደረጃ ያፋጥናል፣ ያበራል እና ያዘጋጃል፤ ነገር ግን ሁልጊዜ ምርመራውን የሚያረጋግጥ, ትዕዛዙን የሚያስተዳድር, ለውጡን የሚያረጋግጥ እና ለውጤቱ ሃላፊነት የሚሸከመው ሰው ነው.

በዚህ ክፍል ውስጥ የአንድን ክስተት የሕይወት ዑደት-የማወቅ፣የምርመራ፣የጣልቃ ገብነት፣የመፍታት፣የትምህርት-እና የ AI ሚና እና ገደቦች በእያንዳንዱ ደረጃ በምሳሌ ያዋህዳሉ።

የአንድ ክስተት የሕይወት ዑደት

እያንዳንዱ ከባድ ክስተት በተመሳሳይ ደረጃዎች ውስጥ ያልፋል፣ እና AI በእያንዳንዱ ደረጃ የተለየ ሚና አለው። ማወቂያ፡ የማንቂያ ደወል ይሰማል፣ ተጠቃሚ ያማርራል፣ ልኬት ከመነሻ መስመር ያፈነግጣል (ክፍል 4)። ማረጋገጫ እና ወሰን፡ በእውነቱ ጉዳይ ነው፣ ምን ያህል ሰፊ ነው? ምርመራ፡ ከምዝግብ ማስታወሻዎች እና መለኪያዎች (ክፍል 3) ወደ ዋናው ምክንያት መድረስ። ምላሽ እና ቅነሳ: ጉዳትን ማቆም, መፍትሄ. ቋሚ መፍትሄ፡ በለውጥ አስተዳደር (ክፍል 9)፣ ስክሪፕት (ክፍል 2) ወይም አስፈላጊ ከሆነ ውቅር (ክፍል 5) ማስተካከል። መማር፡ ድህረ-ሟች እና runbook ዝማኔ (ክፍል 7)። AI በምርመራው ውስጥ ያለውን ያልተለመደ ምልክት ያሳያል ፣ በምርመራው ውስጥ መላምቶችን ያዘጋጃል ፣ በጣልቃ ገብነት ውስጥ አማራጮችን ይሰጣል ፣ በመፍትሔ ውስጥ ረቂቆችን ይጽፋል ፣ በመማሪያ ውስጥ ሰነዶችን ያዘጋጃል - ግን በእያንዳንዱ ደረጃ ፣ ሰዎች በውሳኔው ላይ ይቆማሉ ።

ጠቃሚ ምክር፡ የአደጋ ጊዜ በጣም አደገኛው የምርመራ ጊዜ እና ውጥረቱ ከፍተኛ በሆነበት ጊዜ ምላሽ መስጠት ነው - በትክክል AI ን በጭፍን የመታመን ፍላጎት በጣም ጠንካራ በሚሆንበት ጊዜ። በተጣደፉ ቁጥር፣ “አንብብ፣ አረጋግጥ፣ ለመመለስ ተዘጋጅ” የሚለውን ምላሽ አጥብቀህ ትይዛለህ። በድንጋጤ ውስጥ አንድ ነጠላ ማረጋገጫ ክስተቱን በእጥፍ ይጨምራል።

ከመጀመሪያው እስከ መጨረሻው ምሳሌ

ኮንክሪት እናድርገው። በ02፡10 ላይ ያለ ማንቂያ፡ የክፍያ አገልግሎት p99 ምላሽ ጊዜ 6 ሰከንድ ነው፣ ከመነሻው (250-400 ሚሴ) በላይ። ማግኘቱ ትክክል፡ ክትትል ሠርቷል። ማረጋገጫ፡ ከብዙ ቦታዎች ማረጋገጫ፣ እውነተኛ ክስተት። መመርመሪያ፡ መሐንዲስ ጭንብል የተደረገ ሎግ እና የ20 ደቂቃ መለኪያዎችን ለኤአይኤ ሰጥቷል። AI የጊዜ መስመርን ያስቀምጣል እና ማሽቆልቆሉን ከስራ ማሰማራቱ በኋላ ወዲያውኑ በ 02:08 እንደሚጀምር ያመላክታል - ጠንካራ ግንኙነት, ግን አሁንም መላምት. መሐንዲሱ ይህንን በማሰማራት ምዝግብ ማስታወሻው አረጋግጠዋል፡ አዎ፣ በ02፡08 ላይ ልቀት ተለቋል። ምላሽ: በጣም ፈጣኑ ቅነሳ ማከፋፈሉን ወደ ኋላ መመለስ ነው; በለውጥ ጥያቄ ውስጥ ያለው የመመለሻ እርምጃ ዝግጁ ነው (ክፍል 9)። መሐንዲሱ መጀመሪያ መልሶ መመለሻውን በካናሪ አመክንዮ በአገልጋዩ ላይ ይተገብራል፣ የምላሽ ሰዓቱ ይሻሻላል፣ እና ከዚያ ያሰራጫል። ቋሚ መፍትሄ፡ ትክክለኛው የስር መንስኤ (በአዲሱ እትም ውስጥ ያልተገለጸ መጠይቅ) በሚቀጥለው ቀን በእርጋታ ይስተካከላል። መማር፡ ከ AI-ነጻ ድህረ-ሟች ተዘጋጅቷል እና "ድህረ-ማሰማራት p99 ክትትል" እርምጃ ወደ runbook ታክሏል። በእያንዳንዱ ደረጃ, AI የተፋጠነ; ሰው በእያንዳንዱ የውሳኔ ነጥብ የተረጋገጠ.

የሰው-AI የስራ ክፍፍል ወርቃማ ህግ

በመላው ሞጁል ውስጥ የሚያዩት ልዩነት እዚህ ደንብ ይሆናል: AI "ምን እየሆነ እንዳለ, ምን ሊከሰት ይችላል, እንዴት እንደሚጻፍ" በሚሉት ጥያቄዎች ውስጥ ቀዳሚ ነው; እንደ "አሁን ይህን ማድረግ አለብኝ፣ ለዚህ ​​ማን ዋስትና ሊሰጥ ይችላል?" ወደሚሉት ጥያቄዎች ሲመጣ ሰዎች ቀድመዋል። AI ደከመኝ ሰለቸኝ ሳይል፣ ፈጣን፣ ሰፊ መረጃን ይቃኛል እና ንድፎችን ያመነጫል - ነገር ግን ሙሉ አውድ አያውቀውም፣ ቅዠቶችን ይፈጥራል፣ ተጠያቂነትን አይቆጣጠርም፣ እና የድርጅትዎን ድብቅ ጥገኞች አይመለከትም። ሰው ዘገምተኛ ነው፣ነገር ግን አውድ፣ሃላፊነት እና ፍርድን ይሸከማል። በጣም ጥሩው ውጤት በሁለቱ መካከል ባለው ትክክለኛ የሥራ ክፍፍል ውስጥ ነው: ተደጋጋሚ, ጽሑፋዊ, ጠቃሚ ስራን ወደ AI ውክልና መስጠት; የማረጋገጫ ፣ የውሳኔ እና የአፈፃፀም ሰው ያቆዩ።

ሶስት ጥቃቅን ጉዳዮች

ጉዳይ 1 - 40 ደቂቃ መጨረሻ እስከ መጨረሻ። በዲስክ ሙሉ ክስተት አንድ SRE አጠቃላይ ሰንሰለቱን ከ AI ጋር አፋጥኗል፡ ማንቂያውን ከመነሻው (5 ደቂቃ) ጋር አረጋግጧል፣ የተሸሸገው ምዝግብ ማስታወሻ በ YZ ጠቅለል አድርጎ የመጀመሪያውን ስህተት (5 ደቂቃ) አገኘ፣ የ AI የ"ሎግ ማሽከርከር ቆሟል" በእውነተኛው ስርዓት ላይ መላምትን አረጋግጧል (5 ደቂቃ)፣ ሮጦ ተተግብሯል ዝግጁ የሆነ የጽዳት ስክሪፕት በደረቅ አሂድ (10 ደቂቃ የተጻፈው እውነታ) እና AI 1 ጽሁፍ ፅፏል። ደቂቃ) ጠቅላላ 40 ደቂቃዎች; ያለ AI በግምት ሁለት ጊዜ ያህል። ግን በእያንዳንዱ ደረጃ የማረጋገጫ ደረጃ ነበር.

ጉዳይ 2 — በፍርሀት ቅጽበት ማረጋገጥ ተዘሏል። ሌላ ቡድን በፍጥነት ተቆርጧል። የ AI የመጀመሪያ ስርወ ምክንያት መላምት (ጥገኛ አገልግሎት) ሳያረጋግጥ ተቀብሎ አገልግሎቱን እንደገና ጀምሯል። ችግሩ አልተስተካከለም ምክንያቱም ትክክለኛው መንስኤ ሌላ ነገር ነበር; ከዚህም በላይ, አላስፈላጊ ዳግም ማስነሳት ሁለተኛ መቋረጥ ፈጠረ. ትምህርት፡ መቸኮል ማረጋገጫን ለመዝለል ምንም ምክንያት አይሆንም። የ AI መላምት ከመረጋገጡ በፊት, ድርጊት ክስተቱን ያባብሰዋል.

ጉዳይ 3 - ገደቡን ማወቅ። አንድ መሐንዲስ AI ውስብስብ በሆነ የአውታረ መረብ ጉዳይ ላይ ሲያበረታታ የነበረውን የውቅር ለውጥ ተግባራዊ ሊያደርግ ነበር። ነገር ግን ለውጡ የማይቀለበስ ይመስላል፣ እና AI የኤጀንሲውን ልዩ የማዘዣ ህጎች አያውቅም። መሐንዲሱ ቆም ብለው አንድ ከፍተኛ የኔትወርክ ኤክስፐርት አማከሩ እና የ AI ፕሮፖዛል በዚህ ልዩ ቶፖሎጂ ውስጥ የማዞሪያ ዑደት እንደሚፈጥር ተረዳ። የ AI ወሰንን ማወቁ መስተጓጎል እንዳይፈጠር አድርጓል።

አራት ሊገለበጡ የሚችሉ አብነቶች

1) የክስተት ቀስቅሴ ማጠቃለያ (መለያ)፡-

የእርስዎ ሚና፡ ከፍተኛ SRE፣ ረዳት የአደጋ አዛዥ። ንቁ የሆነ ክስተት አለ። የምሰጥህ ጭምብል የተሸፈነው ማንቂያ/ሜትሪክ/ሎግ ፈጣን ልዩነት ይሰጠኛል፡ (1) ምልክቱ ምንድን ነው፣ (2) የተፅዕኖው ወሰን ምንድ ነው፣ (3) መጀመሪያ ማየት ያለብን 3 ቦታዎች፣ (4) ለእያንዳንዱ ተነባቢ-ብቻ የቁጥጥር ትእዛዝ። ውሳኔው እና አፈፃፀሙ የእኔ ነው; መንገዱን ላክ. ውሂብ፡ [ጭምብል የተደረገ]

2) ደረጃ የደረሰ የአደጋ አስተዳደር መመሪያ፡-

ለምልክት [ምልክት]፡- የመለየት ማረጋገጫ፣ ምርመራ፣ ቅነሳ፣ ቋሚ መፍትሄ፣ ትምህርት ለማግኘት በተፈጠረው የህይወት ኡደት ውስጥ ደረጃ በደረጃ ውሰደኝ። በእያንዳንዱ ደረጃ፣ (ሀ) ምን ማድረግ እንዳለብኝ ንገረኝ፣ (ለ) ደህንነቱ በተጠበቀ ሁኔታ ለ AI ውክልና መስጠት የምችልበት ጊዜ፣ (ሐ) ምን አይነት ውሳኔ እራሴ ማድረግ እንዳለብኝ። በችኮላ ብሆንም መዝለል የሌለብኝን የማረጋገጫ ደረጃዎች ላይ ምልክት አድርግ።

3) የውሳኔ ነጥብ ቁጥጥር;

በአንድ ክስተት መካከል ነኝ እና የሚከተለውን እርምጃ ልወስድ ነው። ከመተግበሩ በፊት፣ ጠይቁኝ፡ (1) ይህ ሊቀለበስ የሚችል ነው፣ (2) ምን ማረጋገጫ አደረግሁ/ያላደረግሁት፣ (3) የመመለሻ እቅድ አለኝ፣ (4) ይህ እርምጃ በትክክል መንስኤውን እንደፈታ የሚያሳይ ማስረጃ አለኝ? የጎደለ ነገር ካየህ አቁምኝ።

4) ከክስተት በኋላ የተቀናጀ ትምህርት፡-

ክስተቱ አሁን ለተፈታ [ማጠቃለያ] ይሰጠኛል፡ (1) የድህረ-ሞት ረቂቅ ያለ ነቀፋ፣ (2) 3 ቋሚ ማሻሻያዎች (ክትትል/አውቶማቲክ/ማዋቀር) ይህንን ክስተት የሚከላከለው፣ (3) መዘመን ያለባቸው የ runbook ደረጃዎች፣ (4) ለተመሳሳይ ክስተት የቅድመ ማስጠንቀቂያ ምልክት ጥቆማ። ያለ ማስረጃ መነሻ ምክንያት መጻፍ; በእውነታዎች ላይ በመመስረት.

ደካማ ጥያቄ / ጠንካራ ጥያቄ

ደካማ ጥያቄ፡

ስርዓቱ ተበላሽቷል, ምን ማድረግ አለብኝ?

የተደናገጠ፣ ያለ አውድ እና ማረጋገጫ፣ ይህ ጥያቄ አጠቃላይ እና ምናልባትም አደገኛ ምክሮችን ከ AI ይቀበላል። በዚህ ጊዜ መቸኮል ወደ ስህተቶች ይመራል።

ኃይለኛ ጥያቄ፡-

የእርስዎ ሚና፡ ረዳት የክስተቱ አዛዥ። ንቁ ክስተት፡ የክፍያ serviceip99 ምላሽ ጊዜ 15 ጊዜ መነሻ መስመር (250-400 ሚሴ) ከ02፡10 ጀምሮ። 02፡08 ላይ ስርጭት እንደነበረ አውቃለሁ። ስጠኝ፡(1) በጣም ሊከሰት የሚችል መላምት እና እንዴት ማረጋገጥ እንዳለብኝ ማንበብ ብቻ፣ (2) ፈጣኑ እና ሊቀለበስ የሚችል የመቀነስ አማራጭ፣ (3) ይህን ቅነሳ ከመተግበሩ በፊት መቆጣጠር ያለብኝን ስጋቶች። አፈፃፀሙ እና ፍቃድ አለኝ። ተጨማሪ ውሂብ፡ [ጭምብል የተደረገ ሜትሪክ/ሎግ]

የክስተት ደረጃ

የ AI ሚና

ወሳኝ የሰው ውሳኔ

መለየት

ያልተለመደውን ምልክት ያድርጉ

ትክክለኛው ክስተት ነው ፣ ወሰን ምንድን ነው?

ምርመራ

መላምት ማመንጨት

የትኛው መላምት ነው የተረጋገጠው?

ቅነሳ

አማራጮችን አታቅርቡ

የትኛው ቅነሳ ነው የሚቀለበስ?

ዘላቂ መፍትሄ

ረቂቅ/ስክሪፕት።

ለውጡን ማጽደቅ እና ማስፈጸም

መማር

የድህረ-ሞት ንድፍ

እውነታዎችን እና ትምህርቶችን ማረጋገጥ

የተለመዱ ስህተቶች

  • በድንጋጤ ማረጋገጥን መዝለል። መቸኮል የ"ማንበብ-አረጋግጥ-አዘጋጅ መመለስ" ሪፍሌክስን ለመተው ምንም ምክንያት አይሆንም። ውጥረት እየጨመረ በሄደ ቁጥር ተግሣጽ መጨመር አለበት.
  • ለመረጃ የሚሆን መላምት ስህተት። የ AI የመጀመሪያ መንስኤ ጥቆማን ሳያረጋግጡ እርምጃ መውሰድ ክስተቱን ያባብሰዋል።
  • የ AI አውድ ወሰን በመርሳት ላይ። AI የድርጅቱን ድብቅ ጥገኞች አያውቅም; በወሳኝ ለውጥ፣ የሰው ፍርድ ያሸንፋል።
  • የመማሪያ ደረጃን መዝለል. ክስተቱ፣ ከድህረ-ሟች እና runbook ዝመናዎች ውጭ፣ በተመሳሳይ ምሽት እንደገና ይጀምራል።
  • ኃላፊነቱን በ AI ላይ ማድረግ. “ኤአይኤ እንዲህ ብሏል” መከላከያ አይደለም፤ የማስፈጸም ኃላፊነት ሁል ጊዜ በሰው ልጆች ላይ ነው።
ጥንቃቄ፡ በአደጋ አስተዳደር ውስጥ AI መጠቀም የትምህርት ክስተት አስተዳደርን አይተካም። ተሽከርካሪው ሊወድቅ፣ ሊወድቅ ወይም ሊደረስበት የማይችል ሊሆን ይችላል። መሰረታዊ ነገሮችን የሚያውቅ መሐንዲስ ከ AI ጋር ፈጣን ነው; መሰረታዊ ነገሮችን የማያውቅ መሐንዲስ በ AI በፍጥነት ስህተቶችን ያደርጋል. መጀመሪያ ተግሣጽን ያቋቁሙ፣ ከዚያ ፍጥነቱን ከ AI ያግኙ።

በማጠቃለያው

በገሃዱ ዓለም፣ ክፍሎቹ አንድ በአንድ አይመጡም ነገር ግን በአንድ ክስተት ውስጥ የተሳሰሩ ናቸው። አንድን ክስተት ከመለየት እስከ መማር ሲያስተዳድር፣ AI በየደረጃው ያፋጥናል፡ አኖማሊውን ይጠቁማል፣ መላምቶችን ያመነጫል፣ አማራጮችን ይሰጣል፣ ረቂቆችን ያቀርባል፣ ድህረ ሞትን ያዘጋጃል። ነገር ግን በእያንዳንዱ የውሳኔ ነጥብ አንድ ሰው ይቆማል - ምርመራውን ያረጋግጣል, ለመቀነስ ይመርጣል, ለውጡን ያጸድቃል, የውጤቱ ባለቤት ነው. ወርቃማው ህግ ግልጽ ነው: AI "ምን እንደሚፈጠር, እንዴት እንደሚፃፍ" በሚሉት ጥያቄዎች ውስጥ ቀዳሚ ነው, እና ሰዎች "ዋስትና ሰጪው ማን ነው, ላደርገው ይገባል?" በድንጋጤ ጊዜ ተግሣጽን ጨምር፣ መላምትን ከማስረጃ ለይ፣ የኤአይአይ አውድ ገደብ አስታውስ እና ከእያንዳንዱ ክስተት የ runbook ትምህርት ይሳሉ። የዚህ ሞጁል ይዘት አንድ ዓረፍተ ነገር ነው: AI ኃይለኛ ረዳት ነው; የምህንድስና ኃላፊነት በውክልና ሊሰጥ አይችልም.

የመተግበሪያ ተግባር

ባለፈው ከመጀመሪያ እስከ መጨረሻ ያጋጠመዎትን (ወይም ያሰቡትን) ክስተት አስቡበት። ከላይ ባለው “በደረጃ የተደረገ የክስተት አስተዳደር መመሪያ” አብነት፣ ኤአይአይ ጉዳዩን በማወቅ-ምርመራ-መቀነሻ-መፍትሄ-የመማሪያ ደረጃዎች ውስጥ እንዲመራው ይጠይቁ። በእያንዳንዱ ደረጃ, ለ AI ውክልና መስጠት የሚችሉትን ደረጃ እና እራስዎን ለመወሰን የሚያስፈልግዎትን ደረጃ ለየብቻ ይጻፉ. በምርመራው ደረጃ ላይ ቢያንስ አንድ የ AI መላምት ከማረጋገጫ ትእዛዝ ጋር ያረጋግጡ። በመጨረሻም፣ የድህረ-ሟች እና የ runbook ማሻሻያ ረቂቅ ከ"ከክስተት በኋላ የተቀናጀ ትምህርት" አብነት ያዘጋጁ። በጠቅላላው ሂደት የሰው-AI የሥራ ክፍፍልን በ 7 እቃዎች ውስጥ ማጠቃለል.

የማረጋገጫ ዝርዝር

  • [ ] ክስተቱን ወደ ማወቂያ፣ ምርመራ፣ ቅነሳ፣ መፍትሄ እና የመማሪያ ደረጃዎች ከፍዬዋለሁ?
  • [ ] ወደ AI ሊሰጡ የሚችሉ እርምጃዎችን እና በእያንዳንዱ ደረጃ የሰው ውሳኔ አሰጣጥን በሚጠይቁ ደረጃዎች መካከል ለይቻለሁ?
  • [] በምርመራው ውስጥ የ AI መላምትን ከማስረጃው ለይቼ በማረጋገጫ ትእዛዝ አረጋግጫለሁ?
  • [ ] ቅናሹን ከመልሶ ማግኛ እና ወደ ኋላ ለመመለስ እቅድ ገምግሜያለሁ?
  • [ ] በድንጋጤ ጊዜም ቢሆን የ"ማንበብ-ማረጋገጥ-ተዘጋጅ መመለስ" አስተያየቴን አቆይቻለሁ?
  • [ ] ከክስተቱ የድህረ-ሞት እና የ runbook ትምህርት ተምሬያለሁ?

የሞዱል ፈተና

1. በስርአት እና በኔትዎርክ አስተዳደር ውስጥ ለሰው ሰራሽ የማሰብ ችሎታ ከሚከተሉት ውስጥ በጣም ትክክለኛው አቀማመጥ የትኛው ነው?

  • ሀ) አርቲፊሻል ኢንተለጀንስ ረዳት እና የውሳኔ ድጋፍ መሳሪያ ነው; ወሳኝ የአስፈፃሚ ውሳኔዎች ሀላፊነት እና የመጨረሻ ማፅደቅ በሰዎች ላይ ነው ✔
  • ለ) አርቴፊሻል ኢንተለጀንስ ትዕዛዞችን ማስኬድ እና በምርት ላይ ለውጦችን ያለ ሰው ፈቃድ መተግበር ይችላል።
  • ሐ) አርቲፊሻል ኢንተለጀንስ የሚሠራው በጽሑፍ ጽሑፍ ውስጥ ብቻ ነው, ከስርዓት እና ከኔትወርክ ሥራ ጋር ምንም ግንኙነት የለውም
  • መ) አርቴፊሻል ኢንተለጀንስ ሁል ጊዜ ከሰዎች የበለጠ ትክክለኛ ውሳኔዎችን ያደርጋል፣ ስለዚህ ማረጋገጥ አላስፈላጊ ነው።

መግለጫ፡ አርቴፊሻል ኢንተለጀንስ እንደ ስክሪፕት፣ የምዝግብ ማስታወሻ እና ሰነዶች ያሉ ረቂቆችን እና ትንታኔዎችን የሚያዘጋጅ ረዳት እና የውሳኔ ድጋፍ መሳሪያ ነው። የስራ ማቆም ጊዜን፣ የውሂብ መጥፋትን እና ደህንነትን የሚነኩ የአስፈፃሚ ውሳኔዎች ሀላፊነት እና የመጨረሻ ማፅደቅ፣ ለምሳሌ ትዕዛዝን መፈጸም ወይም ለውጥን ማፅደቅ የብቃት መሐንዲሱ ናቸው።

2. በምርት ውስጥ በአርቴፊሻል ኢንተለጀንስ የመነጨውን ትእዛዝ ከማስኬዱ በፊት የማረጋገጫ ሪፍሌክስ አራት ደረጃዎች ምንድናቸው?

  • ሀ) ቅዳ ፣ መለጠፍ ፣ መሮጥ ፣ ተስፋ
  • ለ) አንብብ እና ተረዳ፣ መመዝገብ፣ በገለልተኛ አካባቢ ሞክር፣ ለአስተያየት ተዘጋጅ ✔
  • ሐ) ላይክ ፣ ሼር ያድርጉ ፣ ያስቀምጡ ፣ ያከማቹ
  • መ) ይሰርዙ፣ ይፃፉ፣ ይጨመቁ፣ ይላኩ።

መግለጫ፡- ወሳኝ በሆነ ውጤት ላይ ለመተግበር አራት ደረጃዎች፡ (1) የትእዛዝ መስመሩን በመስመር ማንበብ እና መረዳት፣ (2) ባንዲራዎችን እና አገባቦችን ከኦፊሴላዊው ሰነድ ጋር ማገናኘት፣ (3) በገለልተኛ/በሙከራ አካባቢ መሞከር፣ ከተቻለ ማድረቅ፣ (4) የውድቀት እቅድ ማዘጋጀት (ምትኬ፣ ቅጽበተ-ፎቶ) ከተሳሳተ።

3. አውቶሜሽን ስክሪፕት 'ደማቅ' መሆን ማለት ምን ማለት ነው እና ለምን አስፈላጊ ነው?

  • ሀ) ስክሪፕቱ በእያንዳንዱ ሩጫ የተለያዩ ውጤቶችን ያስገኛል
  • ለ) ስክሪፕቱ አንድ ጊዜ ብቻ ነው የሚሰራው ከዚያም ሊሰረዝ ይችላል።
  • ሐ) ስክሪፕቱ ለሁለተኛ ጊዜ ሲሮጥ ምንም ዓይነት ጉዳት አያስከትልም; ✔ በድጋሚ ቢቀሰቀስም ደህንነቱ የተጠበቀ
  • መ) ስክሪፕቱ የስህተት አስተዳደርን አልያዘም።

ማብራሪያ፡ ኢዴምፖትሲሲ ማለት አንድ አይነት ስክሪፕት ሁለት ወይም ከዚያ በላይ ጊዜ ሲሰራ በሁለተኛው ሩጫ ላይ ጉዳት አያስከትልም ወይም ስህተት አይፈጥርም ማለት ነው። እንደ 'ተጠቃሚው ካለ ዝለል'፣ ' ከሌለው ፍጠር፣ ካለ አትንካው' የመሳሰሉ አመክንዮዎች ተመስርተዋል። ይህ አውቶሜሽኑ በአጋጣሚ እንደገና ቢቀሰቀስም ደህንነቱ በተጠበቀ ሁኔታ እንደሚሰራ ያረጋግጣል።

4. አጥፊ ስራዎችን (መሰረዝ፣ ዳግም ማስጀመር) የያዘውን ስክሪፕት ለመጠበቅ በጣም መሠረታዊው መንገድ ምንድነው?

  • ሀ) ስክሪፕቱን በተቻለ ፍጥነት ያሂዱ
  • ለ) የስህተት መልዕክቶችን መደበቅ
  • ሐ) ስክሪፕቱን በቀጥታ በምርት ውስጥ መሞከር
  • መ) አውዳሚ ስራዎችን ከነባሪው የደረቅ አሂድ ጀርባ በማስቀመጥ ትክክለኛ ትግበራውን ከትክክሌጣ ባንዲራ ጋር ማሰር ✔

ማብራርያ፡ አጥፊ ሂደቶችን በነባሪነት በደረቅ አሂድ ሁነታ ማቆየት እና ትክክለኛውን መተግበሪያ በግልፅ ፍቃድ ባንዲራ (ለምሳሌ --apply) ብቻ ማስኬድ መጀመሪያ ስክሪፕቱ ሲሰራ ምን እንደሚሆን ለማየት ያስችላል። እንዲሁም ባዶ ተለዋዋጭ ፍተሻ (VAR:?) የመንገድ ስህተቶችን ይከላከላል።

5. በሎግ ትንተና 'ተዛምዶ አይደለም መንስኤ' የሚለው መርህ ምን ማለት ነው?

  • ሀ) አንድ ላይ የሚለዋወጡ ሁለት ክስተቶች የግድ በምክንያት-ውጤት ግንኙነት ውስጥ አይደሉም። ምክኒያቱም መረጋገጥ አለበት ✔
  • ለ) በምዝግብ ማስታወሻዎች ውስጥ ትስስር መፈለግ ጊዜ ማባከን ነው
  • ሐ) አብረው ከሚለዋወጡት ሁለት ክስተቶች አንዱ በእርግጠኝነት የሌላኛው ምክንያት ነው።
  • መ) መንስኤው በሰው ሰራሽ የማሰብ ችሎታ ብቻ ሊወሰን ይችላል

ማብራሪያ፡- ሁለት ክስተቶች በአንድ ጊዜ ስለሚከሰቱ ብቻ (ግንኙነት) አንዱ ሌላውን ያስከትላል (ምክንያት) ማለት አይደለም። ሁለቱም የሶስተኛ ክስተት ውጤት ሊሆኑ ይችላሉ. 'X ምናልባት Yን ፈጥሯል' የሚለው የ AI አስተያየት መላምት ነው እና በስርዓቱ ውስጥ እስካልተረጋገጠ ድረስ እንደ ግኝት አይቆጠርም።

6. በአፈጻጸም ክትትል ውስጥ የምላሽ ጊዜን ሲለካ ፐርሰንታይል (p95/p99) ከአማካይ ለምን ይመረጣል?

  • ሀ) መቶኛ ከአማካይ ለማስላት ቀላል ነው።
  • ለ) አማካዩ የአናሳዎችን መጥፎ ልምድ ይደብቃል; ፐርሰንታይል እነዚህን የተደበቁ ችግሮች ✔ ያሳያል
  • ሐ) አማካዩ ሁል ጊዜ የተሳሳተ ነው እና ጥቅም ላይ መዋል የለበትም
  • መ) መቶኛ የሚመለከተው በሲፒዩ መለኪያዎች ላይ ብቻ ነው።

ማብራሪያ፡ አማካኝ ትንሽ ክፍል ተጠቃሚዎች ያላቸውን በጣም መጥፎ ተሞክሮ ይደብቃል። ምንም እንኳን አማካይ 200 ms ቢመስልም, p99 6 ሰከንድ ሊሆን ይችላል; ይህ ማለት ከመቶ ጥያቄዎች ውስጥ አንዱ በጣም ዘገምተኛ ነው ማለት ነው። በመቶኛ በአማካኝ የተደበቀውን የእነዚህ አናሳዎች ህመም እንዲታይ ያደርገዋል።

7. በውቅረት አስተዳደር ውስጥ 'drift' ምንድን ነው እና ለምን አደገኛ ነው?

  • ሀ) የአውታረ መረብ ትራፊክ በሌሊት ይወድቃል
  • ለ) የአገልጋይ አካላዊ ማዛወር
  • ሐ) አገልጋዮች ከጊዜ በኋላ እርስ በርሳቸው እና ደረጃ ያፈነግጡ; ✔ ችግር እስኪፈጠር ድረስ የማይታይ
  • መ) የማዋቀሪያ ፋይሎችን በራስ-ሰር መጠባበቂያ

መግለጫ፡ ድራይፍት የአገልጋዮች እርስበርስ እና ከስታንዳርድ መዛባት በጊዜ ሂደት ሰነድ በሌላቸው በእጅ ለውጦች ነው። ጉዳቱ ዝምታ ነው፡ ችግሩ እስኪፈጠር ድረስ አይታይም ከዛ አንዱ አገልጋይ ከሌላው የተለየ ባህሪ አለው እና ምርመራው ሰአታት ይወስዳል። AI በንፅፅር እንዲንሸራሸር ያደርገዋል; የወርቅ ብየዳ መርህ ይከላከላል.

8. ለምንድነው የ'ፕላኑ' እርምጃ በ IaC መሳሪያዎች (እንደ ቴራፎርም) በጣም አስፈላጊው የጥበቃ ሀዲድ የሆነው?

  • ሀ) እቅዱ ኮዱን በፍጥነት ይሰራል
  • ለ) የእቅዱን ግዛት ፋይል ይሰርዛል
  • ሐ) ዕቅዱ የሚያስተካክለው የኮድ ቅርጸትን ብቻ ነው።
  • መ) ዕቅዱ ከመተግበሩ በፊት ምን እንደሚጨመር፣ እንደሚለወጥ እና እንደሚሰረዝ ያሳያል። የውሂብ መጥፋትን ይከላከላል ✔

መግለጫ፡ ፕላን (terraform plan/asible --check) ኮድን ከመተግበሩ በፊት 'ምን እንደሚቀየር' ቅድመ እይታ ይሰጣል፡ ምን ያህል ግብዓቶች እንደሚጨመሩ፣ እንደሚቀየሩ፣ እንደሚሰረዙ ያሳያል። በተለይም 'አጠፋ' እና 'መተካት ያስገድዳል' መስመሮች ከመተግበሩ በፊት የመረጃ መጥፋት አደጋን ያመለክታሉ. እቅዱን ሳያነቡ ማመልከት በጣም ውድ ከሆኑ ስህተቶች ውስጥ አንዱ ነው.

9. ለምንድነው የቴራፎርም ግዛት ፋይል በጥንቃቄ የተጠበቀ እና ወደ AI ወይም ክፍት ማከማቻዎች የማይለጠፍ?

  • ሀ) ግልጽ የጽሁፍ ሚስጥሮች በስቴት ፋይል ውስጥ ሊካተቱ ይችላሉ; ሾልኮ ከወጣ የማንነት መረጃው ይፋ ይሆናል ✔
  • ለ) የግዛቱ ፋይል በጣም ትልቅ ስለሆነ
  • ሐ) የግዛቱ ፋይል አስቀድሞ በማይነበብበት ሁኔታ ተመስጥሯል።
  • መ) የግዛት ፋይል ሲጋራ ኮዱ በፍጥነት ይሰራል

መግለጫ፡ የስቴት ፋይል አሁን ያለውን የሚተዳደር መሠረተ ልማት ሁኔታን ያቆያል እና ግልጽ የጽሑፍ ሚስጥሮችን (የውሂብ ጎታ ይለፍ ቃላት፣ ቁልፎች) ሊያካትት ይችላል። ስለዚህ፣ ኢንክሪፕት የተደረገ፣ መዳረሻ የተገደበ፣ በተቆለፈ የርቀት ጀርባ ውስጥ መቀመጥ አለበት። በሕዝብ መኪና ወይም ማከማቻ ውስጥ በፍጹም መቀመጥ የለበትም፣ አለበለዚያ ሚስጥሩ ይፈስሳል።

10. 'የተሳሳተ runbook ከምንም በላይ አደገኛ ነው' የሚለው አረፍተ ነገር በሰነዱ ውስጥ የሚያጎላው ምንድን ነው?

  • ሀ) runbook መጻፍ ጊዜ ማባከን ነው።
  • ለ) ያልተፈተነ የሩጫ መጽሐፍ በችግር ጊዜ በጭፍን ይተገበራል; አንድ የተሳሳተ እርምጃ ወደ ጥፋት ሊመራ ይችላል ✔
  • ሐ) Runbooks የተጻፉት ለአስተዳዳሪዎች ብቻ ነው።
  • መ) ሰነዶች በፍፁም መዘመን የለባቸውም

ማብራሪያ፡- runbook የሌለው ቡድን በችግር ጊዜ ጠንቃቃ እና አጠራጣሪ ነው። ነገር ግን 'ኦፊሴላዊ' runbook ያለው ሰው ሳይጠየቅ በውጥረት ውስጥ ይተገበራል። የ runbook ያልተሞከረ እና አንድ እርምጃ ከተሳሳተ፣ ዓይነ ስውር አተገባበር ወደ ጥፋት ያመራል። ለዚያም ነው እያንዳንዱ የሩጫ መጽሐፍ በእውነተኛ አካባቢ ውስጥ በደንብ መሞከር እና መታተም ያለበት።

11. በመተንበይ ጥገና, ዲስክ ወደ ውድቀት ሲቃረብ ለመረዳት ትክክለኛው አቀራረብ የትኛው ነው?

  • ሀ) አንድን መጥፎ SMART ዲስክ ወዲያውኑ ይተኩ
  • ለ) የ SMART ውሂብን ሙሉ በሙሉ ችላ ማለት
  • ሐ) በጊዜ ሂደት የእሴቶችን አዝማሚያ መመልከት; ✔ ተከታታይ እና የሚያፋጥን ጭማሪ ምልክት ቆጠራ
  • መ) ዲስኩ ሙሉ በሙሉ ከተሰበሰበ በኋላ ብቻ እርምጃ መውሰድ

ማብራሪያ፡ አንድ መጥፎ SMART ማንበብ ለፍርሃት መንስኤ አይደለም፤ ዲስኮች አልፎ አልፎ ስህተቶች እንዲስተካከሉ ማድረግ የተለመደ ነው። ትክክለኛው ምልክት አዝማሚያው ነው፡- ከጊዜ ወደ ጊዜ ወደ ሌላ ቦታ የተሸጋገረ ሴክተር ያሉ እሴቶች ወጥነት ያለው እና የሚያፋጥኑ። ለዚያም ነው AI አንድ ጊዜ ንባብ ሳይሆን ተከታታይ ጊዜ የሚሰጠው።

12. ሁለቱ በጣም በተደጋጋሚ የሚታለፉ ግን ወሳኝ የሆኑ የምርት ለውጥ ክፍሎች የትኞቹ ናቸው?

  • ሀ) የለውጡ ቀለም እና ስም
  • ለ) ለውጡን የሚያመጣው ሰው ርዕስ እና ክፍል
  • ሐ) በማህበራዊ አውታረመረቦች ላይ የለውጡን ማስታወቂያ
  • መ) የመመለሻ እቅድ እና የስኬት ማረጋገጫ መስፈርቶች ✔

ማብራሪያ፡ ለውጥ ከመተግበሩ በፊት 'መጥፎ ከሆነ እንዴት በትክክል እመለሳለሁ' (የመመለሻ እቅድ) እና 'ስኬታማ መሆኑን እንዴት አረጋግጣለሁ' (የስኬት ማረጋገጫ መስፈርት) ለሚሉት ጥያቄዎች የጽሁፍ መልስ ከሌለ ለውጡ ገና ዝግጁ አይደለም። እነዚህ ሁለቱ ከሌሉ፣ የተበላሸ ለውጥ 'ሙሉ' ተብሎ ሊወሰድ ይችላል።

13. የደህንነት ማሰማራት (አዲስ ስሪት/ፓች) ለሁሉም አገልጋዮች በተመሳሳይ ጊዜ ከመዘርጋት ይልቅ 'የካናሪ' አካሄድ ለምን ይመረጣል?

  • ሀ) ለውጡ በመጀመሪያ በትንሽ ክፍል ላይ ይተገበራል; ትኋን ሁሉንም መርከቦች ሳይሆን ትንሽ ክፍልን ይጎዳል እና ቀደም ብሎ ✔ ይያዛል
  • ለ) የካናሪ ስርጭት አነስተኛ የኤሌክትሪክ ፍጆታ ይወስዳል
  • ሐ) ካናሪ የማሰማራት ማረጋገጫን ሙሉ በሙሉ አላስፈላጊ ያደርገዋል
  • መ) የካናሪ ማሰማራት የሚመለከተው በመረጃ ቋቶች ላይ ብቻ ነው።

መግለጫ፡ የካናሪ ማሰማራት ለውጡን በትንሽ ክፍል (አንድ አገልጋይ፣ 5% ተጠቃሚዎች) በመጀመሪያ እና በመከታተል ላይ ነው። በዚህ መንገድ, ትኋን ሁሉንም መርከቦች ሳይሆን ትንሽ ክፍልን ይጎዳል እና ቀደም ብሎ ይያዛል. በአንድ ጊዜ የሚሰራጭ ሳንካ ሁሉንም ተጠቃሚዎች በተመሳሳይ ጊዜ ይነካል።

14. በደህንነት ሥራ ውስጥ አርቴፊሻል ኢንተለጀንስ ሲጠቀሙ የማይለዋወጥ የሥነ-ምግባር እና የሕግ ደንብ ምንድን ነው?

  • ሀ) አርቴፊሻል ኢንተለጀንስ በማንኛውም ስርአት ውስጥ ያሉ ተጋላጭነቶችን ለመቃኘት በነጻነት መጠቀም ይቻላል።
  • ለ) የሥነ ምግባር ደንብ የሚመለከተው በትልልቅ ተቋማት ላይ ብቻ ነው።
  • ሐ) በተፈቀደላቸው ስርዓቶች እና ለመከላከያ ዓላማዎች ብቻ ጥቅም ላይ ይውላል; ላልተፈቀደ መዳረሻ ወይም ጥቃት መጠቀም ወንጀል ነው።
  • መ) ለመማር ወደ ሌላ ሰው ስርዓት ውስጥ ሰርጎ መግባት ነፃ ነው።

መግለጫ: የስርዓት እና የአውታረ መረብ መረጃ ሁለት ጊዜ ጥቅም ላይ ይውላል. አርቴፊሻል ኢንተለጀንስ እርስዎ ፍቃድ በፃፉባቸው ስርዓቶች ውስጥ እና ለመከላከያ ዓላማዎች (የመዝገብ ማስፈራሪያ ፍለጋ፣ ማጠንከር፣ የአደጋ ምላሽ) ብቻ ነው መጠቀም የሚቻለው። የእርስዎን ያልሆነውን ስርዓት ለመቃኘት ወይም ሰርጎ ለመግባት መጠቀም ያልተፈቀደ መዳረሻ እና ወንጀል ነው። ለመማር ገለልተኛ ላቦራቶሪ መጠቀም አለበት።