യൂണിറ്റുകൾ
1. സിസ്റ്റത്തിലും നെറ്റ്‌വർക്ക് മാനേജ്‌മെൻ്റിലും ആർട്ടിഫിഷ്യൽ ഇൻ്റലിജൻസിൻ്റെ ആമുഖം: റോളുകൾ, അതിരുകൾ, ആധികാരികത, അധികാരം 2. ഓട്ടോമേഷൻ സ്ക്രിപ്റ്റുകൾ: ബാഷ്, പവർഷെൽ, പൈത്തൺ എന്നിവ സുരക്ഷിതമായി സൃഷ്ടിക്കുന്നു 3. ലോഗ് വിശകലനവും മൂലകാരണ വിശകലനവും: ശബ്ദത്തിൽ സിഗ്നൽ കണ്ടെത്തൽ 4. ശേഷിയും പ്രകടന നിരീക്ഷണവും: റീഡിംഗ് മെട്രിക്‌സും ഭാവിയിലേക്കുള്ള ആസൂത്രണവും 5. കോൺഫിഗറേഷൻ മാനേജ്മെൻ്റ്: കോൺഫിഗറേഷൻ സൃഷ്ടിക്കുന്നു, മൂല്യനിർണ്ണയം നടത്തുന്നു, ഡ്രിഫ്റ്റ് ക്യാപ്ചർ ചെയ്യുന്നു 6. കോഡ് (IaC) ആയി ഇൻഫ്രാസ്ട്രക്ചർ മാനേജ്മെൻ്റ്: ടെറാഫോം, അൻസിബിൾ, പ്ലാൻ കൺട്രോൾ 7. ഡോക്യുമെൻ്റേഷനും ഇൻഫർമേഷൻ മാനേജ്‌മെൻ്റും: റൺബുക്ക്, പോസ്റ്റ്‌മോർട്ടം, കോർപ്പറേറ്റ് മെമ്മറി 8. പ്രവചനാത്മക പരിപാലനം: പരാജയങ്ങൾ സംഭവിക്കുന്നതിന് മുമ്പ് കാണുക 9. മാനേജ്മെൻ്റ് മാറ്റുക: റിസ്ക് അസസ്മെൻ്റ്, റോൾബാക്ക്, മെയിൻ്റനൻസ് വിൻഡോ 10. സുരക്ഷയും പ്രതിരോധവും: പ്രതിരോധ ആവശ്യങ്ങൾക്കും അതോറിറ്റിയുടെ പരിധിക്കുള്ളിലും കൃത്രിമബുദ്ധി ഉപയോഗിക്കുന്നു 11. എൻഡ്-ടു-എൻഡ് ഇൻ്റഗ്രേഷൻ: തുടക്കം മുതൽ അവസാനം വരെ ഒരു സംഭവം കൈകാര്യം ചെയ്യുക
യൂണിറ്റ് 3 / 11

ലോഗ് വിശകലനവും മൂലകാരണ വിശകലനവും: ശബ്ദത്തിൽ സിഗ്നൽ കണ്ടെത്തൽ

നേട്ടങ്ങൾ:

  • സംഗ്രഹിക്കാനും ഗ്രൂപ്പുചെയ്യാനും ടൈംലൈൻ ലോഗുകളും AI ഉപയോഗിച്ച് ശബ്ദത്തിൽ സിഗ്നൽ വേഗത്തിൽ കണ്ടെത്തുക
  • പരസ്പര ബന്ധവും കാര്യകാരണവും വേർതിരിക്കാനും ആർട്ടിഫിഷ്യൽ ഇൻ്റലിജൻസിൻ്റെ മൂലകാരണ നിർദ്ദേശങ്ങളെ സ്ഥിരീകരിക്കേണ്ട അനുമാനങ്ങളായി പരിഗണിക്കാനുമുള്ള കഴിവ്
  • ആർട്ടിഫിഷ്യൽ ഇൻ്റലിജൻസ് ഉപയോഗിച്ച് '5 എന്തുകൊണ്ട്' രീതി പ്രവർത്തിപ്പിക്കുന്നതിലൂടെയും യഥാർത്ഥ തെളിവുകൾ ഉപയോഗിച്ച് ഓരോ ഘട്ടത്തെയും പിന്തുണയ്ക്കുന്നതിലൂടെയും യഥാർത്ഥ മൂലകാരണം നേടാനുള്ള കഴിവ്

ലോഗ് വിശകലനവും മൂലകാരണ വിശകലനവും: AI ഉപയോഗിച്ച് ശബ്ദത്തിൽ സിഗ്നൽ കണ്ടെത്തൽ

ഒരു സിസ്റ്റം തകരാറിലാകുമ്പോൾ, നിങ്ങൾ ആദ്യം നോക്കുന്നത് ലോഗുകളാണ്. ഒരു സിസ്റ്റത്തിൻ്റെയോ ആപ്ലിക്കേഷൻ്റെയോ "ഞാൻ എന്താണ് ചെയ്തത്, എന്താണ് സംഭവിച്ചത്, എന്താണ് തകർന്നത്" എന്നതിൻ്റെ ടൈം സ്റ്റാമ്പ് ചെയ്ത റെക്കോർഡ് സൂക്ഷിക്കുന്ന ഒരു ടെക്സ്റ്റ് സ്ട്രീം ആണ് ലോഗ്. എന്നാൽ ഒരു ആധുനിക ഇൻഫ്രാസ്ട്രക്ചർ മണിക്കൂറിൽ ദശലക്ഷക്കണക്കിന് രേഖകൾ നിർമ്മിക്കുന്നു; ഇത് വിവരങ്ങളുടെ കടലല്ല, പലപ്പോഴും ശബ്ദത്തിൻ്റെ ഒരു സമുദ്രമാണ്. ഈ ശബ്ദത്തിലെ പ്രധാന സിഗ്നൽ (പിശക്, അസാധാരണത, പാറ്റേൺ) കണ്ടെത്തുന്നതിനുള്ള കലയാണ് ലോഗ് വിശകലനം. ഒരു സംഭവത്തിന് ശേഷം "യഥാർത്ഥ കാരണം എന്തായിരുന്നു" എന്ന ചോദ്യത്തിന് ഉത്തരം നൽകുന്ന പ്രക്രിയയെ മൂലകാരണ വിശകലനം (RCA - റൂട്ട് കോസ് അനാലിസിസ്) എന്ന് വിളിക്കുന്നു. ഇവിടെ, സെക്കൻഡിൽ ആയിരക്കണക്കിന് വരികൾ സംഗ്രഹിക്കുന്നതിനും പാറ്റേണുകൾ വേർതിരിച്ചെടുക്കുന്നതിനും ടൈംലൈനുകൾ സ്ഥാപിക്കുന്നതിനും സാധ്യമായ കാരണങ്ങൾ പട്ടികപ്പെടുത്തുന്നതിനും AI വളരെ ശക്തമാണ്. എന്നാൽ ഒരു മുന്നറിയിപ്പ്: AI സാധ്യമായ കാരണങ്ങൾ സൃഷ്ടിക്കുന്നു; സിസ്റ്റത്തിൽ ഏതാണ് യഥാർത്ഥമെന്ന് പരിശോധിച്ച് തീരുമാനമെടുക്കുന്നത് നിങ്ങളാണ്.

ഈ യൂണിറ്റിൽ AI ഉപയോഗിച്ച് ലോഗുകൾ എങ്ങനെ ആത്മവിശ്വാസത്തോടെ സംഗ്രഹിക്കാം, ഒരു ഇവൻ്റിൻ്റെ ടൈംലൈൻ എങ്ങനെ സ്ഥാപിക്കാം, പരസ്പര ബന്ധവും (ഒന്നിച്ച് മാറുന്നതും) കാരണവും (ഒന്ന് മറ്റൊന്നിന് കാരണമാകുന്നു) എങ്ങനെ വേർതിരിക്കാം, കൂടാതെ AI ഉപയോഗിച്ച് "5 എന്തുകൊണ്ട്" പോലുള്ള ഒരു RCA രീതി പ്രവർത്തിപ്പിക്കാമെന്നും നിങ്ങൾ പഠിക്കും.

എന്തുകൊണ്ട് പരസ്പരബന്ധം കാരണമല്ല?

ഈ യൂണിറ്റിൻ്റെ ഏറ്റവും നിർണായകമായ ആശയം ഇതാണ്. രണ്ട് സംഭവങ്ങൾ ഒരേ സമയം സംഭവിക്കുന്നത് കൊണ്ട് ഒന്ന് മറ്റൊന്നിന് കാരണമാകില്ല. ഒരു സെർവറിൻ്റെ സിപിയുവും നെറ്റ്‌വർക്ക് ട്രാഫിക്കും ഒരേ സമയം വർദ്ധിച്ചേക്കാം; എന്നാൽ ഒന്ന് മറ്റൊന്നിൻ്റെ ഫലമല്ല, രണ്ടും മൂന്നാമതൊരു സംഭവത്തിൻ്റെ ഫലമായിരിക്കാം (ഉദാഹരണത്തിന്, ഒരു ബാച്ച് ജോലിയുടെ തുടക്കം). മെട്രിക്‌സ് ഒരുമിച്ച് മാറുന്നത് AI കാണുമ്പോൾ, "ഒരുപക്ഷേ X കാരണമായത് Y" എന്ന് അനുമാനിക്കുന്നു. ഇതൊരു തുടക്കമാണ്, ഒരു നിഗമനമല്ല. കാര്യകാരണം പരിശോധിക്കാൻ, നിങ്ങൾ ഒന്നുകിൽ വേരിയബിളിനെ വേർതിരിക്കേണ്ടതുണ്ട് (ടെസ്റ്റ് എൻവയോൺമെൻ്റിൽ X ട്രിഗർ ചെയ്‌ത് Y സംഭവിക്കുന്നുണ്ടോ എന്ന് നോക്കുക) അല്ലെങ്കിൽ മെക്കാനിസം തെളിയിക്കുക (X Y ഉത്പാദിപ്പിക്കുന്ന സാങ്കേതിക മാർഗങ്ങൾ കാണിക്കുക).

മുന്നറിയിപ്പ്: "ഇത് ഒരുപക്ഷേ ഇതിന് കാരണമായേക്കാം" എന്ന AI വാക്യം ഒരു സിദ്ധാന്തമായി എടുക്കുക, ഒരു കണ്ടെത്തലല്ല. RCA-യിൽ, തെറ്റായ മൂലകാരണം തെറ്റായ തിരുത്തലിലേക്കും സംഭവത്തിൻ്റെ ആവർത്തനത്തിലേക്കും നയിക്കുന്നു. നിങ്ങൾ ആദ്യം സംശയിക്കുന്നയാളെ കണ്ടെത്തി, കാരണം അല്ല; ജോലി അവിടെ തുടങ്ങുന്നു.

ഘട്ടം ഘട്ടമായി: AI ഉപയോഗിച്ചുള്ള ലോഗ് വിശകലനം

  1. വ്യാപ്തി ചുരുക്കുക. ഇവൻ്റ് വിൻഡോ നൽകുക, മുഴുവൻ ലോഗ് അല്ല: "ഇവൻ്റ് 14:05-ന് ആരംഭിച്ചു, 14:00-14:20 മുതൽ നിർണായകമാണ്". പ്രസക്തമായ സമയ സ്ലോട്ടും സേവനവും AI-യോട് പറയുക.
  2. മുഖംമൂടി. ലോഗുകളിൽ ആന്തരിക ഐപി, ഹോസ്റ്റ് നാമം, ഉപയോക്താവ്, ടോക്കൺ എന്നിവ അടങ്ങിയിരിക്കുന്നു. അവരെ മാസ്ക് ചെയ്യുക (10.x.x.x, host-A, user1, REDACTED) തുടർന്ന് കയറ്റുമതി ചെയ്യുക.
  3. സംഗ്രഹവും ഗ്രൂപ്പിംഗും അഭ്യർത്ഥിക്കുക. "ഈ ലോഗ് തീവ്രത അനുസരിച്ച് ഗ്രൂപ്പുചെയ്യുക, ആവർത്തിച്ചുള്ള പിശകുകൾ എണ്ണുക, ആദ്യ പിശകിൻ്റെ ടൈംസ്റ്റാമ്പ് കണ്ടെത്തുക." ഘടന ആവശ്യപ്പെടുക, അസംസ്കൃത രേഖയല്ല.
  4. ഒരു ടൈംലൈൻ സജ്ജീകരിക്കുക. "ഈ ഇവൻ്റുകൾ സമയക്രമത്തിൽ ക്രമീകരിക്കുക, എന്താണ് പിന്തുടരുന്നതെന്ന് കാണിക്കുക." ആദ്യത്തെ ഡോമിനോ കണ്ടെത്തുന്നത് മൂലകാരണത്തിലേക്കുള്ള വഴിയാണ്.
  5. സിദ്ധാന്തം ആവശ്യപ്പെടുക, തെളിവുകളല്ല. "സാധ്യമായ മൂലകാരണങ്ങൾ പ്രോബബിലിറ്റിയുടെ ക്രമത്തിൽ പട്ടികപ്പെടുത്തുകയും ഓരോന്നിനും സിസ്റ്റത്തിൽ പ്രവർത്തിപ്പിക്കുന്നതിന് എനിക്ക് ഒരു സ്ഥിരീകരണ കമാൻഡ് നൽകുകയും ചെയ്യുക." രോഗനിർണയത്തിനായി ആവശ്യപ്പെടുക, ഫലമല്ല.
  6. സിസ്റ്റത്തിൽ പരിശോധിച്ചുറപ്പിക്കുക. റീഡ്-ഒൺലി ഡയഗ്നോസ്റ്റിക് കമാൻഡുകൾ (ലോഗ് ഗ്രെപ്പ്, സ്റ്റാറ്റസ് ക്വറി, മെട്രിക്) ഉപയോഗിച്ച് ഓരോ സിദ്ധാന്തവും പരിശോധിക്കുക. സ്ഥിരീകരിച്ച ഒരു മൂലകാരണം മാത്രം ഉണ്ടാകുന്നതുവരെ ഇല്ലാതാക്കുക.

5 എന്തുകൊണ്ട് രീതി

RCA-യുടെ ക്ലാസിക്, ശക്തമായ ടൂൾ "5 എന്തുകൊണ്ട്" ആണ്: ഒരു ലക്ഷണത്തിൽ തുടങ്ങി "എന്തുകൊണ്ട്?" അഞ്ച് തവണ. ചോദിക്കുന്നതിലൂടെ, ഉപരിതല ലക്ഷണത്തിന് താഴെയുള്ള മൂലകാരണത്തിലേക്ക് നിങ്ങൾ എത്തിച്ചേരും. ഉദാഹരണം: "സൈറ്റ് തകർന്നു. എന്തുകൊണ്ട്? മെമ്മറി തീർന്നതിനാൽ ആപ്ലിക്കേഷൻ മരിച്ചു. എന്തുകൊണ്ട്? ഒരു ചോദ്യം മുഴുവൻ മെമ്മറിയും ദഹിപ്പിച്ചു. എന്തുകൊണ്ട്? ചോദ്യം ഒരു സൂചിക ഉപയോഗിച്ചില്ല. എന്തുകൊണ്ട്? അവസാന റിലീസിൽ സൂചിക ഇല്ലാതാക്കി. എന്തുകൊണ്ട്? ഇത് മാറ്റ അവലോകനത്തിൽ ശ്രദ്ധിക്കപ്പെട്ടില്ല." മൂലകാരണം ഉപരിതല "സൈറ്റ് ക്രാഷ്" അല്ല, മറിച്ച് "ദുർബലമായ മാറ്റ അവലോകന പ്രക്രിയ" ആണ്. ഈ ശൃംഖല നിർമ്മിക്കുന്നതിൽ AI ഒരു നല്ല പങ്കാളിയായിരിക്കും - എന്നാൽ നിങ്ങൾ ഓരോ "എന്തുകൊണ്ട്" എന്ന ഘട്ടവും യഥാർത്ഥ തെളിവുകൾ ഉപയോഗിച്ച് ബാക്കപ്പ് ചെയ്യണം, അല്ലെങ്കിൽ AI ഒരു വിശ്വസനീയവും തെറ്റായതുമായ ഒരു ശൃംഖലയുമായി വന്നേക്കാം.

മൂന്ന് മിനി കേസുകൾ

കേസ് 1 - 40,000 വരികൾ, 3 മിനിറ്റ്. ഒരു അഡ്‌മിനിസ്‌ട്രേറ്റർ ഒറ്റരാത്രികൊണ്ട് 40,000 അപേക്ഷാ ലോഗുകൾ സ്വമേധയാ സ്കാൻ ചെയ്യാൻ തുടങ്ങിയിരുന്നു. മാസ്ക് ചെയ്ത ലോഗിൻ്റെ പ്രസക്തമായ 20 മിനിറ്റ് ഭാഗം അദ്ദേഹം AI-ക്ക് നൽകുകയും സംഗ്രഹവും ഗ്രൂപ്പിംഗും ആവശ്യപ്പെടുകയും ചെയ്തു. കാലഹരണപ്പെട്ട ബഗുകൾക്ക് തൊട്ടുപിന്നാലെ, 02:14-ന് AI ആദ്യത്തെ OutOfMemory ബഗ് ഫ്ലാഗ് ചെയ്തു. എഞ്ചിനീയർക്ക് ടൈം ഷീറ്റ് ലഭിച്ചത് 3 മിനിറ്റിനുള്ളിൽ; സ്വന്തം മെട്രിക് പാനലിൽ യഥാർത്ഥ രോഗനിർണയം സ്ഥിരീകരിച്ചു.

കേസ് 2 - തെറ്റായ മൂലകാരണത്തിൽ നിന്ന് മടങ്ങുന്നു. AI-യുടെ ആദ്യ സിദ്ധാന്തം ("ലോഗുകൾ ഡിസ്കിൽ നിറഞ്ഞു") ശരിയാണെന്ന് ഒരു സംഘം കരുതി ലോഗുകൾ മായ്ച്ചു. എന്നാൽ സംഭവം അടുത്ത ദിവസവും ആവർത്തിച്ചു. രണ്ടാം റൗണ്ടിൽ, അവർ അച്ചടക്കത്തോടെ "5 എന്തുകൊണ്ട്" നടപ്പിലാക്കി: യഥാർത്ഥ കാരണം, ഒരു ആപ്ലിക്കേഷൻ പിശക് സെക്കൻഡിൽ നൂറുകണക്കിന് കോർ ഡമ്പുകൾ എഴുതുന്നു എന്നതാണ്. ആദ്യ സിദ്ധാന്തം പരസ്പര ബന്ധമായിരുന്നു; യഥാർത്ഥ കാരണം മറ്റൊന്നായിരുന്നു. പരിശോധിച്ചുറപ്പിക്കാതെയുള്ള സ്വീകാര്യത ഒരു ദിവസത്തെ സാവകാശം മാത്രമാണ് നൽകിയത്.

കേസ് 3 - ടൈംലൈൻ കുറ്റവാളിയെ കണ്ടെത്തി. ഇടയ്‌ക്കിടെയുള്ള നെറ്റ്‌വർക്ക് തകരാർ സമയത്ത് ഡസൻ കണക്കിന് ഉപകരണങ്ങളുടെ ലോഗുകൾ ഉണ്ടായിരുന്നു. എഞ്ചിനീയർ മാസ്ക് ധരിച്ച ലോഗുകൾ AI-ക്ക് നൽകുകയും അത് ഒരു ഏകീകൃത ടൈംലൈൻ സൃഷ്ടിക്കുകയും ചെയ്തു. ഒരു റിഡൻഡൻസി സ്വിച്ച് ഹെൽത്ത് ചെക്ക് സന്ദേശത്തിന് ശേഷം കൃത്യം 30 സെക്കൻഡുകൾക്ക് ശേഷം ഓരോ തടസ്സവും ആരംഭിച്ചതായി ചാർട്ട് കാണിച്ചു. ഈ പരസ്പരബന്ധം ശക്തമായ ഒരു സൂചനയായിരുന്നു; ഉപകരണത്തിലെ കീയുടെ ഫേംവെയർ പിശക് ടീം പരിശോധിച്ചുറപ്പിക്കുകയും അത് മാറ്റിസ്ഥാപിക്കുകയും ചെയ്തു.

പകർത്താവുന്ന നാല് ടെംപ്ലേറ്റുകൾ

1) ലോഗ് സംഗ്രഹവും ഗ്രൂപ്പിംഗും:

14:00-14:20 വരെയുള്ള [സേവനത്തിനായുള്ള മാസ്ക് ചെയ്ത ലോഗ് ചുവടെയുണ്ട്. എന്നോട് പറയൂ: (1) തീവ്രത പ്രകാരം വരികൾ ഗ്രൂപ്പുചെയ്‌ത് എണ്ണുക (പിശക്/മുന്നറിയിപ്പ്/വിവരം), (2) ആവർത്തിച്ചുള്ള 5 മികച്ച പിശക് പാറ്റേണുകൾ ലിസ്റ്റ് ചെയ്യുക, (3) ആദ്യ പിശകിൻ്റെ ടൈംസ്റ്റാമ്പ് കണ്ടെത്തുക. റോ ലോഗ് മാറ്റിയെഴുതരുത്, ഘടനാപരമായ ഒരു സംഗ്രഹം നൽകുക. ഒരു നിർമ്മിത ലൈൻ ചേർക്കുന്നു.ലോഗ്: [മാസ്ക്ഡ് ലോഗ്]

2) ഒരു ടൈംലൈൻ സജ്ജീകരിക്കുന്നു:

ഇനിപ്പറയുന്ന മാസ്ക് ചെയ്ത ഇവൻ്റ് റെക്കോർഡുകൾ ഞങ്ങൾ ഒരൊറ്റ ടൈംലൈനിലേക്ക് ക്രമീകരിച്ചു (ടൈംസ്റ്റാമ്പ് + ഉറവിടം + ഇവൻ്റ്). ഇനിപ്പറയുന്നവ കാണിക്കുകയും ആദ്യ ട്രിഗർ ആയി തോന്നുന്ന ഇവൻ്റ് അടയാളപ്പെടുത്തുകയും ചെയ്യുക. ഇതൊരു ഹൈപ്പോഥെസിസാണെന്നും കാര്യകാരണം പരിശോധിക്കേണ്ടതുണ്ടെന്നും ശ്രദ്ധിക്കുക. റെക്കോർഡിംഗുകൾ: [മാസ്ക് ചെയ്ത റെക്കോർഡിംഗുകൾ]

3) 5 കാരണങ്ങൾ RCA പങ്കാളി:

നിങ്ങളുടെ റോൾ: RCA ഫെസിലിറ്റേറ്റർ. ലക്ഷണം: [ലക്ഷണം]. "5 എന്തുകൊണ്ട്" എന്നോടൊപ്പം ചെയ്യുക: ഒരു "എന്തുകൊണ്ട്?" ഓരോ ഘട്ടത്തിലും. ചോദിക്കൂ, എൻ്റെ പക്കലുള്ള തെളിവുകൾ വെച്ച് ഞാൻ ഉത്തരം തരാം, നിങ്ങൾ അടുത്ത ചോദ്യം ചോദിക്കൂ. എൻ്റെ തെളിവുകൾ ദുർബലമാണെങ്കിൽ, എനിക്ക് മുന്നറിയിപ്പ് നൽകുകയും ഞാൻ ശേഖരിക്കേണ്ട ഡാറ്റ എന്താണെന്ന് പറയുകയും ചെയ്യുക. തെളിവില്ലാതെ മൂലകാരണം പ്രഖ്യാപിക്കരുത്.

4) അനുമാനം + സ്ഥിരീകരണ കമാൻഡ്:

ഈ ലക്ഷണത്തിൻ്റെ [ലക്ഷണം] സാധ്യമായ മൂലകാരണങ്ങൾ പ്രോബബിലിറ്റിയുടെ ക്രമത്തിൽ പട്ടികപ്പെടുത്തുക. ഓരോ കാരണത്തിനും: (എ) നിങ്ങൾ എന്താണ് സംശയിക്കുന്നത്, (ബി) എൻ്റെ സിസ്റ്റത്തിൽ പ്രവർത്തിപ്പിക്കുന്നതിന് എനിക്ക് ഒരു റീഡ്-ഒൺലി വെരിഫിക്കേഷൻ കമാൻഡ് നൽകുക (ഇല്ലാതാക്കുകയോ മാറ്റുകയോ ചെയ്യരുത്). ഏത് ഫലമാണ് അനുമാനത്തെ സ്ഥിരീകരിക്കുന്നത് അല്ലെങ്കിൽ നിരാകരിക്കുന്നത് എന്ന് വിശദീകരിക്കുക.

ദുർബലമായ പ്രോംപ്റ്റ് / ശക്തമായ പ്രോംപ്റ്റ്

ദുർബലമായ പ്രോംപ്റ്റ്:

ഈ രേഖയിൽ എന്താണ് തെറ്റ്? [10,000 വരികൾ അസംസ്കൃത രേഖ]

ഇത് രണ്ട് സെൻസിറ്റീവ് ഡാറ്റ ചോർത്താൻ പ്രേരിപ്പിക്കുന്നു, കൂടാതെ AI-യെ സന്ദർഭമില്ലാതെ വിടുകയും ചെയ്യുന്നു. AI ഒരു ക്രമരഹിതമായ വരിയിൽ ഇടറിവീഴുകയും ഉപരിപ്ലവമായ അല്ലെങ്കിൽ നിർമ്മിത കാരണം നൽകുകയും ചെയ്തേക്കാം.

ശക്തമായ നിർദ്ദേശം:

നിങ്ങളുടെ റോൾ: സീനിയർ SRE. ഇവൻ്റ്: പേയ്‌മെൻ്റ് സേവനം 02:10-02:25 ഇടയിൽ 50% പിശക് നൽകി. ആ ജാലകത്തിൻ്റെ മാസ്ക് ചെയ്ത ലോഗ് ചുവടെയുണ്ട്. എനിക്ക് (1) കാഠിന്യം അനുസരിച്ച് ഗ്രൂപ്പുചെയ്‌ത സംഗ്രഹം, (2) ആദ്യ പിശകിൻ്റെ ടൈംസ്റ്റാമ്പ്, (3) പ്രോബബിലിറ്റിയുടെ ക്രമത്തിൽ സാധ്യമായ മൂലകാരണങ്ങൾ, ഓരോന്നിനും ഒരു റീഡ്-ഒൺലി വെരിഫിക്കേഷൻ കമാൻഡ് എന്നിവ നൽകുക. മാർക്ക് കാര്യകാരണം അനുമാനങ്ങളായി അവകാശപ്പെടുന്നു. ലോഗ്: [മുഖമൂടി രേഖ]

പടി

ഉദ്ദേശം

AI യുടെ പങ്ക്

മനുഷ്യൻ്റെ പങ്ക്

സംഗ്രഹം/ഗ്രൂപ്പിംഗ്

ശബ്ദം കുറയ്ക്കുക

ആയിരക്കണക്കിന് വരികൾ കോൺഫിഗർ ചെയ്യുന്നു

വ്യാപ്തിയും മാസ്കും നിർണ്ണയിക്കുക

ടൈംലൈൻ

ആദ്യത്തെ ഡൊമിനോ കണ്ടെത്തുന്നു

ഇവൻ്റുകൾ അടുക്കുന്നു

സ്റ്റാമ്പുകൾ സാധൂകരിക്കുക

അനുമാന തലമുറ

സംശയിക്കുന്നവരെ തരംതിരിക്കുന്നു

സാധ്യതകൾ പട്ടികപ്പെടുത്തുക

സന്ദർഭം അനുസരിച്ച് ഫിൽട്ടർ ചെയ്യുക

സ്ഥിരീകരണം

യഥാർത്ഥ കാരണം കണ്ടെത്തുക

ഡയഗ്നോസ്റ്റിക് കമാൻഡ് നിർദ്ദേശിക്കുക

കമാൻഡ് പ്രവർത്തിപ്പിച്ച് അഭിപ്രായമിടുക

തീരുമാനം

പരിഹരിക്കാൻ തിരഞ്ഞെടുക്കുന്നു

ഓഫർ ഓപ്ഷനുകൾ

തീരുമാനം എടുത്ത് സ്ഥിരീകരിക്കുക

സാധാരണ തെറ്റുകൾ

  • കാര്യകാരണമായി പരസ്പരബന്ധം തെറ്റിദ്ധരിക്കുന്നു. "ഒന്ന് മറ്റൊന്നിന് കാരണമായി" ഒന്നിച്ച് മാറുന്ന രണ്ട് മെട്രിക്കുകൾ സ്വീകരിക്കുന്നത് തെറ്റായ തിരുത്തൽ ഉണ്ടാക്കുന്നു.
  • മാസ്ക് ഇല്ലാതെ റോ ലോഗ് ഒട്ടിക്കുന്നു. ഐപിയും ടോക്കണും ഉപയോക്താവും അടങ്ങുന്ന ലോഗ് ഓപ്പൺ ടൂളിലേക്ക് നൽകുന്നത് സുരക്ഷാ ലംഘനമാണ്.
  • ആദ്യ സിദ്ധാന്തത്തെ മൂലകാരണമായി പ്രഖ്യാപിക്കുന്നു. AI-യുടെ ആദ്യ നിർദ്ദേശം പരിശോധിച്ചുറപ്പിക്കാതെ സ്വീകരിക്കുന്നത് ഇവൻ്റിൻ്റെ ആവർത്തനത്തിനുള്ള ക്ഷണമാണ്.
  • മുഴുവൻ ലോഗും കയറ്റുമതി ചെയ്യുന്നു. സന്ദർഭം ഇല്ലാത്ത വലിയ ലോഗ് AI-യെ ഒരു റാൻഡം ലൈനിലേക്ക് പ്ലഗ് ചെയ്യുന്നു; ഇവൻ്റ് വിൻഡോയിലേക്ക് ചുരുക്കുക.
  • തെളിവുകളില്ലാത്ത 5 കാരണങ്ങൾ. നിങ്ങൾ ഓരോ "എന്തുകൊണ്ട്" എന്ന ഘട്ടവും യഥാർത്ഥ ഡാറ്റ ഉപയോഗിച്ച് ബാക്കപ്പ് ചെയ്തില്ലെങ്കിൽ, നിങ്ങൾക്ക് വിശ്വസനീയവും എന്നാൽ നിർമ്മിച്ചതുമായ ഒരു ചെയിൻ ലഭിക്കും.
നുറുങ്ങ്: ഒരു RCA അവസാനിപ്പിക്കുന്നതിന് മുമ്പ്, "ഈ മൂലകാരണം യഥാർത്ഥത്തിൽ പരിഹരിച്ചിട്ടുണ്ടെങ്കിൽ, ഇത് വീണ്ടും സംഭവിക്കില്ലേ?" ചോദ്യം ചോദിക്കുക. ഉത്തരം "ഒരുപക്ഷേ" ആണെങ്കിൽ, നിങ്ങൾ ഇതുവരെ മൂലകാരണത്തിലേക്ക് എത്തിയിട്ടില്ല; മറ്റൊരു "എന്തുകൊണ്ട്" എന്ന് ചോദിക്കുക.

ചുരുക്കത്തിൽ

ലോഗ് വിശകലനം എന്നത് ശബ്ദത്തിൻ്റെ സമുദ്രത്തിൽ സിഗ്നൽ കണ്ടെത്തുന്നതിനെക്കുറിച്ചാണ്; AI ഈ സമുദ്രത്തെ നിമിഷങ്ങൾക്കുള്ളിൽ സംഗ്രഹിക്കുകയും ഘടന ചെയ്യുകയും ചെയ്യുന്നു, ഒരു ടൈംലൈൻ സ്ഥാപിക്കുകയും അനുമാനങ്ങൾ സൃഷ്ടിക്കുകയും ചെയ്യുന്നു. എന്നാൽ പരസ്പരബന്ധം കാരണമല്ല: AI നിർദ്ദേശിച്ച കാരണം ഒരു പ്രാഥമിക സംശയമാണ്, സ്ഥിരീകരിക്കുന്നത് വരെ കണ്ടെത്തലല്ല. ഇവൻ്റ് വിൻഡോയിലേക്ക് ലോഗ് ചുരുക്കുക, അത് മറയ്ക്കുക, ഘടന ആവശ്യപ്പെടുക, "5 എന്തുകൊണ്ട്" ഉപയോഗിച്ച് ആഴത്തിൽ കുഴിച്ചെടുക്കുക, കൂടാതെ റീഡ്-ഒൺലി കമാൻഡുകൾ ഉപയോഗിച്ച് സിസ്റ്റത്തിലെ ഓരോ സിദ്ധാന്തവും പരിശോധിക്കുക. മൂലകാരണം കണ്ടെത്തി പരിഹാരം സ്ഥിരീകരിക്കുന്നത് നിങ്ങളാണ്; AI നിങ്ങളുടെ കൂട്ടുകാരനാണ്.

ആപ്ലിക്കേഷൻ ടാസ്ക്

കഴിഞ്ഞ ഒരു ഇവൻ്റിൻ്റെ (അല്ലെങ്കിൽ ഒരു ടെസ്റ്റ് ഇവൻ്റിൻ്റെ) ലോഗുകൾ എടുക്കുക, ഇവൻ്റ് വിൻഡോയിലേക്ക് അത് ചുരുക്കുക, കൂടാതെ ഏതെങ്കിലും സെൻസിറ്റീവ് ഏരിയകൾ മറയ്ക്കുക. മുകളിലുള്ള "ലോഗ് സംഗ്രഹം", "ടൈംലൈൻ" എന്നീ ടെംപ്ലേറ്റുകൾ ഉപയോഗിച്ച് AI-യിൽ നിന്ന് ഒരു സംഗ്രഹവും ഷെഡ്യൂളും അഭ്യർത്ഥിക്കുക. തുടർന്ന് "5 കാരണങ്ങൾ RCA പങ്കാളി" ടെംപ്ലേറ്റ് ഉപയോഗിച്ച് ലക്ഷണത്തിൽ നിന്ന് മൂലകാരണത്തിലേക്ക് നീങ്ങുക; ഓരോ ഘട്ടത്തിനും നിങ്ങളുടെ സ്വന്തം തെളിവുകൾ എഴുതുക. അവസാനമായി, ഒരു സ്ഥിരീകരണ കമാൻഡ് ഉപയോഗിച്ച് AI-യുടെ പ്രാരംഭ സിദ്ധാന്തം പരിശോധിച്ച് അത് സ്ഥിരീകരിക്കപ്പെട്ടതാണോ അതോ തെളിയിക്കപ്പെട്ടതാണോ എന്ന് രേഖപ്പെടുത്തുക. പ്രക്രിയയെ 6 ഇനങ്ങളിൽ സംഗ്രഹിക്കുക.

ചെക്ക്ലിസ്റ്റ്

  • [ ] ഞാൻ ഇവൻ്റ് വിൻഡോയിലേക്ക് ലോഗ് ചുരുക്കി സെൻസിറ്റീവ് ഏരിയകൾ മറച്ചിട്ടുണ്ടോ?
  • [ ] ഞാൻ AI യോട് ഒരു ഘടനാപരമായ സംഗ്രഹവും ടൈംലൈനും ആവശ്യപ്പെട്ടോ, ഒരു റോ ലോഗ് അല്ല?
  • [ ] ഞാൻ AI യുടെ കാര്യകാരണ അവകാശവാദങ്ങളെ അനുമാനങ്ങളായി അടയാളപ്പെടുത്തിയിട്ടുണ്ടോ?
  • [ ] ഒരു റീഡ്-ഒൺലി വെരിഫിക്കേഷൻ കമാൻഡ് ഉപയോഗിച്ച് സിസ്റ്റത്തിലെ ഓരോ സിദ്ധാന്തവും ഞാൻ പരീക്ഷിച്ചിട്ടുണ്ടോ?
  • [ ] യഥാർത്ഥ തെളിവുകൾ സഹിതം "5 എന്തുകൊണ്ട്" എന്നതിൻ്റെ ഓരോ ഘട്ടവും ഞാൻ ബാക്കപ്പ് ചെയ്തിട്ടുണ്ടോ?
  • [ ] മൂലകാരണം യഥാർത്ഥത്തിൽ ഇവൻ്റിനെ തടയുമോ എന്ന് ഞാൻ ചോദ്യം ചെയ്യുകയും തീരുമാനമെടുക്കുകയും ചെയ്തോ?