లాభాలు:
- గుర్తించడం, రోగ నిర్ధారణ, తగ్గించడం, శాశ్వత పరిష్కారం మరియు అభ్యాస దశలలో కృత్రిమ మేధస్సు మద్దతుతో సంఘటన యొక్క ముగింపు-ముగింపు నిర్వహణ
- కృత్రిమ మేధస్సుకు బదిలీ చేయగల దశలను మరియు ప్రతి దశలో మానవ నిర్ణయం అవసరమయ్యే వాటిని వేరు చేయడం ద్వారా భయాందోళన సమయాల్లో కూడా ధృవీకరణ క్రమశిక్షణను నిర్వహించగల సామర్థ్యం.
- 'ఏం జరుగుతోంది, ఎలా వ్రాయాలి' అనే ప్రశ్నల కంటే కృత్రిమ మేధస్సుకు ప్రాధాన్యత ఉంటుంది అనే గోల్డెన్ రూల్ను వ్యాపార రిఫ్లెక్స్గా మార్చగల సామర్థ్యం.
ఎండ్-టు-ఎండ్ ఇంటిగ్రేషన్: AIతో ఎండ్ నుండి ఎండ్ వరకు ఒక సంఘటనను నిర్వహించడం
మీరు మునుపటి పది యూనిట్లలోని భాగాలను నేర్చుకున్నారు: స్క్రిప్టింగ్, లాగ్ విశ్లేషణ, పర్యవేక్షణ, కాన్ఫిగరేషన్, IaC, డాక్యుమెంటేషన్, ప్రిడిక్టివ్ మెయింటెనెన్స్, మార్పు నిర్వహణ మరియు భద్రత. కానీ వాస్తవ ప్రపంచంలో, ఈ భాగాలు ఒక్కొక్కటిగా రావు, కానీ ఒక సంఘటనలో పెనవేసుకుని ఉంటాయి. ఈ చివరి యూనిట్లో, మేము ముక్కలను ఒకచోట చేర్చుతాము: అర్ధరాత్రి ప్రారంభమైన సంఘటనను ఎండ్-టు-ఎండ్, డిటెక్షన్ నుండి మూలకారణం వరకు, రెమిడియేషన్ నుండి డాక్యుమెంటేషన్ వరకు మరియు ప్రతి దశలో AI యొక్క సరైన మోతాదును ఎలా ఉపయోగించాలో మీరు పూర్తిగా చూస్తారు. లక్ష్యం కొత్త టెక్నిక్ నేర్పడం కాదు; ఇంజనీర్ రిఫ్లెక్స్గా మీరు నేర్చుకున్న వాటిని కలపడం, మాడ్యూల్ అంతటా పునరావృతమయ్యే ఒక సత్యాన్ని బలోపేతం చేయడం: AI ప్రతి దశలో వేగవంతం చేస్తుంది, ప్రకాశిస్తుంది మరియు బ్లూప్రింట్ చేస్తుంది; కానీ ఎల్లప్పుడూ రోగనిర్ధారణను నిర్ధారించేది, ఆదేశాన్ని అమలు చేయడం, మార్పును నిర్ధారించడం మరియు ఫలితానికి బాధ్యత వహించేది మానవుడే.
ఈ యూనిట్లో, మీరు ఒక సంఘటన యొక్క జీవితచక్రాన్ని-గుర్తింపు, నిర్ధారణ, జోక్యం, స్పష్టత, అభ్యాసం-మరియు ప్రతి దశలో AI పాత్ర మరియు పరిమితులను ఒక ఉదాహరణ ద్వారా ఏకీకృతం చేస్తారు.
ఒక సంఘటన యొక్క జీవిత చక్రం
ప్రతి తీవ్రమైన సంఘటన ఒకే విధమైన దశల గుండా వెళుతుంది మరియు ప్రతి దశలో AI విభిన్న పాత్రను కలిగి ఉంటుంది. గుర్తింపు: అలారం ధ్వనులు, వినియోగదారు ఫిర్యాదు చేయడం, మెట్రిక్ బేస్లైన్ నుండి వైదొలగడం (యూనిట్ 4). ధృవీకరణ మరియు పరిధి: ఇది నిజంగా ఒక సమస్య, ఇది ఎంత విస్తృతమైనది? రోగ నిర్ధారణ: లాగ్లు మరియు మెట్రిక్ల నుండి మూల కారణాన్ని పొందడం (యూనిట్ 3). ప్రతిస్పందన మరియు ఉపశమనం: నష్టాన్ని ఆపడం, ప్రత్యామ్నాయం. శాశ్వత పరిష్కారం: మార్పు నిర్వహణ (యూనిట్ 9), స్క్రిప్ట్ (యూనిట్ 2) లేదా అవసరమైతే కాన్ఫిగరేషన్ (యూనిట్ 5)తో పరిష్కరించండి. అభ్యాసం: పోస్ట్మార్టం మరియు రన్బుక్ నవీకరణ (యూనిట్ 7). AI గుర్తించడంలో క్రమరాహిత్యాన్ని సూచిస్తుంది, రోగనిర్ధారణలో పరికల్పనలను ఉత్పత్తి చేస్తుంది, జోక్యంలో ఎంపికలను అందిస్తుంది, పరిష్కారంలో చిత్తుప్రతులను వ్రాస్తుంది, అభ్యాసంలో పత్రాలను ఉత్పత్తి చేస్తుంది - కానీ ప్రతి దశలో, మానవులు నిర్ణయాత్మక పాయింట్లో నిలబడతారు.
చిట్కా: ఒక సంఘటన యొక్క అత్యంత ప్రమాదకరమైన క్షణం అనేది రోగనిర్ధారణ మరియు ఒత్తిడి ఎక్కువగా ఉన్నప్పుడు ప్రతిస్పందన యొక్క క్షణం - ఖచ్చితంగా AIని గుడ్డిగా విశ్వసించాలనే కోరిక బలంగా ఉన్నప్పుడు. మీరు ఎంత హడావుడి చేస్తే, "చదవండి, ధృవీకరించండి, తిరిగి రావడానికి సిద్ధం చేయండి" రిఫ్లెక్స్ను మీరు అంత గట్టిగా పట్టుకుంటారు. భయాందోళనల సమయంలో దాటవేయబడిన ఒక ధృవీకరణ ఈవెంట్ను రెట్టింపు చేస్తుంది.
ప్రారంభం నుండి ముగింపు వరకు ఒక ఉదాహరణ
దానిని కాంక్రీటుగా చేద్దాం. 02:10కి అలారం: చెల్లింపు సేవ p99 ప్రతిస్పందన సమయం 6 సెకన్లు, బేస్లైన్ కంటే బాగా ఎక్కువ (250–400 ms). గుర్తించడం సరైనది: ట్రాకింగ్ పని చేసింది. నిర్ధారణ: బహుళ స్థానాల నుండి నిర్ధారణ, నిజమైన సంఘటన. డయాగ్నస్టిక్స్: ఇంజనీర్ మాస్క్డ్ లాగ్ మరియు చివరి 20 నిమిషాల మెట్రిక్లను AIకి అందిస్తారు; AI టైమ్లైన్ను ఏర్పాటు చేస్తుంది మరియు 02:08కి విస్తరణ తర్వాత వెంటనే ప్రారంభమయ్యే మందగమనాన్ని సూచిస్తుంది - బలమైన సహసంబంధం, కానీ ఇప్పటికీ ఒక పరికల్పన. ఇంజనీర్ దీన్ని విస్తరణ లాగ్తో నిర్ధారిస్తారు: అవును, 02:08కి విడుదల విడుదల చేయబడింది. ప్రతిస్పందన: పంపిణీని వెనక్కి తీసుకోవడం వేగవంతమైన తగ్గింపు; మార్పు అభ్యర్థనలో రోల్బ్యాక్ దశ సిద్ధంగా ఉంది (యూనిట్ 9). ఇంజనీర్ మొదట కానరీ లాజిక్తో సర్వర్లో రోల్బ్యాక్ను అమలు చేస్తాడు, ప్రతిస్పందన సమయం మెరుగుపడుతుంది, ఆపై దానిని ప్రచారం చేస్తుంది. శాశ్వత పరిష్కారం: అసలు మూల కారణం (కొత్త వెర్షన్లో ఇండెక్స్ చేయని ప్రశ్న) మరుసటి రోజు ప్రశాంతంగా పరిష్కరించబడుతుంది. అభ్యాసం: AI-రహిత పోస్ట్-మార్టం డ్రాఫ్ట్ చేయబడింది మరియు రన్బుక్కి “పోస్ట్-డిప్లాయ్మెంట్ p99 మానిటరింగ్” దశ జోడించబడింది. ప్రతి దశలో, AI వేగవంతం చేయబడింది; ప్రతి నిర్ణయం పాయింట్ వద్ద మానవుడు ధృవీకరించబడ్డాడు.
మానవ-AI కార్మిక విభజన యొక్క గోల్డెన్ రూల్
మాడ్యూల్ అంతటా మీరు చూసే వ్యత్యాసం ఇక్కడ ఒక నియమం అవుతుంది: "ఏం జరుగుతోంది, ఏమి జరుగుతుంది, ఎలా వ్రాయాలి" అనే ప్రశ్నలలో AI ముందుంది; “ఇప్పుడేం చేయాలి, దీనికి ఎవరు హామీ ఇస్తారు?” వంటి ప్రశ్నలు వచ్చినప్పుడు ప్రజలు ముందున్నారు. AI అలసిపోనిది, వేగవంతమైనది, విస్తారమైన సమాచారాన్ని స్కాన్ చేస్తుంది మరియు బ్లూప్రింట్లను రూపొందిస్తుంది — కానీ దీనికి పూర్తి సందర్భం తెలియదు, భ్రాంతులు కలిగించగలవు, జవాబుదారీతనాన్ని నిర్వహించలేవు మరియు మీ సంస్థ దాచిన డిపెండెన్సీలను చూడదు. మనిషి నెమ్మదిగా ఉంటాడు, కానీ సందర్భం, బాధ్యత మరియు తీర్పును కలిగి ఉంటాడు. రెండింటి మధ్య సరైన శ్రమ విభజనలో ఉత్తమ ఫలితం ఉంటుంది: AIకి పునరావృత, వచన, ఉత్పాదక పనిని అప్పగించండి; ధృవీకరణ, నిర్ణయం మరియు అమలు మానవీయంగా ఉంచండి.
మూడు చిన్న కేసులు
కేసు 1 — 40 నిమిషాల ముగింపు. డిస్క్ పూర్తి ఈవెంట్లో, ఒక SRE మొత్తం గొలుసును AIతో వేగవంతం చేసింది: బేస్లైన్ (5 నిమి)తో అలారంను నిర్ధారించింది, ముసుగు లాగ్ను YZకి సంగ్రహించి, మొదటి ఎర్రర్ను (5 నిమి), రియల్ సిస్టమ్లో AI యొక్క "లాగ్ రొటేషన్ ఆపివేయబడింది" పరికల్పనను ధృవీకరించింది (5 నిమి), రన్ చేసి, 1 పోస్ట్-మార్క్ క్లీనింగ్తో స్క్రిప్ట్ను అమలు చేసింది. AIకి వ్రాసిన స్కెచ్ మరియు వాస్తవాలను ధృవీకరించింది (15 నిమి). మొత్తం 40 నిమిషాలు; AI లేకుండా దాదాపు రెండు రెట్లు ఎక్కువ. కానీ ప్రతి దశలో ధృవీకరణ దశ ఉంది.
కేస్ 2 — భయాందోళనల సమయంలో ధృవీకరణ దాటవేయబడింది. మరో బృందం కోత పెట్టింది. ఇది AI యొక్క మొదటి మూలకారణ పరికల్పనను (డిపెండెన్సీ సర్వీస్) ధృవీకరించకుండానే అంగీకరించింది మరియు ఆ సేవను పునఃప్రారంభించింది. అసలు కారణం వేరేది అయినందున సమస్య పరిష్కరించబడలేదు; అంతేకాకుండా, అనవసరమైన రీబూట్ రెండవ అంతరాయాన్ని సృష్టించింది. పాఠం: ధృవీకరణను దాటవేయడానికి తొందరపాటు సమర్థన కాదు; AI పరికల్పన ధృవీకరించబడటానికి ముందు, చర్య సంఘటనను పెంచుతుంది.
కేసు 3 - పరిమితి గురించి తెలుసుకోవడం. సంక్లిష్టమైన నెట్వర్క్ సమస్యపై AI కోరుతున్న కాన్ఫిగరేషన్ మార్పును ఇంజనీర్ అమలు చేయబోతున్నారు. కానీ ఈ మార్పు కోలుకోలేనిదిగా అనిపించింది మరియు ఏజెన్సీ యొక్క నిర్దిష్ట రూటింగ్ నియమాలు AIకి తెలియదు. ఇంజనీర్ ఆగి, సీనియర్ నెట్వర్క్ నిపుణుడిని సంప్రదించి, AI యొక్క ప్రతిపాదన ఈ ప్రత్యేక టోపోలాజీలో రూటింగ్ లూప్ను సృష్టిస్తుందని తెలుసుకున్నారు. AI యొక్క పరిమితిని తెలుసుకోవడం అంతరాయాన్ని నిరోధించింది.
నాలుగు కాపీ చేయగల టెంప్లేట్లు
1) ఈవెంట్ ట్రిగ్గర్ సారాంశం (ట్రయాజ్):
మీ పాత్ర: సీనియర్ SRE, అసిస్టెంట్ ఇన్సిడెంట్ కమాండర్. యాక్టివ్ ఈవెంట్ ఉంది. నేను మీకు ఇచ్చే మాస్క్డ్ అలర్ట్/మెట్రిక్/లాగ్ నాకు త్వరిత పరీక్షను అందిస్తుంది: (1) లక్షణం ఏమిటి, (2) ప్రభావం యొక్క పరిధి ఏమిటి, (3) ముందుగా చూడవలసిన 3 ప్రాంతాలు, (4) ప్రతిదానికి చదవడానికి-మాత్రమే నియంత్రణ కమాండ్. నిర్ణయం మరియు అమలు నాదే; దారి పంపండి. డేటా: [ముసుగు]
2) దశల సంఘటన నిర్వహణ గైడ్:
లక్షణం [లక్షణం] కోసం సంఘటన జీవితచక్రం ద్వారా నన్ను దశలవారీగా తీసుకెళ్లండి: గుర్తింపు నిర్ధారణ, రోగ నిర్ధారణ, ఉపశమనం, శాశ్వత పరిష్కారం, అభ్యాసం. ప్రతి దశలో, నాకు చెప్పండి (ఎ) నేను ఏమి చేయాలి, (బి) నేను దానిని AIకి సురక్షితంగా అప్పగించగలిగినప్పుడు, (సి) నేనే ఏ నిర్ణయం తీసుకోవాలి. నేను తొందరపడినా నేను దాటవేయకూడని ధృవీకరణ దశలను గుర్తించండి.
3) డెసిషన్ పాయింట్ కంట్రోల్:
నేను ఈవెంట్ మధ్యలో ఉన్నాను మరియు నేను ఈ క్రింది చర్య తీసుకోబోతున్నాను: [చర్య]. అమలు చేయడానికి ముందు, నన్ను అడగండి: (1) ఇది రివర్సిబుల్, (2) నేను ఏ వెరిఫికేషన్ చేసాను/చేయలేదు, (3) నా దగ్గర రోల్బ్యాక్ ప్లాన్ ఉందా, (4) ఈ చర్య అసలు కారణాన్ని పరిష్కరించిందని నా దగ్గర ఆధారాలు ఉన్నాయా? మీరు ఏదైనా తప్పిపోయినట్లు కనిపిస్తే, నన్ను ఆపండి.
4) ఈవెంట్ తర్వాత ఇంటిగ్రేటెడ్ లెర్నింగ్:
ఇప్పుడే పరిష్కరించబడిన సంఘటన కోసం, [సారాంశం] నాకు అందించింది: (1) నింద లేకుండా పోస్ట్మార్టం డ్రాఫ్ట్, (2) ఈ సంఘటనను నిరోధించే 3 శాశ్వత మెరుగుదలలు (పర్యవేక్షణ/ఆటోమేషన్/కాన్ఫిగరేషన్), (3) అప్డేట్ చేయాల్సిన రన్బుక్ దశలు, (4) ఇలాంటి సంఘటన కోసం ముందస్తు హెచ్చరిక సిగ్నల్ సూచన. ఆధారాలు లేకుండా మూలకారణాన్ని రాయడం; వాస్తవాల ఆధారంగా.
బలహీనమైన ప్రాంప్ట్ / బలమైన ప్రాంప్ట్
బలహీనమైన ప్రాంప్ట్:
సిస్టమ్ క్రాష్ అయింది, నేను ఏమి చేయాలి?
భయంతో, సందర్భం లేకుండా మరియు ధృవీకరణ లేకుండా, ఈ ప్రాంప్ట్ AI నుండి సాధారణ మరియు బహుశా ప్రమాదకరమైన సలహాను అందుకుంటుంది. పరుగెత్తడం ఈ సమయంలో చాలా తప్పులకు దారితీస్తుంది.
శక్తివంతమైన ప్రాంప్ట్:
మీ పాత్ర: సహాయక సంఘటన కమాండర్. సక్రియ ఈవెంట్: చెల్లింపు serviceip99 ప్రతిస్పందన సమయం 02:10 నుండి 15 సార్లు బేస్లైన్ (250-400 ms). 02:08కి పంపిణీ జరిగిందని నాకు తెలుసు. నాకు ఇవ్వండి:(1) అత్యంత సంభావ్య పరికల్పన మరియు దానిని చదవడానికి మాత్రమే ఎలా ధృవీకరించాలి, (2) వేగవంతమైన మరియు రివర్సిబుల్ ఉపశమన ఎంపిక, (3) ఈ ఉపశమనాన్ని వర్తింపజేయడానికి ముందు నేను నియంత్రించాల్సిన ప్రమాదాలు. నాకు అమలు మరియు ఆమోదం ఉంది. అదనపు డేటా: [ముసుగు మెట్రిక్/లాగ్]
ఈవెంట్ దశ
AI పాత్ర
క్లిష్టమైన మానవ నిర్ణయం
గుర్తింపు
క్రమరాహిత్యాన్ని గుర్తించండి
అసలు సంఘటనేనా, పరిధి ఏమిటి?
వ్యాధి నిర్ధారణ
పరికల్పన తరం
ఏ పరికల్పన నిర్ధారించబడింది?
తగ్గింపు
ఎంపికలను అందించవద్దు
ఏ తగ్గింపు రివర్సబుల్?
శాశ్వత పరిష్కారం
డ్రాఫ్ట్/స్క్రిప్ట్
మార్పును ఆమోదించండి మరియు అమలు చేయండి
నేర్చుకోవడం
పోస్ట్ మార్టం స్కెచ్
వాస్తవాలు మరియు పాఠాలను ధృవీకరించడం
సాధారణ తప్పులు
- భయంతో ధృవీకరణను దాటవేస్తున్నారు. "రీడ్-వెరిఫై-ప్రిపేర్ రిటర్న్" రిఫ్లెక్స్ను విడిచిపెట్టడానికి పరుగెత్తడం సమర్థన కాదు; ఒత్తిడి పెరిగే కొద్దీ క్రమశిక్షణ పెరగాలి.
- సాక్ష్యం కోసం పరికల్పనను తప్పుగా అర్థం చేసుకోవడం. AI యొక్క మొదటి మూలకారణ సూచనను నిర్ధారించకుండా చర్య తీసుకోవడం సంఘటనను తీవ్రతరం చేస్తుంది.
- AI యొక్క సందర్భ సరిహద్దును మర్చిపోవడం. AIకి సంస్థ యొక్క దాగి ఉన్న డిపెండెన్సీలు తెలియవు; క్లిష్టమైన మార్పులో, మానవ తీర్పు ప్రబలంగా ఉంటుంది.
- అభ్యాస దశను దాటవేయడం. పోస్ట్మార్టం మరియు రన్బుక్ అప్డేట్లు లేకుండా ఈవెంట్, అదే రాత్రి మళ్లీ ప్రారంభమవుతుంది.
- AI పై బాధ్యతను ఉంచడం. “AI అలా చెప్పింది” అనేది రక్షణ కాదు; ఉరితీత బాధ్యత ఎల్లప్పుడూ మానవునిపైనే ఉంటుంది.
హెచ్చరిక: ఇన్సిడెంట్ మేనేజ్మెంట్లో AIని ఉపయోగించడం నేర్చుకునే సంఘటన నిర్వహణను భర్తీ చేయదు. వాహనం క్రాష్ కావచ్చు, క్రాష్ కావచ్చు లేదా యాక్సెస్ చేయలేకపోవచ్చు. బేసిక్స్ తెలిసిన ఇంజనీర్ AIతో వేగంగా ఉంటాడు; బేసిక్స్ తెలియని ఇంజనీర్ AIతో వేగంగా తప్పులు చేస్తాడు. మొదట క్రమశిక్షణను ఏర్పరచుకోండి, ఆపై AI నుండి వేగాన్ని పొందండి.
సారాంశంలో
వాస్తవ ప్రపంచంలో, భాగాలు ఒక్కొక్కటిగా రావు, కానీ ఒక సంఘటనలో పెనవేసుకుని ఉంటాయి. గుర్తించడం నుండి అభ్యాసం వరకు ఈవెంట్ను నిర్వహిస్తున్నప్పుడు, AI ప్రతి దశలో వేగవంతం చేస్తుంది: క్రమరాహిత్యాన్ని ఫ్లాగ్ చేస్తుంది, పరికల్పనలను రూపొందిస్తుంది, ఎంపికలను అందిస్తుంది, డ్రాఫ్ట్లను అందిస్తుంది, పోస్ట్మార్టంను సిద్ధం చేస్తుంది. కానీ ప్రతి నిర్ణయం పాయింట్ వద్ద ఒకరు ఆగిపోతారు - రోగనిర్ధారణను నిర్ధారిస్తుంది, తగ్గించడాన్ని ఎంచుకుంటుంది, మార్పును ఆమోదించింది, ఫలితాన్ని కలిగి ఉంటుంది. గోల్డెన్ రూల్ స్పష్టంగా ఉంది: "ఏం జరుగుతుంది, ఎలా వ్రాయాలి" అనే ప్రశ్నలలో AI ముందుంది మరియు "నేను దీన్ని చేయాలా, ఎవరు హామీదారుడు?" అనే ప్రశ్నలలో మానవులు ముందున్నారు. భయాందోళనల సమయాల్లో, క్రమశిక్షణను పెంచుకోండి, సాక్ష్యం నుండి పరికల్పనను వేరు చేయండి, AI యొక్క సందర్భ పరిమితిని గుర్తుంచుకోండి మరియు ప్రతి ఈవెంట్ నుండి రన్బుక్ పాఠాన్ని గీయండి. ఈ మాడ్యూల్ యొక్క సారాంశం ఒక వాక్యం: AI ఒక శక్తివంతమైన సహాయకుడు; ఇంజనీరింగ్ బాధ్యత అప్పగించబడదు.
అప్లికేషన్ టాస్క్
మీరు మీ గతంలో అనుభవించిన (లేదా ఊహించిన) ఈవెంట్ను మొదటి నుండి చివరి వరకు పరిగణించండి. పైన ఉన్న “దశల సంఘటన నిర్వహణ గైడ్” టెంప్లేట్తో, గుర్తించడం-నిర్ధారణ-ఉపశమనం-రిజల్యూషన్-లెర్నింగ్ దశల ద్వారా సంఘటనను మార్గనిర్దేశం చేయమని AIని అడగండి; ప్రతి దశలో, మీరు AIకి అప్పగించగల దశను మరియు మీరే నిర్ణయించుకోవాల్సిన దశను విడిగా వ్రాయండి. నిర్ధారణ దశలో కనీసం ఒక AI పరికల్పనను ధృవీకరణ ఆదేశంతో నిర్ధారించండి. చివరగా, "పోస్ట్-ఈవెంట్ ఇంటిగ్రేటెడ్ లెర్నింగ్" టెంప్లేట్తో పోస్ట్-మార్టం మరియు రన్బుక్ అప్డేట్ డ్రాఫ్ట్ను రూపొందించండి. మొత్తం ప్రక్రియలో మానవ-AI శ్రమ విభజనను 7 అంశాలలో సంగ్రహించండి.
చెక్లిస్ట్
- [ ] నేను సంఘటనను గుర్తించడం, రోగ నిర్ధారణ, తగ్గించడం, పరిష్కారం మరియు అభ్యాస దశలుగా విభజించానా?
- [ ] నేను AIకి అప్పగించే దశలు మరియు ప్రతి దశలో మానవ నిర్ణయాధికారం అవసరమయ్యే దశల మధ్య తేడాను గుర్తించానా?
- [ ] రోగనిర్ధారణలో, నేను AI పరికల్పనను సాక్ష్యం నుండి వేరు చేసి ధృవీకరణ ఆదేశంతో నిర్ధారించానా?
- [ ] నేను రివర్సిబిలిటీ మరియు రోల్బ్యాక్ ప్లాన్ పరంగా ఉపశమనాన్ని మూల్యాంకనం చేశానా?
- [ ] నేను భయాందోళన సమయంలో కూడా "రీడ్-వెరిఫై-ప్రిపేర్ రిటర్న్" రిఫ్లెక్స్ను నిర్వహించానా?
- [ ] నేను సంఘటన నుండి పోస్ట్ మార్టం మరియు రన్ బుక్ పాఠం నేర్చుకున్నానా?
మాడ్యూల్ పరీక్ష
1. సిస్టమ్ మరియు నెట్వర్క్ మేనేజ్మెంట్లో కృత్రిమ మేధస్సు కోసం కింది వాటిలో అత్యంత ఖచ్చితమైన స్థానం ఏది?
- ఎ) ఆర్టిఫిషియల్ ఇంటెలిజెన్స్ సహాయక మరియు నిర్ణయ మద్దతు సాధనం; క్లిష్టమైన కార్యనిర్వాహక నిర్ణయాల యొక్క బాధ్యత మరియు తుది ఆమోదం మానవులదే ✔
- బి) కృత్రిమ మేధస్సు మానవ ఆమోదం లేకుండా ఆదేశాలను అమలు చేయగలదు మరియు ఉత్పత్తిలో మార్పులను అమలు చేయగలదు
- సి) ఆర్టిఫిషియల్ ఇంటెలిజెన్స్ టెక్స్ట్ రాయడంలో మాత్రమే పని చేస్తుంది, దీనికి సిస్టమ్ మరియు నెట్వర్క్ పనితో సంబంధం లేదు
- డి) ఆర్టిఫిషియల్ ఇంటెలిజెన్స్ ఎల్లప్పుడూ మనుషుల కంటే ఖచ్చితమైన నిర్ణయాలు తీసుకుంటుంది, కాబట్టి ధృవీకరణ అనవసరం
వివరణ: కృత్రిమ మేధస్సు అనేది స్క్రిప్ట్లు, లాగ్ విశ్లేషణ మరియు పత్రాలు వంటి డ్రాఫ్ట్లు మరియు విశ్లేషణలను రూపొందించే సహాయక మరియు నిర్ణయ మద్దతు సాధనం. ఆదేశాన్ని అమలు చేయడం లేదా మార్పును ఆమోదించడం వంటి పనికిరాని సమయం, డేటా నష్టం మరియు భద్రతను ప్రభావితం చేసే కార్యనిర్వాహక నిర్ణయాల బాధ్యత మరియు తుది ఆమోదం సమర్థుడైన ఇంజనీర్కు చెందుతుంది.
2. ఉత్పత్తిలో కృత్రిమ మేధస్సు ద్వారా రూపొందించబడిన ఆదేశాన్ని అమలు చేయడానికి ముందు తప్పనిసరిగా అమలు చేయవలసిన ధృవీకరణ రిఫ్లెక్స్ యొక్క నాలుగు దశలు ఏమిటి?
- ఎ) కాపీ, పేస్ట్, రన్, హోప్
- బి) చదవండి మరియు అర్థం చేసుకోండి, డాక్యుమెంట్ చేయండి, ఏకాంత వాతావరణంలో ప్రయత్నించండి, అభిప్రాయం కోసం సిద్ధం చేయండి ✔
- సి) లైక్ చేయండి, షేర్ చేయండి, సేవ్ చేయండి, ఆర్కైవ్ చేయండి
- డి) తొలగించండి, తిరిగి వ్రాయండి, కుదించండి, పంపండి
వివరణ: క్లిష్టమైన అవుట్పుట్కి వర్తింపజేయడానికి నాలుగు దశలు: (1) లైన్ ద్వారా కమాండ్ లైన్ను చదవండి మరియు అర్థం చేసుకోండి, (2) అధికారిక డాక్యుమెంటేషన్కు ఫ్లాగ్లు మరియు సింటాక్స్ని లింక్ చేయండి, (3) దీన్ని వివిక్త/పరీక్ష వాతావరణంలో ప్రయత్నించండి, వీలైతే డ్రై-రన్ చేయండి, (4) తప్పు జరిగితే ఫాల్బ్యాక్ ప్లాన్ (బ్యాకప్, స్నాప్షాట్) సిద్ధం చేయండి.
3. ఆటోమేషన్ స్క్రిప్ట్ 'ఐడెంపోటెంట్'గా ఉండటం అంటే ఏమిటి మరియు అది ఎందుకు ముఖ్యమైనది?
- ఎ) స్క్రిప్ట్ ప్రతి రన్లో విభిన్న ఫలితాలను అందిస్తుంది
- బి) స్క్రిప్ట్ ఒక్కసారి మాత్రమే అమలు చేయబడుతుంది మరియు ఆపై తొలగించబడుతుంది
- సి) రెండవసారి అమలు చేసినప్పుడు స్క్రిప్ట్ ఎటువంటి హాని కలిగించదు; ✔ మళ్లీ ట్రిగ్గర్ చేయబడినా కూడా సురక్షితం
- D) స్క్రిప్ట్లో లోపం నిర్వహణ లేదు
వివరణ: ఐడెంపోటెన్సీ అంటే ఒకే స్క్రిప్ట్ని రెండు లేదా అంతకంటే ఎక్కువ సార్లు అమలు చేసినప్పుడు, అది రెండవ రన్లో నష్టాన్ని కలిగించదు లేదా లోపాలను సృష్టించదు. 'వినియోగదారు ఇప్పటికే ఉన్నట్లయితే దాటవేయి', 'ఉంటే డైరెక్టరీని సృష్టించు, ఉనికిలో ఉంటే దాన్ని తాకవద్దు' వంటి లాజిక్లు స్థాపించబడ్డాయి. అనుకోకుండా మళ్లీ ప్రేరేపించబడినప్పటికీ ఆటోమేషన్ సురక్షితంగా పనిచేస్తుందని ఇది నిర్ధారిస్తుంది.
4. విధ్వంసక కార్యకలాపాలను (తొలగింపు, పునఃప్రారంభించడం) కలిగి ఉన్న స్క్రిప్ట్ను భద్రపరచడానికి అత్యంత ప్రాథమిక మార్గం ఏమిటి?
- ఎ) స్క్రిప్ట్ను వీలైనంత వేగంగా అమలు చేయండి
- బి) దోష సందేశాలను దాచడం
- సి) ఉత్పత్తిలో నేరుగా స్క్రిప్ట్ను పరీక్షించడం
- డి) డిఫాల్ట్ డ్రై-రన్ వెనుక విధ్వంసక కార్యకలాపాలను ఉంచడం మరియు వాస్తవ అమలును స్పష్టమైన టిక్ ఫ్లాగ్కి బంధించడం ✔
వివరణ: విధ్వంసక ప్రక్రియలను డిఫాల్ట్గా డ్రై-రన్ మోడ్లో ఉంచడం మరియు స్పష్టమైన ఆమోదం ఫ్లాగ్తో (ఉదా. --వర్తించు) అసలు అప్లికేషన్ను మాత్రమే అమలు చేయడం ద్వారా స్క్రిప్ట్ రన్ అయినప్పుడు ఏమి జరుగుతుందో చూడడానికి మిమ్మల్ని అనుమతిస్తుంది. అలాగే శూన్య వేరియబుల్ చెకింగ్ (VAR:?) పాత్ ఎర్రర్లను నివారిస్తుంది.
5. లాగ్ విశ్లేషణలో 'సహసంబంధం కారణం కాదు' అనే సూత్రం అర్థం ఏమిటి?
- ఎ) కలిసి మారే రెండు సంఘటనలు కారణం-ప్రభావ సంబంధంలో తప్పనిసరిగా ఉండవు; కారణాన్ని కూడా ధృవీకరించాలి ✔
- బి) లాగ్లలో సహసంబంధం కోసం వెతకడం సమయం వృధా
- సి) కలిసి మారే రెండు సంఘటనలలో ఒకటి ఖచ్చితంగా మరొకదానికి కారణం.
- డి) కృత్రిమ మేధస్సు ద్వారా మాత్రమే కారణాన్ని నిర్ణయించవచ్చు
వివరణ: రెండు సంఘటనలు ఒకే సమయంలో సంభవించినందున (సహసంబంధం) ఒకటి మరొకటి (కారణం) కలిగిస్తుందని అర్థం కాదు; రెండూ మూడవ సంఘటన ఫలితంగా ఉండవచ్చు. AI యొక్క సూచన 'X బహుశా Y కారణం కావచ్చు' అనేది ఒక పరికల్పన మరియు ఇది సిస్టమ్లో ధృవీకరించబడే వరకు కనుగొనబడినదిగా పరిగణించబడదు.
6. పనితీరు పర్యవేక్షణలో ప్రతిస్పందన సమయాన్ని కొలిచేటప్పుడు సగటు కంటే పర్సంటైల్ (p95/p99) ఎందుకు ప్రాధాన్యతనిస్తుంది?
- ఎ) సగటు కంటే శాతం లెక్కించడం సులభం
- బి) సగటు మైనారిటీ యొక్క చెడు అనుభవాన్ని దాచిపెడుతుంది; పర్సంటైల్ ఈ దాచిన సమస్యలను వెల్లడిస్తుంది ✔
- సి) సగటు ఎల్లప్పుడూ తప్పుగా ఉంటుంది మరియు ఉపయోగించరాదు
- D) CPU మెట్రిక్లకు మాత్రమే పర్సంటైల్ వర్తిస్తుంది
వివరణ: కొంత మంది వినియోగదారులకు కలిగిన చాలా చెడ్డ అనుభవాన్ని సగటు దాచిపెడుతుంది. సగటు 200 ms కనిపించినప్పటికీ, p99 6 సెకన్లు కావచ్చు; అంటే ప్రతి వంద అభ్యర్థనలలో ఒకటి చాలా నెమ్మదిగా ఉంది. సరాసరి దాచుకున్న ఈ మైనారిటీ బాధను పర్సంటైల్ కనిపించేలా చేస్తుంది.
7. కాన్ఫిగరేషన్ నిర్వహణలో 'డ్రిఫ్ట్' అంటే ఏమిటి మరియు అది ఎందుకు ప్రమాదకరం?
- ఎ) రాత్రి సమయంలో నెట్వర్క్ ట్రాఫిక్ పడిపోతుంది
- బి) సర్వర్ యొక్క భౌతిక పునరావాసం
- సి) సర్వర్లు ఒకదానికొకటి మరియు కాలక్రమేణా ప్రమాణం నుండి వైదొలిగిపోతాయి; ✔ సమస్య సంభవించే వరకు కనిపించదు
- డి) కాన్ఫిగరేషన్ ఫైల్స్ ఆటోమేటిక్ బ్యాకప్
వివరణ: డ్రిఫ్ట్ అనేది కాలానుగుణంగా నమోదుకాని మాన్యువల్ మార్పుల ద్వారా ఒకదానికొకటి మరియు ప్రమాణం నుండి సర్వర్ల విచలనం. దాని ప్రమాదం దాని నిశ్శబ్దం: సమస్య సంభవించే వరకు ఇది కనిపించదు, అప్పుడు ఒక సర్వర్ ఇతరులకు భిన్నంగా ప్రవర్తిస్తుంది మరియు రోగ నిర్ధారణ గంటలు పడుతుంది. AI పోలిక ద్వారా డ్రిఫ్ట్ కనిపించేలా చేస్తుంది; బంగారు వెల్డింగ్ సూత్రం నిరోధిస్తుంది.
8. IaC టూల్స్లో (టెర్రాఫార్మ్ వంటివి) 'ప్లాన్' స్టెప్ అత్యంత కీలకమైన సెక్యూరిటీ గార్డ్రైల్గా ఎందుకు ఉంది?
- ఎ) ప్లాన్ కోడ్ని వేగంగా అమలు చేస్తుంది
- బి) ప్లాన్ స్టేట్ ఫైల్ను తొలగిస్తుంది
- సి) ప్లాన్ కోడ్ ఫార్మాటింగ్ను మాత్రమే పరిష్కరిస్తుంది
- D) ప్లాన్ అమలుకు ముందు ఏమి జోడించబడుతుందో, మార్చబడుతుందో మరియు తొలగించబడుతుందో చూపిస్తుంది; డేటా నష్టాన్ని నివారిస్తుంది ✔
వివరణ: కోడ్ని అమలు చేయడానికి ముందు ప్లాన్ (టెర్రాఫార్మ్ ప్లాన్ / యాన్సిబుల్ --చెక్) 'ఏం మారుతుంది' ప్రివ్యూని ఇస్తుంది: ఎన్ని వనరులు జోడించబడతాయి, మార్చబడతాయి, తొలగించబడతాయి. ప్రత్యేకించి, 'డిస్ట్రాయ్' మరియు 'ఫోర్స్ రీప్లేస్మెంట్' లైన్లు అమలుకు ముందు డేటా నష్టపోయే ప్రమాదాన్ని సూచిస్తాయి. ప్లాన్ చదవకుండా దరఖాస్తు చేయడం అత్యంత ఖరీదైన తప్పులలో ఒకటి.
9. టెర్రాఫార్మ్ స్టేట్ ఫైల్ ఎందుకు జాగ్రత్తగా రక్షించబడాలి మరియు AI లేదా ఓపెన్ రిపోజిటరీలలో అతికించకూడదు?
- ఎ) సాదా వచన రహస్యాలు స్టేట్ ఫైల్లో చేర్చబడవచ్చు; లీక్ అయినట్లయితే, గుర్తింపు సమాచారం బహిర్గతమవుతుంది ✔
- బి) ఎందుకంటే స్టేట్ ఫైల్ చాలా పెద్దది
- సి) స్టేట్ ఫైల్ ఇప్పటికే చదవలేని విధంగా ఎన్క్రిప్ట్ చేయబడింది.
- D) స్టేట్ ఫైల్ షేర్ చేయబడినప్పుడు కోడ్ వేగంగా నడుస్తుంది
వివరణ: స్టేట్ ఫైల్ నిర్వహించబడే ఇన్ఫ్రాస్ట్రక్చర్ యొక్క ప్రస్తుత స్థితిని ఉంచుతుంది మరియు సాదా వచన రహస్యాలను (డేటాబేస్ పాస్వర్డ్లు, కీలు) కలిగి ఉంటుంది. కాబట్టి, ఇది ఎన్క్రిప్టెడ్, యాక్సెస్-నియంత్రిత, లాక్ చేయబడిన రిమోట్ బ్యాకెండ్లో ఉంచాలి; దీనిని ఎప్పుడూ పబ్లిక్ వాహనం లేదా రిపోజిటరీలో ఉంచకూడదు, లేకుంటే రహస్యం లీక్ అవుతుంది.
10. డాక్యుమెంటేషన్లో 'రాంగ్ రన్బుక్ ఏ రన్బుక్ కంటే ప్రమాదకరమైనది' అనే ప్రకటన దేన్ని నొక్కి చెబుతుంది?
- ఎ) రన్బుక్ రాయడం వల్ల సమయం వృధా అవుతుంది
- B) ఒక సంక్షోభంలో పరీక్షించబడని రన్బుక్ గుడ్డిగా అమలు చేయబడుతుంది; ఒక తప్పు అడుగు విపత్తుకు దారి తీస్తుంది ✔
- సి) రన్బుక్లు నిర్వాహకుల కోసం మాత్రమే వ్రాయబడ్డాయి
- డి) డాక్యుమెంటేషన్ ఎప్పటికీ నవీకరించబడకూడదు
వివరణ: రన్బుక్ లేని బృందం సంక్షోభ సమయంలో జాగ్రత్తగా మరియు అనుమానాస్పదంగా ఉంటుంది; కానీ 'అధికారిక' రన్బుక్ ఉన్న వ్యక్తి ప్రశ్నించకుండా ఒత్తిడిలో దానిని వర్తింపజేస్తాడు. రన్బుక్ పరీక్షించబడకుండా మరియు ఒక అడుగు తప్పుగా ఉంటే, బ్లైండ్ ఇంప్లిమెంటేషన్ విపత్తుకు దారి తీస్తుంది. అందుకే ప్రతి రన్బుక్ను పూర్తిగా పరీక్షించి, వాస్తవ వాతావరణంలో స్టాంప్ చేయాలి.
11. ప్రిడిక్టివ్ మెయింటెనెన్స్లో, డిస్క్ వైఫల్యాన్ని సమీపిస్తున్నప్పుడు అర్థం చేసుకోవడానికి సరైన విధానం ఏది?
- ఎ) ఒక చెడ్డ SMART డిస్క్ను వెంటనే భర్తీ చేయండి
- B) SMART డేటాను పూర్తిగా విస్మరించడం
- సి) కాలక్రమేణా విలువల ధోరణిని చూడటం; ✔ స్థిరమైన మరియు వేగవంతమైన పెరుగుదల సిగ్నల్ కౌంట్
- డి) డిస్క్ పూర్తిగా కూలిపోయిన తర్వాత మాత్రమే చర్య తీసుకోవడం
వివరణ: ఒక్క చెడ్డ SMART పఠనం భయాందోళనకు కారణం కాదు; డిస్క్లు అప్పుడప్పుడు తప్పులు సరిదిద్దడం సాధారణం. నిజమైన సిగ్నల్ ట్రెండ్: కాలక్రమేణా తిరిగి కేటాయించబడిన రంగం వంటి విలువల స్థిరమైన మరియు వేగవంతమైన పెరుగుదల. అందుకే AIకి సమయ శ్రేణి ఇవ్వబడింది, ఒక్క పఠనం కాదు.
12. ఉత్పాదక మార్పులో చాలా తరచుగా విస్మరించబడిన కానీ క్లిష్టమైన భాగాలు ఏవి?
- ఎ) మార్పు యొక్క రంగు మరియు పేరు
- బి) మార్పు చేస్తున్న వ్యక్తి యొక్క శీర్షిక మరియు విభాగం
- సి) సోషల్ మీడియాలో మార్పు ప్రకటన
- D) రోల్బ్యాక్ ప్లాన్ మరియు సక్సెస్ వెరిఫికేషన్ ప్రమాణాలు ✔
వివరణ: మార్పును అమలు చేయడానికి ముందు 'అది చెడిపోతే నేను ఖచ్చితంగా ఎలా వెనక్కి తీసుకోవాలి' (రోల్బ్యాక్ ప్లాన్) మరియు 'ఇది విజయవంతమైందని నేను ఎలా నిరూపించాలి' (విజయం ధృవీకరణ ప్రమాణాలు) అనే ప్రశ్నలకు వ్రాతపూర్వక సమాధానం లేకపోతే, ఆ మార్పు ఇంకా సిద్ధంగా లేదు. ఈ రెండూ లేకుండా, విరిగిన మార్పు 'పూర్తి'గా పరిగణించబడుతుంది.
13. ఒకే సమయంలో అన్ని సర్వర్లకు భద్రతా విస్తరణ (కొత్త వెర్షన్/ప్యాచ్)ను విడుదల చేయడం కంటే 'కానరీ' విధానం ఎందుకు ప్రాధాన్యతనిస్తుంది?
- ఎ) మార్పు మొదట చిన్న భాగానికి వర్తించబడుతుంది; బగ్ ఒక చిన్న భాగాన్ని ప్రభావితం చేస్తుంది, మొత్తం ఫ్లీట్ని కాదు మరియు ముందుగానే పట్టుకుంటుంది ✔
- బి) కానరీ పంపిణీ తక్కువ విద్యుత్తును వినియోగిస్తుంది
- సి) కానరీ విస్తరణ ధృవీకరణను పూర్తిగా అనవసరంగా చేస్తుంది
- D) కానరీ విస్తరణ డేటాబేస్లకు మాత్రమే వర్తిస్తుంది
వివరణ: కానరీ విస్తరణ మొదట చిన్న భాగానికి (ఒక సర్వర్, 5% వినియోగదారులు) మార్పును వర్తింపజేస్తుంది మరియు పర్యవేక్షిస్తుంది. ఈ విధంగా, బగ్ ఒక చిన్న భాగాన్ని ప్రభావితం చేస్తుంది, మొత్తం ఫ్లీట్ని కాదు మరియు ముందుగానే పట్టుకుంటుంది. ఒకేసారి వ్యాపించే బగ్ ఒకే సమయంలో వినియోగదారులందరినీ తాకుతుంది.
14. భద్రతా పనిలో కృత్రిమ మేధస్సును ఉపయోగిస్తున్నప్పుడు మార్పులేని నైతిక మరియు చట్టపరమైన నియమం ఏమిటి?
- ఎ) కృత్రిమ మేధస్సును ఏదైనా సిస్టమ్లోని దుర్బలత్వాలను స్కాన్ చేయడానికి ఉచితంగా ఉపయోగించవచ్చు
- బి) నీతి నియమావళి పెద్ద సంస్థలకు మాత్రమే వర్తిస్తుంది
- సి) ఇది అధీకృత వ్యవస్థలలో మరియు రక్షణ ప్రయోజనాల కోసం మాత్రమే ఉపయోగించబడుతుంది; అనధికారిక యాక్సెస్ లేదా దాడి కోసం ఉపయోగించడం నేరం ✔
- D) నేర్చుకోవడానికి వేరొకరి వ్యవస్థలోకి చొరబడటం ఉచితం.
వివరణ: సిస్టమ్ మరియు నెట్వర్క్ సమాచారం ద్వంద్వ ఉపయోగం. ఆర్టిఫిషియల్ ఇంటెలిజెన్స్ మీరు వ్రాతపూర్వక అధికారాన్ని కలిగి ఉన్న సిస్టమ్లలో మాత్రమే ఉపయోగించబడుతుంది మరియు రక్షణ ప్రయోజనాల కోసం (లాగ్ బెదిరింపు గుర్తింపు, గట్టిపడటం, సంఘటన ప్రతిస్పందన). మీకు చెందని సిస్టమ్ను స్కాన్ చేయడానికి లేదా చొరబాట్లకు ఉపయోగించడం అనధికార ప్రాప్యత మరియు నేరం; నేర్చుకోవడానికి ఒక వివిక్త ప్రయోగశాలను ఉపయోగించాలి.