Qazanclar:
- Böyük log tullantılarını AI-də maskalamaq və süzməklə ümumiləşdirmək və vaxt qrafiki yaratmaq bacarığı
- Süni intellekt tərəfindən qurulan zaman əlaqələrini səbəbiyyət deyil, fərziyyə kimi qiymətləndirə bilmək
- Metriklər və kodlarla kök səbəb fərziyyəsini təsdiqləmək və postmortem eskiz hazırlamaq bacarığı
Proqram istehsalatda işləyərkən (canlı mühit) yalnız izlər, ölçülər və qeydlər (işləyərkən proqram tərəfindən istehsal olunan vaxt möhürlü jurnal xətləri) sizə onun nə etdiyini bildirir. Kəskinlik zamanı minlərlə, bəzən milyonlarla log xəttindən mənalı siqnalın çəkilməsi hadisəyə reaksiyanın ən stresli və zaman baxımından kritik anıdır. Burada süni intellekt məxfilik və yoxlama məhdudiyyətlərinə hörmət etdiyiniz müddətcə böyük mətni ümumiləşdirərək, nümunələr çıxaran və fərziyyələr yaradaraq köməkçi ola bilər.
Bu bölmədə biz süni intellektdən müşahidə oluna bilənlik kontekstində istifadə etməyi öyrənirik - sistemin xarici nəticələrinə baxmaqla onun daxili vəziyyətini anlamaq bacarığı: log səs-küyündən məna çıxarmaq, səhvin vaxt qrafikini qurmaq, təkrarlanan nümunələri tapmaq və postmortem tərtib etmək. Öncədən kritik xəbərdarlıq: xam istehsal jurnallarında çox vaxt şəxsi məlumatlar və sirrlər olur; onları AI alətinə təsadüfən yapışdırmaq ciddi pozuntudur.
Jurnallar niyə çətindir, AI niyə faydalıdır?
Qeydlər üç səbəbə görə çətindir: həcm (çox sayda var), səs-küy (bir çox xətlər əhəmiyyətsizdir) və qarışıqlıq (hadisə müxtəlif xidmətlərin qeydləri arasında səpələnmişdir). İnsan gözü bu yığında yorulur və vacib xətti qaçırır.
Süni intellekt böyük mətn bloklarını ümumiləşdirməkdə, təkrarlanan nümunələri saymaqda və “bu xəta partlayışından bir qədər əvvəl nə dəyişdi?” sualını verməkdə yaxşıdır. kimi zaman əlaqələri qurmaqda güclüdür, lakin iki məhdudiyyət var. Birincisi kontekst pəncərəsidir: bir modelə sığdıra biləcəyiniz qeydlərin miqdarı məhduddur, ona görə də əvvəlcə filtrləməli və nümunə götürməlisiniz. İkincisi, doğrulama: AI-nin “əsas səbəb budur” deməsi fərziyyədir; Metriklər və kodlarla təsdiqləmədən qərar verməyin.
Diqqət: Xam istehsal jurnallarında IP ünvanı, e-poçt, nişan, sessiya ID və bəzən açıq sirr ola bilər. Süni intellektə verməzdən əvvəl onları maskalayın və ya yalnız müəssisə tərəfindən təsdiqlənmiş, məlumatla qorunan vasitələrdən istifadə edin. Bu mövzunu 10-cu bölmədə dərinləşdiririk.
Addım-addım: Girişdən kök səbəbə
- Vaxt pəncərəsini daraltın. Tədbirin başladığı dəqiqələri müəyyənləşdirin; Bütün günü yox, o pəncərəni yoxlayın.
- Səs-küyü süzün. Məlum təkrarlanan, zərərsiz xətləri çıxarın; Səhv (ERROR), xəbərdarlıq (XƏBƏRDARLIQ) və ilk sapma anına diqqət yetirin.
- Həssas məlumatları maskalayın. Şəxsi məlumatları və sirləri AI-yə verməzdən əvvəl təmizləyin.
- Xülasə və vaxt qrafiki yaradın. Süni intellektdən hadisəni xronologiyada ümumiləşdirməsini xahiş edin (“əvvəlcə bu, sonra o”).
- Metriklər və kodlarla fərziyyəni təsdiqləyin. AI-nin göstərdiyi səbəb; Mümkünsə, idarə paneli, müvafiq kod və yerləşdirmə qrafiki ilə təsdiqləyin.
- Öyrəndiklərinizi yazın. Postmortem eskizini hazırlayın və profilaktik tədbirləri sadalayın.
Üç mini qutu
Case 1 — 5 dəqiqə ərzində ümumiləşdirilmiş 40.000 sətir. Ödəniş xidməti 12 dəqiqə ərzində aralıq xəta olduğunu bildirdi. Komanda 20 dəqiqəlik maskalı logların müvafiq pəncərəsini (təxminən 40.000 sətir, nümunə götürülmüş) AI-yə bəslədi və bir zaman çizelgesi yaratdı. Model göstərdi ki, xətanın partlaması asılılıq xidmətinin cavab müddəti 200 ms-dən 8 saniyəyə yüksəldiyi vaxta təsadüf edir. Komanda bunu tablosunda təsdiqlədi və səbəbi 10 dəqiqə ərzində daraltdı.
2-ci hal – Yanıltıcı korrelyasiya. Başqa bir hadisədə, AI səhvlərin cron (planlaşdırılmış tapşırıq) işləməsi ilə "eyni zamanda" baş verdiyini söyləyərək onu günahlandırdı. Komanda ölçüləri yoxladıqda, cronun hadisədən əvvəl həqiqətən bitdiyini gördülər; Korrelyasiya təsadüf idi. Əsl səbəb yaddaş sızması idi. Dərs: AI tərəfindən qurulan vaxt korrelyasiyası sübut deyil, bir ipucudur.
3-cü hal - Postmortem sürətləndirildi. Kəskinlikdən sonra komanda (maskalı) mesaj stenoqramını və hadisə kanalından süni intellektə ötürdü və ondan postmortem eskiz hazırladı: xülasə, təsir, qrafik, əsas səbəb, hərəkətlər. İnsan redaktoru faktları düzəltdi və fəaliyyət sahiblərini təyin etdi. Adətən 2 saat çəkən sənəd daha ardıcıl bir quruluşla təxminən 40 dəqiqəyə tamamlandı.
Dörd Kopyalana bilən Şablon
Jurnalın xülasəsi və qrafiki (maskalı jurnal ilə):
Aşağıda maskalı istehsal jurnalının hadisə pəncərəsi var.1) Hadisəni xronoloji vaxt qrafikinə tökün (ilk sapma anını qeyd edin).2) Ən tez-tez təkrarlanan xəta/xəbərdarlıq növlərini sayın və qruplaşdırın.3) "Bir az əvvəl nə dəyişdi?" Sual üçün namizəd hadisələrini qeyd edin. Bunlar hipotezlərdir; Bunu "təsdiq edilməlidir" kimi qeyd edin. {{logs}}
Xəta nümunəsinin çıxarılması:
Bu jurnal xətlərində təkrarlanan səhv nümunələrini tapın. Hər nümunə üçün: nümunə xətti (maskalı), təxmin edilən mənbə və mümkün məna. Nadir, lakin kritik tək xətaları ayrıca "diqqət" siyahısında toplayın.{{logs}}
Strukturlaşdırılmış sorğu/filtr yaradılması:
{{log aləti: grep/jq/Kibana KQL/CloudWatch Insights}} üçün aşağıdakı şərtə cavab verən sorğu yazın: {{məs. X istifadəçisi istisna olmaqla, son 15 dəqiqə ərzində 5xx səhvləri}}. Sorğunu izah edin; Domen adlarını yaratmadığınızdan əmin olun, əmin deyilsinizsə soruşun.
Ölümdən sonrakı eskiz:
Aşağıdakı (maskalı) hadisə qrafikindən ölümdən sonrakı eskiz yazın: Xülasə / Təsir (müddət, istifadəçi təsirlənmiş) / Zaman qrafiki / Əsas səbəb / Nə yaxşı getdi / Tədbirlər (hər biri üçün sahib sahəsini boş buraxın). İttihamedici dildən istifadə etməyin; Faktiki və təşəbbüskar olun.{{timeline}}
Zəif məlumat / Güclü göstəriş
Zəif: "Bu jurnallara bax, nə olub?" (Bütün günün xam jurnalı, şəxsi məlumatlarla, hədəfsiz.)
Güclü: "Aşağıda 14:02–14:20 (5xxs-ə qədər süzülmüş) maskalı istehsal jurnalı var. Bu pəncərədə xətanın baş verdiyi anı tapın, ən çox rast gəlinən xəta növünü sayın və partlayışdan dərhal əvvəl 60 saniyə ərzində görünən kənarlaşmaları sıralayın; onların hamısını "təsdiq ediləcək fərziyyə" kimi qeyd edin."
Güclü versiya; O, vaxt pəncərəsini daraldır, jurnalı süzgəcdən keçirir və maskalayır, aydın sual verir və nəticənin fərziyyə olduğunu əvvəldən müəyyən edir.
Quest
AI güclüdür
Limit / doğrulama
Böyük log xülasəsi
Bəli, tez
Nümunə itkisi ola bilər
Zaman əlaqəsinin qurulması
göstərişlər yaradır
Korrelyasiya ≠ səbəb əlaqəsi
Sorğu/filtr yaradılması
yaxşı qaralama
Domen adları realdırmı?
Ölümdən sonrakı eskiz
Struktur və dil
Hadisələr insan tərəfindən təsdiqlənir
Korrelyasiya Səbəb Bağlılığı Deyil
Günlük təhlilində ən çox rast gəlinən tələ "eyni zamanda baş verdi, ona görə də" səhvidir. Süni intellekt bu tələyə insanlardan daha asan olmasa da, asanlıqla düşür; çünki mətndəki simultanlığın güclü siqnal olduğunu düşünür. Bir hadisənin əslində başqa bir hadisəyə səbəb olduğunu söyləyə bilmək; vaxt, mexanizm və mümkünsə təkrarlanma tələb olunur. Süni intellektin müəyyən etdiyi hər bir səbəb-nəticə iddiası üçün “bunu başqa hansı sübutlar təsdiqləyir?” sualını veririk. Bunu sualla sınayın.
İpucu: Süni intellektə daxil olarkən mətn tullantıları əvəzinə, mümkünsə, əvvəlcə sorğu/filtri çap edin və onu avtomobilinizdə işə salın; Bu yolla siz həm həssas məlumatları azaldırsınız, həm də modelin kontekst pəncərəsini həqiqətən vacib sətirlərə ayırırsınız.
Ümumi səhvlər
- Xam, maskalanmamış jurnalın yapışdırılması. Şəxsi məlumatların və sirlərin açıqlanması; məxfiliyin ciddi şəkildə pozulması.
- Bütün günü bir anda vermək. Kontekst pəncərəsini aşır, siqnal səs-küydə boğulur.
- Səbəb əlaqəsini səhv salmaq. AI tərəfindən qurulan zaman əlaqəsi sübut deyil, bir ipucudur.
- Uydurulmuş domen adı ilə sorğuya güvənmək. Model mövcud olmayan log sahəsinin adını təklif edə bilər; sxemi ilə yoxlayın.
- Təsdiq etmədən postmortemi dərc etmək. Faktlar və təsir rəqəmləri insan tərəfindən təsdiqlənməlidir.
Xülasə
Süni intellekt log analizində həcm və səs-küyü aradan qaldırmaq üçün güclü bir vasitədir: böyük transkriptlərin ümumiləşdirilməsi, vaxt qrafiklərinin yaradılması, nümunələrin çıxarılması və postmortem eskizlərin hazırlanması. Ancaq üç məhdudiyyəti yadda saxlayın: həssas məlumatları maskalamadan ixrac etməyin, kontekst pəncərəsinə uyğunlaşdırmaq üçün onu süzgəcdən keçirin və nümunə götürün və hər bir səbəb-nəticə iddiasını ölçülər və kodlarla yoxlayın. Korrelyasiya səbəb-nəticə deyil; Süni intellekt ipuçları verir, siz dəlillərlə qərar verirsiniz.
Tətbiq tapşırığı
Sahib olduğunuz hadisə və ya sınaq mühiti jurnalından 15-20 dəqiqəlik bir pəncərə seçin. Əvvəlcə şəxsi məlumatları və sirləri maskalayın (yaxud sintetik jurnal hazırlayın). Sonra "log xülasəsi və qrafiki" şablonu ilə AI-dən xronologiya və ən çox rast gəlinən səhv növlərini çıxarın. Süni intellektin irəli sürdüyü əsas səbəb fərziyyəsini sizdə olan bir metrik və ya kod parçası ilə yoxlamağa çalışın: fərziyyə özünü doğrultdu, yoxsa bu, yanlış əlaqə idi? Tapıntınızı bir cümlə ilə yazın.
yoxlama siyahısı
- [ ] Mən jurnalı AI-yə verməzdən əvvəl şəxsi məlumatları və sirləri maskalayıram.
- [ ] Mən təhlili dar bir zaman pəncərəsinə və filtrə endirirəm.
- [ ] Mən süni intellekt tərəfindən qurulan zaman əlaqələrini səbəbiyyət deyil, fərziyyə kimi görürəm.
- [ ] Mən ölçülər və kodla əsas səbəb iddiasını yoxlayıram.
- [ ] Yaratdığım sorğuların/filtrlərin domen adlarının real olduğunu təsdiq edirəm.
- [ ] Mən ölümdən sonrakı eskizdəki faktları və rəqəmləri insanca təsdiq edirəm.