Lợi nhuận:
- Khả năng tách nguyên nhân gốc rễ khỏi các cảnh báo thứ cấp trong lũ báo động và tạo ra giả thuyết nguyên nhân gốc rễ từ chuỗi cảnh báo được đánh dấu thời gian bằng trí tuệ nhân tạo
- Khả năng hiểu không coi giả thuyết nguyên nhân gốc rễ của trí tuệ nhân tạo là bằng chứng mà không cần xác nhận chỉ số vật lý và đọc các giá trị thủ công từ nguồn chính thức
- Khả năng hiểu rằng việc dừng máy, vô hiệu hóa hành trình an toàn và các quyết định điều động khẩn cấp thuộc về con người và không thể tự động hóa được.
Số giây được tính khi chuông báo động vang lên trong phòng máy. Hàng chục cảm biến, hệ thống đan xen và đôi khi nhiều cảnh báo đổ chuông cùng lúc (lũ báo động - một loạt cảnh báo kích hoạt lẫn nhau trong trường hợp có sự cố) thách thức kỹ sư. Việc tách lỗi thực tế khỏi các cảnh báo thứ cấp mà nó kích hoạt (phân tích nguyên nhân gốc rễ) đòi hỏi phải suy nghĩ nhanh chóng và chính xác. AI có thể là công cụ hỗ trợ quyết định mạnh mẽ trong chẩn đoán lỗi và giải thích cảnh báo; Nhưng các quyết định dừng máy, khởi động và thực hiện các biện pháp can thiệp khẩn cấp là trách nhiệm của kỹ sư trưởng và tổ máy.
Trong phần này, bạn sẽ học cách sử dụng AI một cách an toàn trong quản lý cảnh báo, phân tích nguyên nhân cốt lõi và chẩn đoán lỗi; Bạn sẽ biết những quyết định nào không bao giờ có thể được tự động hóa.
Báo động lũ lụt và nguyên nhân gốc rễ
Trong hầu hết các trường hợp, sự cố không tự xảy ra. Ví dụ: nếu máy bơm chất làm mát dừng: báo động máy bơm, sau đó là cảnh báo nhiệt độ cao, sau đó cảnh báo chạy chậm lại của máy sẽ phát ra liên tục. Bạn sẽ thấy 8 cảnh báo trên bảng điều khiển, nhưng nguyên nhân cốt lõi chỉ có một: máy bơm. Chẩn đoán chính xác là làm sáng tỏ chuỗi này theo chiều ngược lại.
AI có thể giúp làm sáng tỏ chuỗi này: nó sắp xếp các dấu thời gian báo động và đưa ra một giả thuyết chẳng hạn như "cái đầu tiên kêu là báo động máy bơm; những cái khác có thể là kết quả của nó." Nhưng:
- Đây là một giả thuyết, không phải bằng chứng. Kỹ sư xác minh bằng các chỉ báo vật lý và thông tin hệ thống.
- Nếu dấu thời gian và cấu trúc liên kết hệ thống không được cung cấp chính xác, AI có thể chỉ ra nguyên nhân gốc sai.
Mẹo: Khi có cảnh báo phân tích AI, hãy đưa ra dấu thời gian chính xác của cảnh báo (đến độ chính xác thứ hai) và hệ thống nào được kết nối với hệ thống nào (ví dụ: "máy bơm này cấp nguồn cho mạch này"). Nếu không có trình tự thời gian và thông tin kết nối, dự đoán nguyên nhân gốc rễ sẽ không đáng tin cậy.
Hỗ trợ quyết định: nơi có, nơi không
Những nơi AI được sử dụng an toàn trong phòng máy:
- Sắp xếp chuỗi cảnh báo và tạo ra giả thuyết nguyên nhân gốc rễ có thể xảy ra.
- Danh sách các nguyên nhân có thể xảy ra và phác thảo cách khắc phục sự cố đối với một triệu chứng lỗi.
- Công cụ tìm nhanh phần liên quan trong sổ tay và quy trình kỹ thuật.
- Viết báo cáo can thiệp bằng ngôn ngữ khách quan.
Các quyết định không bao giờ được ủy quyền cho AI:
- Dừng hoặc khởi động máy đầu.
- Tắt thiết bị an toàn (chuyến đi an toàn - tự động dừng khi gặp nguy hiểm).
- Các thao tác khẩn cấp như hỏa hoạn, lấy nước, mất điện (mất điện).
- Ghi đè cảnh báo bằng cách gọi nó là "không quan trọng".
Những quyết định này đòi hỏi cả sự đào tạo, thẩm quyền cũng như trách nhiệm pháp lý; Tất cả vẫn còn với kỹ sư con người.
Thận trọng: Tắt tiếng/bỏ qua hành trình an toàn hoặc báo động chỉ vì AI gợi ý rằng điều đó có thể dẫn đến thảm họa. Báo thức là cách hệ thống giao tiếp với bạn. Nhiều nhất, AI sẽ nói "cảnh báo đó có thể đã tắt vì lý do này hay lý do khác"; Quyết định hủy bỏ nó thuộc về kỹ sư dựa trên cơ sở và thủ tục.
ba trường hợp nhỏ
Trường hợp 1 - Tìm ra nguyên nhân gốc rễ nhanh chóng. Trong ca đêm, 6 chuông báo thức vang lên cùng lúc. Kỹ sư trực sẽ cung cấp nhật ký cảnh báo (được đóng dấu thời gian) cho AI; YZ liệt kê rằng điều đầu tiên vang lên là sự sụt giảm áp suất bôi trơn, những điều khác cũng theo sau. Kỹ sư kiểm tra hệ thống dầu, tìm và sửa bộ lọc bị tắc. AI tiết kiệm thời gian; Kỹ sư đưa ra chẩn đoán và can thiệp.
Trường hợp 2 - Nguyên nhân gốc rễ gây hiểu lầm. Trong một sự cố tương tự, AI nhận được dấu thời gian cảnh báo không chính xác (với đồng hồ không đồng bộ); AI nhầm cảnh báo sai là "lần đầu tiên" và chỉ ra nguyên nhân gốc sai. Kỹ sư trưởng giàu kinh nghiệm nhận thấy các chỉ số vật lý hướng đến một hệ thống khác và bác bỏ giả thuyết của AI. Bài học: nếu đầu vào (đồng bộ hóa thời gian) không đúng thứ tự thì đầu ra cũng không theo thứ tự.
Trường hợp 3 - Báo động không nên tắt tiếng. Một kỹ sư hỏi AI về cảnh báo nhiệt độ liên tục đổ chuông là "có thể là lỗi cảm biến"; AI khiến điều này dường như có thể thực hiện được. Tuy nhiên, kỹ sư đã làm theo quy trình và kiểm tra vật lý trước tiên và phát hiện hiện tượng quá nhiệt thực sự. Nếu báo động bị tắt, thiết bị sẽ bị hỏng. Bài học: báo động đầu tiên được xác minh, sau đó được diễn giải; Ngay cả khi AI nói "có thể là cảm biến".
Bốn mẫu có thể sao chép
1) Giả thuyết nguyên nhân gốc rễ của chuỗi cảnh báo:
Vai trò của bạn: cố vấn chẩn đoán máy. Tôi sẽ cung cấp cho bạn nhật ký cảnh báo được đánh dấu thời gian và thông tin kết nối hệ thống (thiết bị nào cung cấp dữ liệu gì). Nhiệm vụ: sắp xếp các cảnh báo theo thứ tự thời gian, đưa ra giả thuyết (các) nguyên nhân gốc rễ có thể xảy ra và giải thích chuỗi. Viết rằng đây là GIẢ THUYẾT và cần phải xác minh thực tế. Tôi có quyền quyết định dừng/can thiệp.
2) Trình tự khắc phục triệu chứng lỗi:
Triệu chứng: [ví dụ: nhiệt độ khí thải đầu động cơ cao trong một xi-lanh. Hãy cho tôi bản tóm tắt về các nguyên nhân có thể xảy ra và TRÌNH TỰ KIỂM TRA (bắt đầu bằng lần kiểm tra có khả năng xảy ra nhất và an toàn nhất). Viết “quan sát, lấy số đo” cho từng bước. Đánh dấu bước cần cảnh báo an toàn. Quyết định và can thiệp là của tôi.
3) Hướng dẫn thủ công:
Tóm tắt phần nào trong sổ tay bảo trì của nhà sản xuất mà tôi nên xem xét trong trường hợp có [triệu chứng] đối với [thiết bị] và logic quy trình chung. Tôi sẽ đọc các giá trị/mô-men xoắn/trình tự chính xác từ hướng dẫn chính thức; Bạn không tạo nên số lượng/mô-men xoắn, chỉ cần điều khiển nó.
4) Dự thảo báo cáo can thiệp:
Tôi sẽ cung cấp cho bạn thông tin chi tiết về cách khắc phục sự cố (thời gian, cảnh báo, hành động được thực hiện, kết quả) từng bước. Soạn thảo báo cáo sự cố máy khách quan. Chỉ sử dụng những thông tin tôi đã cung cấp, không thêm chi tiết, để lại dòng "[cần xác nhận]" mơ hồ.
Dấu nhắc yếu / Dấu nhắc mạnh
Dấu nhắc yếu:
Chuông báo trên máy kêu, tôi phải làm sao?
Báo động nào, hệ thống nào, triệu chứng nào không rõ ràng; AI đưa ra lời khuyên chung chung và đầy rủi ro.
Lời nhắc mạnh mẽ:
Vai trò của bạn: cố vấn chẩn đoán máy. Thiết bị: máy đầu. Nhật ký cảnh báo có dấu thời gian và sơ đồ hệ thống được đính kèm. Triệu chứng: Báo áp suất dầu thấp lúc 03:12, nhiệt độ vòng bi cao lúc 03:12:20, chậm lại lúc 03:13. Nhiệm vụ: đưa ra giả thuyết nguyên nhân gốc rễ và trình tự kiểm chứng; Tôi nên xem xét chỉ số nào ở mỗi bước? Giải thích rằng đây chỉ là một giả thuyết và tôi có trách nhiệm ngăn chặn nó.
Sự rõ ràng về thời gian cảnh báo, bối cảnh hệ thống và ranh giới quyết định giúp đầu ra được an toàn.
Cảnh báo/chẩn đoán: phân bổ vai trò
Nhiệm vụ
Đóng góp của AI
Công việc của kỹ sư
Phân loại chuỗi cảnh báo
Giả thuyết dựa trên thời gian
xác minh vật lý
nguyên nhân gốc rễ
nguyên nhân ứng cử viên
chẩn đoán, quyết định
Trình tự khắc phục sự cố
dự thảo
Ứng dụng, quan sát
Giá trị thủ công
chuyển hướng
Đọc từ văn bản chính thức
dừng máy
(Không có quyết định)
Quyết định của kỹ sư trưởng
Chuyến đi/ghi đè an toàn
(Không có quyết định)
con người + thủ tục
Những lỗi thường gặp
- Nhầm giả thuyết nguyên nhân gốc rễ với bằng chứng. Trật tự AI là sự khởi đầu; Cần phải xác nhận chỉ số vật lý.
- Cung cấp nhật ký bị hỏng/đồng bộ về thời gian. Dấu thời gian sai tạo ra nguyên nhân gốc sai.
- Đầu tiên giải thích cảnh báo và sau đó xác minh nó. Báo động đầu tiên được kiểm tra vật lý; Giả định "có thể là cảm biến" là nguy hiểm.
- Để lại quyết định dừng/ghi đè cho AI. Những quyết định này là thẩm quyền và trách nhiệm của con người.
- Lấy giá trị thủ công từ AI. Mô-men xoắn, nhiệt độ, trình tự được đọc từ sách hướng dẫn chính thức; AI có thể làm được điều đó.
Tóm lại
Quản lý cảnh báo và chẩn đoán lỗi trong phòng máy đòi hỏi tốc độ và độ chính xác. AI là công cụ hỗ trợ ra quyết định có giá trị trong việc sắp xếp chuỗi cảnh báo và đưa ra các giả thuyết về nguyên nhân cốt lõi, trình tự khắc phục sự cố và hướng dẫn thủ công. Nhưng mọi giả thuyết đều được xác minh về mặt vật lý; Việc dừng máy, vô hiệu hóa hành trình an toàn và thao tác khẩn cấp là trách nhiệm của kỹ sư con người. Báo động đầu tiên được xác minh và sau đó được giải thích; Đầu ra của AI không thay thế nhận định của kỹ sư có thẩm quyền.
Nhiệm vụ ứng dụng
Thiết lập kịch bản lỗi: nguyên nhân cốt lõi và 4-5 cảnh báo phụ do nguyên nhân đó kích hoạt, kèm theo dấu thời gian. Yêu cầu AI giải quyết vấn đề đó bằng mẫu “giả thuyết nguyên nhân gốc của chuỗi cảnh báo”. Sau đó lặp lại yêu cầu tương tự, cố tình trộn các dấu thời gian và quan sát xem AI mắc lỗi như thế nào. Viết ra chỉ báo vật lý nào bạn sẽ xác minh trong từng trường hợp.
danh sách kiểm tra
- [ ] Tôi đã xuất nhật ký cảnh báo với đúng dấu thời gian và bối cảnh hệ thống.
- [ ] Tôi đã xác nhận giả thuyết nguyên nhân gốc rễ bằng các chỉ số vật lý.
- [ ] Tôi đã kiểm tra thực tế từng cảnh báo trước khi bình luận.
- [ ] Với tư cách là kỹ sư, tôi đã đưa ra quyết định dừng, ghi đè và điều động khẩn cấp.
- [ ] Tôi đọc các giá trị thủ công từ nguồn chính thức; Tôi đã không theo kịp AI.