Đơn vị 1 / 11

Giới thiệu về Trí tuệ nhân tạo trong Quản lý hệ thống và mạng: Vai trò, ranh giới, xác thực và quyền hạn

Lợi nhuận:

  • Khả năng phân biệt nhiệm vụ nào (tập lệnh, nhật ký, bản nháp tài liệu) trí tuệ nhân tạo tiết kiệm thời gian thực và nhiệm vụ nào như thời gian ngừng hoạt động, mất dữ liệu và các quyết định điều hành ảnh hưởng đến bảo mật được giao cho con người, tùy thuộc vào mức độ rủi ro của nhiệm vụ.
  • Khả năng áp dụng kỷ luật bốn bước để xác minh từng đầu ra AI bằng cách đọc nó, kết nối nó với tài liệu, kiểm tra nó trong môi trường biệt lập và chuẩn bị kế hoạch trả lại.
  • Khả năng tiếp thu nguyên tắc che giấu dữ liệu nhạy cảm trong nhật ký và cấu hình cũng như chỉ sử dụng trí tuệ nhân tạo cho mục đích phòng thủ trong các hệ thống được ủy quyền

Máy nhắn tin phát ra tiếng bíp lúc 3 giờ sáng, máy chủ sản xuất không phản hồi, tình trạng ngừng hoạt động hàng nghìn pound mỗi giờ đang được xử lý sau lưng bạn và mọi con mắt đều đổ dồn vào bạn. Quản lý hệ thống và mạng; Kỷ luật đảm bảo hoạt động liên tục, an toàn và hiệu suất cao của máy chủ, mạng, bộ lưu trữ và dịch vụ — từ cài đặt đến vá lỗi, giám sát đến ứng phó sự cố, sao lưu đến khắc phục thảm họa. Bản chất của công việc này là bên dưới một số lượng lớn các nhiệm vụ lặp đi lặp lại (viết tập lệnh, đọc nhật ký, so sánh cấu hình) là một số ít các quyết định rất nặng nề (khởi động lại máy chủ, thay đổi quy tắc tường lửa, khôi phục bản sao lưu). Ở đây, trí tuệ nhân tạo (AI - phần mềm trích xuất các mẫu từ dữ liệu lịch sử và tạo ra văn bản, mã và dự đoán) giúp bạn tiết kiệm thời gian ở trung tâm của cấu trúc kép này. Nhưng lời hứa đầu tiên và thường xuyên của mô-đun này rất rõ ràng: AI là một trợ lý, người tạo bản thảo và công cụ hỗ trợ quyết định; Bạn còn lại việc chạy lệnh, xác nhận thay đổi và chịu trách nhiệm về hệ thống.

Mô-đun tiên tiến này cài đặt phản xạ của một kỹ sư chứ không phải chìa khóa của xe. Trong phần đầu tiên này, chúng ta sẽ xem xét nơi AI tạo ra giá trị thực và nơi nào là mối nguy hiểm thực sự trong thế giới hệ thống và mạng; cách xác thực từng đầu ra; Bạn sẽ tìm hiểu những dữ liệu nào bạn có thể cung cấp cho công cụ nào và quan trọng nhất là chỉ những cách sử dụng quyền lực này được ủy quyền và phòng thủ mới là hợp pháp. Nếu không đặt nền móng này, các đơn vị tiếp theo sẽ chuyển sang tốc độ nguy hiểm.

AI có ích ở đâu trong hoạt động?

Hãy chia hệ thống và mạng làm việc thành hai cụm lớn. Cụm đầu tiên: công việc lặp đi lặp lại, dựa trên văn bản và mã, có thể sản xuất được. Viết bản thảo đầu tiên của tập lệnh sao lưu, tóm tắt hàng nghìn dòng nhật ký và gắn cờ các điểm bất thường, giải thích cú pháp của cấu hình nginx, đóng khung báo cáo khám nghiệm tử thi, giải mã câu lệnh cron, liệt kê các nguyên nhân có thể gây ra thông báo lỗi. Trong các tác vụ này, AI giảm thiểu từng phút xuống còn vài giây, không gây mệt mỏi và hoạt động với chất lượng như nhau ngay cả vào lúc nửa đêm.

Cụm thứ hai: các quyết định thực thi dẫn đến ngừng hoạt động, mất dữ liệu hoặc vi phạm bảo mật. Chạy DELETE trên cơ sở dữ liệu sản xuất, mở quy tắc tường lửa, xóa máy chủ khỏi cụm, khôi phục bản sao lưu vào sản xuất, triển khai bản vá cho toàn bộ nhóm. Những quyết định này đòi hỏi bối cảnh, kiến ​​thức thể chế, khả năng chấp nhận rủi ro và trách nhiệm. Ở đây, AI hiển thị các tùy chọn và hiệu ứng có thể có - nhưng bạn nhấn phím Enter.

Hãy làm rõ sự khác biệt trong một câu: AI rất giỏi trong các câu hỏi "điều này có nghĩa là gì và nó có thể là gì"; Quyết định là của bạn khi đối mặt với những câu hỏi như "tôi có nên chạy cái này bây giờ không và ai đảm bảo cho nó?" Người kỹ sư tiếp thu sự khác biệt này không đưa AI vào sản xuất với sự tự tin mù quáng cũng như không kiên quyết từ chối nó; Anh ấy sử dụng nó đúng nơi và đúng liều lượng.

Mẹo: Trước khi giao công việc cho AI, hãy hỏi: “Tôi sẽ mất gì nếu kết quả đầu ra này sai?” Nếu câu trả lời là "vài phút", hãy thoải mái ủy thác. Nếu câu trả lời là "gián đoạn, dữ liệu hoặc bảo mật", hãy để AI tạo bản nháp, bạn xác minh nó trong môi trường thử nghiệm và triển khai nó.

Kỷ luật xác minh: bốn bước

AI nói trôi chảy và tự tin; Điều đó không có nghĩa là nó đúng. AI đôi khi tạo ra ảo giác - nghĩa là nó giả mạo cờ lệnh không tồn tại, khóa cấu hình hoặc lệnh gọi API như thật. Cờ rm giả trong hệ thống sẽ xóa dữ liệu, cú pháp tường lửa giả sẽ mở bảo mật hoặc cắt quyền truy cập. Vì vậy, hãy phát triển phản xạ bốn bước để áp dụng cho mọi đầu ra:

  1. Đọc và hiểu. Đọc từng dòng lệnh và cấu hình mà AI tạo ra trước khi chạy để hiểu nó đang làm gì. Đừng bao giờ chạy lệnh mà bạn không hiểu; Yêu cầu AI giải thích từng lá cờ.
  2. Liên kết đến tài liệu. Xác nhận cờ, khóa hoặc cú pháp do AI đưa ra bằng hướng dẫn chính thức (trang man, tài liệu sản phẩm). "Lá cờ này có thực sự tồn tại không?" Xác minh câu hỏi bằng tìm kiếm.
  3. Hãy thử nó trong một môi trường biệt lập. Trước tiên hãy chạy lệnh quan trọng trên máy kiểm tra/dàn dựng, với --dry-run nếu có thể. Sản xuất không phải là nơi để diễn tập.
  4. Chuẩn bị cho sự trở lại của bạn. Viết ra kế hoạch "làm cách nào để quay lại nếu xảy ra sự cố" trước khi thực hiện: sao lưu, chụp nhanh, sao chép cấu hình trước đó. Đừng thực hiện một thay đổi không thể đảo ngược chỉ vì AI đã đề xuất điều đó.
Thận trọng: “AI đã nói như vậy” không phải là lời biện minh. Nếu có sự gián đoạn, trách nhiệm không thuộc về AI mà thuộc về kỹ sư đã thực thi lệnh đó mà không xác minh. Một lệnh AI chưa được xác minh cũng có rủi ro như một lệnh sudo được đưa vào sản xuất mà không được đọc.

Quyền lực, quốc phòng và đạo đức: ranh giới đỏ

Thông tin hệ thống và mạng có hai công dụng: cùng một thông tin có thể vừa bảo vệ vừa phá hủy mạng. Do đó, nguyên tắc đạo đức của mô-đun này là duy nhất và không thể tranh cãi: Chỉ sử dụng AI trong các hệ thống mà bạn có thẩm quyền, cho mục đích phòng thủ và vận hành. Việc tăng cường máy chủ của tổ chức bạn, tìm kiếm các mối đe dọa trong nhật ký của chính bạn và đóng lỗ hổng trong mạng của chính bạn là hợp pháp. Việc quét hệ thống không thuộc về bạn, cố gắng xâm nhập quyền truy cập của người khác, xâm nhập vào mạng mà không được phép là bất hợp pháp và việc sử dụng AI cho mục đích này cũng là bất hợp pháp. Bạn hỏi AI không phải "làm cách nào để xâm nhập vào hệ thống này" mà là "làm cách nào để bảo vệ hệ thống của chính tôi trước cuộc tấn công này?"

Sự chặt chẽ tương tự cũng được yêu cầu về mặt dữ liệu. Nhật ký, cấu hình và cấu trúc liên kết thường nhạy cảm và bí mật: địa chỉ IP nội bộ, tên người dùng, tên máy chủ, khóa API, chứng chỉ. Che dấu nhật ký hoặc cấu hình trước khi dán vào công cụ công khai (10.x.x.x thay vì IP thực, user1 thay vì người dùng thực, khóa BỊ GIẢM GIÁ). Chỉ cung cấp dữ liệu bí mật cho các phương tiện theo hợp đồng của tổ chức mà dữ liệu không được đưa vào đào tạo mẫu.

ba trường hợp nhỏ

Trường hợp 1 - Tiết kiệm thời gian đúng chỗ. Một quản trị viên hệ thống đã dành 45 phút mỗi sáng để quét thủ công đầu ra nhật ký hệ thống từ 60 máy chủ. Anh ta đưa nhật ký có che IP và tên máy chủ cho AI và nói: “Nhóm các lỗi theo mức độ nghiêm trọng của chúng và đánh dấu 5 mẫu lặp lại”. Thời gian giảm xuống còn 8 phút. Anh ấy đã dành 37 phút tiết kiệm được để xác nhận các mẫu quan trọng được AI gắn cờ trong hệ thống thực. AI đã phát lại; Quyết định vẫn thuộc về kỹ sư.

Trường hợp 2 - Việc xác minh đã ngăn chặn được thảm họa. Một kỹ sư DevOps đã yêu cầu AI cung cấp một tập lệnh để dọn dẹp ổ đĩa. YZ tìm /var/log -mtime +30 -exec rm {} \; Anh ta đưa ra một mệnh lệnh tương tự; Nó rất trôi chảy, nhưng kỹ sư đã thực hiện bước "đọc và hiểu" và nhận ra rằng lệnh có thể chạy trong thư mục gốc thay vì /var/log do biến đường dẫn không chính xác. Anh ấy đã thử sử dụng logic --dry-run bằng cách thay thế rm bằng echo trên máy kiểm tra, thấy lỗi và sửa nó. Bước này đã ngăn cản việc giải cứu có thể kéo dài hàng giờ đồng hồ.

Trường hợp 3 - Ranh giới đạo đức và bảo mật. Một thực tập sinh vừa dán chuỗi kết nối đầy đủ của cơ sở dữ liệu sản xuất (bao gồm tên người dùng, mật khẩu, máy chủ) vào một công cụ công cộng và nói "tối ưu hóa kết nối này". Kỹ sư cấp cao đã can thiệp: đây là thông tin xác thực trực tiếp nằm ngoài tầm kiểm soát và yêu cầu thay đổi mật khẩu ngay lập tức. Công việc tương tự được thực hiện lại trong công cụ đã được tổ chức phê duyệt, với tất cả các bí mật được che dấu bằng ĐÃ GIẤU và mật khẩu bị rò rỉ đã được thay đổi ngay lập tức.

Bốn mẫu có thể sao chép

1) Đánh giá rủi ro nhiệm vụ:

Vai trò của bạn: cố vấn cấp cao về hệ thống/kỹ thuật mạng. Tôi sẽ mô tả vai trò bên dưới. Hãy cho tôi biết (1) liệu đây là công việc soạn thảo/phân tích có thể được ủy quyền an toàn cho AI hay công việc thực thi quan trọng mà con người phải quyết định, (2) tác động có thể xảy ra của kết quả đầu ra không chính xác (thời gian ngừng hoạt động/dữ liệu/bảo mật), (3) kế hoạch xác thực và dự phòng nào tôi nên chuẩn bị trước khi thực hiện. Nhiệm vụ: [chèn nhiệm vụ vào đây]

2) Mô tả lệnh và kiểm tra bảo mật:

Giải thích từng dòng lệnh sau: chỉ định mỗi cờ làm gì, nó ảnh hưởng đến tệp/thư mục nào và các tác động phá hoại có thể có của nó. Sử dụng cờ tự tạo; Nếu bạn không chắc chắn, hãy viết "cần xác minh". Liệt kê 3 rủi ro tôi nên chú ý trước khi chạy lệnh này trong sản xuất. Lệnh: [lệnh]

3) Kiểm soát che giấu dữ liệu:

Văn bản nhật ký/cấu hình tôi sẽ cung cấp cho bạn có thể chứa dữ liệu nhạy cảm (IP, tên máy chủ, người dùng, mật khẩu, khóa API, chứng chỉ). Đầu tiên hãy liệt kê những khu vực nào trong văn bản này cần được che đi; Tôi sẽ che nó và gửi lại. Đừng phân tích nó như nó vốn có.

4) Cơ cấu thẩm quyền và mục đích:

Mục tiêu của tôi là bảo vệ và vận hành trên [hệ thống/mạng] mà tôi được ủy quyền. Tôi sẽ hỏi bạn một câu hỏi; Chỉ đưa ra câu trả lời của bạn trong khuôn khổ phòng thủ, củng cố và xác minh. Cảnh báo tôi trong trường hợp truy cập trái phép hoặc yêu cầu các bước tấn công và đề xuất giải pháp thay thế phòng thủ hợp pháp.

Dấu nhắc yếu / Dấu nhắc mạnh

Dấu nhắc yếu:

Tăng tốc máy chủ của tôi.

Lời nhắc này không có ngữ cảnh: không rõ hệ điều hành nào, nút cổ chai nào, số liệu nào. AI là xu hướng chủ đạo, không thể áp dụng được và một số phát ra các chất nguy hiểm.

Lời nhắc mạnh mẽ:

Vai trò của bạn: trợ lý cấp cao kỹ sư hệ thống Linux. Tôi có máy chủ web 8 lõi/16GB chạy Ubuntu 22.04 với CPU liên tục ở mức 85%. Tôi có đầu ra của "ball" và "iostat" bị che (bên dưới). Mục tiêu của tôi là xác định nút cổ chai. Cung cấp cho tôi (1) những số liệu cần tìm ở đầu ra, (2) các nguyên nhân có thể xảy ra theo thứ tự xác suất, (3) các lệnh chẩn đoán chỉ đọc cho từng nguyên nhân mà tôi có thể chạy mà không cần chạm vào quá trình sản xuất. Đề xuất thay đổi; chẩn đoán trước. Đầu ra: [dữ liệu bị che]

Cách tiếp cận

tốc độ

Rủi ro về tính toàn vẹn/bảo mật

Trách nhiệm của ai

Thực thi lệnh quan trọng bằng AI mà không cần xác minh

cao

rất cao

Không chắc chắn - nguy hiểm

Dự thảo AI, xác minh và thực thi của con người

cao

Thấp (nếu được xác nhận)

Con người - đúng

Đừng làm mọi thứ bằng tay

thấp

thấp

con người nhưng chậm chạp

Không bao giờ sử dụng AI

thấp

thấp

đằng sau đối thủ cạnh tranh

Những lỗi thường gặp

  • Nhầm lẫn sự trôi chảy với sự chính xác. AI tạo ra mệnh lệnh tự tin; Điều này không có nghĩa là lệnh an toàn, hãy đọc từng dòng.
  • Ủy quyền thực hiện quan trọng. Trong quá trình sản xuất, việc yêu cầu AI "phê duyệt" rm, XÓA, thay đổi và khôi phục tường lửa khiến trách nhiệm trở nên lơ lửng.
  • Xuất dữ liệu nhạy cảm sang một công cụ mở. Dán nhật ký chứa IP, mật khẩu và khóa mà không che giấu nó là vi phạm bảo mật.
  • Để lại thẩm quyền và mục đích không rõ ràng. Chỉ sử dụng trên các hệ thống được ủy quyền của riêng bạn cho mục đích phòng thủ; nếu không nó là bất hợp pháp.
  • Thực hiện mà không có kế hoạch dự phòng. Thực hiện thay đổi mà không có bản sao lưu hoặc ảnh chụp nhanh chỉ vì AI gợi ý rằng đó sẽ là công thức dẫn đến thảm họa.
Mẹo: Bắt đầu mỗi phiên AI với “vai trò + bối cảnh hệ thống + dữ liệu bị che giấu + nhiệm vụ + ràng buộc + quyền/mục đích + người ra quyết định”. Khung này đồng thời cải thiện cả chất lượng và tính bảo mật của đầu ra.

Tóm lại

Quản trị hệ thống và mạng là một lĩnh vực trong đó một số lượng nhỏ các quyết định nặng nề làm nền tảng cho một số lượng lớn các nhiệm vụ lặp đi lặp lại. AI là một trợ lý đắc lực giúp tăng tốc các tác vụ viết mã và văn bản lặp đi lặp lại; nhưng thời gian ngừng hoạt động, mất dữ liệu và các quyết định điều hành ảnh hưởng đến bảo mật là trách nhiệm của kỹ sư. Đọc từng đầu ra, liên kết nó với tài liệu, thử riêng biệt, chuẩn bị trả lại. Che giấu dữ liệu nhạy cảm, chỉ cung cấp nó cho các công cụ bảo mật. Và quan trọng nhất: chỉ sử dụng sức mạnh này cho mục đích phòng thủ trên các hệ thống mà bạn được ủy quyền. Người kỹ sư thiết lập kỷ luật này áp dụng mọi kỹ thuật trong các đơn vị tiếp theo một cách an toàn.

Nhiệm vụ ứng dụng

Liệt kê 10 nhiệm vụ từ công việc kinh doanh của bạn mà bạn đã thực hiện trong tuần trước. Đánh dấu mỗi mục là “bản thảo/phân tích có thể ủy quyền của AI” hoặc “quyết định thực thi của con người” và thêm cột “tác động nếu sai (gián đoạn/dữ liệu/bảo mật)” bên cạnh cột đó. Chọn một trong những cái có thể chuyển nhượng và tham khảo ý kiến ​​AI với mẫu "Đánh giá rủi ro nhiệm vụ" ở trên. Sau đó che dấu một trong các nhật ký của bạn (IP, máy chủ, người dùng) và yêu cầu phân tích mẫu. Áp dụng phản xạ xác minh bốn bước và viết những quan sát của bạn thành 6 mục.

danh sách kiểm tra

  • [ ] Tôi đã tách nhiệm vụ thành “quyết định có thể ủy quyền” và “quyết định điều hành của con người” chưa?
  • [ ] Tôi đã đọc mọi đầu ra quan trọng, liên kết nó với tài liệu, thử nó trong một môi trường biệt lập, chuẩn bị kế hoạch hoàn trả chưa?
  • [ ] Tôi đã che giấu IP, máy chủ, người dùng, mật khẩu và khóa trong nhật ký và cấu hình chưa?
  • [ ] Có phải tôi chỉ tiết lộ dữ liệu nhạy cảm cho một công cụ an toàn, được tổ chức phê duyệt phải không?
  • [ ] Tôi có chỉ sử dụng AI trong các hệ thống mà tôi được ủy quyền và cho mục đích phòng thủ không?
  • [ ] Tôi đã bao gồm vai trò, bối cảnh, dữ liệu ẩn, nhiệm vụ, ràng buộc, quyền hạn và người ra quyết định trong lời nhắc của mình chưa?