Единицы
1. Введение в искусственный интеллект в управлении системами и сетями: роли, границы, аутентификация и полномочия 2. Скрипты автоматизации: безопасное создание Bash, PowerShell и Python 3. Анализ журналов и анализ первопричин: поиск сигнала в шуме 4. Мониторинг мощности и производительности: считывание показателей и планирование на будущее 5. Управление конфигурацией: создание конфигурации, проверка и фиксация отклонений 6. Управление инфраструктурой как кодом (IaC): Terraform, Ansible и Plan Control 7. Управление документацией и информацией: Runbook, Post-mortem и корпоративная память 8. Прогнозируемое обслуживание: выявление сбоев до того, как они произойдут 9. Управление изменениями: оценка рисков, откат и окно обслуживания 10. Безопасность и оборона: использование искусственного интеллекта в целях обороны и в пределах полномочий 11. Сквозная интеграция: управление инцидентом от начала до конца
Единица 1 / 11

Введение в искусственный интеллект в управлении системами и сетями: роли, границы, аутентификация и полномочия

Прибыль:

  • Возможность различать, в каких задачах (скрипты, журналы, черновики документов) искусственный интеллект экономит реальное время, а в каких такие задачи, как простои, потеря данных и исполнительные решения, влияющие на безопасность, оставляют на усмотрение людей, в зависимости от уровня риска задачи.
  • Способность применять четырехэтапную дисциплину, которая проверяет каждый вывод ИИ, считывая его, подключая к документу, тестируя его в изолированной среде и подготавливая план возврата.
  • Возможность усвоить принцип маскировки конфиденциальных данных в журналах и конфигурации и использовать искусственный интеллект в целях защиты только в авторизованных системах.

Пейджер подает звуковой сигнал в 3 часа ночи, рабочий сервер не отвечает, тысячи фунтов в час простоев обрабатываются за вашей спиной, и все взгляды обращены на вас. Управление системой и сетью; Это дисциплина, которая обеспечивает бесперебойную, безопасную и высокопроизводительную работу серверов, сетей, хранилищ и сервисов — от установки до установки исправлений, от мониторинга до реагирования на инциденты, от резервного копирования до аварийного восстановления. Суть этой работы такова, что за большим количеством повторяющихся задач (написание скриптов, чтение логов, сравнение конфигураций) скрывается небольшое количество очень тяжелых решений (перезапуск сервера, изменение правила брандмауэра, восстановление резервной копии). Здесь искусственный интеллект (ИИ — программное обеспечение, которое извлекает закономерности из исторических данных и создает текст, код и прогнозы) экономит ваше время в основе этой двойной структуры. Но первое и постоянное обещание этого модуля ясно: ИИ — это помощник, генератор проектов и инструмент поддержки принятия решений; Вам остается выполнить команду, подтвердить изменение и взять на себя ответственность за систему.

Этот продвинутый модуль устанавливает рефлексы инженера, а не ключей автомобиля. В этом первом разделе мы рассмотрим, где ИИ приносит реальную ценность, а где реальную опасность в системном и сетевом мире; как проверить каждый вывод; Вы узнаете, какие данные какому инструменту вы можете предоставить, и, что наиболее важно, что только разрешенное и защитное использование этой силы является законным. Без закладки этого фундамента последующие подразделения превратятся в опасную скорость.

Где в работе может пригодиться ИИ?

Разделим системную и сетевую работу на два больших кластера. Первый кластер: повторяющаяся, основанная на тексте и коде, производительная работа. Написание первого черновика сценария резервного копирования, обобщение тысяч строк журнала и пометка аномалий, объяснение синтаксиса конфигурации nginx, составление отчета о вскрытии, расшифровка оператора cron, перечисление возможных причин сообщения об ошибке. В этих задачах ИИ сокращает минуты до секунд, не устает и работает с тем же качеством даже в полночь.

Второй кластер: правоприменительные решения, которые приводят к сбоям в работе, потере данных или нарушениям безопасности. Запуск DELETE в рабочей базе данных, открытие правила брандмауэра, удаление сервера из кластера, восстановление резервной копии в рабочей базе, развертывание исправления для всего парка. Эти решения требуют контекста, институциональных знаний, терпимости к риску и ответственности. Здесь ИИ делает видимыми параметры и возможные эффекты — но вы нажимаете клавишу Enter.

Давайте проясним разницу в одном предложении: ИИ силен в вопросах «что это значит и что это может быть»; Решение за вами, когда дело доходит до таких вопросов, как «Должен ли я запустить это сейчас и кто за это поручится?» Инженер, усвоивший это различие, не внедряет ИИ в производство со слепой уверенностью и не отвергает его упрямо; Он использует его в нужном месте и в нужной дозе.

Совет: прежде чем поручить работу ИИ, спросите: «Что я потеряю, если этот результат окажется неправильным?» Если ответ «несколько минут», смело делегируйте. Если ответ «прерывание, данные или безопасность», позвольте ИИ создать черновик, вы проверите его в тестовой среде и внедрите.

Дисциплина проверки: четыре шага

ИИ говорит бегло и уверенно; Это не значит, что это правда. ИИ иногда вызывает галлюцинации — то есть он подделывает несуществующий командный флаг, ключ конфигурации или вызов API как реальные. Поддельный флаг rm в системе удаляет данные, поддельный синтаксис брандмауэра либо открывает безопасность, либо отсекает доступ. Итак, выработайте четырехшаговый рефлекс, применимый к каждому результату:

  1. Прочтите и поймите. Прочтите каждую строку команды и конфигурации, которую выдает ИИ, построчно, прежде чем запускать ее, чтобы понять, что он делает. Никогда не запускайте команду, которую вы не понимаете; Попросите ИИ объяснить каждый флаг.
  2. Ссылка на документ. Подтвердите флаг, ключ или синтаксис, заданный AI, с помощью официального руководства (справочная страница, документация по продукту). «Этот флаг действительно существует?» Проверьте вопрос поиском.
  3. Попробуйте это в изолированной среде. Сначала запустите критическую команду на тестовой/промежуточной машине, если возможно, с --dry-run. Производство – не место для репетиций.
  4. Подготовьте свое возвращение. Перед реализацией запишите план «как мне вернуться, если что-то пойдет не так»: резервная копия, снимок, копия предыдущей конфигурации. Не вносите необратимые изменения только потому, что это предложил ИИ.
Внимание: «Так сказал ИИ» не является оправданием. В случае прерывания ответственность лежит не на ИИ, а на инженере, который выполнил эту команду без ее проверки. Непроверенная команда ИИ так же опасна, как и sudo, введенный в эксплуатацию и не прочитанный.

Власть, защита и этика: красная линия

Системная и сетевая информация имеет двойное назначение: одна и та же информация может как защитить, так и разрушить сеть. Поэтому этическая линия этого модуля едина и бесспорна: используйте ИИ только в тех системах, для которых у вас есть полномочия, в оборонных и оперативных целях. Законно усилить защиту сервера вашего учреждения, искать угрозы в собственном журнале и закрывать уязвимости в собственной сети. Незаконно сканировать систему, которая вам не принадлежит, пытаться взломать чужой доступ, проникнуть в сеть без разрешения, а также незаконно использовать ИИ для этой цели. Вы спрашиваете ИИ не «как мне проникнуть в эту систему», а «как мне защитить свою собственную систему от этой атаки?»

Аналогичная строгость требуется и в отношении данных. Журналы, конфигурации и топологии часто являются секретными и конфиденциальными: внутренние IP-адреса, имена пользователей, имена хостов, ключи API, сертификаты. Замаскируйте журнал или конфигурацию перед вставкой в ​​общедоступный инструмент (10.x.x.x вместо реального IP, user1 вместо реального пользователя, ключи УДАЛЕНЫ). Предоставляйте конфиденциальные данные только транспортным средствам, работающим по контракту с учреждением, чьи данные не используются для обучения моделей.

три мини-кейса

Случай 1 — Экономия времени в нужном месте. Системный администратор каждое утро тратил 45 минут на сканирование данных системного журнала с 60 серверов. Он передал журнал с замаскированными IP-адресами и именами хостов ИИ и сказал: «Сгруппируйте ошибки по уровню серьезности и отметьте 5 повторяющихся шаблонов». Время сокращено до 8 минут. Сэкономленные 37 минут он посвятил подтверждению критических закономерностей, отмеченных ИИ в реальной системе. ИИ снял повтор; Решение осталось за инженером.

Случай 2. Проверка предотвратила катастрофу. Инженер DevOps попросил у ИИ скрипт для очистки диска. YZ find /var/log -mtime +30 -exec rm {} \; Он дал аналогичную команду; Она была написана бегло, но инженер выполнил этап «прочитал и понял» и понял, что команда может выполняться в корневом каталоге вместо /var/log из-за неправильной переменной пути. Он попробовал использовать логику --dry-run, заменив rm на echo на тестовой машине, увидел ошибку и исправил ее. Этот шаг предотвратил возможную многочасовую спасательную операцию.

Случай 3. Граница этики и конфиденциальности. Стажер только что вставил полную строку подключения производственной базы данных (включая имя пользователя, пароль, хост) в общедоступный инструмент и сказал: «Оптимизируйте это соединение». Вмешался старший инженер: действующие учетные данные вышли из-под контроля и требовали немедленной ротации (смены) пароля. Та же самая работа была повторена с помощью одобренного учреждением инструмента, при этом все секреты были замаскированы с помощью УДАЛЕНО, а утекший пароль был немедленно изменен.

Четыре копируемых шаблона

1) Оценка риска миссии:

Ваша роль: старший консультант по системному/сетевому проектированию. Я опишу роль ниже. Скажите мне (1), является ли это работой по составлению/анализу, которую можно безопасно делегировать ИИ, или критически важной работой по исполнению, где человек должен решить, (2) возможное влияние неправильных результатов (простой/данные/безопасность), (3) какой план проверки и запасной вариант мне следует подготовить перед выполнением. Задача: [вставьте задачу здесь]

2) Описание команды и проверка безопасности:

Объясните следующую команду построчно: укажите, что делает каждый флаг, на какой файл/каталог он влияет, и его возможные разрушительные последствия. Использование вымышленного флага; Если не уверены, напишите «требуется проверка». Перечислите 3 риска, на которые мне следует обратить внимание, прежде чем запускать эту команду в рабочей среде. Команда: [команда]

3) Управление маскировкой данных:

Текст журнала/конфигурации, который я вам предоставлю, может содержать конфиденциальные данные (IP-адрес, имя хоста, пользователя, пароль, ключ API, сертификат). Сначала перечислите, какие области в этом тексте необходимо замаскировать; Я замаскирую его и отправлю еще раз. Не анализируйте всё как есть.

4) Структура полномочий и цели:

Моя цель — защита и работа в [системе/сети], в которой я авторизован. Я задам вам вопрос; Дайте свой ответ только в рамках защиты, закалки и проверки. Предупредите меня в случае несанкционированного доступа или запроса на атаку и предложите законную альтернативу защиты.

Слабая подсказка / Сильная подсказка

Слабая подсказка:

Ускорьте мой сервер.

Это приглашение является контекстно-свободным: непонятно, какая ОС, какое узкое место, какой показатель. ИИ является общепринятым, неприменимым, а некоторые выделяют опасные вещества.

Мощная подсказка:

Ваша роль: старший помощник системного инженера Linux. У меня есть веб-сервер с 8 ядрами и 16 ГБ под управлением Ubuntu 22.04 с постоянной загрузкой процессора 85%. У меня замаскированы выходные данные «ball» и «iostat» (ниже). Моя цель — выявить узкое место. Дайте мне (1) какие метрики искать в выходных данных, (2) возможные причины в порядке вероятности, (3) доступные только для чтения диагностические команды для каждой причины, которые я могу запустить, не касаясь производства. Предложить изменения; сначала диагностика. Выходные данные: [замаскированные данные]

Подход

скорость

Риск целостности/безопасности

Чья ответственность

Выполнение критической команды с помощью ИИ без проверки

высокий

очень высокий

Неопределенно — опасно

Проект искусственного интеллекта, проверка человеком и обеспечение соблюдения требований

высокий

Низкий (если подтвердится)

Человек — правда

Не делайте все вручную

низкий

низкий

человечный, но медленный

Никогда не используйте ИИ

низкий

низкий

позади конкурентов

Распространенные ошибки

  • Принимаю беглость за точность. ИИ обеспечивает уверенное командование; Это не означает, что команда безопасна, читайте каждую строку.
  • Делегирование критического исполнения. В производстве получение от ИИ «одобрения» rm, DELETE, изменений и восстановления брандмауэра оставляет ответственность висящей в воздухе.
  • Экспорт конфиденциальных данных в открытый инструмент. Вставка журнала, содержащего IP, пароль и ключ, без его маскировки является нарушением безопасности.
  • Оставляя полномочия и цели неясными. Используйте только в своих авторизованных системах в защитных целях; в противном случае это незаконно.
  • Реализация без запасного плана. Внесение изменений без резервной копии или моментального снимка только потому, что это предположил ИИ, было бы верным путем к катастрофе.
Совет: начинайте каждый сеанс ИИ с «роли + системного контекста + замаскированных данных + задачи + ограничения + полномочий/цели + лица, принимающего решения». Эта структура одновременно улучшает качество и безопасность результатов.

В итоге

Системное и сетевое администрирование — это дисциплина, в которой небольшое количество сложных решений лежит в основе большого количества повторяющихся задач. ИИ — мощный помощник, который ускоряет повторяющиеся текстовые и кодовые задачи; но ответственность за простои, потерю данных и принятие исполнительных решений, влияющих на безопасность, лежит на инженере. Прочтите каждый вывод, свяжите его с документом, опробуйте отдельно, подготовьте отчет. Маскируйте конфиденциальные данные и передавайте их только безопасным инструментам. И самое главное: используйте эту возможность в оборонительных целях только в тех системах, для которых вы авторизованы. Инженер, который устанавливает эту дисциплину, безопасно применяет каждую технику в последующих подразделениях.

Задача приложения

Перечислите 10 задач из своего бизнеса, которые вы выполнили за последнюю неделю. Отметьте каждое из них как «Проект/анализ, делегируемый ИИ» или «Решение, выполняемое человеком», и добавьте рядом с ним столбец «Воздействие в случае ошибки (прерывание/данные/безопасность)». Выберите один из переносимых и обратитесь к ИИ с шаблоном «Оценка риска задачи» выше. Затем замаскируйте один из ваших журналов (IP, хост, пользователь) и запросите образец анализа. Примените четырехшаговый рефлекс проверки и запишите свои наблюдения в 6 пунктах.

контрольный список

  • [ ] Разделил ли я задачи на «делегируемые» и «человеческие исполнительные решения»?
  • [ ] Прочитал ли я все важные результаты, связал ли их с документом, опробовал ли я в изолированной среде, подготовил ли план возврата?
  • [ ] Скрыл ли я IP-адрес, хост, пользователя, пароль и ключи в журнале и конфигурации?
  • [ ] Передал ли я конфиденциальные данные только безопасному инструменту, одобренному учреждением?
  • [ ] Использовал ли я ИИ только в системах, для которых у меня есть разрешение, и в оборонительных целях?
  • [ ] Включил ли я в подсказку роль, контекст, замаскированные данные, задачу, ограничение, полномочия и лицо, принимающее решения?