Принципы управляемых систем

Как открытость, ремонтопригодность, документация и прозрачные зависимости делают ИТ надёжнее.

Надёжная ИТ-система — не та, в которой больше всего продуктов. Это система, назначение, зависимости и пути восстановления которой понятны.

Начинать с функции

До выбора компонентов необходимо определить, какую функцию следует сохранить, кому нужна информация, какое время реакции допустимо и что может временно отказать.

Рассматривать всю информационную цепочку

Устройства, идентификация, сети, DNS, время, хранилища, резервные копии и каналы связи образуют цепочку. Незаметное звено может остановить важный процесс.

Использовать открытость осмысленно

Open Source и открытые стандарты полезны, если они улучшают заменяемость, проверяемость, обслуживание или передачу знаний. Независимость от производителя означает не отказ от всех производителей, а осознанный контроль зависимостей.

Планировать восстановление заранее

Альтернативные пути, резервные копии конфигураций, отслеживаемые изменения и доступная документация должны существовать до инцидента.

Делать зависимости видимыми

Для каждой важной зависимости должно быть понятно: какая функция от неё зависит, кто отвечает, как она контролируется и как восстановить состояние.

Относиться к документации как к инструменту эксплуатации

Документация должна помогать при изменениях, передаче и сбоях. Обоснования решений столь же важны, как конфигурации.

Передавать знания

Управляемая система не должна постоянно зависеть от памяти одного человека.

Осознанно выбирать меньше

Каждый дополнительный компонент увеличивает объём эксплуатации, обновлений и документации. Самое простое жизнеспособное решение часто оказывается самым надёжным.

Поиск по IT-Nerds

Введите поисковый запрос.