Примечание.
Для доступа к этой странице требуется авторизация. Вы можете попробовать войти или изменить каталоги.
Для доступа к этой странице требуется авторизация. Вы можете попробовать изменить каталоги.
Инженерия хаоса — это практика внедрения контролируемых сбоев в систему, чтобы убедиться, что она обрабатывает нарушения корректно. Внедрение ошибок — это механизм, который делает это возможным. В ней возникают такие ошибки, как задержка сети, недоступность ресурсов или внезапная загрузка.
Azure Chaos Studio применяет эти принципы как управляемую службу. Рабочие пространства Chaos Studio — это текущая модель ресурса. Рабочая область выявляет ваши ресурсы и рекомендует сценарии, которые имитируют релевантные шаблоны сбоев. Эксперименты (классические) — это прежняя модель для настраиваемых комбинаций сбоев, использующих целевые объекты и возможности. Чтобы выбрать модель, см. Выбор между рабочими областями Chaos Studio и экспериментами (классическая версия).
Почему тестирование устойчивости имеет значение
Распределённые облачные приложения зависят от инфраструктуры, служб и сетей, которые могут выходить из строя независимо друг от друга. Нарушение в одном компоненте может каскадироваться в инцидент на уровне системы, если приложение не было разработано для его разрешения. Примеры включают аварийное переключение базы данных, сбой DNS или отключение зоны доступности.
Устойчивость — это свойство всей системы, а не отдельных компонентов. Единственный способ узнать, выживает ли приложение определенный шаблон сбоя, заключается в том, чтобы протестировать его в этом условии. Хаос-инжиниринг предлагает структурированный подход к этому в предпроизводственной и производственной средах.
Как Chaos Studio применяет инженерию хаоса
Chaos Studio вызывает сбои в ресурсах Azure контролируемым образом и в течение ограниченного периода времени. В рабочих областях Chaos Studio сценарий определяет действия, затрагиваемые типы ресурсов и последовательность шаблона сбоя. В разделе «Эксперименты» (классические) эксперимент определяет, какие сбои запускаются для каких целевых объектов и запускаются ли они параллельно или последовательно.
Многие продолжительные сбои ограничены по времени, и их временные изменения отменяются по завершении эксперимента. Например, сбой удаляет добавленные им правила группы безопасности сети или перезапускает остановленные им ресурсы. Для экспериментов (классическая модель) проверьте поведение очистки в библиотеке ошибок и действий.