DevOps

Alerting та Incident Response

Runbooks, paging, ескалація, керування інцидентами, on-call практики, postmortems, troubleshooting сповіщень

20 питань зі співбесід·
Mid-Level
1

Що таке runbook у контексті DevOps?

Відповідь

Runbook — це операційний документ, що містить стандартизовані процедури для обробки інцидентів або повторюваних завдань обслуговування. Він дозволяє on-call командам виконувати наперед визначені та валідовані кроки для швидкого вирішення відомих проблем, тим самим скорочуючи час вирішення та людські помилки. Runbook'и можуть бути ручними або автоматизованими та є фундаментальним елементом керування інцидентами.

2

Що таке paging у контексті керування інцидентами?

Відповідь

Paging — це механізм сповіщення, який повідомляє on-call інженерів про виникнення критичного інциденту. Ця система використовує різні канали зв'язку, такі як SMS, телефонні дзвінки або спеціалізовані застосунки, щоб гарантувати швидке сповіщення відповідальної особи, навіть поза робочим часом. Хороша система paging включає політики автоматичної ескалації, якщо перша особа не відповідає.

3

Що таке postmortem у контексті керування інцидентами?

Відповідь

Postmortem — це ретроспективний аналіз, що проводиться після значного інциденту. Його мета — зрозуміти першопричини інциденту, задокументувати хронологію подій, визначити коригувальні дії та поділитися здобутими знаннями з командою. Ефективний postmortem використовує blameless-підхід, зосереджений на покращенні систем і процесів, а не на індивідуальній відповідальності.

4

Яка різниця між event та інцидентом?

5

Що означає MTTA (Mean Time To Acknowledge)?

+17 питань зі співбесід

Інші теми співбесід DevOps

Контроль версій & Git

Junior
20 запитань

Основи Linux

Junior
22 запитань

Shell Scripting & Bash

Mid-Level
20 запитань

Основи мереж

Junior
22 запитань

Основи Docker

Junior
24 запитань

Основи CI/CD

Junior
18 запитань

GitHub Actions

Mid-Level
22 запитань

GitLab CI/CD

Mid-Level
22 запитань

Jenkins

Mid-Level
22 запитань

Основи Kubernetes

Mid-Level
26 запитань

Networking Kubernetes

Mid-Level
24 запитань

Kubernetes Просунутий

Mid-Level
24 запитань

Ingress & API Gateway

Mid-Level
20 запитань

Основи Terraform

Mid-Level
22 запитань

Terraform Просунутий

Mid-Level
22 запитань

Ansible & Configuration Management

Mid-Level
20 запитань

Основи AWS

Mid-Level
26 запитань

Основи Azure

Mid-Level
22 запитань

Основи GCP

Mid-Level
22 запитань

Моніторинг і Prometheus

Mid-Level
22 запитань

Logging & ELK Stack

Mid-Level
20 запитань

Cloud Identity & Secrets

Mid-Level
22 запитань

Безпека CI/CD пайплайнів

Mid-Level
20 запитань

Helm & Kubernetes

Mid-Level
20 запитань

Безпека Runtime та Cluster

Senior
24 запитань

Container Supply Chain Security

Senior
22 запитань

Service Mesh та Istio

Senior
24 запитань

GitOps & ArgoCD

Senior
22 запитань

Progressive Delivery

Senior
20 запитань

Розподілена спостережуваність

Senior
22 запитань

Disaster Recovery & Backup

Senior
20 запитань

Оптимізація продуктивності

Senior
22 запитань

Оптимізація витрат на хмару

Senior
20 запитань

Принципи SRE

Senior
24 запитань

Chaos Engineering

Senior
20 запитань

Platform Engineering

Senior
22 запитань

Опануй DevOps для наступної співбесіди

Отримай доступ до всіх питань, flashcards, технічних тестів, вправ code review та симуляторів співбесід.

Почни безкоштовно