DevOps

Принципи SRE

SLI, SLO, SLA, error budget, зменшення toil, керування інцидентами, on-call, blameless postmortem

24 питань зі співбесід·
Senior
1

Що таке SLI (Service Level Indicator) у SRE?

Відповідь

SLI (Service Level Indicator) — це кількісна метрика, яка вимірює конкретний аспект рівня сервісу, що надається користувачам. Типові SLI включають доступність (uptime), latency (час відповіді), error rate або throughput. Ці показники об'єктивно вимірюються системами monitoring і слугують основою для визначення SLO. Наприклад, SLI доступності може бути відсотком успішних HTTP-запитів (коди 2xx) від загальної кількості запитів.

2

Яка основна різниця між SLO та SLA?

Відповідь

SLO (Service Level Objective) — це внутрішня ціль рівня сервісу, визначена командою для спрямування зусиль SRE, без юридичних наслідків. SLA (Service Level Agreement) — це формальний договір із клієнтом, що включає наслідки (відшкодування, штрафи) у разі недосягнення цілей. SLO зазвичай суворіший за SLA, щоб створити запас безпеки й уникнути порушень SLA. Наприклад, SLO 99,9% за SLA 99,5% дає запас безпеки.

3

Що таке error budget у SRE?

Відповідь

Error budget — це прийнятна кількість збоїв або недоступності сервісу за певний період. Він обчислюється як різниця між 100% і SLO. Наприклад, за SLO 99,9% error budget становить 0,1% (приблизно 43 хвилини downtime на місяць). Цей error budget дозволяє балансувати між інноваціями та надійністю: поки бюджет залишається, команда може швидко розгортати нові функції. Якщо його вичерпано, фокус має зміститися на стабільність, а release слід відкласти.

4

Як обчислити залишковий error budget для сервісу?

5

Що робити, коли error budget сервісу вичерпано?

+21 питань зі співбесід

Інші теми співбесід DevOps

Контроль версій & Git

Junior
20 запитань

Основи Linux

Junior
22 запитань

Shell Scripting & Bash

Mid-Level
20 запитань

Основи мереж

Junior
22 запитань

Основи Docker

Junior
24 запитань

Основи CI/CD

Junior
18 запитань

GitHub Actions

Mid-Level
22 запитань

GitLab CI/CD

Mid-Level
22 запитань

Jenkins

Mid-Level
22 запитань

Основи Kubernetes

Mid-Level
26 запитань

Networking Kubernetes

Mid-Level
24 запитань

Kubernetes Просунутий

Mid-Level
24 запитань

Ingress & API Gateway

Mid-Level
20 запитань

Основи Terraform

Mid-Level
22 запитань

Terraform Просунутий

Mid-Level
22 запитань

Ansible & Configuration Management

Mid-Level
20 запитань

Основи AWS

Mid-Level
26 запитань

Основи Azure

Mid-Level
22 запитань

Основи GCP

Mid-Level
22 запитань

Моніторинг і Prometheus

Mid-Level
22 запитань

Logging & ELK Stack

Mid-Level
20 запитань

Alerting та Incident Response

Mid-Level
20 запитань

Cloud Identity & Secrets

Mid-Level
22 запитань

Безпека CI/CD пайплайнів

Mid-Level
20 запитань

Helm & Kubernetes

Mid-Level
20 запитань

Безпека Runtime та Cluster

Senior
24 запитань

Container Supply Chain Security

Senior
22 запитань

Service Mesh та Istio

Senior
24 запитань

GitOps & ArgoCD

Senior
22 запитань

Progressive Delivery

Senior
20 запитань

Розподілена спостережуваність

Senior
22 запитань

Disaster Recovery & Backup

Senior
20 запитань

Оптимізація продуктивності

Senior
22 запитань

Оптимізація витрат на хмару

Senior
20 запитань

Chaos Engineering

Senior
20 запитань

Platform Engineering

Senior
22 запитань

Опануй DevOps для наступної співбесіди

Отримай доступ до всіх питань, flashcards, технічних тестів, вправ code review та симуляторів співбесід.

Почни безкоштовно