DevOps

SRE Prensipleri

SLI, SLO, SLA, error budget, toil azaltma, olay yönetimi, on-call, blameless postmortem

24 mülakat soruları·
Senior
1

SRE'de SLI (Service Level Indicator) nedir?

Cevap

SLI (Service Level Indicator), kullanıcılara sunulan hizmet düzeyinin belirli bir yönünü ölçen niceliksel bir metriktir. Tipik SLI'ler arasında erişilebilirlik (uptime), latency (yanıt süresi), error rate veya throughput yer alır. Bu göstergeler monitoring sistemleri tarafından nesnel olarak ölçülür ve SLO'ları tanımlamak için temel oluşturur. Örneğin bir erişilebilirlik SLI'si, toplam istek içindeki başarılı HTTP isteklerinin (2xx kodları) yüzdesi olabilir.

2

SLO ile SLA arasındaki temel fark nedir?

Cevap

SLO (Service Level Objective), SRE çabalarına rehberlik etmek için ekip tarafından tanımlanan, yasal sonuçları olmayan dahili bir hizmet düzeyi hedefidir. SLA (Service Level Agreement), hedeflere ulaşılmaması durumunda sonuçlar (geri ödemeler, cezalar) içeren, müşteriyle yapılan resmi bir sözleşmedir. SLO genellikle bir güvenlik tamponu oluşturmak ve SLA ihlallerini önlemek için SLA'dan daha katıdır. Örneğin %99,5 SLA ile birlikte %99,9 SLO bir güvenlik payı sağlar.

3

SRE'de error budget nedir?

Cevap

Error budget, bir hizmetin belirli bir süre boyunca kabul edilebilir hata veya kullanılamazlık miktarıdır. 100% ile SLO arasındaki fark olarak hesaplanır. Örneğin %99,9 SLO ile error budget %0,1'dir (ayda yaklaşık 43 dakika downtime). Bu error budget, inovasyon ile güvenilirliği dengelemeyi sağlar: bütçe kaldığı sürece ekip yeni özellikleri hızlıca dağıtabilir. Tükenirse, odak istikrara kaymalı ve release'ler ertelenmelidir.

4

Bir hizmet için kalan error budget nasıl hesaplanır?

5

Bir hizmetin error budget'ı tükendiğinde ne yapılmalı?

+21 mülakat soruları

Bir sonraki mülakatın için DevOps'de uzmanlaş

Tüm sorulara, flashcards'a, teknik testlere, code review alıştırmalarına ve mülakat simülatörlerine eriş.

Ücretsiz başla