DevOps

Alerting ve Incident Response

Runbook'lar, paging, eskalasyon, olay yönetimi, on-call uygulamaları, postmortem'ler, alert troubleshooting

20 mülakat soruları·
Mid-Level
1

DevOps bağlamında runbook nedir?

Cevap

Runbook, olayları veya tekrar eden bakım görevlerini yönetmek için standartlaştırılmış prosedürleri içeren operasyonel bir belgedir. On-call ekiplerin bilinen sorunları hızlıca çözmek için önceden tanımlanmış ve doğrulanmış adımları izlemesine olanak tanır, böylece çözüm süresini ve insan hatalarını azaltır. Runbook'lar manuel veya otomatik olabilir ve olay yönetiminin temel bir unsurunu oluşturur.

2

Olay yönetimi bağlamında paging nedir?

Cevap

Paging, kritik bir olay meydana geldiğinde on-call mühendislerini bilgilendiren alerting mekanizmasıdır. Bu sistem, sorumlu kişinin çalışma saatleri dışında bile hızlı bir şekilde uyarılmasını sağlamak için SMS, telefon görüşmeleri veya özel uygulamalar gibi çeşitli iletişim kanallarını kullanır. İyi bir paging sistemi, ilk kişinin yanıt vermemesi durumunda otomatik eskalasyon politikalarını içerir.

3

Olay yönetimi bağlamında postmortem nedir?

Cevap

Postmortem, önemli bir olaydan sonra gerçekleştirilen retrospektif bir analizdir. Amacı, olayın kök nedenlerini anlamak, olayların zaman çizelgesini belgelemek, düzeltici eylemleri tanımlamak ve öğrenilenleri ekiple paylaşmaktır. Etkili bir postmortem, bireysel hesap verebilirlikten ziyade sistemleri ve süreçleri iyileştirmeye odaklanan blameless yaklaşımını benimser.

4

Bir event ve bir incident arasındaki fark nedir?

5

MTTA (Mean Time To Acknowledge) ne anlama gelir?

+17 mülakat soruları

Bir sonraki mülakatın için DevOps'de uzmanlaş

Tüm sorulara, flashcards'a, teknik testlere, code review alıştırmalarına ve mülakat simülatörlerine eriş.

Ücretsiz başla