DevOps

Alerting & Incident Response

Runbooks, paging, eskalasi, manajemen insiden, praktik on-call, postmortems, troubleshooting alert

20 pertanyaan wawancara·
Mid-Level
1

Apa itu runbook dalam konteks DevOps?

Jawaban

Runbook adalah dokumen operasional yang berisi prosedur standar untuk menangani insiden atau tugas pemeliharaan berulang. Ini memungkinkan tim on-call mengikuti langkah-langkah yang telah ditentukan dan divalidasi untuk menyelesaikan masalah yang diketahui dengan cepat, sehingga mengurangi waktu penyelesaian dan kesalahan manusia. Runbook dapat berupa manual atau otomatis dan merupakan elemen fundamental dari manajemen insiden.

2

Apa itu paging dalam konteks manajemen insiden?

Jawaban

Paging adalah mekanisme alerting yang memberitahu insinyur on-call ketika insiden kritis terjadi. Sistem ini menggunakan berbagai saluran komunikasi seperti SMS, panggilan telepon, atau aplikasi khusus untuk memastikan orang yang bertanggung jawab segera diberi tahu, bahkan di luar jam kerja. Sistem paging yang baik mencakup kebijakan eskalasi otomatis jika orang pertama tidak merespons.

3

Apa itu postmortem dalam konteks manajemen insiden?

Jawaban

Postmortem adalah analisis retrospektif yang dilakukan setelah insiden signifikan. Tujuannya adalah memahami akar penyebab insiden, mendokumentasikan kronologi peristiwa, mengidentifikasi tindakan korektif, dan berbagi pembelajaran dengan tim. Postmortem yang efektif mengadopsi pendekatan blameless, berfokus pada peningkatan sistem dan proses daripada tanggung jawab individu.

4

Apa perbedaan antara event dan insiden?

5

Apa arti MTTA (Mean Time To Acknowledge)?

+17 pertanyaan wawancara

Kuasai DevOps untuk wawancara berikutnya

Akses semua pertanyaan, flashcards, tes teknis, latihan code review dan simulator wawancara.

Mulai gratis