
Alerting & Incident Response
Runbooks, paging, eskalasi, manajemen insiden, praktik on-call, postmortems, troubleshooting alert
1Apa itu runbook dalam konteks DevOps?
Apa itu runbook dalam konteks DevOps?
Jawaban
Runbook adalah dokumen operasional yang berisi prosedur standar untuk menangani insiden atau tugas pemeliharaan berulang. Ini memungkinkan tim on-call mengikuti langkah-langkah yang telah ditentukan dan divalidasi untuk menyelesaikan masalah yang diketahui dengan cepat, sehingga mengurangi waktu penyelesaian dan kesalahan manusia. Runbook dapat berupa manual atau otomatis dan merupakan elemen fundamental dari manajemen insiden.
2Apa itu paging dalam konteks manajemen insiden?
Apa itu paging dalam konteks manajemen insiden?
Jawaban
Paging adalah mekanisme alerting yang memberitahu insinyur on-call ketika insiden kritis terjadi. Sistem ini menggunakan berbagai saluran komunikasi seperti SMS, panggilan telepon, atau aplikasi khusus untuk memastikan orang yang bertanggung jawab segera diberi tahu, bahkan di luar jam kerja. Sistem paging yang baik mencakup kebijakan eskalasi otomatis jika orang pertama tidak merespons.
3Apa itu postmortem dalam konteks manajemen insiden?
Apa itu postmortem dalam konteks manajemen insiden?
Jawaban
Postmortem adalah analisis retrospektif yang dilakukan setelah insiden signifikan. Tujuannya adalah memahami akar penyebab insiden, mendokumentasikan kronologi peristiwa, mengidentifikasi tindakan korektif, dan berbagi pembelajaran dengan tim. Postmortem yang efektif mengadopsi pendekatan blameless, berfokus pada peningkatan sistem dan proses daripada tanggung jawab individu.
Apa perbedaan antara event dan insiden?
Apa arti MTTA (Mean Time To Acknowledge)?
+17 pertanyaan wawancara
Topik wawancara DevOps lainnya
Kontrol Versi & Git
Dasar-dasar Linux
Shell Scripting & Bash
Dasar-Dasar Networking
Dasar-Dasar Docker
Dasar-Dasar CI/CD
GitHub Actions
GitLab CI/CD
Jenkins
Dasar-dasar Kubernetes
Networking Kubernetes
Kubernetes Lanjutan
Ingress & API Gateway
Dasar-dasar Terraform
Terraform Lanjutan
Ansible & Configuration Management
Dasar-Dasar AWS
Dasar-Dasar Azure
Dasar-Dasar GCP
Monitoring & Prometheus
Logging & ELK Stack
Cloud Identity & Secrets
Keamanan Pipeline CI/CD
Helm & Kubernetes
Keamanan Runtime & Cluster
Container Supply Chain Security
Service Mesh & Istio
GitOps & ArgoCD
Progressive Delivery
Observability Terdistribusi
Disaster Recovery & Backup
Optimasi Performa
Optimasi Biaya Cloud
Prinsip SRE
Chaos Engineering
Platform Engineering
Kuasai DevOps untuk wawancara berikutnya
Akses semua pertanyaan, flashcards, tes teknis, latihan code review dan simulator wawancara.
Mulai gratis