
Prinsip SRE
SLI, SLO, SLA, error budget, pengurangan toil, manajemen insiden, on-call, blameless postmortem
1Apa itu SLI (Service Level Indicator) dalam SRE?
Apa itu SLI (Service Level Indicator) dalam SRE?
Jawaban
SLI (Service Level Indicator) adalah metrik kuantitatif yang mengukur aspek spesifik dari tingkat layanan yang diberikan kepada pengguna. SLI umum mencakup ketersediaan (uptime), latency (waktu respons), error rate, atau throughput. Indikator ini diukur secara objektif oleh sistem monitoring dan menjadi dasar untuk mendefinisikan SLO. Misalnya, SLI ketersediaan bisa berupa persentase request HTTP yang berhasil (kode 2xx) dari total request.
2Apa perbedaan utama antara SLO dan SLA?
Apa perbedaan utama antara SLO dan SLA?
Jawaban
SLO (Service Level Objective) adalah target tingkat layanan internal yang didefinisikan tim untuk memandu upaya SRE, tanpa konsekuensi hukum. SLA (Service Level Agreement) adalah kontrak formal dengan klien yang mencakup konsekuensi (pengembalian dana, penalti) jika target tidak tercapai. SLO biasanya lebih ketat daripada SLA untuk menciptakan buffer keamanan dan menghindari pelanggaran SLA. Misalnya, SLO 99,9% dengan SLA 99,5% memberikan margin keamanan.
3Apa itu error budget dalam SRE?
Apa itu error budget dalam SRE?
Jawaban
Error budget adalah jumlah kegagalan atau ketidaktersediaan layanan yang dapat diterima selama periode tertentu. Dihitung sebagai selisih antara 100% dan SLO. Misalnya, dengan SLO 99,9%, error budget adalah 0,1% (sekitar 43 menit downtime per bulan). Error budget ini memungkinkan keseimbangan antara inovasi dan keandalan: selama anggaran masih ada, tim dapat men-deploy fitur baru dengan cepat. Jika habis, fokus harus beralih ke stabilitas dan release harus ditunda.
Bagaimana cara menghitung sisa error budget untuk sebuah layanan?
Apa yang harus dilakukan ketika error budget sebuah layanan habis?
+21 pertanyaan wawancara
Topik wawancara DevOps lainnya
Kontrol Versi & Git
Dasar-dasar Linux
Shell Scripting & Bash
Dasar-Dasar Networking
Dasar-Dasar Docker
Dasar-Dasar CI/CD
GitHub Actions
GitLab CI/CD
Jenkins
Dasar-dasar Kubernetes
Networking Kubernetes
Kubernetes Lanjutan
Ingress & API Gateway
Dasar-dasar Terraform
Terraform Lanjutan
Ansible & Configuration Management
Dasar-Dasar AWS
Dasar-Dasar Azure
Dasar-Dasar GCP
Monitoring & Prometheus
Logging & ELK Stack
Alerting & Incident Response
Cloud Identity & Secrets
Keamanan Pipeline CI/CD
Helm & Kubernetes
Keamanan Runtime & Cluster
Container Supply Chain Security
Service Mesh & Istio
GitOps & ArgoCD
Progressive Delivery
Observability Terdistribusi
Disaster Recovery & Backup
Optimasi Performa
Optimasi Biaya Cloud
Chaos Engineering
Platform Engineering
Kuasai DevOps untuk wawancara berikutnya
Akses semua pertanyaan, flashcards, tes teknis, latihan code review dan simulator wawancara.
Mulai gratis