DevOps

หลักการ SRE

SLI, SLO, SLA, error budget, การลด toil, การจัดการเหตุการณ์, on-call, blameless postmortem

24 คำถามสัมภาษณ์·
Senior
1

SLI (Service Level Indicator) ใน SRE คืออะไร?

คำตอบ

SLI (Service Level Indicator) คือเมตริกเชิงปริมาณที่วัดแง่มุมเฉพาะของระดับบริการที่มอบให้แก่ผู้ใช้ SLI ทั่วไปได้แก่ ความพร้อมใช้งาน (uptime), latency (เวลาตอบสนอง), error rate หรือ throughput ตัวบ่งชี้เหล่านี้ถูกวัดอย่างเป็นกลางโดยระบบ monitoring และเป็นพื้นฐานสำหรับการกำหนด SLO ตัวอย่างเช่น SLI ของความพร้อมใช้งานอาจเป็นเปอร์เซ็นต์ของ request HTTP ที่สำเร็จ (โค้ด 2xx) จากจำนวน request ทั้งหมด

2

ความแตกต่างหลักระหว่าง SLO และ SLA คืออะไร?

คำตอบ

SLO (Service Level Objective) คือเป้าหมายระดับบริการภายในที่ทีมกำหนดเพื่อนำทางความพยายามของ SRE โดยไม่มีผลทางกฎหมาย SLA (Service Level Agreement) คือสัญญาอย่างเป็นทางการกับลูกค้าที่รวมถึงผลที่ตามมา (การคืนเงิน บทลงโทษ) หากไม่บรรลุเป้าหมาย โดยทั่วไป SLO จะเข้มงวดกว่า SLA เพื่อสร้างบัฟเฟอร์ด้านความปลอดภัยและหลีกเลี่ยงการละเมิด SLA ตัวอย่างเช่น SLO 99.9% กับ SLA 99.5% ให้ส่วนเผื่อด้านความปลอดภัย

3

error budget ใน SRE คืออะไร?

คำตอบ

error budget คือปริมาณความล้มเหลวหรือความไม่พร้อมใช้งานของบริการที่ยอมรับได้ในช่วงเวลาที่กำหนด คำนวณเป็นผลต่างระหว่าง 100% และ SLO ตัวอย่างเช่น ด้วย SLO 99.9% error budget คือ 0.1% (ประมาณ 43 นาทีของ downtime ต่อเดือน) error budget นี้ช่วยสร้างสมดุลระหว่างนวัตกรรมและความน่าเชื่อถือ ตราบใดที่ยังมีงบประมาณเหลือ ทีมสามารถ deploy ฟีเจอร์ใหม่ได้อย่างรวดเร็ว หากหมดลง ต้องหันมาเน้นความเสถียรและเลื่อน release ออกไป

4

จะคำนวณ error budget ที่เหลือสำหรับบริการได้อย่างไร?

5

ควรทำอย่างไรเมื่อ error budget ของบริการหมดลง?

+21 คำถามสัมภาษณ์

หัวข้อสัมภาษณ์ DevOps อื่นๆ

การควบคุมเวอร์ชัน & Git

Junior
20 คำถาม

พื้นฐาน Linux

Junior
22 คำถาม

Shell Scripting & Bash

Mid-Level
20 คำถาม

พื้นฐาน Networking

Junior
22 คำถาม

พื้นฐาน Docker

Junior
24 คำถาม

พื้นฐาน CI/CD

Junior
18 คำถาม

GitHub Actions

Mid-Level
22 คำถาม

GitLab CI/CD

Mid-Level
22 คำถาม

Jenkins

Mid-Level
22 คำถาม

พื้นฐาน Kubernetes

Mid-Level
26 คำถาม

Networking ของ Kubernetes

Mid-Level
24 คำถาม

Kubernetes ขั้นสูง

Mid-Level
24 คำถาม

Ingress & API Gateway

Mid-Level
20 คำถาม

พื้นฐาน Terraform

Mid-Level
22 คำถาม

Terraform ขั้นสูง

Mid-Level
22 คำถาม

Ansible & Configuration Management

Mid-Level
20 คำถาม

พื้นฐาน AWS

Mid-Level
26 คำถาม

พื้นฐาน Azure

Mid-Level
22 คำถาม

พื้นฐาน GCP

Mid-Level
22 คำถาม

การมอนิเตอร์และ Prometheus

Mid-Level
22 คำถาม

Logging & ELK Stack

Mid-Level
20 คำถาม

Alerting & Incident Response

Mid-Level
20 คำถาม

Cloud Identity & Secrets

Mid-Level
22 คำถาม

ความปลอดภัยของ CI/CD Pipeline

Mid-Level
20 คำถาม

Helm & Kubernetes

Mid-Level
20 คำถาม

ความปลอดภัย Runtime และ Cluster

Senior
24 คำถาม

Container Supply Chain Security

Senior
22 คำถาม

Service Mesh & Istio

Senior
24 คำถาม

GitOps & ArgoCD

Senior
22 คำถาม

Progressive Delivery

Senior
20 คำถาม

Observability แบบกระจาย

Senior
22 คำถาม

Disaster Recovery & Backup

Senior
20 คำถาม

การปรับแต่งประสิทธิภาพ

Senior
22 คำถาม

การเพิ่มประสิทธิภาพต้นทุน Cloud

Senior
20 คำถาม

Chaos Engineering

Senior
20 คำถาม

Platform Engineering

Senior
22 คำถาม

เชี่ยวชาญ DevOps สำหรับการสัมภาษณ์ครั้งถัดไป

เข้าถึงคำถามทั้งหมด flashcards แบบทดสอบเทคนิค แบบฝึกหัด code review และตัวจำลองสัมภาษณ์

เริ่มใช้ฟรี