
Alerting & Incident Response
Runbooks, paging, escalation, การจัดการอินซิเดนต์, แนวปฏิบัติ on-call, postmortems, การแก้ไขปัญหา alerts
1Runbook ในบริบทของ DevOps คืออะไร?
Runbook ในบริบทของ DevOps คืออะไร?
คำตอบ
Runbook คือเอกสารปฏิบัติการที่มีขั้นตอนมาตรฐานสำหรับการจัดการอินซิเดนต์หรืองานบำรุงรักษาที่เกิดขึ้นซ้ำ ช่วยให้ทีม on-call ปฏิบัติตามขั้นตอนที่กำหนดไว้ล่วงหน้าและได้รับการตรวจสอบเพื่อแก้ไขปัญหาที่ทราบอย่างรวดเร็ว ลดเวลาในการแก้ไขและข้อผิดพลาดของมนุษย์ Runbook อาจเป็นแบบ manual หรือ automated และเป็นองค์ประกอบพื้นฐานของการจัดการอินซิเดนต์
2Paging ในบริบทของการจัดการอินซิเดนต์คืออะไร?
Paging ในบริบทของการจัดการอินซิเดนต์คืออะไร?
คำตอบ
Paging คือกลไกการแจ้งเตือนที่แจ้งวิศวกร on-call เมื่อเกิดอินซิเดนต์ระดับวิกฤต ระบบนี้ใช้ช่องทางการสื่อสารต่างๆ เช่น SMS การโทรศัพท์ หรือแอปพลิเคชันเฉพาะ เพื่อให้แน่ใจว่าผู้รับผิดชอบได้รับการแจ้งเตือนอย่างรวดเร็ว แม้นอกเวลาทำงาน ระบบ paging ที่ดีจะมีนโยบาย escalation อัตโนมัติหากบุคคลแรกไม่ตอบสนอง
3Postmortem ในบริบทของการจัดการอินซิเดนต์คืออะไร?
Postmortem ในบริบทของการจัดการอินซิเดนต์คืออะไร?
คำตอบ
Postmortem คือการวิเคราะห์ย้อนหลังที่ดำเนินการหลังเกิดอินซิเดนต์ที่สำคัญ วัตถุประสงค์คือเพื่อทำความเข้าใจสาเหตุที่แท้จริงของอินซิเดนต์ จัดทำเอกสารไทม์ไลน์ของเหตุการณ์ ระบุการดำเนินการแก้ไข และแบ่งปันบทเรียนกับทีม Postmortem ที่มีประสิทธิภาพใช้แนวทาง blameless โดยเน้นการปรับปรุงระบบและกระบวนการมากกว่าความรับผิดชอบของบุคคล
ความแตกต่างระหว่าง event และ incident คืออะไร?
MTTA (Mean Time To Acknowledge) หมายถึงอะไร?
+17 คำถามสัมภาษณ์
หัวข้อสัมภาษณ์ DevOps อื่นๆ
การควบคุมเวอร์ชัน & Git
พื้นฐาน Linux
Shell Scripting & Bash
พื้นฐาน Networking
พื้นฐาน Docker
พื้นฐาน CI/CD
GitHub Actions
GitLab CI/CD
Jenkins
พื้นฐาน Kubernetes
Networking ของ Kubernetes
Kubernetes ขั้นสูง
Ingress & API Gateway
พื้นฐาน Terraform
Terraform ขั้นสูง
Ansible & Configuration Management
พื้นฐาน AWS
พื้นฐาน Azure
พื้นฐาน GCP
การมอนิเตอร์และ Prometheus
Logging & ELK Stack
Cloud Identity & Secrets
ความปลอดภัยของ CI/CD Pipeline
Helm & Kubernetes
ความปลอดภัย Runtime และ Cluster
Container Supply Chain Security
Service Mesh & Istio
GitOps & ArgoCD
Progressive Delivery
Observability แบบกระจาย
Disaster Recovery & Backup
การปรับแต่งประสิทธิภาพ
การเพิ่มประสิทธิภาพต้นทุน Cloud
หลักการ SRE
Chaos Engineering
Platform Engineering
เชี่ยวชาญ DevOps สำหรับการสัมภาษณ์ครั้งถัดไป
เข้าถึงคำถามทั้งหมด flashcards แบบทดสอบเทคนิค แบบฝึกหัด code review และตัวจำลองสัมภาษณ์
เริ่มใช้ฟรี