
Alerting e Incident Response
Runbook, paging, escalation, gestione degli incidenti, pratiche on-call, postmortem, troubleshooting degli alert
1Cos'è un runbook nel contesto DevOps?
Cos'è un runbook nel contesto DevOps?
Risposta
Un runbook è un documento operativo che contiene procedure standardizzate per gestire incidenti o attività di manutenzione ricorrenti. Consente ai team on-call di seguire passaggi predefiniti e validati per risolvere rapidamente problemi noti, riducendo così il tempo di risoluzione e gli errori umani. I runbook possono essere manuali o automatizzati e rappresentano un elemento fondamentale della gestione degli incidenti.
2Cos'è il paging nel contesto della gestione degli incidenti?
Cos'è il paging nel contesto della gestione degli incidenti?
Risposta
Il paging è il meccanismo di alerting che notifica gli ingegneri on-call quando si verifica un incidente critico. Questo sistema utilizza vari canali di comunicazione come SMS, chiamate telefoniche o applicazioni dedicate per garantire che la persona responsabile venga avvisata rapidamente, anche al di fuori dell'orario di lavoro. Un buon sistema di paging include politiche di escalation automatica se la prima persona non risponde.
3Cos'è un postmortem nel contesto della gestione degli incidenti?
Cos'è un postmortem nel contesto della gestione degli incidenti?
Risposta
Un postmortem è un'analisi retrospettiva condotta dopo un incidente significativo. Il suo obiettivo è comprendere le cause profonde dell'incidente, documentare la cronologia degli eventi, identificare azioni correttive e condividere gli insegnamenti con il team. Un postmortem efficace adotta un approccio blameless, focalizzato sul miglioramento dei sistemi e dei processi piuttosto che sulla responsabilità individuale.
Qual è la differenza tra un event e un incident?
Cosa significa MTTA (Mean Time To Acknowledge)?
+17 domande da colloquio
Altri argomenti di colloquio DevOps
Controllo di versione & Git
Fondamenti di Linux
Shell Scripting & Bash
Fondamenti di Networking
Fondamenti di Docker
Fondamenti di CI/CD
GitHub Actions
GitLab CI/CD
Jenkins
Fondamenti di Kubernetes
Networking di Kubernetes
Kubernetes Avanzato
Ingress & API Gateway
Fondamenti di Terraform
Terraform Avanzato
Ansible & Configuration Management
Fondamenti di AWS
Fondamenti di Azure
Fondamenti di GCP
Monitoring e Prometheus
Logging & ELK Stack
Cloud Identity & Secrets
Sicurezza delle Pipeline CI/CD
Helm & Kubernetes
Sicurezza Runtime e Cluster
Container Supply Chain Security
Service Mesh & Istio
GitOps & ArgoCD
Progressive Delivery
Observability Distribuita
Disaster Recovery & Backup
Ottimizzazione delle prestazioni
Ottimizzazione dei Costi Cloud
Principi SRE
Chaos Engineering
Platform Engineering
Padroneggia DevOps per il tuo prossimo colloquio
Accedi a tutte le domande, flashcards, test tecnici, esercizi di code review e simulatori di colloquio.
Inizia gratis