
Principi SRE
SLI, SLO, SLA, error budget, riduzione del toil, gestione degli incidenti, on-call, blameless postmortem
1Che cos'è un SLI (Service Level Indicator) in SRE?
Che cos'è un SLI (Service Level Indicator) in SRE?
Risposta
Un SLI (Service Level Indicator) è una metrica quantitativa che misura un aspetto specifico del livello di servizio fornito agli utenti. SLI tipici includono disponibilità (uptime), latency (tempo di risposta), error rate o throughput. Questi indicatori vengono misurati in modo oggettivo dai sistemi di monitoring e fungono da base per definire gli SLO. Ad esempio, un SLI di disponibilità potrebbe essere la percentuale di richieste HTTP riuscite (codici 2xx) sul totale delle richieste.
2Qual è la principale differenza tra un SLO e un SLA?
Qual è la principale differenza tra un SLO e un SLA?
Risposta
Un SLO (Service Level Objective) è un obiettivo interno di livello di servizio definito dal team per guidare gli sforzi SRE, senza conseguenze legali. Un SLA (Service Level Agreement) è un contratto formale con il cliente che include conseguenze (rimborsi, penali) se gli obiettivi non vengono raggiunti. Lo SLO è generalmente più rigoroso dello SLA per creare un margine di sicurezza ed evitare violazioni dello SLA. Ad esempio, uno SLO del 99,9% con uno SLA del 99,5% offre un margine di sicurezza.
3Che cos'è un error budget in SRE?
Che cos'è un error budget in SRE?
Risposta
Un error budget è la quantità accettabile di guasti o indisponibilità di un servizio in un dato periodo. Si calcola come la differenza tra 100% e lo SLO. Ad esempio, con uno SLO del 99,9%, l'error budget è dello 0,1% (circa 43 minuti di downtime al mese). Questo error budget consente di bilanciare innovazione e affidabilità: finché rimane budget, il team può rilasciare rapidamente nuove funzionalità. Se esaurito, l'attenzione deve spostarsi sulla stabilità e i release vanno rinviati.
Come calcolare l'error budget rimanente per un servizio?
Cosa fare quando l'error budget di un servizio è esaurito?
+21 domande da colloquio
Altri argomenti di colloquio DevOps
Controllo di versione & Git
Fondamenti di Linux
Shell Scripting & Bash
Fondamenti di Networking
Fondamenti di Docker
Fondamenti di CI/CD
GitHub Actions
GitLab CI/CD
Jenkins
Fondamenti di Kubernetes
Networking di Kubernetes
Kubernetes Avanzato
Ingress & API Gateway
Fondamenti di Terraform
Terraform Avanzato
Ansible & Configuration Management
Fondamenti di AWS
Fondamenti di Azure
Fondamenti di GCP
Monitoring e Prometheus
Logging & ELK Stack
Alerting e Incident Response
Cloud Identity & Secrets
Sicurezza delle Pipeline CI/CD
Helm & Kubernetes
Sicurezza Runtime e Cluster
Container Supply Chain Security
Service Mesh & Istio
GitOps & ArgoCD
Progressive Delivery
Observability Distribuita
Disaster Recovery & Backup
Ottimizzazione delle prestazioni
Ottimizzazione dei Costi Cloud
Chaos Engineering
Platform Engineering
Padroneggia DevOps per il tuo prossimo colloquio
Accedi a tutte le domande, flashcards, test tecnici, esercizi di code review e simulatori di colloquio.
Inizia gratis