Site Reliability Engineering (SRE): Como o Google opera seus sistemas
⭐ 4.7 / 5.0 2340 avaliações 550 páginas
DevOps & Confiabilidade Manual Oficial do Google

Site Reliability Engineering (SRE): Como o Google opera seus sistemas

Autor: Betsy Beyer, Chris Jones, Jennifer Petoff & Niall Richard Murphy

A obra definitiva onde engenheiros do Google revelam como mantêm os maiores serviços da internet funcionando com alta disponibilidade e confiabilidade.

Opções de Estudo & Compra
Prefere vídeo? Formação SRE & Observabilidade (Alura)
Nível
Intermediário a Avançado
Formato
Físico & Kindle
Idioma
Português / Inglês

Visão Geral & Por Que Vale a Leitura

Descubra a mentalidade do SRE: o que acontece quando a engenharia de software é aplicada a operações de infraestrutura. Aprenda os conceitos práticos de SLIs, SLOs, Error Budgets, post-mortems sem culpa (blameless) e eliminação de toil.

🎯 Para Quem é Indicado

  • Engenheiros DevOps, SREs e Administradores de Infraestrutura
  • Desenvolvedores Backend preocupados com resiliência em produção
  • Líderes de engenharia buscando modernizar suas operações

📋 Pré-Requisitos Recomendados

  • Conhecimento de infraestrutura Linux, redes e deploy de aplicações

O Que Você Vai Aprender Nesta Obra

1 Princípios fundamentais do SRE no Google
2 Definição de SLIs (Indicadores), SLOs (Objetivos) e SLAs (Acordos)
3 Gestão de Risco com Error Budgets (Orçamentos de Erro)
4 Eliminação de Toil (trabalho manual repetitivo)
5 Monitoramento de Sistemas Distribuídos e Alertas Inteligentes
6 Gerenciamento de Incidentes e Post-mortems sem culpa
7 Gerenciamento de Capacidade e Testes de Carga

Livros Relacionados & Próximas Leituras

Ver catálogo completo →

Eleve seu patamar técnico com esta leitura

Disponível com entrega rápida Prime e versão para e-reader Kindle na Amazon Brasil.