Descubra los principios y prácticas fundamentales de la ingeniería de fiabilidad de sitios (SRE) directamente del equipo de expertos de Google. Esta guía esencial revela cómo Google construye, implementa, monitorea y mantiene con éxito algunos de los sistemas de software más grandes del mundo al comprometerse con todo el ciclo de vida del software. Aprenda cómo hacer que sus sistemas sean más escalables, confiables y eficientes, aplicando las metodologías probadas de Google a su propia organización. Es una inmersión profunda en la excelencia operativa que define el desarrollo de software moderno.
¿Por qué debería leer?
- Comprender qué es la ingeniería de fiabilidad de sitios y en qué se diferencia de las prácticas tradicionales de TI.
- Aprender los principios, patrones y comportamientos fundamentales que definen el trabajo de un SRE.
- Obtener conocimientos prácticos sobre la construcción y operación de grandes sistemas de computación distribuida.
- Explorar las mejores prácticas de Google para la capacitación de equipos, la comunicación y las reuniones efectivas.
Acerca del autor
Los autores, incluidos
Betsy Beyer, Chris Jones, Jennifer Petoff, Niall Richard Murphy y Todd Underwood, son miembros clave del equipo de fiabilidad de sitios de Google. Aportan una experiencia inigualable de su experiencia directa en el diseño, implementación y gestión de algunos de los sistemas de software más complejos y críticos a nivel mundial. Su conocimiento colectivo ofrece una perspectiva única e interna sobre los desafíos y las soluciones para mantener servicios confiables y de gran escala, lo que convierte a este libro en un recurso autorizado para cualquier persona involucrada en las operaciones y el desarrollo de software.