República Web

Site Reliability Engineering en Google con Ramón Medrano #RW188

Informações:

Synopsis

Para este episodio del podcast invitamos a Ramón Medrano Llamas, que actualmente desempeña su trabajo desde Zürich para Google como Site Reliability Engineer (SRE). Conocimos a Ramón Medrano a raíz del pasado incidente de Facebook, cuando la compañía sufrió una caída mundial de su servicio. Un miembro de nuestro grupo de Telegram Malditos Webmasters compartió un tuit de Ramón Medrano donde explicaba con excelente detalle la situación. Este incidente de Facebook dejó desde primera hora de la tarde del 4 de octubre, sin acceso a sus servicios a gran parte de su base de usuarios a nivel mundial. Fueron seguramente cuatro horas larguísimas para el equipo de ingenieros de Facebook encargados de la situación, que a pesar de las bromas en redes sociales que se sucedían, logró recuperar, como mencionó Ramón Medrano, el sistema en tiempo record. En pocas horas los servicios del proveedor OVH también sufría una interrupción del servicio que afectaba a muchos clientes. Estos incidentes sirvieron para poner el foco en