SITE REALIABILITY ENGINEER (SRE) - MADRID

Hay personas que esperan a que suene la alarma. Y luego están los/a Site Reliability Engineers.

Si cuando lees palabras como Linux, Kubernetes, Python, observabilidad, SLI/SLO o alta disponibilidad piensas "esto es lo mío"... ¡puede que estemos buscando precisamente tu perfil!


Tu misión: No vas a apagar fuegos... vas a evitar que empiecen.


  • Diseñar, construir, desplegar y operar servicios críticos de principio a fin.
  • Automatizar todo lo automatizable (y probablemente alguna cosa más).
  • Crear monitorización y observabilidad para saber lo que pasa... incluso antes de que pase.
  • Participar en incidencias críticas cuando aparezcan (porque alguna siempre se cuela).
  • Investigar problemas complejos hasta encontrar la causa real. Aquí no nos conformamos con un "reinicia y listo".
  • Impulsar la cultura SRE: mejora continua, postmortem, fiabilidad y cero miedo a cuestionar cómo se hacen las cosas.


Tu caja de herramientas debería incluir...


  • Linux y/o Windows como si fueran tu segunda casa.
  • Redes, TCP/IP, balanceadores, virtualización, contenedores y Cloud.
  • Python, Go, Shell... o cualquier lenguaje que te permita decirle al ordenador que trabaje por ti.
  • Herramientas de observabilidad, métricas, logs y trazas.
  • Experiencia con plataformas distribuidas donde la disponibilidad no es negociable.
  • Y, sobre todo...que cuando alguien diga "esto siempre se ha hecho así"... tú preguntes "¿y por qué?"


Buscamos tu perfil si:


  • Llevas más de 10 años de experiencia en el sector TIC.
  • Has dedicado al menos 5 años a la operación de servicios, plataformas o infraestructuras críticas.
  • Residencia en Madrid o alrededores, ya que el puesto requiere acudir a las oficinas del cliente dos días por semana (pero sí, el resto es en remoto).


¿Listo/a para poner a prueba tus scripts y tu ingenio?