28 ago
|
Importante empresa
|
Madrid
28 ago
Importante empresa
Madrid
Site Reliability Engineer (SRE)
Descripción de la compañía
Compañía de referencia del sector aéreo que está impulsando su transformación tecnológica mediante soluciones orientadas a mejorar la eficiencia, automatización y escalabilidad de sus operaciones. Su área tecnológica trabaja con equipos de producto y metodologías ágiles para desarrollar y operar servicios críticos, con especial atención a la estabilidad, rendimiento, seguridad e innovación tecnológica.
Misión y ubicación del puesto
Buscamos un/a Site Reliability Engineer (SRE) para asumir un papel clave en la disponibilidad, resiliencia y rendimiento de aplicaciones y servicios críticos.
La posición combina aproximadamente un 75% de componente técnico y un 25% de gestión y coordinación, por lo que buscamos una persona con sólida experiencia técnica que también pueda ejercer liderazgo, coordinar equipos y actuar como referente en materia de fiabilidad y operaciones.
La posición está ubicada en La Muñoza (Madrid).
Descripción de responsabilidades
- Operar y optimizar la infraestructura sobre AWS, garantizando su fiabilidad, escalabilidad y eficiencia.
- Definir y evolucionar la estrategia de observabilidad y monitorización, utilizando herramientas como Dynatrace para anticipar, detectar y mitigar incidencias.
- Garantizar la disponibilidad, resiliencia y rendimiento de aplicaciones y servicios.
- Actuar como referente técnico y service owner, coordinándose con equipos de soporte, desarrollo, infraestructura, arquitectura, ciberseguridad y FinOps.
- Liderar la respuesta ante incidentes críticos y coordinar análisis post-incidente orientados a identificar causas raíz y aplicar soluciones sostenibles.
- Trabajar con SLIs, SLOs, SLAs y KPIs, asegurando el cumplimiento de los niveles de servicio establecidos.
- Automatizar tareas operativas para reducir el trabajo manual y el operational toil.
- Colaborar con los equipos de desarrollo en la evolución de pipelines CI/CD y la adopción de buenas prácticas DevSecOps, utilizando GitHub.
- Mantener una postura sólida de seguridad cloud mediante herramientas como WIZ y contribuir al cumplimiento de requisitos de auditoría.
- Gestionar la obsolescencia tecnológica y el ciclo de vida de componentes de infraestructura.
- Diseñar y validar estrategias de Disaster Recovery, asegurando el cumplimiento de los objetivos RTO/RPO.
- Crear y mantener runbooks operativos, informes de incidentes y planes de mejora de fiabilidad.
- Liderar y acompañar a los equipos de soporte y operaciones, fomentando una cultura de ownership y mejora continua.
Requisitos esenciales
- Experiencia sólida trabajando como Site Reliability Engineer, Cloud Engineer, DevOps Engineer o en posiciones similares dentro de entornos de producción críticos.
- Experiencia práctica operando workloads en AWS, incluyendo servicios como EC2, ECS, S3, IAM o CloudWatch.
- Experiencia con plataformas de observabilidad y monitorización, especialmente Dynatrace.
- Conocimiento sólido de los principios SRE y experiencia trabajando con SLIs, SLOs y SLAs.
- Experiencia en gestión y resolución de incidentes, análisis de causa raíz y mejora de la fiabilidad de sistemas.
- Experiencia con GitHub y workflows de CI/CD.
- Capacidad para desarrollar automatizaciones que reduzcan tareas manuales y carga operativa.
- Experiencia coordinando o liderando equipos técnicos de soporte u operaciones.
- Conocimientos de seguridad, cumplimiento operativo y procesos de auditoría.
- Capacidad de liderazgo, comunicación y colaboración con equipos técnicos multidisciplinares.
Requisitos deseables
- Titulación en Ingeniería Informática, Sistemas de Información, Ingeniería Aeronáutica/Aeroportuaria o disciplinas relacionadas.
- Certificaciones de AWS, como Solutions Architect, SysOps Administrator o equivalentes.
- Experiencia con Terraform para automatización de infraestructura.
- Familiaridad con herramientas de seguridad cloud como WIZ.
- Conocimientos de ITIL y frameworks de gestión de incidentes.
- Experiencia trabajando con metodologías Agile y prácticas DevSecOps.
- Conocimientos de gestión del ciclo de vida y obsolescencia de componentes tecnológicos.
Por qué unirse a la compañía
Tendrás la ocasión de trabajar en un entorno tecnológico de alta criticidad donde la fiabilidad, automatización y escalabilidad tienen un impacto directo en el negocio. Es una posición con un peso técnico elevado y capacidad real para influir en la evolución de las operaciones, impulsar prácticas SRE y trabajar transversalmente con ingeniería, arquitectura, ciberseguridad y FinOps.
📌 SRE (Madrid)
🏢 Importante empresa
📍 Madrid