17 sep
|
agap2 España
|
Madrid
17 sep
agap2 España
Madrid
Desde
agap2
buscamos incorporar un/a
Site Reliability Engineer
para unirse a un equipo de Platform Engineering y participar en un contexto tecnológico de alta escala.
Trabajarás en un equipo de ingeniería enfocado en facilitar el trabajo de los equipos de desarrollo, garantizando la
fiabilidad, disponibilidad, escalabilidad y observabilidad
de las plataformas y servicios en producción.
¿Qué harás? Gestionar y evolucionar las herramientas, procesos y estándares relacionados con el
deployment y las operaciones de plataforma . Trabajar sobre una infraestructura de alta escala con múltiples
microservicios en producción sobre AWS . Analizar y resolver problemas de
rendimiento, disponibilidad y escalabilidad , desde su detección inicial hasta el análisis de causa raíz (RCA). Liderar y documentar procesos de
Root Cause Analysis (RCA)
y post-mortems. Contribuir a una cultura sostenible de
on-call , mejorando continuamente runbooks, alertas y procesos operativos. Colaborar con equipos de desarrollo y datos para incorporar prácticas de
DevOps y SRE
desde el diseño y desarrollo de los servicios. Impulsar buenas prácticas de
observabilidad, fiabilidad y DevOps
dentro de los equipos de ingeniería. Participar en la definición y evolución de estándares de operación y despliegue. Trabajar con arquitecturas basadas en
microservicios y APIs
a gran escala. Contribuir a la mejora continua de la plataforma y de los procesos de ingeniería.
¿Qué buscamos? Más de
3 años de experiencia en SRE, DevOps o Infrastructure Engineering . Sólidos conocimientos de
Linux , networking Cloud y buenas prácticas de operación. Experiencia sólida trabajando con
AWS . Experiencia con
Kubernetes, Docker, Helm y nginx .
Experiencia con
Redis . Experiencia con
GitLab
para control de código fuente y CI/CD. Conocimientos de
PostgreSQL
y experiencia con MySQL. Conocimientos de
Kafka
y arquitecturas de event streaming. Experiencia con
Terraform
como herramienta de Infrastructure as Code. Experiencia desarrollando y manteniendo pipelines de
CI/CD con GitLab CI . Experiencia en
monitorización y observabilidad , especialmente con Datadog (APM, logs y dashboards). Conocimientos de prácticas
SLO/SLA . Experiencia trabajando con
APIs y arquitecturas de microservicios a escala . Nivel alto de
inglés . Capacidad de comunicación, colaboración y trabajo en equipo. Mentalidad pragmática, orientada a la responsabilidad y a la resolución de problemas.
Será valorable Experiencia con
Istio y Envoy . Conocimientos de
Python, Go
u otros lenguajes de programación. Experiencia utilizando asistentes de programación basados en
IA , como Claude Code, GitHub Copilot o Cursor.
¿Qué ofrecemos? Proyecto estable y de alto impacto tecnológico. 100% remoto . Incorporación a un equipo internacional de
Platform Engineering . Trabajo con tecnologías Cloud y arquitecturas de microservicios a gran escala. Entorno orientado a la innovación, la mejora continua y las buenas prácticas de ingeniería. Oportunidades de desarrollo profesional y crecimiento dentro de agap2.
Agap2 ofrece igualdad de oportunidades y garantiza un proceso de selección basado en criterios objetivos, valorando las competencias, experiencia y capacidades de cada candidatura, sin discriminación por razón de género, edad, nacionalidad, discapacidad, orientación sexual, identidad de género o cualquier otra circunstancia personal o social.
📌 Site Reliability Engineer (Madrid)
🏢 agap2 España
📍 Madrid