06 oct
|
agap2 Spain
|
Cantabria
06 oct
agap2 Spain
Cantabria
Desde agap2 buscamos incorporar un/a Site Reliability Engineer para unirse a un equipo de Platform Engineering y participar en un entorno tecnológico de alta escala. Trabajarás en un equipo de ingeniería enfocado en facilitar el trabajo de los equipos de desarrollo, garantizando la fiabilidad, disponibilidad, escalabilidad y observabilidad de las plataformas y servicios en producción.
Gestionar y evolucionar las herramientas, procesos y estándares relacionados con el deployment y las operaciones de plataforma . Trabajar sobre una infraestructura de alta escala con múltiples microservicios en producción sobre AWS . Analizar y resolver problemas de rendimiento, disponibilidad y escalabilidad , desde su detección inicial hasta el análisis de causa raíz (RCA). Liderar y documentar procesos de Root Cause Analysis (RCA) y post-mortems.
Contribuir a una cultura sostenible de on-call , mejorando continuamente runbooks, alertas y procesos operativos. Colaborar con equipos de desarrollo y datos para incorporar prácticas de Dev Ops y SRE desde el diseño y desarrollo de los servicios. Impulsar buenas prácticas de observabilidad, fiabilidad y Dev Ops dentro de los equipos de ingeniería.
Participar en la definición y evolución de estándares de operación y despliegue. Trabajar con arquitecturas basadas en microservicios y APIs a gran escala.
Contribuir a la mejora continua de la plataforma y de los procesos de ingeniería. Más de 3 años de experiencia en SRE, Dev Ops o Infrastructure Engineering . Sólidos conocimientos de Linux , networking Cloud y buenas prácticas de operación.
Experiencia sólida trabajando con AWS .
Experiencia con Kubernetes, Docker, Helm y nginx .
Experiencia con Redis .
Experiencia con Git Lab para control de código fuente y CI/CD. Conocimientos de Postgre SQL y experiencia con My SQL. Conocimientos de Kafka y arquitecturas de event streaming.
Experiencia con Terraform como herramienta de Infrastructure as Code.
Experiencia desarrollando y manteniendo pipelines de CI/CD con Git Lab CI .
Experiencia en monitorización y observabilidad , especialmente con Datadog (APM, logs y dashboards). Conocimientos de prácticas SLO/SLA .
Experiencia trabajando con APIs y arquitecturas de microservicios a escala . Nivel alto de inglés . Capacidad de comunicación, colaboración y trabajo en equipo. Mentalidad pragmática, orientada a la responsabilidad y a la resolución de problemas.
Será valorable Experiencia con Istio y Envoy . Conocimientos de Python, Go u otros lenguajes de programación.
Experiencia utilizando asistentes de programación basados en IA , como Claude Code, Git Hub Copilot o Cursor. Proyecto estable y de alto impacto tecnológico. Incorporación a un equipo internacional de Platform Engineering . Trabajo con tecnologías Cloud y arquitecturas de microservicios a gran escala. Contexto orientado a la innovación, la mejora continua y las buenas prácticas de ingeniería.
Oportunidades de desarrollo profesional y crecimiento dentro de agap2. Agap2 ofrece igualdad de oportunidades y garantiza un proceso de selección basado en criterios objetivos, valorando las competencias, experiencia y capacidades de cada candidatura, sin discriminación por razón de género, edad, nacionalidad, discapacidad, orientación sexual, identidad de género o cualquier otra circunstancia personal o social.
📌 Site reliability engineer (Cantabria)
🏢 agap2 Spain
📍 Cantabria