16 sep
|
Shakers
|
Madrid
Descripción del trabajo
Un banco mayorista español de referencia incorpora un/a
Coordinador/a senior de Observabilidad y Monitorización . Rol clave para liderar la definición, implantación, operación y evolución del modelo de observabilidad de sus servicios tecnológicos, con visión end-to-end de salud, disponibilidad, rendimiento y experiencia de usuario. Sobre el rol
Actuarás como punto de coordinación entre el equipo de Proyecto y la Oficina de Observabilidad con equipos técnicos, operación, desarrollo, seguridad, proveedores y responsables de servicio. Enfoque estructurado, trazable, automatizado y orientado a prevención del impacto + mejora continua. Combina profundidad técnica con capacidad de gobierno, liderazgo y coordinación. Lo que harás
Gobierno de observabilidad y monitorización
Definir y mantener estrategia, arquitectura, estándares y hoja de ruta. Establecer criterios para métricas, logs, trazas, eventos, alertas, dashboards, SLI, SLO y umbrales. Garantizar cobertura de monitorización end-to-end (infra, aplicaciones, integraciones, batch, cloud). Mantener inventario de activos monitorizados, dependencias, responsables, alertas y procedimientos. Diseño técnico e implementación
Liderar diseño e implantación de plataformas de observabilidad en on-premise + híbrido + multicloud. Coordinar instalación, actualización, hardening, HA, backup y recovery. Definir estándares de instrumentación para aplicaciones, middleware, infra, redes, microservicios. Administración especializada de herramientas
Dynatrace (OneAgent, ActiveGate, Smartscape, RUM, Synthetic, APM, Davis AI, Grail, DQL, alerting profiles, SLO, automatización API). Elastic Stack (Elasticsearch, Logstash, Kibana, Beats, pipelines ingesta, ILM, control cardinalidad).
Grafana + Prometheus + Alertmanager + Loki + Tempo (dashboards, PromQL, LogQL). BMC Helix (Ops Management, Discovery, event management, correlación, integración ITSM/CMDB). Monitorización de redes (NNMi, ThousandEyes, SolarWinds, PRTG, Centreon, Zabbix). Monitorización Mainframe (BMC AMI Ops/MainView, OMEGAMON, IBM Z NetView, RMF, SMF, SYSVIEW). Otras: OpenTelemetry, Azure Monitor, CloudWatch, GCP Cloud Monitoring, Splunk, AppDynamics, New Relic. Eventos y ITSM
Diseñar modelo de eventos que reduzca ruido + falsos positivos (correlación + enriquecimiento). Asegurar alertas accionables con severidad, contexto, procedimiento, escalado. Integración con ITSM para creación/actualización/cierre de incidencias con trazabilidad end-to-end. Automatización y observabilidad como código
Automatizar altas/cambios/bajas vía APIs, CI/CD, IaC (Terraform, Ansible). Git + control de versiones + revisión pares aplicado a dashboards, reglas, SLO, alertas. Scripting Python, PowerShell, Bash. Seguridad y cumplimiento
Principios mínimo privilegio, segregación funciones, gestión credenciales, cifrado, trazabilidad. Tratamiento confiable datos telemetría + retención + enmascarado. Apoyo auditorías + resiliencia + requerimientos regulatorios. Coordinación proyectos y proveedores
Planificar proyectos de implantación, migración, consolidación y evolución. Gestionar alcance, hitos, riesgos, dependencias, recursos,
presupuesto, licencias. Gobernar relación con fabricantes/proveedores. Facilitar comités técnicos + informes ejecutivos. Imprescindibles
Perfil senior con experiencia técnica demostrable en entornos críticos de alta disponibilidad, preferiblemente sector financiero/bancario. Dominio de los tres pilares de observabilidad: métricas + logs + trazas. APM y experiencia digital (instrumentación, trazabilidad distribuida, RUM, sintética). Dynatrace en profundidad + al menos 2 plataformas adicionales entre Elastic Stack, Grafana/Prometheus, BMC Helix. Sistemas e infraestructura: Linux + Windows + virtualización + redes TCP/IP + BBDD. Cloud y cloud-native: AWS + Azure + GCP + Docker + Kubernetes + microservicios. Automatización + DevOps: Git, CI/CD, Terraform, Ansible, Python/PowerShell/Bash. ITIL + gestión de eventos/incidencias/problemas/cambios/capacidad. Español profesional + inglés valorable. Suma puntos
Monitorización Mainframe (IBM Z, z/OS, CICS, Db2, IMS, MQ, JES, OMEGAMON, RMF). Monitorización de red (NNMi, ThousandEyes, SolarWinds, PRTG, Cisco DNA Center). OpenTelemetry en producción. Certificaciones Dynatrace / Elastic / Grafana Labs / BMC / AWS / Azure / GCP. ITIL 4 + PMP/PRINCE2/SAFe. Condiciones
Modalidad: freelance vía Shakers. Duración: 6 meses inicial + 6 meses posibles adicionales. Horario: L-J 8:00-17:30, V 8:00-15:00 (calendario Madrid). Ubicación: inicialmente híbrido en Madrid las primeras semanas, posteriormente remoto con visitas puntuales. En Shakers nos ocupamos de la gestión del proyecto, la facturación y el acompañamiento durante toda la colaboración. Tú te centras en construir un modelo de observabilidad extremo a extremo.
#J-18808-Ljbffr
📌 Sre (Madrid)
🏢 Shakers
📍 Madrid