06 sep
|
Shakers
|
España
Un banco mayorista español de referencia incorpora un/a Coordinador/a senior de Observabilidad y Monitorización .
Rol clave para liderar la definición, implantación, operación y evolución del modelo de observabilidad de sus servicios tecnológicos, con visión end-to-end de salud, disponibilidad, rendimiento y experiencia de usuario. Sobre el rol Actuarás como punto de coordinación entre el equipo de Proyecto y la Oficina de Observabilidad con equipos técnicos, operación, desarrollo, seguridad, proveedores y responsables de servicio.
Enfoque estructurado, trazable, automatizado y orientado a prevención del impacto + mejora continua.
Combina profundidad técnica con capacidad de gobierno, liderazgo y coordinación. Lo que harás Gobierno de observabilidad y monitorización: Definir y mantener estrategia, arquitectura, estándares y hoja de ruta.
Establecer criterios para métricas, logs, trazas, eventos, alertas, dashboards, SLI, SLO y umbrales.
Garantizar cobertura de monitorización end-to-end (infra, aplicaciones, integraciones, batch, cloud).
Mantener inventario de activos monitorizados, dependencias, responsables, alertas y procedimientos.
Diseño técnico e implementación: Liderar diseño e implantación de plataformas de observabilidad en on-premise + híbrido + multicloud.
Coordinar instalación, actualización, hardening, HA, backup y recovery.
Definir estándares de instrumentación para aplicaciones, middleware, infra, redes, microservicios.
Administración especializada de herramientas: Dynatrace (One Agent, Active Gate, Smartscape, RUM, Synthetic, APM, Davis AI, Grail, DQL, alerting profiles, SLO, automatización API).
Elastic Stack (Elasticsearch, Logstash, Kibana, Beats, pipelines ingesta, ILM, control cardinalidad).
Grafana + Prometheus + Alertmanager + Loki + Tempo (dashboards, Prom QL, Log QL). BMC Helix (Ops Management, Discovery, event management, correlación, integración ITSM/CMDB).
Monitorización de redes (NNMi, Thousand Eyes, Solar Winds, PRTG, Centreon, Zabbix).
Monitorización Mainframe (BMC AMI Ops/Main View, OMEGAMON, IBM Z Net View, RMF, SMF, SYSVIEW).
Otras: Open Telemetry, Azure Monitor, Cloud Watch, GCP Cloud Monitoring, Splunk, App Dynamics, New Relic.
Eventos y ITSM: Diseñar modelo de eventos que reduzca ruido + falsos positivos (correlación + enriquecimiento).
Asegurar alertas accionables con severidad, contexto, procedimiento, escalado.
Integración con ITSM para creación/actualización/cierre de incidencias con trazabilidad end-to-end.
Automatización y observabilidad como código: Automatizar altas/cambios/bajas vía APIs, CI/CD, Ia C (Terraform, Ansible).
Git + control de versiones + revisión pares aplicado a dashboards, reglas, SLO, alertas.
Scripting Python, Power Shell, Bash.
Seguridad y cumplimiento: Principios mínimo privilegio, segregación funciones, gestión credenciales, cifrado, trazabilidad.
Tratamiento seguro datos telemetría + retención + enmascarado.
Apoyo auditorías + resiliencia + requerimientos regulatorios.
Coordinación proyectos y proveedores: Planificar proyectos de implantación, migración, consolidación y evolución.
Gestionar alcance, hitos, riesgos, dependencias, recursos,
presupuesto, licencias.
Gobernar relación con fabricantes/proveedores.
Facilitar comités técnicos + informes ejecutivos. ✅ Imprescindibles Perfil senior con experiencia técnica demostrable en entornos críticos de alta disponibilidad, preferiblemente sector financiero/bancario.
Dominio de los tres pilares de observabilidad: métricas + logs + trazas. APM y experiencia digital (instrumentación, trazabilidad distribuida, RUM, sintética).
Dynatrace en profundidad + al menos 2 plataformas adicionales entre Elastic Stack, Grafana/Prometheus, BMC Helix.
Sistemas e infraestructura: Linux + Windows + virtualización + redes TCP/IP + BBDD.
Cloud y cloud-native: AWS + Azure + GCP + Docker + Kubernetes + microservicios.
Automatización + Dev Ops: Git, CI/CD, Terraform, Ansible, Python/Power Shell/Bash. ITIL + gestión de eventos/incidencias/problemas/cambios/capacidad.
Español cualificado + inglés valorable. Suma puntos Monitorización Mainframe (IBM Z, z/OS, CICS, Db2, IMS, MQ, JES, OMEGAMON, RMF).
Monitorización de red (NNMi, Thousand Eyes, Solar Winds, PRTG, Cisco DNA Center).
Open Telemetry en producción.
Certificaciones Dynatrace / Elastic / Grafana Labs / BMC / AWS / Azure / GCP. ITIL 4 + PMP/PRINCE2/SAFe. Condiciones Modalidad: freelance vía Shakers.
Duración: 6 meses inicial + 6 meses posibles adicionales Horario: L-J 8:00-17:30, V 8:00-15:00 (calendario Madrid).
Ubicación: inicialmente híbrido en Madrid las primeras semanas, posteriormente remoto con visitas puntuales En Shakers nos ocupamos de la gestión del proyecto, la facturación y el acompañamiento durante toda la colaboración. Tú te centras en construir un modelo de observabilidad extremo a extremo.
📌 Sre - Remote (España)
🏢 Shakers
📍 España