15 ago
|
Senovo IT
|
Castilla y León
15 ago
Senovo IT
Castilla y León
Data Engineer – (GCP & DBT)
Ubicación: Madrid o España (Remoto)
Lugar de trabajo: España
Duración: 12 meses (renovables)
Idioma requerido: Español
Buscamos un/a Data Engineer para juntarse a un workstream clave de ingeniería de datos, completamente construido y operado sobre Google Cloud Platform (GCP).
Este rol es ideal para trabajar con un equipo en marcha para un moderno data stack en la nube, impulsando la arquitectura, las mejores prácticas y soluciones escalables de extremo a extremo.
Descripción del Rol
Como Data Engineer, ayudaras a diseñarar, construir y optimizar plataformas de datos escalables aprovechando todo el ecosistema de GCP.
Tendrás un papel principal en la definición de la arquitectura de datos, la implementación de pipelines ELT robustos y la garantía de una entrega de datos eficiente, fiable y de alta calidad para toda la organización.
Responsabilidades
- Contribuir al diseño e implementación de pipelines de datos end-to-end en GCP, desde la ingesta hasta las capas de transformación y consume
- Desarrollar y optimizar modelos de datos en BigQuery, enfocándose en rendimiento, escalabilidad y eficiencia de costes (partitioning, clustering, optimización de queries)
- Construir y mantener workflows de orquestación utilizando Cloud Composer (Apache Airflow), asegurando la fiabilidad de los pipelines
- Participar en el desarrollo de la capa de transformación con dbt, siguiendo estándares definidos por el equipo
- Desarrollar y mantener modelos en dbt siguiendo buenas prácticas (capas staging, intermedia y marts)
- Implementar controles de calidad de datos mediante tests en dbt (schema tests y validaciones básicas)
- Contribuir a la documentación, linaje y catálogo de datos en dbt
- Colaborar en la optimización del rendimiento en BigQuery y dbt (modelos incrementales, materializaciones)
- Participar en la integración de dbt en pipelines de CI/CD junto con el equipo
- Colaborar con equipos de Analytics y Data Science para proporcionar datasets fiables y bien estructurados
Stack Tecnológico y Skills
- Cloud (Core): Experiencia práctica en GCP incluyendo BigQuery, Cloud Storage, Cloud Composer (Airflow)
- Data Warehouse: Experiencia trabajando con BigQuery (consultas, modelado y optimización básica)
- Orquestación: Experiencia con Cloud Composer / Apache Airflow en entornos de desarrollo o producción
- Transformación (Clave):
- Experiencia práctica con dbt
- Conocimiento de buenas prácticas en modelado y estructuración de proyectos dbt
- Experiencia básica en testing y documentación con dbt
- Familiaridad con entornos de control de versiones y CI/CD (Git, pipelines)
- Programación: Buen nivel de SQL y conocimientos de Python
- Data Engineering: Experiencia trabajando con pipelines de datos y conceptos ELT/ETL
Experiencia Requerida
- 3-4 años de experiencia en Data Engineering
- Experiencia trabajando en entornos cloud, idealmente en GCP
- Experiencia participando en el desarrollo de pipelines y modelos de datos en entornos modernos (BigQuery, dbt, Airflow)
- Necesitamos un perfil medio/junior (no entry lvl) que pueda desarrollar con con DBT, airflow y bigquery
Resumen
Buscamos un/a Data Engineer con experiencia en el ecosistema de datos de GCP, con ganas de crecer en un entorno moderno y colaborar en todo el ciclo de vida del dato: desde la ingesta y orquestación hasta la transformación y modelado.
Interesado/a o conoces a alguien que encaje?
📌 Data Engineer (Castilla y León)
🏢 Senovo IT
📍 Castilla y León