Buscamos un/a Data Engineer con experiencia sólida en procesamiento de datos y construcción de pipelines escalables para incorporarse a un proyecto tecnológico orientado a entornos Big Data y procesamiento Batch.
La persona seleccionada participará en el diseño, desarrollo y optimización de procesos ETL/ELT sobre grandes volúmenes de información, trabajando en arquitecturas modernas basadas en Python y PySpark.
Modalidad: 100% Remoto
Salario: 36K
Proyecto fiable
Jornada completa
Responsabilidades
Diseño y desarrollo de pipelines de datos robustos y escalables
Procesamiento y transformación de grandes volúmenes de información mediante PySpark
Desarrollo de procesos ETL/ELT productivos
Optimización de rendimiento sobre procesos Batch
Manipulación y explotación de datos mediante SQL avanzado
Diseño y mantenimiento de modelos de datos relacionales
Desarrollo de scripts de automatización en Python
Integración de fuentes de datos y procesos de carga masiva
Optimización de consultas complejas y rendimiento de bases de datos
Participación en procesos de calidad y validación de datos
Colaboración con equipos técnicos y analíticos en entornos Agile
Requisitos técnicos
Imprescindibles
Experiencia sólida con Python
Experiencia avanzada con PySpark
Experiencia en procesamiento Batch
Dominio de SQL y optimización de consultas
Experiencia desarrollando pipelines ETL/ELT
Manejo de grandes volúmenes de datos
Experiencia con bases de datos relacionales
Bases de datos
PostgreSQL
MySQL
SQL Server
Muy valorable
Experiencia en arquitecturas Big Data Optimización de DataFrames y Spark SQL
Automatización de procesos de datos
Experiencia en entornos cloud
Conocimientos de buenas prácticas en ingeniería de datos
Experiencia trabajando en entornos Agile/Scrum
Stack tecnológico
Python
PySpark
Spark SQL
DataFrames API
SQL
PostgreSQL
MySQL
SQL Server
ETL / ELT
Batch Processing
Perfil buscado
Perfil analítico y orientado a calidad de datos
Capacidad de trabajar de forma autónoma
Mentalidad resolutiva y orientación a rendimiento
Experiencia en entornos de procesamiento masivo
Buenas prácticas de desarrollo y optimización
Capacidad de adaptación y trabajo en equipo
Proyecto idóneo para perfiles especializados en ingeniería de datos, procesamiento distribuido y optimización de pipelines Big Data en entornos modernos y escalables.
📌 Data Engineer Python & Pyspark Madrid
🏢 TECDATA ENGINEERING
📍 Madrid
Postulate a este anuncio
Muestra tus habilidades a la empresa, rellenar el formulario y deja un toque personal en la carta, ayudará el reclutador en la elección del candidato.