22 sep
|
TECDATA ENGINEERING
|
Madrid
22 sep
TECDATA ENGINEERING
Madrid
Buscamos un/a Data Engineer con experiencia sólida en procesamiento de datos y construcción de pipelines escalables para incorporarse a un proyecto tecnológico orientado a entornos Big Data y procesamiento Batch.
La persona seleccionada participará en el diseño, desarrollo y optimización de procesos ETL/ELT sobre grandes volúmenes de información, trabajando en arquitecturas modernas basadas en Python y PySpark.
Modalidad: 100% Remoto
Salario: 36K
Proyecto fiable
Jornada completa
Responsabilidades
- Diseño y desarrollo de pipelines de datos robustos y escalables
- Procesamiento y transformación de grandes volúmenes de información mediante PySpark
- Desarrollo de procesos ETL/ELT eficientes
- Optimización de rendimiento sobre procesos Batch
- Manipulación y explotación de datos mediante SQL avanzado
- Diseño y mantenimiento de modelos de datos relacionales
- Desarrollo de scripts de automatización en Python
- Integración de fuentes de datos y procesos de carga masiva
- Optimización de consultas complejas y rendimiento de bases de datos
- Participación en procesos de calidad y validación de datos
- Colaboración con equipos técnicos y analíticos en entornos Agile
Requisitos técnicos
Imprescindibles
Experiencia sólida con Python
Experiencia avanzada con PySpark
Experiencia en procesamiento Batch
Dominio de SQL y optimización de consultas
Experiencia desarrollando pipelines ETL/ELT
Manejo de grandes volúmenes de datos
Experiencia con bases de datos relacionales
Bases de datos
PostgreSQL
MySQL
SQL Server
Muy valorable
Experiencia en arquitecturas Big Data
Optimización de DataFrames y Spark SQL
Automatización de procesos de datos
Experiencia en entornos cloud
Conocimientos de buenas prácticas en ingeniería de datos
Experiencia trabajando en entornos Agile/Scrum
Stack tecnológico
- Python
- PySpark
- Spark SQL
- DataFrames API
- SQL
- PostgreSQL
- MySQL
- SQL Server
- ETL / ELT
- Batch Processing
Perfil buscado
- Perfil analítico y orientado a calidad de datos
- Capacidad de trabajar de forma autónoma
- Mentalidad resolutiva y orientación a rendimiento
- Experiencia en entornos de procesamiento masivo
- Buenas prácticas de desarrollo y optimización
- Capacidad de adaptación y trabajo en equipo
Proyecto ideal para perfiles especializados en ingeniería de datos, procesamiento distribuido y optimización de pipelines Big Data en entornos modernos y escalables.
📌 Data Engineer (Python & PySpark) (Madrid)
🏢 TECDATA ENGINEERING
📍 Madrid