Buscamos un/a Data Scientist especializado/a en Entity Resolution & AI Matching para participar en el desarrollo y evolución de los algoritmos que permiten identificar automáticamente si distintos registros procedentes de múltiples sistemas representan el mismo activo, pieza u operación.
Formará parte de un proyecto estratégico dentro de la plataforma de datos, colaborando estrechamente con Data Engineers y Data Stewards para diseñar, entrenar, desplegar y optimizar modelos de matching probabilístico en entornos productivos.
RequisitosExperiencia avanzada en Python aplicado a entornos productivos (scikit-learn, pandas, Polars).
Experiencia en Entity Resolution, Record Linkage y modelos probabilísticos de matching.
Conocimientos de técnicos/as como Fellegi-Sunter, Jaro-Winkler, Levenshtein, TF-IDF y estrategias de bloqueo.
Experiencia con herramientas como recordlinkage, Splink, Dedupe o equivalentes.
Nivel avanzado de SQL en BigQuery.
Experiencia en MLflow o Weights & Biases,
Git y despliegue de modelos en Vertex AI (GCP).
Valorable experiencia con datos industriales, Graph ML, embeddings, LLMs aplicados al matching y certificación GCP Professional Machine Learning Engineer.
Responsabilidades
Incorporación a un proyecto internacional de gran impacto dentro del ambiente industrial.
Participación en el diseño y evolución de motores avanzados de Entity Resolution basados en IA y modelos probabilísticos.
Trabajo con tecnologías punteras en el ecosistema Google Cloud, incluyendo BigQuery y Vertex AI.
Contexto altamente especializado donde colaborar con perfiles de Data Engineering, Machine Learning y Gobierno del Dato.
Capacidad de influir directamente en la calidad y fiabilidad de una plataforma de datos corporativa crítica.
Required Skill Profession
Mathematical Science Occupations
📌 Data Scientist Madrid (España)
🏢 Lhh
📍 España