22 sep
|
Capitole
|
Madrid
¿Te gustaría trabajar en un proyecto internacional de inteligencia artificial y ciencia de datos, participando en el desarrollo y mejora de soluciones avanzadas de procesamiento de documentos mediante LLMs, NLP, RAG y Machine Learning?
En
Capitole
buscamos un/a Data Scientist especializado en NLP y Large Language Models (LLMs) para unirse a nuestro equipo en Barcelona. Serás responsable de diseñar soluciones avanzadas de procesamiento de lenguaje, construir infraestructuras RAG, desarrollar modelos predictivos y llevar tus modelos a producción junto a equipos de ingeniería y producto.
Tu trabajo tendrá impacto directo en decisiones estratégicas del grupo, transformando datos complejos en insights accionables y modelos robustos.
Responsabilidades principales
NLP & LLMs
Diseñar y construir arquitecturas
RAG
para mejorar el rendimiento de LLMs.
Desarrollar
embeddings , modelos de clasificación, tokenización y pipelines NLP.
Trabajar con
transformers
(BERT, GPT, RoBERTa) y técnicas de fine‑tuning.
Aplicar
prompt engineering
y evaluación avanzada de modelos.
Data Science & Machine Learning
Construir modelos predictivos: regresión, árboles, redes neuronales, optimización, recomendadores y forecasting.
Evaluar, validar y optimizar modelos con metodologías rigurosas.
Realizar análisis exploratorio, detección de patrones y anomalías.
Infraestructura & Producción
Desarrollar soluciones en
AWS
y entornos cloud.
Implementar código de calidad: testing, CI/CD, GitHub, SonarQube.
Colaborar con equipos de producto para llevar modelos a producción.
Visualización & Comunicación
Crear dashboards y visualizaciones claras para stakeholders no técnicos.
Comunicar insights y resultados de forma estructurada y orientada a negocio.
Data Governance
Garantizar cumplimiento de GDPR y buenas prácticas de calidad de datos.
Requisitos
4–5+ años de experiencia en Data Science o roles similares.
Experiencia sólida en
NLP ,
LLMs ,
transformers
y
modelos predictivos .
Python av
📌 Data Science (Madrid)
🏢 Capitole
📍 Madrid