Finom’s AI Team seeks a seasoned data scientist to own evaluation methodologies for its internal AI agents. You will design benchmarks, set quality gates, and partner with domain experts to label cases and resolve disagreements.
You’ll work with Databricks, Claude Code, and dbt to build robust evaluation pipelines. You will lead the offline and online evaluation suites across ~20 processes and translate findings into actionable product decisions, balancing quality, cost, and latency.
📌 Senior AI Evaluation (Barcelona)
🏢 Lever
📍 Barcelona
Postulate a este anuncio
Muestra tus habilidades a la empresa, rellenar el formulario y deja un toque personal en la carta, ayudará el reclutador en la elección del candidato.