31 jul
|
Cibernos
|
Madrid
Ingeniero/a MLOps e Infraestructura de IAMLOps / LLMOps Engineer
Buscamos un/a Ingeniero/a MLOps especializado/a en infraestructura de IA y LLMOps para desplegar, gestionar y optimizar modelos de lenguaje en entornos productivos.
Objetivo del rol
Garantizar que los modelos y soluciones de IA funcionen de manera sólido, segura, productivo y rentable, prestando especial atención a la privacidad, la latencia, el consumo de recursos y los costes de infraestructura.
Principales responsabilidades
Desplegar modelos de lenguaje en entornos productivos.
Configurar y gestionar motores de inferencia.
Implementar modelos locales o privados.
Optimizar latencia, rendimiento, uso de GPU y memoria.
Aplicar técnicas de cuantización.
Gestionar bases de datos vectoriales.
Controlar la escalabilidad, disponibilidad y costes de los servicios.
Garantizar la privacidad y seguridad de los datos.
Tecnologías y conocimientos principal:
Inferencia y modelos locales
Experiencia con una o varias de estas tecnologías:
vLLM.
TGI — Text Generation Inference.
Ollama.
LM Studio.
Optimización de modelos
Conocimientos de formatos y técnicas de cuantización:
GGUF.
AWQ.
GPTQ.
Bases de datos vectoriales
Experiencia con una o varias de las siguientes soluciones:
pgvector sobre PostgreSQL.
Qdrant.
ChromaDB.
Pinecone.
Perfil que buscamos Una persona con experiencia llevando modelos de IA a producción, capaz de seleccionar la infraestructura adecuada y optimizar el rendimiento, la privacidad y los costes de cada solución.
No es necesario dominar todas las tecnologías mencionadas. Buscamos conocimiento práctico en alguna de ellas y una comprensión sólida de los principios de inferencia, cuantización y gestión de bases de datos vectoriales.
📌 Ingeniero/a Mlops E Infraestructura De Iamlops Madrid
🏢 Cibernos
📍 Madrid