30 jul
|
Cibernos
|
Madrid
Ingeniero/a MLOps e Infraestructura de IAMLOps / LLMOps Engineer
Buscamos un/a Ingeniero/a MLOps especializado/a en infraestructura de IA y LLMOps para desplegar, gestionar y optimizar modelos de lenguaje en entornos productivos.
Objetivo del rol
Garantizar que los modelos y soluciones de IA funcionen de manera estable, segura, productivo y rentable, prestando especial atención a la privacidad, la latencia, el consumo de recursos y los costes de infraestructura.
Principales responsabilidades
- Desplegar modelos de lenguaje en entornos productivos.
- Configurar y gestionar motores de inferencia.
- Implementar modelos locales o privados.
- Optimizar latencia, rendimiento, uso de GPU y memoria.
- Aplicar técnicas de cuantización.
- Gestionar bases de datos vectoriales.
- Controlar la escalabilidad, disponibilidad y costes de los servicios.
- Garantizar la privacidad y seguridad de los datos.
Tecnologías y conocimientos clave:
Inferencia y modelos locales
Experiencia con una o varias de estas tecnologías:
- vLLM.
- TGI — Text Generation Inference.
- Ollama.
- LM Studio.
Optimización de modelos
Conocimientos de formatos y técnicas de cuantización:
- GGUF.
- AWQ.
- GPTQ.
Bases de datos vectoriales
Experiencia con una o varias de las siguientes soluciones:
- pgvector sobre PostgreSQL.
- Qdrant.
- ChromaDB.
- Pinecone.
Perfil que buscamos Una persona con experiencia llevando modelos de IA a producción, capaz de seleccionar la infraestructura adecuada y optimizar el rendimiento, la privacidad y los costes de cada solución.
No es necesario dominar todas las tecnologías mencionadas. Buscamos conocimiento práctico en alguna de ellas y una comprensión sólida de los principios de inferencia, cuantización y gestión de bases de datos vectoriales.
📌 Ingeniero/a MLOps e Infraestructura de IAMLOps (Madrid)
🏢 Cibernos
📍 Madrid