Mecalux Software Solutions es la compañía tecnológica del Grupo Mecalux, con sede en el Centro Tecnológico de Gijón y delegaciones en Badajoz y Salamanca.Desplácese hacia abajo para ver todos los requisitos del puesto y las responsabilidades que pueden esperar los candidatos seleccionados.Desarrollamosproducto y plataforma software propiospara la optimización de cadenas de suministro. No trabajamos por proyectos:evolucionamos una plataforma SaaS y on-premise de gran escala , con SLAs reales, alta disponibilidad, resiliencia y observabilidad.Construimos y operamos una plataforma cloud y on-premise crítica (24x7)que gestiona procesos esenciales del negocio de nuestros clientes, con foco enCloud/SRE, ciberseguridad, data/IA y producto .NuestraPlataforma Easy (Easy WMS)optimiza la gestión física y documental del flujo de productos, garantizando trazabilidad y eficiencia operativa en entornos complejos.Contamos con un área deI+Dy un área deOperaciones , donde trabajamos constack y prácticas modernas(CI/CD, IaC, metodologías ágiles, SecOps) y conimpacto directo en negocio .Buscamos talento que quiera crecer en un entorno tecnológico exigente, crítico y en continua evolución. Puedes ver nuestro trabajo en los siguientes enlaces:Mecalux Software | Software para almacenes - Robots móviles autónomos (AMR) - Ingeniero/a de Plataforma de IA e Infraestructura GPU -> Oficina Gijón, AsturiasConstruye la plataforma que hará posible la próxima generación de IA¿Te interesa trabajar conGPU NVIDIA de última generación, Kubernetes, entrenamiento distribuido, MLOps y plataformas de IA a gran escala ?Buscamos un/aIngeniero/a de Plataforma de IA e Infraestructura GPUpara diseñar, construir y operar una plataforma de IA completa, desde la infraestructura GPU hasta la puesta en producción de modelos y servicios.No buscamos simplemente a alguien que administre servidores o clústeres.Buscamos a una persona que quieraconstruir la plataforma sobre la que otros equipos desarrollarán y desplegarán IA .El reto combinainfraestructura, plataforma, automatización, rendimiento, alta disponibilidad y MLOps , con un fuerte foco en convertir una infraestructura compleja en servicios sencillos y reutilizables para los equipos de desarrollo.El retoLa posición tiene dos grandes ejes, con especial foco en el primero:1. Plataforma para entrenamiento de IA — prioridad principalDiseñar y evolucionar la infraestructura que permita ejecutar cargas de entrenamiento distribuidas de forma eficiente, escalable y reproducible, aprovechando al máximo los recursos GPU disponibles.2. Operación de la plataforma — alta disponibilidad y alto rendimientoGarantizar que la plataforma sea robusta, observable, segura y optimizado,
preparada para cargas críticas de entrenamiento e inferencia.Trabajarás conGPU NVIDIA H200y participarás en la evolución de la plataforma hacia nuevas generaciones de infraestructura, incluyendoB300 .¿Qué vas a construir?Tu trabajo abarcará toda la cadena de la plataforma de IA:Diseñar, desplegar y operar la plataforma sobreKubernetes , incluyendo scheduler, NVIDIA GPU Operator y mecanismos avanzados de asignación de recursos.Gestionar y optimizar los nodosNVIDIA H200y participar en el diseño e incorporación de nuevas generaciones de GPU, comoB300 .Configurar y evolucionar el uso deMIG , GPU completas y estrategias de asignación de recursos según las necesidades de cada workload.Optimizarred, almacenamiento y comunicacionespara cargas distribuidas de entrenamiento e inferencia.Gestionardrivers NVIDIA, CUDA, NCCL, imágenes base y matrices de compatibilidad , garantizando entornos reproducibles y soportados.Diseñar y operarcontainer registries y model registries .Implantar y evolucionarMLflowy las capacidades de observabilidad, evaluación, auditoría y trazabilidad de modelos y experimentos.Diseñar y operarmodel gateways y API gatewayspara exponer modelos y servicios de inferencia de forma segura y controlada.Implementar mecanismos deIAM, RBAC, gestión de secretos, segregación de entornos y aislamiento multi-tenant .Diseñar estrategias debackup, disaster recovery y continuidad de servicio .Realizarcapacity planningy desarrollar prácticas deGPU FinOps , midiendo utilización, eficiencia, costes y demanda futura.Construircomponentes, plantillas y servicios reutilizablesque permitan a los squads consumir la plataforma sin tener que gestionar su complejidad interna.Automatizar el ciclo de vida de la plataforma medianteInfrastructure as Code, CI/CD y GitOps .Operar la plataforma en entornoson-premise, cloud e híbridos .Definir estándares, arquitectura, procedimientos y buenas prácticas que permitan hacer crecer la plataforma de forma sostenible. Stack tecnológicoBuscamos experiencia práctica en varias de estas áreas:Compute & AI InfrastructureNVIDIA H200 / experiencia con GPUs de datacenter.GPU Operator.MIG.CUDA.NCCL.Entrenamiento e inferencia distribuida.Platform EngineeringKubernetes en producción.Alta disponibilidad.Scheduling y gestión avanzada de recursos.Helm.GitOps.Terraform.Ansible.MLOpsMLflow.Model registries.Container registries.Evaluación y trazabilidad de modelos.Observabilidad de workloads de IA.InfrastructureDocker y construcción de imágenes.Redes de alto rendimiento.Almacenamiento compartido/distribuido.Automatización de infraestructura.Entornos on-premise, cloud e híbridos.Security & OperationsIAM / RBAC.Secret management.Multi-tenancy y aislamiento.Métricas, logs, trazas y alertas.Backup y disaster recovery.Capacity planning.GPU FinOps.No es necesario dominar todas estas tecnologías.Valoramos especialmente la experiencia real en producción y la capacidad para entender y conectar las distintas capas de la plataforma.¿Qué perfil buscamos?Una persona con mentalidad dePlatform Engineer , capaz de moverse entre arquitectura, automatización y operación.Alguien que:Disfrute resolviendo problemas complejos de infraestructura.Entienda que una plataforma no termina cuando se despliega: hay queoperarla, medirla y mejorarla continuamente .Tenga una fuerte orientación a la automatización.Sea capaz de tomar decisiones técnicas y establecer estándares.Piense en los equipos de desarrollo comousuarios de la plataforma .Busque eliminar complejidad y trabajo manual mediante servicios y componentes reutilizables.Tenga autonomía y responsabilidad sobre entornos tecnológicos críticos.Sepa documentar, comunicar decisiones y transferir conocimiento.Trabaje inicialmente 100% presencial desde la oficina de Gijón con posibilidad de formato híbrido tras formación y encaje en el equipo¿Por qué puede ser un proyecto interesante?Porque tendrás la oportunidad de trabajar en una plataforma donde confluyen algunas de las áreas más exigentes de la ingeniería actual:GPU + Kubernetes + IA + entrenamiento distribuido + MLOps + automatización + alta disponibilidad.No serás únicamente responsable de mantener infraestructura existente.Participarás en el diseño de la plataforma, en sus decisiones de arquitectura y en su evolución.Si te motiva construir infraestructura de IA de alto rendimiento y convertirla en una plataforma que otros equipos puedan utilizar de forma sencilla, este proyecto puede ser para ti.¿Te interesa?Queremos hablar contigo si tienes experiencia construyendo y operando plataformas de infraestructura, Kubernetes, GPU computing o MLOps y quieres dar el siguiente paso haciaAI Platform Engineering .Te brindamos la oportunidad de impulsar tu carrera en el dinámico sector de la logística, uno de los más prometedores en la actualidad. Si buscas crecer profesionalmente en un entorno de constante evolución, ¡nos encantaría contar contigo en nuestro equipo! xkdbapo En Mecalux tenemos un compromiso con la igualdad de género. Por ello, nuestra voluntad es promover activamente la participación de mujeres y hombres en nuestros procesos de selección y así mismo, garantizar que éstos sean justos y objetivos sin distinción de sexo, orientación, identidad, colectivo, expresión de género o cualquier otra característica protegida por ley.
📌 Ingeniero/a de Plataforma IA + Infraestructura GPU (Gijón)
🏢 Mecalux
📍 Gijón