04 ago
|
Deutsche Telekom
|
Granada
04 ago
Deutsche Telekom
Granada
ph3Deine Aufgabe /h3 pDie Mission dieser Rolle ist es, eine souveräne AI-Toolchain zu entwerfen, aufzubauen und zu betreiben, die in isolierten oder streng kontrollierten Umgebungen eingesetzt wird. Dies umfasst Model Serving, Retrieval, Orchestrierung, Observability sowie den sicheren Plattformbetrieb für Enterprise-AI-Engineering-Workloads. Der Fokus dieser Rolle liegt auf Open-Source- oder Open-Weight-LLM-Stacks, Air-Gapped- oder isolierten Deployment-Models, Kubernetes-basierter Platform Engineering, GPU-fähigen Umgebungen und prüfbaren AI-Operationen, die für souveränitätskritische Programme geeignet sind. /p h3Aufgaben /h3 ul liEntwurf und Betrieb von Kubernetes-Umgebungen, die für AI-Inferenz, Retrieval, Experimentierung und Agenten-Ausführung in sicheren oder isolierten Settings optimiert sind /li liDeployment und Betrieb von Open-Source- oder Open-Weight-Modell-Stacks, Modell-Gateways, Vektordatenbanken und unterstützenden Plattformkomponenten /li liAufbau einer reproduzierbaren Plattformautomatisierung mittels Infrastructure as Code und GitOps-Ansätzen für eine stabile und prüfbare Bereitstellung /li liVerwaltung von lokalen Registries, Package-Mirrors, Secrets, Zugriffskontrollen, Storage, Networking und Observability in Umgebungen mit begrenzter oder keiner Public-Cloud-Abhängigkeit /li liOptimierung der GPU-, Compute- und Storage-Nutzung für zuverlässige AI-Workloads unter Einhaltung der Sicherheits- und Datensouveränitätsanforderungen /li /ul h3Dein Profil /h3 pWir suchen einen professionellen Platform Engineer / MLOps Specialist mit umfangreicher Erfahrung in Kubernetes, Linux und KI-Infrastruktur,
speziell mit Fokus auf dem Deployment und Betrieb von souveränen, air-gapped oder isolierten LLM-Stacks. /p h3Muss-Kriterien /h3 ul liMindestens 5 Jahre Erfahrung in Platform Engineering, DevOps, SRE oder MLOps /li liAusgeprägte Expertise in Kubernetes und Linux /li liNachgewiesene Erfahrung mit KI-Infrastruktur und Model Serving /li liErfahrung mit privaten oder On-Prem-Deployments sowie Produktionsbetrieb für LLM-basierte Workloads /li liStarke Hands-on-Kenntnisse in Python /li liVersiertheit in Automatisierungstools wie Terraform, Ansible und Helm /li liErfahrung mit GitOps-Workflows /li liTiefes Verständnis von Networking, Storage, Zugriffskontrolle und Monitoring /li liErfahrung mit operational Hardening in Hochsicherheitsumgebungen /liliFähigkeit, in souveränitätsgetriebenen Umgebungen zu arbeiten, die Auditierbarkeit, Isolation und kontrollierte Datenverarbeitung erfordern /li liKenntnisse von Inference- und Local-Serving-Stacks wie vLLM, Ollama, llama.cpp oder OpenAI-kompatiblen,
selbstgehosteten Endpunkten /li liErfahrung mit Open-Source- oder Open-Weight-Modellen für souveräne Deployments /li liErfahrung mit Vector Stores wie Qdrant oder ähnlichen Tools /li liErfahrung mit internen Interfaces wie Open WebUI oder vergleichbaren Tools /li liKenntnisse von Integrationsoptionen für Entwickler, wie VS Code-kompatible Extensions oder lokale Modell-Connectoren im Stil von Continue /li liHardware-Know-how bezüglich GPU-gestützter Nodes, CPU-only Fallback-Optionen, Storage-Performance und Netzwerkisolation /li /ul h3Über uns /h3 pbT-Systems /b ist Teil der Deutsche Telekom Gruppe mit rund 30.000 Mitarbeitern weltweit. Wir schaffen Technologie mit Sinn, um eine positive Wirkung auf die Gesellschaft zu erzielen. Wir suchen neugierige Talente, die lernwillig sind, Herausforderungen annehmen und Ideen beisteuern, die das Erlebnis unserer Kunden transformieren. /p pWir vertrauen den Menschen: Wir bieten bAutonomie, kontinuierliche Unterstützung und ein kollaboratives Umfeld /b, in dem du ohne Grenzen wachsen kannst. Wir sind ein globales Team, geleitet von Respekt, Integrität und der Leidenschaft, jeden Tag besser zu werden. /p ul liFlexibler Vergütungsplan: beinhaltet Krankenversicherung, Essensgutscheine, Kinderbetreuung und Transport /li liTelemedizin /li liLebens- und Unfallversicherung /li liSozialfonds /li liUrlaub: 26+ Arbeitstage pro Jahr /li liKostenloser Zugang zu Fachdiensten (medizinisch, rechtlich, Wellness) /li li100 % Gehaltsfortzahlung während des Krankenstands /li liT-Social: soziale Initiativen (Sport, Community, Gesundheit etc.) /li /ul h3Weitere Details /h3 ul liWachstum Entwicklung: ul liMaßgeschneiderte Trainings via Coursera /li liWöchentliche Sprachkurse (Englisch Deutsch) /li liInternationale Mentoring-Sessions Experience Days /li /ul /li liZeitplan: Versátil Arbeitszeiten /li /ul /p #J-18808-Ljbffr
📌 Sovereign AI Platform Engineer (m/w/d) T Cloud Public (Granada)
🏢 Deutsche Telekom
📍 Granada