JobMatch
← Back to jobs

Principal DevOps Engineer (m/w/d) für Industrial AI Cloud

Deutsche Telekom

RemoteBilbao, Basque Country, SpainprincipalFull-time
Posted
today
Source
LinkedIn (remote, Europe)
Field
Engineering

Skills

KubernetesOnboardingTerraformAnsiblePythonDevOpsCI/CDLinuxLLMsGitMachine LearningAI

Description

Deine Aufgabe NVIDIA und die Deutsche Telekom entwickeln gemeinsam eine industrielle KI-Cloud für Europa. Diese KI-Fabrik in Deutschland wird 10.000 GPUs auf NVIDIA DGX B200-Systemen und RTX Pro Servern hosten. Als DevOps Engineer Principal begleitest du Unternehmenskunden durch Onboarding, Schulung und frühe Einführung der KI-Plattform. Deine Verantwortung umfasst das Verstehen von Kundenanforderungen, die Unterstützung beim Lösungsdesign, die Durchführung von Proofs of Concept (PoCs) und die Sicherstellung einer reibungslosen Integration von Kunden-Workloads (LLMs, GPU-Computing, KI-Pipelines). Du agierst als vertrauenswürdiger technischer Berater und hilfst Kunden, ihre GPU-Cluster und KI-Toolchains effizient zu nutzen. Wir suchen einen DevOps Engineer Principal, der eine Schlüsselrolle dabei spielt, unseren Unternehmenskunden zu helfen, unsere KI-Plattform erfolgreich einzuführen und zu skalieren. In dieser Position begleitest du Kunden durch Onboarding, Schulung und frühe Implementierung modernster KI-Lösungen. Du arbeitest eng mit ihnen zusammen, um ihre technischen und geschäftlichen Anforderungen zu verstehen, unterstützt das Design maßgeschneiderter Architekturen und leitest Proofs of Concept, die den realen Mehrwert validieren. Du stellst die reibungslose Integration komplexer Workloads sicher – vom LLM-Deployment und der GPU-Computing-Optimierung bis hin zum Aufbau von End-to-End-KI/ML-Pipelines. Als vertrauenswürdiger technischer Berater befähigst du Kunden, ihre GPU-Cluster und KI-Toolchains effizient zu nutzen, Herausforderungen zu beheben und Best Practices zu übernehmen, die ihre KI-Reise beschleunigen. Aufgaben - Beratung von Kunden zu allen technischen Aspekten rund um GPU-Infrastruktur und Plattformnutzung - Leitung von Onboarding und Schulungen, Mentoring von Kundenspezialisten zur optimalen Nutzung ihrer GPU-Cluster und KI-Umgebungen - Design und Implementierung von PoCs, einschließlich Umgebungssetup, Datenverarbeitungspipelines und Deployment-Workflows - Durchführung von Anforderungsanalysen, Übersetzung von Geschäftsanforderungen in technische Spezifikationen - Unterstützung von Kunden bei Performance-Optimierung, Troubleshooting, Feinabstimmung und Validierung gelieferter Lösungen - Agieren als zentraler technischer Ansprechpartner, Koordination funktionsübergreifender Teams in den Bereichen Infrastruktur, Netzwerk, Automatisierung, Sicherheit und KI-Services - Vorschlag und Entwicklung von Automatisierungskonzepten zur Verbesserung von Services, Prozessen und Betriebsmodellen - Sicherstellung, dass Best Practices in Bezug auf Zuverlässigkeit, Skalierbarkeit und Sicherheit über den gesamten Kundenlebenszyklus hinweg angewendet werden - Unterstützung bei Monitoring, Observability und Kapazitätsplanung für KI-Workloads und GPU-Auslastung Dein Profil Wir suchen einen DevOps Engineer Principal mit umfangreicher Erfahrung in Cloud-Infrastruktur, GPU-basierten Systemen, Kubernetes und Automatisierungstools. Der ideale Kandidat verfügt über ausgeprägte technische Expertise in Container-Technologien, CI/CD-Pipelines, Scripting und Monitoring sowie über ausgezeichnete Kommunikations- und Führungsfähigkeiten. Muss-Kriterien - Mindestens 3 Jahre Erfahrung im Design und der Bereitstellung von Systemen basierend auf IaaS, PaaS und SaaS - Erfahrung mit GPU-basierter Infrastruktur - Fundierte Kenntnisse in Kubernetes-basierten Container-Technologien - Expertenkenntnisse in Skriptsprachen (Python/Bash) - Expertenkenntnisse in Automatisierungstools und automatisierten Deployments (Ansible/Salt-Stack/Terraform/Helm) - Expertenkenntnisse in CI/CD in einer Kubernetes-Umgebung und Repository-Management - Experte in Automatisierung mit Git (GitHub, GitLab) und CI/CD-Tools wie GitHub Actions oder GitLab CI/CD - Ausgeprägte Erfahrung mit Linux OS - Erfahrung mit Monitoring- und Visualisierungstools (Grafana, Prometheus) - Englischkenntnisse auf B2-Niveau - Gute Kommunikationsfähigkeiten - Analytisches Denken - Teamfähigkeit - Präsentationsfähigkeiten - Verhandlungsgeschick - Grundlegende Projektmanagement-Kenntnisse - Grundlegende Führungsfähigkeiten - Fortgeschrittene Kenntnisse im Qualitätsmanagement Von Vorteil - Deutschkenntnisse Über uns T-Systems ist Teil der Deutsche Telekom Gruppe mit rund 30.000 Mitarbeitern weltweit. Wir schaffen Technologie mit Sinn, um eine positive Wirkung auf die Gesellschaft zu erzielen. Wir suchen neugierige Talente, die lernbegierig sind, Herausforderungen annehmen und Ideen einbringen, die die Erfahrung unserer Kunden transformieren. Wir vertrauen Menschen: Wir bieten Autonomie, kontinuierliche Unterstützung und ein kollaboratives Umfeld, in dem du ohne Grenzen wachsen kannst. Wir sind ein globales Team, geleitet von Respekt, Integrität und der Leidenschaft, jeden Tag besser zu werden. Arbeitsumfeld & Flexibilität - Internationales, dynamisches und kollaboratives Umfeld - T-Social: soziale Initiativen (Sport, Community, Gesundheit, ...) - Hybrides Arbeitsmodell (remote/vor Ort) - Flexible Arbeitszeiten Wachstum & Entwicklung - Maßgeschneiderte Schulungen: Zugang zu Coursera, um zu lernen, was du willst, wann du willst - Wöchentliche Sprachkurse (Englisch, Spanisch & Deutsch) - Internationale Mentoring-Sessions & Experience Days Vergütung & Benefits - Flexibler Vergütungsplan (Krankenversicherung, Essensgutscheine, Kinderbetreuung, Transport) - Telemedizin - Lebens- und Unfallversicherung - Sozialfonds Wohlbefinden & Freizeit - 26+ Arbeitstage Urlaub pro Jahr - Kostenloser Zugang zu Fachdiensten (medizinisch, rechtlich, Wellness) - 100% Gehaltsfortzahlung während Krankheitsurlaub Bewerbungsinformationen Wenn du eine neue Herausforderung suchst, zögere nicht, uns deinen Lebenslauf zu schicken! Bitte sende deinen Lebenslauf auf Englisch. T-Systems Iberia wird nur die Lebensläufe von Kandidaten bearbeiten, die die für jedes Angebot angegebenen Anforderungen erfüllen.

JobMatch aggregates public listings. Always apply through the original posting.