Auf einen Blick
Leite Presales und operative Delivery von Mission-Critical GPU/HPC Kubernetes Plattformen für Enterprise Clients. Gestalte Architektur und führe High-Impact Infrastruktur-Transformationen durch.
💰 €80.000–150.000/Jahr
📊 Senior
🕒 Contract
🗺️ EMEA
- Tiefe Kubernetes und HPC Infrastructure Erfahrung
- GPU-Aware Cluster Design
- Production Kubernetes Operations
Kubernetes
GPU Infrastructure
Terraform
GitOps
Azure DevOps
✅ Geeignet für
- Senior DevOps/SysOps Engineer mit Kubernetes Expertise
- HPC Specialist transitioning zu Cloud-Native Infrastructure
🚫 Weniger geeignet
- Reine Kubernetes Developer ohne System-Level Experience
- Cloud-Only DevOps ohne On-Premises/HPC Background
💡 Gut zu wissen
- 60% Implementation, 40% Presales Split erforderlich
- GPU/HPC ist spezialisiertes Feld (nicht alle Kubernetes ist GPU)
- Presales bedeutet technische Due Diligence und POC Delivery
Über das Unternehmen
Integrant ist ein IT-Beratungs-Unternehmen mit Expertise in HPC, GPU Infrastructure und Enterprise Kubernetes Architekturen.
Deine Aufgaben
- Presales: Partnerschaften mit Sales und Solution Teams bei Opportunity Identifikation und RFP Responses
- Delivery: Operation von Production Kubernetes Clusters und GPU/HPC Umgebungen
- Linux System Administration auf Deep Level (Kernel Tuning, Storage, Networking)
- Design und Operation von Production-Grade Multi-Cluster Kubernetes Plattformen
- IaC Pipelines, GitOps Workflows und CI/CD Systeme implementieren und maintainen
- Architecture Design für End-to-End Plattformen über Cloud, Hybrid und On-Premises HPC
- GPU-aware Cluster Design (NVIDIA H100/A100/B200 Node Pools)
- Workload Isolation, Networking Architectures und Storage Strategies definieren
- MIG Partitioning und Multi-Tenant Modelle designen
- Senior Escalation Point für komplexe Operational Incidents
Deine Voraussetzungen
- Tiefes Hands-On SysOps/HPC Expertise mit Strategic Architecture Vision
- Starke Erfahrung mit Production-Grade Kubernetes (RKE2, EKS, AKS)
- GPU-Aware Cluster Design Erfahrung (NVIDIA H100/A100 Node Pools)
- Hybrid Cloud + On-Premises HPC Infrastructure Experience
- Advanced Linux Administration (Kernel Tuning, Storage, Networking)
- GitOps Tooling: ArgoCD, Fleet Erfahrung
- CI/CD Pipelines: Azure DevOps, Jenkins
- Infrastructure as Code: Terraform (Modules, Remote State)
- GPU Infrastructure Architecture: GPU Operator, MIG Partitioning
- AI Workload Classes und Distributed Training Erfahrung
- Observability: Prometheus, Loki, GPU Telemetry (DCGM Exporter)
- Security & Multi-Tenancy: Zero-Trust, Secret Management, RBAC
Benefits
- Presales und Delivery Balance (60% Implementation)
- HPC und GPU Infrastructure auf Enterprise Scale
- Internationale Clientele und High-Impact Projekte