Auf einen Blick
Site Reliability Engineer für Network Infrastructure bei Nebius. Linux Fundamentals und High-Availability-Systeme mit SRE-Fokus erforderlich.
💰 ~$120.000–160.000/Jahr (geschätzt)
📊 Senior
🕒 Vollzeit
🌍 Remote
🗺️ EMEA
- Strong Linux Fundamentals
- High-Availability Erfahrung
- Automation (Go/Python)
- Incident Investigation
Linux
Go
Incident Response
Observability
Gehalt geschätzt anhand Senior SRE with Linux and networking at large-scale cloud company. Kein Gehalt in der Anzeige angegeben.
✅ Geeignet für
- Senior SRE mit Network-Fokus
- Infrastructure Engineer mit Automation
- Incident Response Spezialisten
🚫 Weniger geeignet
- Application Development fokussierte Kandidaten
- Junior ohne Ops-Erfahrung
- Personen ohne Linux-Tiefe
💡 Gut zu wissen
- Large-scale Network Reliability erforderlich
- Root Cause Analysis statt Symptom-Behandlung
- Modern DevOps Tooling essentiell
Über das Unternehmen
Nebius ist ein Cloud-Infrastruktur-Anbieter für die globale AI-Ökonomie. Das Unternehmen arbeitet mit Börsennotierung (NBIS) und hat 1.500+ Mitarbeiter weltweit.
Deine Aufgaben
- Definition und Besitz von Zuverlässigkeits-Zielen für Network Services (SLIs/SLOs)
- Improvement von Netzwerk-Zuverlässigkeit durchgehend
- Incident Response für zugeordnete Bereiche mit gründlicher Root Cause Analysis
- Aufbau von Observability - Metrics, Logs, Traces, Alerting
- Design von sicheren Change Workflows mit Automation und Staged Rollouts
- Enge Zusammenarbeit mit Network Engineers zur Operabilität
Deine Voraussetzungen
- Starke Linux Fundamentals und strukturiertes Debugging-Verständnis
- Solides Netzwerk-Verständnis und Kenntnisse von Ausfallszenarien
- Hands-on Erfahrung mit High-Availability-Systemen
- Fähigkeit Software/Automation zu schreiben (Go oder Python)
- Erfahrung mit moderner Infrastruktur-Tooling (IaC, CI/CD)