Auf einen Blick
Okta sucht einen Manager für Site Reliability Engineering zur Führung eines SRE-Teams mit Focus auf Plattform-Zuverlässigkeit und Automation. Erforderlich sind 3+ Jahre Team-Führung und 8+ Jahre SRE/Cloud-Erfahrung.
💰 $180.000–280.000/Jahr
📊 Senior
🕒 Vollzeit
🌍 Remote
🗺️ Americas
- 3+ Jahre Team-Führung in SRE
- 8+ Jahre Gesamt-Industrie-Erfahrung
- AWS/Azure und Terraform Expertise
Site Reliability Engineering
Kubernetes
AWS
Terraform
Go
Python
Team Leadership
Incident Response
✅ Geeignet für
- Erfahrene SRE Engineers mit Team-Führung
- Infrastructure Leaders mit Kubernetes/Cloud-Expertise
- Technical Managers mit Leidenschaft für Automation
🚫 Weniger geeignet
- Individual Contributors ohne Führungserfahrung
- Kandidaten mit weniger als 8 Jahren Industrie-Erfahrung
- Personen, die keine 24/7 On-Call-Rotationen akzeptieren
💡 Gut zu wissen
- Position erfordert 24/7 On-Call-Rotation mit Follow-the-Sun Abdeckung
- Hands-On-Einbeziehung in Incident Response ist Kern der Rolle
- US Person Status wird für Zugang zu föderalen Umgebungen/Daten erforderlich
Über das Unternehmen
Okta (ehemals Auth0) ist der Vertrauenszentrum für Identität. Das Unternehmen schützt AI-Infrastruktur mit vertrauenswürdigen, neutralen Systemen, die Millionen von Nutzern weltweit bedienen. Das SRE Leadership Team ist das Rückgrat der Plattform-Zuverlässigkeit.
Deine Aufgaben
- Führung der technischen Richtung des SRE-Teams mit Focus auf Skalierbarkeit und Resilienz
- Hands-On-Teilnahme an 24/7 On-Call-Rotationen mit Follow-the-Sun-Abdeckung
- Direktes Troubleshooting und Remediation kritischer Systeme
- Aufbau von Infrastruktur-Resilienz durch Monitoring, Alerting und Automation
- Etablierung von Zuverlässigkeits-Best-Practices und Kultur
- Mentoring und Entwicklung von SRE-Talenten
- Vertretung von Zuverlässigkeit als Senior Technical Leader in Architektur-Reviews
- Sicherstellung, dass Zuverlässigkeit ein Kern-Kriterium bei großen Ingenieur-Entscheidungen ist
Deine Voraussetzungen
- 3+ Jahre Hands-On Team Leadership in SRE oder Software Engineering in Cloud-Native Umgebungen
- 8+ Jahre insgesamt Industrie-Erfahrung
- Tiefe Expertise in Cloud-Plattformen (AWS, Azure) und Infrastructure-as-Code (Terraform)
- Bewährte Erfahrung bei Verwaltung Cloud-Native Architekturen (Container, Kubernetes, Microservices, Datenbanken)
- Starke Programmierfähigkeiten in Go oder Python
- Datengetriebener Mindset basierend auf SRE-Prinzipien
- Hervorragende Kommunikationsfähigkeiten verbal und schriftlich
- Fähigkeit, hochperformante Teams in verteilten Remote-First-Umgebungen zu bauen und zu führen
- Strategic Vision kombiniert mit Technical Depth und Leidenschaft für Mentoring