B
Senior Site Reliability Engineer I
Gehalt
153.815.277.000 EUR / Jahr
Auf einen Blick
Braze sucht einen Senior Site Reliability Engineer I in Kanada, um Ingress Fleets und API-Services zu architektieren und zu betreiben. Du wirst hochperformante Systeme in Kubernetes und NGINX verwalten.
💰 ~$140.000–220.000/Jahr (geschätzt)
📊 Senior
🕒 Vollzeit
🗺️ Americas
- 5+ Jahre DevOps/SRE Erfahrung
- NGINX und Kubernetes Mastery
Kubernetes
NGINX
DevOps
Go
Ruby on Rails
Gehalt geschätzt anhand Senior SRE mit 5+ Jahren High-Scale Production Erfahrung und Kubernetes/NGINX Spezialisierung. Kein Gehalt in der Anzeige angegeben.
✅ Geeignet für
- Erfahrene Infrastructure Engineers
- People mit High-Scale System Erfahrung
🚫 Weniger geeignet
- Junior DevOps Engineers
- Kandidaten ohne Kubernetes Erfahrung
💡 Gut zu wissen
- Höchst operationale und foundational Rolle
- Pagerduty On-Call Rotation erforderlich
Über das Unternehmen
Braze ist ein globales Customer Engagement SaaS-Unternehmen mit über 3,3 Milliarden monatlich aktiven Usern. Das Unternehmen betreut über 6.000 Enterprise-Kunden und liefert Milliarden Nachrichten täglich an End-Benutzer. Das Unternehmen hat eine Kultur der Autonomie, Accountability und Innovation.
Deine Aufgaben
- NGINX und Kubernetes Ingress Infrastructure architektieren und betreiben
- Hochperformanz-NGINX-Routing, Proxying und Ingress Controller konfigurieren und tunen
- Automatisierte Skalierungsroutinen für hochdurchsätzige API-Services erweitern und tunen
- Mit Product Teams zusammenarbeiten, um Anforderungen in resiliente, hochverfügbare Technologie-Stacks zu übersetzen
- Service Level Indicators (SLIs) und Service Level Objectives (SLOs) definieren
- Systems Design, Bottleneck Profiling und Capacity Planning durchführen
- Proaktive On-Call-Rotation durchführen und Incidents verhindern
- Root-Cause-Analyse und blameless Retrospectives leiten
Deine Voraussetzungen
- 5+ Jahre Erfahrung als DevOps oder Site Reliability Engineer in High-Scale Production
- Tiefe praktische Erfahrung mit NGINX-Konfiguration und -Betrieb unter Heavy Traffic
- Vertieftes Kubernetes-Wissen für Administration und Cluster Networking
- Erfahrung mit Docker und Container-Orchestrierung
- Fähigkeit, on-call Rotationen zu verwalten und Incidents proaktiv zu verhindern