Auf einen Blick
Setze Production Reliability Strategie für ein Healthcare-Transformations-Unternehmen als Staff Site Reliability Engineer bei Garner, das Patienten mit top-performing Ärzten verbindet. Du wirst SLO Frameworks, Incident Response und Automation-First Kultur definieren.
💰 $140.000–190.000/Jahr
📊 Senior
🕒 Vollzeit
🌍 Remote
🗺️ Americas
- Expert-Level SRE Erfahrung
- AWS und Kubernetes Expertise
- Incident Response Programme Leadership
Cloud Infrastructure
AWS
Kubernetes
Incident Response
Observability
✅ Geeignet für
- Senior Site Reliability Engineers mit Healthcare Interest
- Infrastructure/DevOps Leaders mit Patient-Impact Focus
🚫 Weniger geeignet
- Junior SRE/DevOps Engineers
- Kandidaten ohne Production On-Call Erfahrung
💡 Gut zu wissen
- Healthcare Compliance prägt jeden Reliability Decision
- AI/ML Workloads haben Unique Reliability Challenges
- Automation-First bedeutet kontinuierliche Integration von neuen Tools
Über das Unternehmen
Garner transformiert das US-Healthcare-System durch Identifikation von top-performing Ärzten über 80+ Spezialitäten mit 320M+ Patienten-Dataset. Garner partnert mit Arbeitgebern, um Mitglieder zu top-performing Care zu leiten und hat 2,5 Millionen Menschen geholfen, bessere Care zu erhalten und 1 Milliarde Dollar Healthcare-Kosten gespart.
Deine Aufgaben
- Eigne Reliability Strategy für Cloud Infrastructure um Built's Products und AI/ML Workloads zu powern
- Setze Technical Direction wie Garner Production Quality definiert, misst und aufrechterhält
- Architektiere SLO Framework, Incident Response Programme und Automation Standards
- Leite Incident Response Programm, serve in On-Call Rotation, führe Root Cause Analysis
- Architektiere Monitoring, Alerting und Observability Platform
- Transformiere High-Level Scaling und Reliability Requirements in Automation und Infrastructure-as-Code
- Identifiziere Cost-Efficiency und Performance Gains über Cloud Stack
- Multipliziere Engineering Team durch Empowerment zu Ship AI Features schneller und zuverlässiger
- Uphold Security und HIPAA Compliance für Healthcare-Systeme
Deine Voraussetzungen
- Expert SRE und Production Reliability Erfahrung
- Strong Cloud Infrastructure (AWS, Kubernetes) Expertise
- Incident Response und On-Call Programme Erfahrung
- Hands-On Automation und Infrastructure-as-Code Skills
- Healthcare Compliance und Security Verständnis
Benefits
- Umfassende Healthcare-Leistungen
- Remote Work mit Optional NYC HQ