Auf einen Blick
CodeRabbit sucht einen Site Reliability Engineer mit 6–8 Jahren Erfahrung in Platform Engineering. Diese Vollzeit-Position in Bengaluru beinhaltet die Architektur von GCP-Infrastruktur, SLI/SLO-Management, Incident-Response und Self-Service-Tooling-Entwicklung für Large-Scale Code-Review-Systeme.
💰 ~$90.000–130.000/Jahr (geschätzt)
📊 Senior
🕒 Vollzeit
🌍 Vor Ort
🗺️ APAC
- 6–8 Jahre SRE/Platform Engineering/DevOps
- GCP oder AWS mit Compute, Storage, Networking
- Kubernetes und Docker Containerization
- Terraform für Infrastructure as Code
SRE
Platform Engineering
GCP
Kubernetes
Terraform
Node.js
Gehalt geschätzt anhand 6–8 Jahre Senior SRE/Platform Engineering in Bengaluru Tech Market. Kein Gehalt in der Anzeige angegeben.
✅ Geeignet für
- Senior SRE/Platform Engineers mit 6–8 Jahren Erfahrung
- GCP-Spezialisten mit Kubernetes und Terraform Expertise
- Infrastruktur-Architekten mit Large-Scale Systems Erfahrung
🚫 Weniger geeignet
- Junior SRE oder DevOps Anfänger (<6 Jahren)
- Kandidaten ohne GCP oder AWS Cloud Platform Erfahrung
- Menschen ohne Kubernetes oder IaC Erfahrung
💡 Gut zu wissen
- GCP ist spezifische Cloud-Anforderung, nicht AWS
- Terraform-Terragrunt ist zusammengewachsen, nicht separat
- Large-Scale bedeutet Millionen Code Reviews, hohe Anforderungen
- Bengaluru Onsite Position, keine Remote-Flexibilität angegeben
Über das Unternehmen
CodeRabbit ist ein innovatives Research und Development-Unternehmen mit Fokus auf extraordinär produktive Human-Machine-Kollaborations-Systeme, spezialisiert auf Gen-AI-getriebene Code-Review. Das Unternehmen verarbeitet Millionen von Code Reviews mit LLM- und Distributed-Architecture-Technologien.
Deine Aufgaben
- Design, Implementierung und Wartung skalierbarer GCP-Infrastruktur
- Entwicklung, Ownership und Betrieb kritischer Platform Services
- Bau und Wartung von Infrastructure as Code mit Terraform-Terragrunt
- Establishment und Wartung von SLI/SLO Frameworks für kritische Services
- Comprehensive Monitoring, Alerting, Observability und Incident Management Implementierung
- Incident Response, Root Cause Analysis und Continuous Improvement
- Optimierung von Application und Infrastructure Performance und Cost
- Design und Implementierung von Chaos Engineering Practices
- Development von Self-Service Platforms und Tooling für Engineering Teams
Deine Voraussetzungen
- 6–8 Jahre Erfahrung in Site Reliability Engineering, Platform Engineering oder DevOps
- Track Record von Production Systems Management im großen Maßstab
- Starker GCP oder AWS Hintergrund (Compute, Storage, Networking, Managed Services)
- Containerization und Orchestration Plattformen (Kubernetes, Docker)
- Programming Languages: Proficiency in Node.js und TypeScript
- Advanced Infrastructure as Code: Terraform für Provisioning
- Monitoring & Observability: Datadog oder ähnlich (Prometheus, Grafana, ELK)
- Starke Linux/Unix Systems Skills