Staff Data Engineer – Data Lake

H1
New York Vor Ort Lead 04.07.2026
Data Engineer Data Engineer
Auf einen Blick

Leite Data Lake Architektur und Entwicklung bei H1. 8+ Jahre Distributed Data Platform Erlebnis erforderlich; scale ETL/ELT Pipelines, drive Data Quality und mentor Engineers.

💰 ~$200.000–300.000/Jahr (geschätzt) 📊 Senior 🕒 Vollzeit 🗺️ Americas
  • 8+ Jahre Data Engineering, Software Engineering oder verwandt
  • Erfahrung beim Bauen und Skalieren verteilter Data Platforms
  • Technical Leadership und Mentoring Erlebnis
  • Python/PySpark, Java, Scala und Advanced SQL Kompetenz
Data Engineering ETL/ELT SQL Python Distributed Systems Data Architecture

Gehalt geschätzt anhand Staff-level data engineer with distributed platform expertise and mentoring responsibility, New York. Kein Gehalt in der Anzeige angegeben.

✅ Geeignet für
  • Staff-Level Data Engineers mit Distributed Systems Expertise
  • Technical Leaders interessiert in Data Foundation Architecture
  • Ingenieure, die in Manager-Track wechseln möchten
🚫 Weniger geeignet
  • Junior oder Mid-Level Engineers ohne 8+ Jahre
  • Menschen ohne Erlebnis mit großflächigen ETL/ELT Pipelines
  • Kandidaten ohne Mentoring Interest oder Experience
💡 Gut zu wissen
  • Staff-Level bedeutet High Autonomy und Technical Direction Setting
  • Data Lake ist die Foundation – Zuverlässigkeit ist kritisch
  • Mentoring ist explizit Teil der Rolle

Über das Unternehmen

H1 ist eine Healthcare-Intelligence-Plattform, die Ärzte weltweit mit Informationen versorgt. Die Data Lake ist die Foundation von H1's Plattform, verantwortlich für die Validierung, Genauigkeit, Standardisierung und Qualität von Daten, die alle Downstream Products und Teams stützen.

Deine Aufgaben

  • Architektiere, baue und skaliere verteilte ETL/ELT Pipelines und großflächige Ingestion Frameworks
  • Leite die Evolution von H1's Data Lake Architektur mit Fokus auf Scalability, Observability, Zuverlässigkeit
  • Verantworte Data Quality, Validation, Normalisierung und Standardisierung Workflows über Tausende globale Datenquellen
  • Entwerfe und optimiere Batch und Near Real-Time Data Processing Frameworks
  • Optimiere verteilte Compute und Storage Systeme, einschließlich Spark Workloads und Query Performance
  • Treibe Monitoring, Governance und Production Reliability Verbesserungen voran
  • Troubleshoot komplexe Production Data und Infrastruktur-Probleme
  • Arbeite mit Product, Infrastructure, Security und Downstream Teams zusammen
  • Mentoriere Ingenieure durch Technical Leadership und Architecture Reviews

Deine Voraussetzungen

  • 8+ Jahre in Data Engineering, Software Engineering oder verwandten Feldern mit Erfahrung beim Bauen und Skalieren verteilter Data Platforms
  • Demonstrated Technical Leadership Erfahrung mit Interesse an oder Erfahrung beim Mentorieren von Ingenieuren
  • Starke Kompetenz in Python (PySpark), Java, Scala oder ähnliche Programmiersprachen
  • Advanced SQL Expertise für großflächige Datasets

Benefits

  • Staff-Level IC mit Engineering Manager Track Option
  • Data Lake Foundation Ownership