Auf einen Blick
Data Engineer mit Fokus auf RAG-Pipelines, ETL/ELT-Prozesse und großflächige Datenverwaltung in AWS. Spezialisierung auf ElasticSearch, Prefect und moderne Data Engineering Technologien.
💰 ~$120.000–150.000/Jahr (geschätzt)
📊 Mid-Level
🕒 Vollzeit
🌍 Vor Ort
🗺️ Americas
- ETL/ELT und Data Modeling Erfahrung
- Prefect Workflow Erfahrung
- ElasticSearch Knowledge
- Python Proficiency und Active TS/SCI Clearance
RAG Pipelines
ETL/ELT
Python
AWS
Apache NiFi
Prefect
ElasticSearch
Vector Databases
Gehalt geschätzt anhand Mid-level Data Engineer in Tampa FL area with specialized RAG/AI skills. Kein Gehalt in der Anzeige angegeben.
✅ Geeignet für
- Data Engineers mit AWS und Python Erfahrung
- Professionals, die Generative AI unterstützen möchten
- Engineers mit RAG und Vector Database Interesse
🚫 Weniger geeignet
- Kandidaten ohne TS/SCI Clearance
- Frontend oder DevOps fokussierte Professionals
- Junior-Level ohne substantielle Data Engineering Erfahrung
💡 Gut zu wissen
- Erfordert TS/SCI federal security clearance
- Onsite in Tampa, Florida
- Spezialisierte Rollen in Generative AI und LLM Support
Über das Unternehmen
Accenture Federal Services unterstützt die US-Bundesregierung mit Technologie und Innovation im Bereich Defense.
Deine Aufgaben
- Design, Build und Wartung von RAG-Pipelines mit Dokumenten-Ingestion, Indexing und Embedding
- Entwicklung und Management von strukturierten und unstrukturierten Daten-Pipelines
- Build und Optimierung von ETL/ELT-Pipelines in AWS mit S3, Lambda, Step Functions, EMR, Glue, ECS/EKS
- Implementierung und Betrieb von NiFi-Flows für High-Throughput Datenerfassung
- Entwicklung und Orchestrierung von Workflows mit Prefect
- Implementierung von Indexing und Retrieval Patterns mit ElasticSearch
- Collaboration mit Architektur-, ML- und Anwendungs-Teams
- Data Quality, Lineage und Governance sicherstellen
Deine Voraussetzungen
- Solides Verständnis von ETL/ELT-Prozessen und Data Modeling Best Practices
- Hands-On Erfahrung mit Prefect Workflows
- In-Depth Knowledge von ElasticSearch Indexing und Cluster Management
- Python Proficiency mit Data Libraries (Pandas, PySpark, requests, etc.)