Staff AI Engineer
Staff AI Engineer bei Wati in Hong Kong für LLM Orchestration, RAG und Agent Infrastructure bei 4B+ messages/year Scale. Leitet AI Production Stack und Optimization.
- 5+ Jahre Backend/Infrastructure Engineering
- Mastery einer High-Performance Language (Go, Rust, C++)
- Deep Python Proficiency
- LLM/NLP Production Track Record
Gehalt geschätzt anhand Staff AI Engineer mit 5+ Jahren Backend/Infrastructure Experience. Kein Gehalt in der Anzeige angegeben.
- Erfahrene Backend Engineer mit AI/ML-Interesse
- Infrastructure-Spezialist mit LLM-Production-Background
- Tech-Leads, die AI-Systeme skalieren möchten
- Datenwissenschaftler ohne Backend-Engineering-Erfahrung
- Kandidaten ohne 5+ Jahre Production Engineering
- Frontend-Fokussierte Entwickler
- Staff-Level Rolle mit hoher technischer Verantwortung
- LLM Production bei Skala (4B+ messages/year) erfordert tiefe Optimierungs-Skills
- Multi-Provider Orchestration und Cost Optimization sind zentral
Über das Unternehmen
Wati ist eine AI-powered Customer Engagement Platform, die seit 2020 als WhatsApp Team Inbox gestartet hat und sich zu einer umfassenden Lösung entwickelt hat. Das Unternehmen verarbeitet über 4 Milliarden Nachrichten pro Jahr über 100+ Länder. Trusted von über 16.000 Kunden, Wati wird von Tiger Global, Sequoia Capital, DST Global und Shopify unterstützt.
Deine Aufgaben
- Architektur und Leitung des AI Production Stack einschließlich Multi-Provider LLM Gateway Optimierung, Token Budget Management und Low-Latency Inference Routing
- Design und Implementierung skalierbarer RAG (Retrieval-Augmented Generation) Systeme und Multi-Step AI Agent Workflows
- Leitung der Evolution von Voice AI Layer (WebRTC/realtime) und Cross-Channel Agent Coordination
- Aufbau automatisierter Pipelines für Data Collection, Cleaning, Fine-Tuning Orchestration und Model Versioning
- Kontinuierliche Optimierung von API Kosten, Token Budgets, Latenz und Caching Strategien
- Aufbau von Infrastruktur für systematische AI Quality Assessment und Identification von Failure Modes
- Technische Roadmap-Definitionen in Zusammenarbeit mit Engineering Leadership
Deine Voraussetzungen
- 5+ Jahre Professional Experience in Backend oder Infrastructure Engineering
- Mastery mindestens einer High-Performance Language (Go, Rust oder C++)
- Deep Proficiency in Python
- Nachgewiesenes Track Record von LLMs/NLP Models in High-Traffic Production
- Verständnis von Multi-Provider Orchestration, Prompt Engineering at Scale, Model Drift Management
- Starke Erfahrung mit Data Pipelines für AI Workloads einschließlich Document Processing und Embedding Generation
- Product-Minded Engineer Mentalität
- Autonomous Builder mit hoher Ambiguity Tolerance
- Erfahrung mit Vector Databases (Qdrant, Milvus, Pinecone)
- Vertrautheit mit Agentic Frameworks und Tool-Calling Protocols
Benefits
Ownership über AI Quality bei Platform mit 16.000+ Businesses in 190+ Ländern. Direct Access zu führenden KI-Experten.