ML Engineer
⚲ Warszawa
Do uzgodnienia
Wymagania
- bardzo dobra znajomość Pythona oraz SQL
- doświadczenie w przetwarzaniu dużych wolumenów danych (Spark, Polars)
- doświadczenie z analitycznymi bazami danych typu kolumnowego
- doświadczenie w pracy w sektorze operującym na dużej skali danych
- doświadczenie w projektowaniu i modelowaniu struktur danych pod zaawansowaną analitykę i systemy Real-Time
Mile widziane
- znajomość ClickHouse i/lub StarRocks
- znajomość Kubernetes oraz narzędzi GitOps (ArgoCD)
- doświadczenie w branży RTB / programmatic advertising
Opis stanowiska
Dołączysz do Wirtualnej Polski, gdzie będziesz pracować nad warstwą danych zasilającą modele ML w środowisku dużej skali — prawdopodobnie w kontekście reklamy i systemów Real-Time. Twoim zadaniem będzie budowa i optymalizacja pipeline'ów danych, projektowanie schematów przechowywania pod analitykę i Real-Time oraz tworzenie monitoringu jakości danych i modeli produkcyjnych (w tym wykrywanie distribution shift). To oferta dla inżyniera, który czuje się swobodnie w przetwarzaniu dużych wolumenów danych i chce łączyć pracę z danymi z realnym wpływem na systemy ML działające produkcyjnie. Uwaga: to rola hybrydowa — 3 dni w biurze, 2 zdalnie.
🔍 Dekoder Ogłoszenia
✓ Ogłoszenie wygląda transparentnie — brak typowych czerwonych flag.