Data Engineer
⚲ Warszawa
28 000 - 31 000 PLN netto (B2B)
Wymagania
- Python
- SQL
- Celery
- CI/CD
- Terraform
- AWS
Opis stanowiska
Wspólnie z naszym Partnerem, amerykańskim producentem sprzętu fitness, poszukujemy doświadczonego/ej specjalisty/ki do realizacji projektów jako Data Engineer.
Będziesz świadczyć usługi w projekcie, który obejmuje budowę od podstaw polskiego oddziału R&D oraz rozwój skalowalnych rozwiązań w dynamicznym środowisku scale-up. Projekt zapewnia dostęp do zaawansowanych narzędzi i infrastruktury enterprise oraz pracy z realnymi użytkownikami i danymi medycznymi.
💡 ZAKRES USŁUG:
• Zapewnienie spójności danych między bazami, indeksami, cache’ami i strumieniami zdarzeń oraz implementacja mechanizmów idempotencji.
• Monitorowanie jakości i świeżości danych, opóźnień oraz kosztów, a także automatyzacja infrastruktury z wykorzystaniem Terraform i kontenerów.
• Projektowanie i obsługa event-driven workflows z kolejkami, dead-letter queues, replay oraz mechanizmami at-least-once delivery.
• Projektowanie i utrzymanie pipeline’ów ingestu, synchronizacji danych, indeksów wyszukiwania, kolejek i cache’y.
• Rozwój infrastruktury wyszukiwania: indeksowanie leksykalne, wektorowe, hybrydowe, k-NN oraz rank-fusion.
• Realizacja bezpiecznych migracji i backfilli danych oraz zarządzanie schematami, API i kontraktami zdarzeń.
🔍 WYMAGANE KOMPETENCJE:
• Minimum 5 lat doświadczenia jako Data Engineer w tworzeniu i utrzymaniu oprogramowania produkcyjnego.
• Doświadczenie w testowaniu, debugowaniu z wykorzystaniem logów, tracingu i metryk oraz ocenie rozwiązań modelowych vs deterministycznych.
• Bardzo dobra znajomość Python, SQL oraz asynchronicznych serwisów i background workerów (Celery).
• Praktyczna znajomość AI/ML/LLM, systemów agentowych, tool-calling oraz applied statistics.
• Doświadczenie w AWS, CI/CD oraz Terraform.
•
Realizacja usług zdalnie.
•
Język angielski - C1.
Mile widziane: LangGraph, LangChain, Vector search z hard filters, Narzędzia ewaluacyjne (scenario suites, model-based judging, tracing), Bandyci (bandits), Uplift modeling, Optymalizacja rankingu, Twarde budżety latencji/streaming/real-time, TypeScript, Produkty głosowe/TTS.
✨ OFERUJEMY:
•
Nowy sposób na aplikowanie z AI Rekruterem (AIR) – w trakcie procesu możesz porozmawiać z wirtualnym rekruterem 24/7, bez czekania na telefon. Finalną decyzję zawsze podejmuje Opiekun Projektu.
• Uczestnictwo w wydarzeniach branżowych oraz meetupach technologicznych, umożliwiających dzielenie się wiedzą i doświadczeniem.
• Współpraca realizowana w modelu projektowym, z rozliczeniem opartym na etapach i protokołach odbioru poszczególnych deliverables.
• Wsparcie po stronie Connectis w sprawach administracyjnych i rozliczeniowych związanych ze współpracą.
• Elastyczną formę współpracy B2B przy projektach realizowanych dla renomowanego Partnera.
• 5000 PLN za polecenie znajomych do naszych projektów.
• Szybki i zdalny proces.
Dziękujemy za wszystkie zgłoszenia. Pragniemy poinformować, że skontaktujemy się z wybranymi osobami.
13284/KD
Będziesz świadczyć usługi w projekcie, który obejmuje budowę od podstaw polskiego oddziału R&D oraz rozwój skalowalnych rozwiązań w dynamicznym środowisku scale-up. Projekt zapewnia dostęp do zaawansowanych narzędzi i infrastruktury enterprise oraz pracy z realnymi użytkownikami i danymi medycznymi.
💡 ZAKRES USŁUG:
• Zapewnienie spójności danych między bazami, indeksami, cache’ami i strumieniami zdarzeń oraz implementacja mechanizmów idempotencji.
• Monitorowanie jakości i świeżości danych, opóźnień oraz kosztów, a także automatyzacja infrastruktury z wykorzystaniem Terraform i kontenerów.
• Projektowanie i obsługa event-driven workflows z kolejkami, dead-letter queues, replay oraz mechanizmami at-least-once delivery.
• Projektowanie i utrzymanie pipeline’ów ingestu, synchronizacji danych, indeksów wyszukiwania, kolejek i cache’y.
• Rozwój infrastruktury wyszukiwania: indeksowanie leksykalne, wektorowe, hybrydowe, k-NN oraz rank-fusion.
• Realizacja bezpiecznych migracji i backfilli danych oraz zarządzanie schematami, API i kontraktami zdarzeń.
🔍 WYMAGANE KOMPETENCJE:
• Minimum 5 lat doświadczenia jako Data Engineer w tworzeniu i utrzymaniu oprogramowania produkcyjnego.
• Doświadczenie w testowaniu, debugowaniu z wykorzystaniem logów, tracingu i metryk oraz ocenie rozwiązań modelowych vs deterministycznych.
• Bardzo dobra znajomość Python, SQL oraz asynchronicznych serwisów i background workerów (Celery).
• Praktyczna znajomość AI/ML/LLM, systemów agentowych, tool-calling oraz applied statistics.
• Doświadczenie w AWS, CI/CD oraz Terraform.
•
Realizacja usług zdalnie.
•
Język angielski - C1.
Mile widziane: LangGraph, LangChain, Vector search z hard filters, Narzędzia ewaluacyjne (scenario suites, model-based judging, tracing), Bandyci (bandits), Uplift modeling, Optymalizacja rankingu, Twarde budżety latencji/streaming/real-time, TypeScript, Produkty głosowe/TTS.
✨ OFERUJEMY:
•
Nowy sposób na aplikowanie z AI Rekruterem (AIR) – w trakcie procesu możesz porozmawiać z wirtualnym rekruterem 24/7, bez czekania na telefon. Finalną decyzję zawsze podejmuje Opiekun Projektu.
• Uczestnictwo w wydarzeniach branżowych oraz meetupach technologicznych, umożliwiających dzielenie się wiedzą i doświadczeniem.
• Współpraca realizowana w modelu projektowym, z rozliczeniem opartym na etapach i protokołach odbioru poszczególnych deliverables.
• Wsparcie po stronie Connectis w sprawach administracyjnych i rozliczeniowych związanych ze współpracą.
• Elastyczną formę współpracy B2B przy projektach realizowanych dla renomowanego Partnera.
• 5000 PLN za polecenie znajomych do naszych projektów.
• Szybki i zdalny proces.
Dziękujemy za wszystkie zgłoszenia. Pragniemy poinformować, że skontaktujemy się z wybranymi osobami.
13284/KD
🔍 Dekoder Ogłoszenia
🔴
budowa od podstaw polskiego oddziału R&D
Będziesz częścią zespołu tworzącego nowe struktury i procesy, co może wiązać się z niepewnością i koniecznością samodzielnego definiowania wielu aspektów pracy.
🔴
dynamicznym środowisku scale-up
Oczekuj częstych zmian, szybkiego rozwoju, ale też potencjalnie braku ugruntowanych procesów i konieczności adaptacji do nowych sytuacji.
🔴
pracy z realnymi użytkownikami i danymi medycznymi
Oznacza to potencjalnie wysokie wymagania dotyczące bezpieczeństwa, zgodności z regulacjami (np. RODO, HIPAA) i odpowiedzialności za wrażliwe dane.
🟡
zaawansowanych narzędzi i infrastruktury enterprise
Może to oznaczać pracę z rozbudowanymi, ale też potencjalnie skomplikowanymi i mniej elastycznymi systemami, które wymagają specyficznej wiedzy.
🟡
ocenie rozwiązań modelowych vs deterministycznych
Wymaga to głębokiego zrozumienia różnych podejść do przetwarzania danych i podejmowania decyzji, co może być wyzwaniem dla osób z mniejszym doświadczeniem teoretycznym.