AI Engineer (Python + AWS + AI/LLM)
⚲ Warszawa
28 560 - 30 240 PLN netto (B2B)
Wymagania
- doświadczenie w tworzeniu systemów produkcyjnych w Pythonie
- doświadczenie z AWS (S3, Glue, Aurora)
- doświadczenie z pipeline'ami danych (ETL / batch processing)
- bardzo dobra znajomość SQL i PostgreSQL
- doświadczenie z projektowaniem schematów i migracjami
- doświadczenie z LLM w produkcji (OCR, przetwarzanie i wzbogacanie treści)
- gotowość do onboardingu w Warszawie i kwartalnych wizyt w biurze
Mile widziane
- doświadczenie z bazami wektorowymi (Weaviate, Pinecone, Qdrant, pgvector)
Opis stanowiska
Budowa platformy CaaS (Content as a Service) przekształcającej treści wydawnicze (PDF, Excel) w ustrukturyzowane dane gotowe dla AI — pipeline'y ingestii, konwersja PDF do markdown (AI OCR), chunking, embeddingi i wyszukiwanie wektorowe. Realnie pracujesz na styku data engineeringu i AI/LLM: budujesz wieloetapowe pipeline'y, utrzymujesz spójność danych między S3, PostgreSQL (Aurora) i Weaviate oraz wystawiasz treści przez REST API (FastAPI). Uwaga: praca zdalna, ale pierwszy dzień onboardingu w Warszawie i kwartalne wizyty — warto uwzględnić to w kalkulacji.
🔍 Dekoder Ogłoszenia
🔴
remote with the first day onboarding in Warsaw and occasional visits once per quarter
Praca zdalna, ale wymaga przyjazdu do Warszawy na początku i sporadycznie później, co może generować dodatkowe koszty i czas.
🔴
up to 180 pln/h on b2b
Stawka maksymalna, faktyczna stawka może być niższa w zależności od negocjacji i doświadczenia.
🔴
AI Engineer (Python + AWS + AI/LLM)
Oczekuje się szerokiego zakresu umiejętności, od inżynierii danych po zaawansowane modele AI/LLM, co może oznaczać pracę nad wieloma różnymi zadaniami.
🔴
Design, build, and maintain a scalable data and AI platform
Może oznaczać budowanie od zera lub znaczącą przebudowę istniejącej platformy, co wiąże się z dużą odpowiedzialnością i potencjalnie nieprzewidzianymi wyzwaniami.
🔴
PDF-to-markdown conversion (AI OCR)
Wykorzystanie AI do konwersji PDFów może oznaczać konieczność radzenia sobie z niedoskonałościami OCR i potencjalnie dużą ilością pracy manualnej przy poprawkach.