Senior Data Scientist — AI Evaluation & Quality
⚲ Krakow
Do uzgodnienia
Wymagania
- doświadczenie w budowaniu i utrzymaniu offline eval suite (datasety, judges, metryki)
- praktyka z LLM-as-judge i narzędziami typu DeepEval
- umiejętność budowy dashboardów jakości online (resolution rate, CSAT, error rate, latency)
- doświadczenie w analizie ruchu produkcyjnego i zamienianiu awarii w przypadki regresyjne
- znajomość Databricks i SQL
- umiejętność przekładania metryk na decyzje i prowadzenia tygodniowych synców
Opis stanowiska
Finom to europejski fintech (Amsterdam) budujący platformę B2B łączącą bankowość, księgowość i fakturowanie; po rundzie Series C (~346 mln USD) mocno inwestuje w AI. Dołączysz do zespołu AI, który rozwija m.in. finansowego co-pilota i agenta głosowego, i przejmiesz odpowiedzialność za pętlę ewaluacji (eval loop) wszystkich produktów AI — bramki jakości przed wdrożeniem, monitoring po wdrożeniu i ciągłe doskonalenie. To oferta dla osoby, która lubi pracować na danych z produkcji, budować metryki i zestawy regresyjne oraz przekładać liczby na decyzje produktowe we współpracy z inżynierami AI i ekspertami domenowymi.
🔍 Dekoder Ogłoszenia
🟡
on a journey towards revolutionizing the financial landscape
Ogólnikowy slogan marketingowy bez konkretów o produkcie czy roli.
🟡
seamless, mobile-first platform
Brzmi dobrze, ale 'seamless' bywa używane, gdy integracje w praktyce wymagają pracy.
🟡
empowering our employees to make a real difference
Fraza employer-brandingowa, nie mówi nic o realiach pracy.
🟡
AI-enabled accounting
Brak szczegółów, co dokładnie robi AI — może oznaczać proste automatyzacje.