Site Reliability Engineer – Data & AI
⚲ Warsaw
Do uzgodnienia
Wymagania
- doświadczenie w pisaniu kodu produkcyjnej jakości
- doświadczenie w budowie systemów opartych na LLM / agentach AI
- praktyka w observability, monitoringu i analizie przyczyn awarii (root cause)
- doświadczenie z pipeline'ami danych w chmurze (Azure)
Opis stanowiska
Site Reliability Engineer w P&G, który realnie buduje — tworzysz agentów AI (LLM) do wykrywania, klasyfikowania i diagnozowania problemów w pipeline'ach danych, a także systemy proaktywnej kontroli jakości danych, logowania i monitoringu. Praca jest mocno inżynierska i nastawiona na automatyzację zamiast ręcznego gaszenia pożarów. Uwaga: ogłoszenie sugeruje, że w organizacji reliability bywa dokładane po fakcie — warto dopytać, jak obecnie wygląda kultura niezawodności i czy zmiana podejścia jest realnym priorytetem.
🔍 Dekoder Ogłoszenia
🟡
If you write production-quality code and are excited by the challenge of building AI-powered systems, we want to hear from you
Ogłoszenie SRE z naciskiem na budowanie AI agentów — rola może wykraczać poza klasyczny SRE, wymagając kompetencji ML/AI, co nie zawsze jest jasno komunikowane.
🟡
replacing manual investigation with automated reasoning and self-healing workflows
Brzmi ambitnie, ale w praktyce może oznaczać, że budujesz systemy, które same mają zastąpić ludzi — ryzyko wysokich oczekiwań przy niedojrzałych technologiach.
🔴
embed observability, reliability, and resilience from design through to production — not add it after things break
Sugeruje, że w organizacji istnieje problem z podejściem 'naprawiaj po awarii' — możesz trafić do środowiska, gdzie reliability nie jest priorytetem.