Pracuj.pl Praca zdalna Senior

Site Reliability Engineer

EPAM Systems (Poland) sp. z o.o.

⚲ Kraków, Grzegórzki

Do uzgodnienia

Wymagania

  • wykształcenie wyższe w informatyce, inżynierii lub pokrewne
  • 3+ lata hands-on doświadczenia w SRE lub pokrewnej roli
  • doświadczenie z co najmniej jedną chmurą (AWS/GCP/Azure)
  • doświadczenie w implementacji praktyk SRE: SLO/SLI, error budgets, postmortemy, redukcja toil, capacity planning, incident management
  • Python lub inny język skryptowy/programowania
  • angielski min. B2 (Upper-Intermediate)

Mile widziane

  • certyfikat Kubernetes/AWS/GCP/Azure lub podobny
  • doświadczenie z LLM, RAG, AI agents, AI cloud services (AWS Bedrock, Vertex AI, Azure AI) oraz narzędziami typu Cursor/Claude Code

Opis stanowiska

EPAM szuka Site Reliability Engineera do pracy z zespołami developerskimi i operacyjnymi nad niezawodnością, skalowalnością i wydajnością systemów. Zakres obejmuje wdrażanie praktyk SRE (SLO/SLI, error budgets, postmortemy, redukcja toil), monitoring, IaC, CI/CD oraz — co wyróżnia tę ofertę — adopcję AI w platformie (GenAI, agenci autonomiczni, AIOps). To dobra oferta dla SRE z 3+ latami doświadczenia, który chce rozwijać się w kierunku AI-enabled platform capabilities. Uwaga: 'Incident Management' w wymaganiach oznacza realne dyżury i pracę w trybie reagowania na incydenty.

🔍 Dekoder Ogłoszenia

🟡
Reducing Toil
Może oznaczać, że obecnie występuje dużo pracy manualnej i powtarzalnej do zautomatyzowania.
🔴
Incident Management
Możliwe dyżury i praca w trybie reagowania na incydenty.
🟡
Mile widziane: Certification...
Wymagania 'mile widziane' bywają traktowane jako faktyczne oczekiwania.