JustJoin.IT Hybrydowo Senior

Site Reliability Engineer

Caspian One

⚲ warsaw

37 800 - 46 200 PLN netto (B2B)

Wymagania

  • doświadczenie jako SRE, Production Engineer, Platform Engineer lub podobne
  • mocne umiejętności administracji Linux/Unix
  • doświadczenie w skryptowaniu i automatyzacji, najlepiej Python lub Shell
  • doświadczenie z narzędziami monitoringu i obserwowalności, takimi jak Prometheus/Grafana
  • udokumentowane doświadczenie w utrzymaniu systemów krytycznych dla biznesu w dużej skali
  • gotowość do udziału w dyżurach on-call i wsparciu przy poważnych incydentach

Mile widziane

  • doświadczenie w Financial Services lub Capital Markets
  • doświadczenie w chmurze (AWS, Azure lub GCP) oraz DevOps, CI/CD i automatyzacji infrastruktury

Opis stanowiska

SRE w globalnej organizacji bankowej przy platformach tradingowych i markets — budowa platformy obserwowalności, rozwiązywanie złożonych incydentów, automatyzacja zadań operacyjnych i poprawa niezawodności systemów o krytycznym znaczeniu. To nie jest typowy support — oczekuje się podejścia inżynierskiego i proaktywnego usprawniania. Uwaga: praca z systemami krytycznymi oznacza wysokie ciśnienie i konieczność szybkiego reagowania, a dyżury on-call i wsparcie przy poważnych incydentach są częścią roli.

🔍 Dekoder Ogłoszenia

🔴
This isn't a traditional support role.
Choć nie jest to typowy support, nadal będziesz zajmować się rozwiązywaniem problemów produkcyjnych, ale z naciskiem na automatyzację i zapobieganie.
🔴
The team is looking for engineers who enjoy solving problems at scale, automating repetitive processes and improving platform reliability rather than simply firefighting production issues.
Oczekuje się, że będziesz proaktywnie szukać rozwiązań i automatyzować, ale problemy produkcyjne i tak będą się pojawiać.
🔴
Supporting critical production applications used across global markets businesses.
Praca z systemami o kluczowym znaczeniu, co może oznaczać wysokie ciśnienie i konieczność szybkiego reagowania w sytuacjach kryzysowych.
🔴
Contributing to on-call and major incident support when required.
Będziesz musiał być dostępny poza standardowymi godzinami pracy w przypadku awarii.
🔴
Driving continuous improvements across the production estate.
Oczekuje się proaktywności w identyfikowaniu i wdrażaniu usprawnień, co może wymagać dodatkowego wysiłku poza bieżącymi zadaniami.