Site Reliability Engineer
⚲ Warszawa, Kraków, Gdańsk, Poznań, Wrocław
17 850 - 22 700 PLN brutto (UoP)
Wymagania
- doświadczenie w roli SRE, Infrastructure lub DevOps przy zarządzaniu rozproszonymi środowiskami o dużej skali
- zaawansowane umiejętności programowania w Pythonie, z naciskiem na skalowalną automatyzację i narzędzia wewnętrzne
- hands-on doświadczenie w zarządzaniu produkcyjnymi środowiskami Kubernetes
- doświadczenie z narzędziami do zarządzania konfiguracją takimi jak Ansible
- doświadczenie w projektowaniu odpornych architektur infrastruktury w Azure Kubernetes Service i środowiskach on-prem
- biegłość w budowaniu standardowych ekosystemów telemetrii z użyciem self-hosted narzędzi open source
- gotowość do udziału w on-call rotation
Opis stanowiska
Jako Site Reliability Engineer w XTB będziesz odpowiadać za niezawodność systemów obsługujących miliony klientów — to duża odpowiedzialność i presja związana ze stabilnością platformy tradingowej. Twoim zadaniem będzie budowanie i wzmacnianie praktyk SRE, które nie są jeszcze w pełni rozwinięte, oraz tworzenie zaawansowanego ekosystemu obserwowalności (telemetria, distributed tracing, inteligentny sampling). Oferta dla kogoś, kto lubi budować standardy od podstaw i pracować w środowisku o wysokich wymaganiach dostępności.
🔍 Dekoder Ogłoszenia
🔴
define and drive the reliability of XTB systems at the scale of millions of clients
Oznacza to, że będziesz odpowiedzialny za zapewnienie stabilności systemów obsługujących dużą liczbę użytkowników, co może wiązać się z presją i odpowiedzialnością.
🔴
strengthen SRE practices and shape the resilience of our entire technology stack
Może sugerować, że obecne praktyki SRE nie są jeszcze w pełni rozwinięte, a Ty będziesz miał za zadanie je budować od podstaw lub znacząco je usprawniać.
🔴
high-impact observability
Wymaga to stworzenia i utrzymania zaawansowanego systemu monitorowania, który może być złożony i czasochłonny w implementacji oraz utrzymaniu.
🟡
Act as a strategic partner to product engineering teams
Oznacza to, że będziesz musiał efektywnie współpracować z innymi zespołami, co może wymagać negocjacji i wpływania na ich procesy.
🟡
Use error budgets and alerting as the primary langu
Wskazuje na metodykę pracy opartą na konkretnych metrykach i progu tolerancji błędów, co jest standardem w SRE, ale wymaga precyzyjnego definiowania i egzekwowania.