Service Manager & Site Reliability Engineer
⚲ Kraków, Łódź, Warszawa, Poznań
18 800 - 28 900 PLN (PERMANENT)
Wymagania
- min. 5 lat doświadczenia w Incident Operations, SRE, Technical Operations lub podobnej roli
- doświadczenie w środowiskach on-call z odpowiedzialnością za SLA
- mocne zrozumienie systemów rozproszonych i środowisk produkcyjnych
- doświadczenie z narzędziami do monitoringu, alertowania i zarządzania incydentami
- znajomość API, integracji systemów i platform observability
- praktyczne doświadczenie z Pythonem lub Kotlinem
- umiejętność pracy pod presją i zarządzania wieloma priorytetami
Mile widziane
- doświadczenie z Datadog lub Chronosphere, PagerDuty/Rootly/Slack workflows
Opis stanowiska
Rola łącząca Service Management i SRE w GFT: zarządzasz reakcją na incydenty produkcyjne w czasie rzeczywistym, oceniasz wpływ awarii, prowadzisz komunikację zewnętrzną i koordynujesz działania między zespołami. Pracujesz na styku SRE, Incident Response i Partner Operations, dbając o zgodność z SLA. Uwaga: 'real-time incident response' i 'global operations' w praktyce oznaczają dyżury, pracę po godzinach przy awariach i współpracę z zespołami w różnych strefach czasowych.
🔍 Dekoder Ogłoszenia
🔴
real-time incident response
Może oznaczać dyżury i pracę po godzinach przy awariach produkcyjnych
🔴
global operations
Praca w trybie 24/7, współpraca z zespołami w różnych strefach czasowych