Production Support Engineer
⚲ Warszawa, Łódź, Gdańsk, Gdynia
20 160 - 21 000 PLN netto (B2B)
Wymagania
- 5+ lat doświadczenia w operacjach IT, wsparciu aplikacji (2./3. linia) lub podobnej roli produkcyjnej
- 2+ lata praktycznego doświadczenia w ramach ITIL (incident, problem, change management)
- doświadczenie w pracy w środowiskach Agile z zespołami deweloperskimi
- bardzo dobra znajomość języka angielskiego (komunikacja z technicznymi i nietechnicznymi interesariuszami)
- praktyczne doświadczenie ze Splunk, Apica i Sysdig
- doświadczenie w obsłudze usług na Kubernetes i Linux CLI
- doświadczenie z Jenkins, Git oraz bazami Oracle i DB2
Mile widziane
- doświadczenie z Helm, Java/J2EE, IBM DataStage, skrypty Bash/Python lub Ansible
Opis stanowiska
Rola Production Support Engineer w środowisku produkcyjnym, obejmująca zarządzanie incydentami i problemami (RCA, działania zapobiegawcze), monitoring zdrowia usług, wykonywanie wdrożeń przez pipeline'y CI/CD oraz troubleshooting na Kubernetes i Linux. Będziesz też analizować logi w Splunk, tworzyć dashboardy w Prometheus/Grafana i współpracować z zespołami deweloperskimi. To oferta dla doświadczonego inżyniera wsparcia (5+ lat) z bardzo dobrą znajomością angielskiego. Uwaga: rola wymaga samodzielnego prowadzenia całego cyklu życia incydentów oraz proaktywnego reagowania, zanim problemy przerodzą się w awarie.
🔍 Dekoder Ogłoszenia
🔴
Own incident and problem management processes, including RCA, resolution, and preventive actions
Oczekuje się, że będziesz samodzielnie zarządzać całym cyklem życia incydentów i problemów, od analizy po zapobieganie.
🔴
Monitor production service health, detect anomalies, and respond before issues become incidents
Będziesz odpowiedzialny za proaktywne monitorowanie i reagowanie na potencjalne problemy, zanim przerodzą się w poważne awarie.
🟡
Collaborate with development and platform teams to triage incidents and address operational requirements
Będziesz musiał ściśle współpracować z innymi zespołami, aby rozwiązywać problemy i spełniać ich potrzeby operacyjne.
🟢
Identify recurring operational issues and propose automation or tooling improvements
Oczekuje się, że będziesz aktywnie szukać sposobów na usprawnienie procesów poprzez automatyzację i nowe narzędzia.
🟡
Contribute to service continuity activities and disaster recovery exercises
Będziesz brać udział w planowaniu i ćwiczeniach mających na celu zapewnienie ciągłości działania usług i odzyskiwania po awarii.