Senior Site Reliability Engineer (SRE)
⚲ Warszawa
Do uzgodnienia
Wymagania
- doświadczenie w cloud infrastructure, automatyzacji i incident response
- praktyczne doświadczenie z Terraform i usługami AWS
- doświadczenie w budowie automatyzacji provisioning i CI/CD (Jenkins, Packer, Docker)
- gotowość do udziału w rotacji on-call infrastruktury
- doświadczenie w monitoringu i observability (Datadog, Pingdom, Elastic)
- doświadczenie w optymalizacji kosztów i wysokiej dostępności infrastruktury
Opis stanowiska
Senior SRE w SpotMe — platformie B2B do eventów (in-person, virtual, hybrid) obsługującej klientów z life sciences. Będziesz odpowiadać za niezawodność i skalowalność platformy SaaS 24/7: rozwój infrastruktury w Terraform i AWS, optymalizację pod szczyty ruchu, monitoring i observability oraz udział w rotacji on-call. To oferta dla hands-on inżyniera z doświadczeniem w cloud infrastructure, automatyzacji i incident response, który chce mieć realny wpływ na uptime i wydajność. Uwaga: rola wiąże się z pełną odpowiedzialnością za niezawodność platformy i rotacją on-call, co może oznaczać dużą presję i ograniczone wsparcie.
🔍 Dekoder Ogłoszenia
🔴
take full ownership of our platform’s reliability and scalability
Może oznaczać dużą odpowiedzialność i samodzielność, ale też potencjalnie brak wsparcia lub zasobów do realizacji zadań.
🔴
you'll have real latitude to use them
Sugestia dużej swobody w wyborze narzędzi, ale może też oznaczać, że firma nie narzuca konkretnych technologii, co wymaga od kandydata samodzielnego ustalania standardów.
🟡
You will not just monitor the platform; you will drive lasting improvements to its uptime, performance, and resilience.
Oznacza, że oczekuje się proaktywnego podejścia i inicjatywy w usprawnianiu systemu, a nie tylko reagowania na problemy.
🟡
work closely with the engineering and product teams
Wskazuje na potrzebę dobrej komunikacji i współpracy z innymi działami, co jest standardem w zespołach IT.
🟢
making sure the platform scales smoothly to handle peak tr
Podkreśla kluczową odpowiedzialność za zapewnienie stabilności i wydajności systemu podczas największego obciążenia.