JustJoin.IT Praca zdalna Senior

Site Reliability Engineer

Transition Technologies MS

⚲ Warszawa

Do uzgodnienia

Wymagania

  • doświadczenie w SRE, DevOps, Platform Engineering lub Cloud Infrastructure
  • mocne praktyczne doświadczenie z AWS
  • udokumentowane doświadczenie z Terraform i IaC
  • doświadczenie w projektowaniu i utrzymaniu pipeline'ów CI/CD
  • biegłość w skryptowaniu/programowaniu w Python, Bash lub podobnych
  • doświadczenie w administracji i troubleshootingu środowisk Linux
  • doświadczenie we wdrażaniu rozwiązań monitoring/logging/observability

Mile widziane

  • doświadczenie z Kubernetes lub innymi technologiami orkiestracji kontenerów

Opis stanowiska

Rola SRE odpowiedzialna za budowę i utrzymanie niezawodnej, skalowalnej i bezpiecznej platformy chmurowej na AWS — projektowanie infrastruktury, IaC w Terraform, automatyzacja provisioningu i workflow operacyjnych, optymalizacja CI/CD oraz observability (monitoring, logowanie, tracing, alerting). Będziesz też prowadzić incident response, troubleshooting i post-incident reviews oraz promować praktyki SRE/DevOps w zespołach. Uwaga: decoder ostrzega, że rola może obejmować gaszenie pożarów poza godzinami pracy oraz pracę nad optymalizacją istniejących, potencjalnie nieefektywnych procesów.

🔍 Dekoder Ogłoszenia

🔴
help build and operate a reliable, scalable, and secure cloud platform
Może oznaczać zarówno budowanie od podstaw, jak i utrzymanie istniejącej, potencjalnie problematycznej platformy.
🔴
work closely with cross-functional engineering teams
Może oznaczać konieczność częstych interakcji i rozwiązywania problemów innych zespołów, co może być czasochłonne.
🔴
automate infrastructure provisioning, configuration management, and operational workflows
Często oznacza konieczność tworzenia i utrzymywania narzędzi automatyzujących, które nie istnieją lub są w złym stanie.
🔴
Lead incident response, troubleshooting, root cause analysis, and post-incident reviews
Może oznaczać bycie główną osobą do gaszenia pożarów w nocy i weekendy, z naciskiem na szybkie rozwiązywanie problemów.
🔴
Reduce operational overhead through automation and continuous process improvement
Może sugerować, że obecne procesy są nieefektywne i wymagają znaczącej optymalizacji, co może być trudnym zadaniem.