JustJoin.IT Praca zdalna Senior

Senior SRE / DevOps Engineer (Kubernetes / A2P Messaging)

DNA Technology

⚲ Łódź

25 200 - 31 920 PLN netto (B2B)

Wymagania

  • doświadczenie w środowiskach telekomunikacyjnych, carrierskich, messagingowych lub innych opartych na trwałych połączeniach sieciowych
  • znajomość protokołów SMPP, SIP, SS7 lub podobnych
  • doświadczenie produkcyjne w obsłudze Kubernetes w środowiskach self-managed, on-premise lub podobnie infrastrukturowo wymagających (nie tylko managed cloud)
  • doświadczenie z workloadami stateful i długotrwałymi TCP na Kubernetes: connection draining, stabilny ingress/egress, Layer 4 load balancing, zachowanie podczas wdrożeń
  • mocne podstawy Linuksa i sieci — diagnostyka problemów z routingiem, NAT, firewall
  • gotowość do udziału w rotacji on-call 24×7 w fazie steady-state

Opis stanowiska

Budowa i utrzymanie infrastruktury nowej platformy messagingowej o wysokiej przepustowości (ok. 1 mln wiadomości dziennie, ~175 klientów, ~120 dostawców, ponad 300 długotrwałych połączeń). To nie jest typowe środowisko bezstanowe — kluczowe są długotrwałe sesje TCP, stabilne endpointy sieciowe i przewidywalne zachowanie podczas wdrożeń, awarii i skoków ruchu. Praca obejmuje dwa ośrodki infrastrukturalne, od budowy przez migrację i hypercare aż po stałą eksploatację. Uwaga: rekruter wprost pisze o budowaniu infrastruktury od zera i pełnej odpowiedzialności od klastra Kubernetes po reagowanie na incydenty — spodziewaj się dużego zakresu zadań, trudnych problemów niezawodnościowych oraz dyżurów 24×7 w fazie steady-state.

🔍 Dekoder Ogłoszenia

🔴
enjoy building infrastructure from the ground up
Będziesz musiał stworzyć i skonfigurować od zera znaczną część infrastruktury, co może oznaczać brak istniejących rozwiązań i dużą ilość pracy początkowej.
🔴
solving hard reliability problems
Spodziewaj się pracy nad złożonymi i trudnymi do rozwiązania problemami związanymi z niezawodnością systemu, które mogą wymagać niestandardowych podejść.
🔴
staying close to the systems you operate in production
Oznacza to, że będziesz odpowiedzialny za bieżące monitorowanie, reagowanie na incydenty i utrzymanie systemów w produkcji, co może wiązać się z dyżurami.
🔴
taking ownership from the Kubernetes cluster and networking layer through observability, deployment and incident response
Otrzymasz pełną odpowiedzialność za szeroki zakres zadań, od podstawowej infrastruktury po reakcję na awarie, co wymaga wszechstronnych umiejętności.
🟡
This is not a typical stateless web environment.
System wymaga specyficznych rozwiązań i podejścia do zarządzania, które odbiegają od standardowych praktyk dla aplikacji webowych.