T-Hub - AIOps Engineer - AI Infrastructure & Orchestration
⚲ Warszawa, Mokotów
25 000 – 35 000 zł / mies.
Wymagania
- min. 5 lat doświadczenia w DevOps, SRE, Platform Engineering lub Infrastructure Operations
- min. 2 lata praktycznego doświadczenia we wsparciu MLOps, infrastruktury AI lub platform LLM
- mocne doświadczenie w administracji Kubernetes i OpenShift w środowiskach produkcyjnych
- udokumentowane doświadczenie we wdrażaniu i utrzymaniu platform inferencyjnych opartych na vLLM w produkcji
- dogłębna znajomość technologii NVIDIA GPU, sterowników CUDA, NVIDIA Container Toolkit i troubleshootingu GPU
- praktyczne doświadczenie z Prometheus, Grafana, OpenTelemetry i ELK Stack
- mocne umiejętności programowania w Pythonie (automatyzacja i narzędzia operacyjne)
- doświadczenie z Bash scripting i administracją systemami Linux
Opis stanowiska
W T-Mobile (T-Hub) będziesz projektować, wdrażać i utrzymywać usługi inferencji vLLM na OpenShift/Kubernetes działające na bare-metalowej infrastrukturze GPU. Rola łączy SRE/DevOps z AI — zarządzasz zasobami NVIDIA GPU, automatyzujesz cykl życia modeli, budujesz observability (Prometheus, Grafana, OpenTelemetry) i dbasz o bezpieczeństwo oraz rozliczanie zużycia tokenów. To oferta dla inżyniera infrastruktury, który chce pracować blisko LLM-ów produkcyjnie, a nie tylko eksperymentalnie.
🔍 Dekoder Ogłoszenia
✓ Ogłoszenie wygląda transparentnie — brak typowych czerwonych flag.