AI Infrastructure Engineer (GPU) - Remote EMEA
⚲ Dubai
Do uzgodnienia
Wymagania
- doświadczenie w budowie produkcyjnej infrastruktury do serwowania modeli (vLLM, TGI, Triton lub podobne)
- doświadczenie z rozproszonymi systemami GPU
- doświadczenie w projektowaniu pipeline'ów wdrożeniowych (blue/green, canary) dla modeli ML
- doświadczenie w optymalizacji wykorzystania GPU, pamięci i przepustowości sieci
- doświadczenie w zarządzaniu model registry i pipeline'ami CI/CD dla modeli
- gotowość do pełnej odpowiedzialności operacyjnej, w tym on-call
Opis stanowiska
Praca przy infrastrukturze do serwowania modeli ML w firmie budującej rozproszoną chmurę GPU dla workloadów AI. Rola jest w pełni techniczna i produkcyjna: budowa i utrzymanie model serving (vLLM, TGI, Triton), pipeline'y wdrożeniowe z blue/green i canary, autoskalowanie, optymalizacja wykorzystania GPU oraz observability inferencji. To oferta dla inżyniera z doświadczeniem w rozproszonych systemach GPU, gotowego na pełną odpowiedzialność operacyjną, w tym on-call. Praca zdalna z EMEA.
🔍 Dekoder Ogłoszenia
✓ Ogłoszenie wygląda transparentnie — brak typowych czerwonych flag.