Bulldogjob Praca zdalna Senior

ML Ops Engineer

Pragmatike

Do uzgodnienia

Wymagania

  • doświadczenie w produkcyjnym serwowaniu modeli ML (vLLM, TGI, Triton lub podobne)
  • doświadczenie z rozproszonymi systemami GPU
  • doświadczenie w projektowaniu pipeline'ów wdrożeniowych (blue/green, canary)
  • doświadczenie z systemami auto-skalowania i architekturą multi-model serving
  • doświadczenie w zarządzaniu rejestrami modeli i pipeline'ami CI/CD dla ML
  • gotowość do pełnienia dyżurów on-call i wsparcia operacyjnego

Opis stanowiska

Rola w firmie budującej zdecentralizowaną infrastrukturę chmurową z GPU dla obciążeń AI/ML, gdzie odpowiadasz za produkcyjne serwowanie modeli (vLLM, TGI, Triton) i infrastrukturę wnioskowania na dużą skalę. Będziesz projektować pipeline'y wdrożeniowe z blue/green i canary, systemy auto-skalowania, multi-model serving oraz optymalizować wykorzystanie GPU i pamięci. Oferta dla inżyniera z produkcyjnym podejściem i doświadczeniem z rozproszonymi systemami GPU, który chce pracować w szybko rosnącym startupie i pełnić odpowiedzialność on-call.

🔍 Dekoder Ogłoszenia

✓ Ogłoszenie wygląda transparentnie — brak typowych czerwonych flag.