ML Ops Engineer
Do uzgodnienia
Wymagania
- doświadczenie w produkcyjnym serwowaniu modeli ML (vLLM, TGI, Triton lub podobne)
- doświadczenie z rozproszonymi systemami GPU
- doświadczenie w projektowaniu pipeline'ów wdrożeniowych (blue/green, canary)
- doświadczenie z systemami auto-skalowania i architekturą multi-model serving
- doświadczenie w zarządzaniu rejestrami modeli i pipeline'ami CI/CD dla ML
- gotowość do pełnienia dyżurów on-call i wsparcia operacyjnego
Opis stanowiska
Rola w firmie budującej zdecentralizowaną infrastrukturę chmurową z GPU dla obciążeń AI/ML, gdzie odpowiadasz za produkcyjne serwowanie modeli (vLLM, TGI, Triton) i infrastrukturę wnioskowania na dużą skalę. Będziesz projektować pipeline'y wdrożeniowe z blue/green i canary, systemy auto-skalowania, multi-model serving oraz optymalizować wykorzystanie GPU i pamięci. Oferta dla inżyniera z produkcyjnym podejściem i doświadczeniem z rozproszonymi systemami GPU, który chce pracować w szybko rosnącym startupie i pełnić odpowiedzialność on-call.
🔍 Dekoder Ogłoszenia
✓ Ogłoszenie wygląda transparentnie — brak typowych czerwonych flag.