Bulldogjob Praca zdalna Senior

Senior Solutions Architect – Large Scale AI Inference

NVIDIA

From 24 300 PLN (UoP)

Wymagania

  • głębokie doświadczenie w produkcyjnej inferencji AI na dużą skalę
  • doświadczenie w architektowaniu pipeline'ów inferencji dla modeli MoE (dense i sparse/latent)
  • znajomość technik optymalizacji inferencji (kwantyzacja INT4/FP8, speculative decoding, KV cache, disaggregated prefill/decode)
  • doświadczenie w pracy z klastrami multi-node GPU i optymalizacją komunikacji (NVLink, InfiniBand, RDMA)
  • doświadczenie w bezpośrednim wsparciu technicznym klientów enterprise

Opis stanowiska

Rola w NVIDIA przy wdrażaniu i optymalizacji wielkoskalowych workloadów inferencji AI na klastrach multi-node GPU dla klientów EMEA. Będziesz architektować pipeline'y inferencji dla modeli MoE, optymalizować wydajność (kwantyzacja INT4/FP8, speculative decoding, zarządzanie KV cache) i współpracować z zespołami produktowymi NVIDIA (Dynamo, TensorRT-LLM, NIXL). To oferta dla osoby z głębokim doświadczeniem w produkcyjnej inferencji AI na dużą skalę, gotowej na rozwiązywanie nierozwiązanych problemów i pracę pod presją. Uwaga: rola wymaga bezpośredniego doradzania klientom w bardzo złożonych procesach, co wiąże się z dużą odpowiedzialnością i zarządzaniem oczekiwaniami.

🔍 Dekoder Ogłoszenia

🔴
deep experience in large-scale production AI inference
Oczekuje się, że kandydat posiada bardzo rozległą i praktyczną wiedzę w zakresie wdrażania i optymalizacji systemów wnioskowania AI na dużą skalę w środowiskach produkcyjnych, co może oznaczać konieczność radzenia sobie z bardzo złożonymi i krytycznymi problemami.
🔴
collaborate with top EMEA AI Natives, AI infrastructure providers, and enterprises deploying AI at scale
Praca będzie wymagała interakcji z kluczowymi graczami na rynku AI, co może oznaczać dużą presję i potrzebę szybkiego dostosowywania się do różnych wymagań i technologii.
🔴
address the industry's toughest AI inference challenges
Rola będzie polegała na rozwiązywaniu najbardziej skomplikowanych i nierozwiązanych problemów w dziedzinie wnioskowania AI, co może wymagać innowacyjnego myślenia i pracy nad problemami, dla których nie ma jeszcze gotowych rozwiązań.
🔴
Guide EMEA AI Natives customers in deploying and optimizing large-scale inference workloads
Oznacza to, że kandydat będzie odpowiedzialny za bezpośrednie doradzanie i wspieranie klientów w bardzo złożonych procesach, co może wiązać się z dużą odpowiedzialnością i koniecznością zarządzania oczekiwaniami.
🟡
Animate the AI inference developer’s community across EMEA
Oczekuje się aktywnego zaangażowania w budowanie i rozwijanie społeczności, co może oznaczać potrzebę poświęcania czasu na działania poza ścisłymi obowiązkami technicznymi, takie jak organizacja wydarzeń czy tworzenie materiałów.