Bulldogjob Praca zdalna Senior

Senior Solutions Architect – Diffusion AI Models

NVIDIA

From 24 300 PLN (UoP)

Wymagania

  • głęboka ekspertyza w treningu i optymalizacji inferencji modeli dyfuzyjnych na dużą skalę
  • znajomość architektur modeli dyfuzyjnych (DiT, UNet, flow matching)
  • doświadczenie w efektywnym wdrażaniu modeli w środowiskach single i multi-GPU
  • umiejętność identyfikacji wąskich gardeł wydajnościowych w workloadach wizyjnych
  • doświadczenie w pracy z klientami AI Native przy wdrażaniu pipeline'ów generatywnych

Opis stanowiska

Rola w NVIDIA jako techniczny pomost między platformą generatywnej AI a produkcyjnymi pipeline'ami klientów z EMEA budujących produkty do generowania obrazu, wideo i multimodalnych doświadczeń. Będziesz doradzać w zakresie architektur modeli dyfuzyjnych (DiT, UNet, flow matching), optymalizować pipeline'y generacji i identyfikować wąskie gardła wydajnościowe (pamięć, skalowanie attention, komunikacja multi-GPU). To oferta dla osoby z głęboką wiedzą o modelach dyfuzyjnych i doświadczeniem w ich wdrażaniu na dużą skalę. Uwaga: to rola hands-on — oczekuje się aktywnego wdrażania rozwiązań i rozwiązywania problemów technicznych, a nie tylko doradztwa.

🔍 Dekoder Ogłoszenia

🔴
hands-on technical bridge between NVIDIA's generative AI platform and the industry's most demanding production pipelines
Oczekuje się, że będziesz aktywnie wdrażać rozwiązania i rozwiązywać problemy techniczne, a nie tylko doradzać.
🟡
customers unlock the full potential of NVIDIA's accelerated computing stack
Twoja praca będzie polegać na optymalizacji istniejących rozwiązań klientów pod kątem sprzętu NVIDIA, a nie na tworzeniu od podstaw nowych technologii.
🟡
Guide EMEA AI Native companies
Będziesz pracować z klientami, którzy mogą mieć różne poziomy dojrzałości technologicznej i potrzebować wsparcia w podstawowych kwestiach.
🔴
Optimize generation pipelines for.
To zdanie jest niekompletne i sugeruje, że brakuje kluczowych informacji o konkretnych celach optymalizacji.
🟡
Identify performance bottlenecks specific to vision workloads: memory-bound diffusion steps, attention scaling with resolution, and multi-GPU communicati
Oczekuje się od Ciebie dogłębnej analizy technicznej i rozwiązywania złożonych problemów wydajnościowych w specyficznych obszarach.