Senior Solutions Architect – Diffusion AI Models
From 24 300 PLN (UoP)
Wymagania
- głęboka ekspertyza w treningu i optymalizacji inferencji modeli dyfuzyjnych na dużą skalę
- znajomość architektur modeli dyfuzyjnych (DiT, UNet, flow matching)
- doświadczenie w efektywnym wdrażaniu modeli w środowiskach single i multi-GPU
- umiejętność identyfikacji wąskich gardeł wydajnościowych w workloadach wizyjnych
- doświadczenie w pracy z klientami AI Native przy wdrażaniu pipeline'ów generatywnych
Opis stanowiska
Rola w NVIDIA jako techniczny pomost między platformą generatywnej AI a produkcyjnymi pipeline'ami klientów z EMEA budujących produkty do generowania obrazu, wideo i multimodalnych doświadczeń. Będziesz doradzać w zakresie architektur modeli dyfuzyjnych (DiT, UNet, flow matching), optymalizować pipeline'y generacji i identyfikować wąskie gardła wydajnościowe (pamięć, skalowanie attention, komunikacja multi-GPU). To oferta dla osoby z głęboką wiedzą o modelach dyfuzyjnych i doświadczeniem w ich wdrażaniu na dużą skalę. Uwaga: to rola hands-on — oczekuje się aktywnego wdrażania rozwiązań i rozwiązywania problemów technicznych, a nie tylko doradztwa.
🔍 Dekoder Ogłoszenia
🔴
hands-on technical bridge between NVIDIA's generative AI platform and the industry's most demanding production pipelines
Oczekuje się, że będziesz aktywnie wdrażać rozwiązania i rozwiązywać problemy techniczne, a nie tylko doradzać.
🟡
customers unlock the full potential of NVIDIA's accelerated computing stack
Twoja praca będzie polegać na optymalizacji istniejących rozwiązań klientów pod kątem sprzętu NVIDIA, a nie na tworzeniu od podstaw nowych technologii.
🟡
Guide EMEA AI Native companies
Będziesz pracować z klientami, którzy mogą mieć różne poziomy dojrzałości technologicznej i potrzebować wsparcia w podstawowych kwestiach.
🔴
Optimize generation pipelines for.
To zdanie jest niekompletne i sugeruje, że brakuje kluczowych informacji o konkretnych celach optymalizacji.
🟡
Identify performance bottlenecks specific to vision workloads: memory-bound diffusion steps, attention scaling with resolution, and multi-GPU communicati
Oczekuje się od Ciebie dogłębnej analizy technicznej i rozwiązywania złożonych problemów wydajnościowych w specyficznych obszarach.