Senior AI Inference Systems Engineer – GPU-Optimized ML
Enregistrez cette offre et organisez votre recherche
Créez un compte gratuit pour enregistrer des offres d'emploi, créer des alertes et revenir à cette liste depuis votre tableau de bord.
En continuant, vous acceptez nos Conditions d’utilisation & Politique de confidentialité.
NVIDIA in France is seeking a senior ML systems engineer to advance large-scale AI inference on GPU hardware. You will contribute features to vLLM, optimize inference pipelines, and help push the pareto frontier of performance.
You’ll design and benchmark GPU kernels, build high-level DSLs, and orchestrate containerized deployments on GPU clusters across clouds. Strong Python/C++ skills and deep knowledge of ML systems are required.