Principal LLM Inference Engineer Architecting Sovereign AI
Enregistrez cette offre et organisez votre recherche
Créez un compte gratuit pour enregistrer des offres d'emploi, créer des alertes et revenir à cette liste depuis votre tableau de bord.
Bull recherche un Staff / Principal LLM Inference Engineer pour piloter la pile d'inférence BullSequana AI et son intégration avec la plateforme matérielle BullSequana. Vous contribuerez à un serving LLM natif Kubernetes, déployé sur des infrastructures souveraines et hybrides, en collaboration avec Data, IA, et équipes hardware.
Le rôle allie influence architecturale et exécution hands-on, avec un impact direct sur le coût par token et la latence, tout en garantissant la fiabilité et la