Senior LLM Inference Architect
Enregistrez cette offre et organisez votre recherche
Créez un compte gratuit pour enregistrer des offres d'emploi, créer des alertes et revenir à cette liste depuis votre tableau de bord.
Bull recherche un(e) Staff / Principal LLM Inference Engineer pour piloter l'inférence LLM sur BullSequana AI. Vous travaillerez sur une pile Kubernetes-native, l'inférence distribuée et l'intégration avec le matériel BullSequana, en collaboration avec les équipes Data, Services IA et Foundation.
Le rôle exige une expertise pointue en serving de modèles ML/AI à grande échelle, avec une orientation vers la réduction des coûts par token et la latence, tout en assurant des déploiements sécurisés en