Senior LLM Inference Architect

Il y a 3 jours

Valbonne, Provence-Alpes-Côte d'Azur, France Bull Temps plein 120 000 € - 150 000 € Contrat

Bull recherche un(e) Staff / Principal LLM Inference Engineer pour piloter l'inférence LLM sur BullSequana AI. Vous travaillerez sur une pile Kubernetes-native, l'inférence distribuée et l'intégration avec le matériel BullSequana, en collaboration avec les équipes Data, Services IA et Foundation.

Le rôle exige une expertise pointue en serving de modèles ML/AI à grande échelle, avec une orientation vers la réduction des coûts par token et la latence, tout en assurant des déploiements sécurisés en