Principal LLM Inference Engineer Architecting Sovereign AI

Il y a 4 jours

Valbonne, Provence-Alpes-Côte d'Azur, France Atos Temps plein 120 000 € - 190 000 € Contrat

Bull recherche un Staff / Principal LLM Inference Engineer pour piloter la pile d'inférence BullSequana AI et son intégration avec la plateforme matérielle BullSequana. Vous contribuerez à un serving LLM natif Kubernetes, déployé sur des infrastructures souveraines et hybrides, en collaboration avec Data, IA, et équipes hardware.

Le rôle allie influence architecturale et exécution hands-on, avec un impact direct sur le coût par token et la latence, tout en garantissant la fiabilité et la