Senior LLM Inference Engineer – Distributed AI Serving

Il y a 2 jours

Bezons, Île-de-France Atos SE Temps plein 120 000 € - 190 000 € Contrat

Bull recherche un Staff/Principal LLM Inference Engineer pour piloter la pile d'inférence BullSequana AI et son intégration hardware. Vous dirigerez des architectures d'inférence natives Kubernetes, avec du déploiement multi-nœuds et des pipelines multimodaux sur des infrastructures souveraines sur site, cloud ou hybride.

Le rôle combine leadership technique et travail hands-on, en collaboration avec Data, IA, Foundation et le hardware, visant à réduire le coût par token et la latence tout en