Ingénieur LLMOps
Il y a 2 jours
SaintDenis, Ile-de-France
ASTEINS
Temps plein
Gratuit avec email ou Google
Enregistrez cette offre et organisez votre recherche
Créez un compte gratuit pour enregistrer des offres d'emploi, créer des alertes et revenir à cette liste depuis votre tableau de bord.
Gratuit avec email ou Google
En continuant, vous acceptez nos Conditions d’utilisation & Politique de confidentialité.
Asteins recherche un ingénieur LLMOps / MLOps H/F pour accompagner un acteur majeur du secteur ferroviaire dans l’industrialisation d’une plateforme d’intelligence artificielle. Votre mission Vous industrialisez l'exposition des modèles aux agents :
* Mettre en œuvre les services d'inférence et les interfaces d'accès aux modèles
* Structurer le routage entre modèles, les quotas, les timeouts et les stratégies de fallback
* Administrer les versions de modèles, les endpoints et les paramètres de génération
* Contribuer aux choix d'hébergement : GPU, Kubernetes, services managés ou déploiement interne
* Mesurer latence, débit, taux d'erreur, consommation GPU et coût des appels
* Construire les dashboards et alertes associés
* Optimiser l'inférence : paramètres, mise en cache, batch
* Mettre en place la traçabilité des versions de modèles utilisées par les agents
* Contribuer aux gates de validation avant exposition d'un modèle à un cas d'usage
* Documenter les standards LLMOps, les procédures de changement et de rollback
* Collaborer avec le data scientist, le SRE et les équipes métier
* Vous avez une expérience concrète dans l’exploitation de plateformes IA en production, avec :
* Plus de 5 ans d’expérience sur Kubernetes et le déploiement applicatif.
* Plus de 2 ans d’expérience en LLMOps / MLOps, services d’inférence et API.
* Plus de 2 ans d’expérience sur le dimensionnement et l’optimisation GPU.
* Une maîtrise de Python et de l’écosystème IA.
* Une expérience en observabilité, gestion des versions et gouvernance des modèles.
* Une bonne connaissance des contraintes de sécurité et d’exploitation. Rigueur, autonomie, capacité d’analyse et aisance relationnelle sont essentielles pour travailler avec les équipes d’architecture, de développement, d’exploitation et de sécurité. ASTEINS est une entreprise de services du numérique à taille humaine spécialisée dans les métiers de l'IT, de l'ingénierie et des télécommunications. Nous accompagnons nos clients sur des projets stratégiques à forte valeur ajoutée en mettant l'expertise technique, l'engagement et la proximité au cœur de notre approche.
* Mettre en œuvre les services d'inférence et les interfaces d'accès aux modèles
* Structurer le routage entre modèles, les quotas, les timeouts et les stratégies de fallback
* Administrer les versions de modèles, les endpoints et les paramètres de génération
* Contribuer aux choix d'hébergement : GPU, Kubernetes, services managés ou déploiement interne
* Mesurer latence, débit, taux d'erreur, consommation GPU et coût des appels
* Construire les dashboards et alertes associés
* Optimiser l'inférence : paramètres, mise en cache, batch
* Mettre en place la traçabilité des versions de modèles utilisées par les agents
* Contribuer aux gates de validation avant exposition d'un modèle à un cas d'usage
* Documenter les standards LLMOps, les procédures de changement et de rollback
* Collaborer avec le data scientist, le SRE et les équipes métier
* Vous avez une expérience concrète dans l’exploitation de plateformes IA en production, avec :
* Plus de 5 ans d’expérience sur Kubernetes et le déploiement applicatif.
* Plus de 2 ans d’expérience en LLMOps / MLOps, services d’inférence et API.
* Plus de 2 ans d’expérience sur le dimensionnement et l’optimisation GPU.
* Une maîtrise de Python et de l’écosystème IA.
* Une expérience en observabilité, gestion des versions et gouvernance des modèles.
* Une bonne connaissance des contraintes de sécurité et d’exploitation. Rigueur, autonomie, capacité d’analyse et aisance relationnelle sont essentielles pour travailler avec les équipes d’architecture, de développement, d’exploitation et de sécurité. ASTEINS est une entreprise de services du numérique à taille humaine spécialisée dans les métiers de l'IT, de l'ingénierie et des télécommunications. Nous accompagnons nos clients sur des projets stratégiques à forte valeur ajoutée en mettant l'expertise technique, l'engagement et la proximité au cœur de notre approche.