Stage de 6 mois

Il y a 2 jours

Fresnes, Ile-de-France OVHai LLM Temps plein
Chez OVHai LLM, nous développons de grands modèles de langage (LLM) et concevons des plateformes et des services autour de ces modèles pour des cas d'usage spécifiques. Nous sommes une équipe soudée de 15 chercheurs et ingénieurs, unis par la curiosité et par l'envie commune de repousser les limites de ce que les LLM peuvent accomplir, de l'entraînement et du fine-tuning à l'évaluation et au benchmarking rigoureux. Notre équipe est réellement diverse et multiculturelle, réunissant des parcours, des points de vue et des façons de penser différents. Cette diversité est au cœur de notre manière de travailler : nous sommes convaincus que la meilleure recherche naît d'équipes qui se challengent mutuellement et apprennent les unes des autres au quotidien. Nous prenons notre travail au sérieux, mais pas nous-mêmes. Attendez-vous à un environnement collaboratif où les egos ont peu de place, à de nombreux débats passionnants, à des déjeuners partagés et à beaucoup de bonne humeur, ainsi qu'à de réelles opportunités de contribuer dès le premier jour à la recherche de pointe sur les LLM. Rôle
• L'objectif de ce stage de 6 mois au sein d'OVHai LLM est de concevoir et de construire un pipeline CI/CD pour une plateforme d'IA. Les missions seront définies au cours du stage.
• Vous travaillerez sur la problématique du CI/CD appliquée aux applications d'IA : concevoir un workflow de mise en production qui bloque les régressions de comportement, et pas seulement les régressions de code.
• Vous mettrez également fortement l'accent sur les données, en constituant un jeu de données qui maintienne pertinence du pipeline vis-à-vis du domaine d'application. Présentation du stage
• Stage encadré par l'équipe LLM Engineering d'OVHai
• Stage de 6 mois à Paris (100 % sur site)
• Temps plein, 35 heures par semaine
• Date de début : octobre 2026 Missions
• Concevoir un pipeline CI/CD pour la plateforme Verto, en priorité pour l'application RAG
• Identifier les métriques réellement déterminantes pour décider si un prompt, un modèle, une mise à jour du retrieval ou une application d'IA candidate peut être promu(e) en production en toute sécurité
• Définir une stratégie de données et constituer le jeu de données correspondant
• Construire le pipeline
• Publier en interne les métriques obtenues

Profil recherché
• Étudiant(e) en Master (Bac+4/5) en informatique, apprentissage automatique (machine learning) ou traitement automatique du langage naturel (TALN)
• Expérience avec les LLM (projets académiques ou personnels) (indispensable)
• Expérience avec la bibliothèque Hugging Face (indispensable)
• Anglais et français courant (aussi bien à l’oral qu’à l’écrit) Avantages
• Tickets restaurant
• Un environnement innovant et bienveillant, à la pointe des avancées en IA Le processus de recrutement
• Un appel de présentation de 15 minutes avec notre équipe d'ingénierie pour échanger sur le poste
• Un entretien et une étude de cas technique avec deux membres de notre équipe de recherche (à distance ou en présentiel)
• Un entretien RH pour évaluer les soft skills (en présentiel, dans nos locaux parisiens)
• Une séance de débriefing