Site Reliability Engineer
Il y a 2 jours
Paris, Ile-de-France
Temps plein
Gratuit avec email ou Google
Enregistrez cette offre et organisez votre recherche
Créez un compte gratuit pour enregistrer des offres d'emploi, créer des alertes et revenir à cette liste depuis votre tableau de bord.
Gratuit avec email ou Google
En continuant, vous acceptez nos Conditions d’utilisation & Politique de confidentialité.
Au sein de votre équipe #OneTeam Chaque appel aux API du Public Cloud OVHcloud passe par les services opérés par votre future équipe.
L’équipe est notamment responsable de OpenStack Keystone, le service d’identité du Public Cloud qui assure l’authentification des appels API, ainsi que des mécanismes de contrôle permettant de vérifier, à l’entrée, que chaque utilisateur ou service dispose des droits nécessaires. Ces composants se situent sur un chemin critique : leur disponibilité conditionne directement celle du Public Cloud et leur niveau de sécurité est essentiel à la protection de la plateforme. Keystone est intégré à l’IAM d’OVHcloud, opéré par une autre équipe. L’un des principaux enjeux consiste donc à assurer une intégration fiable, sécurisée et scalable entre ces différents systèmes d’identité à l’échelle du Public Cloud. Dans une logique de séparation des responsabilités, l’équipe est indépendante des équipes exploitant directement les infrastructures : les équipes qui définissent et contrôlent les accès ne sont pas celles qui administrent les ressources auxquelles ces accès donnent droit. En tant que SRE Senior, votre expertise portera principalement sur Keystone, l’Identity & Access Management et le contrôle d’accès aux API. Vous contribuerez à la fiabilité, à la sécurité et à l’évolution de services distribués critiques utilisés à grande échelle. Une astreinte 24/7 est assurée par rotation au sein de l’équipe et fait l’objet d’une contrepartie selon les dispositions en vigueur chez OVHcloud. Vos principales responsabilités
* Opérer et fiabiliser OpenStack Keystone dans un environnement Public Cloud distribué à grande échelle.
* Garantir la haute disponibilité, la cohérence multi-régions et la performance du service sur le chemin critique d’authentification.
* Concevoir et réaliser des migrations et évolutions sans interruption de service.
* Faire évoluer les modèles d’authentification et d’autorisation : permissions fines, scopes projet, domaine et région, RBAC et fédération d’identité.
* Assurer l’intégration et la fédération d’identité entre Keystone et l’IAM d’OVHcloud.
* Industrialiser les politiques d’autorisation à travers des approches de Policy as Code, des tests automatisés et des mécanismes de non-régression.
* Contribuer à la sécurisation des API, notamment à travers le filtrage applicatif, le WAF, le rate limiting et la détection des menaces.
* Définir, suivre et améliorer les SLO des services opérés.
* Participer au run et à l’astreinte, analyser les incidents et contribuer aux analyses de causes racines.
* Automatiser les opérations récurrentes afin d’améliorer la fiabilité, la sécurité et l’efficacité opérationnelle.
* Développer et maintenir les composants de la stack en Python et Go.
* Concevoir et maintenir les infrastructures et configurations as code avec notamment Terraform et Helm.
* Maintenir des standards DevOps élevés en matière de qualité de code, tests, CI/CD, documentation, sécurité et traçabilité.
* Contribuer à l’amélioration continue des pratiques techniques et accompagner la montée en compétences de l’équipe. Votre futur impact Dans les 6 mois
* Maîtrise du périmètre : comprendre l’architecture de Keystone, son intégration avec l’IAM OVHcloud et les mécanismes de contrôle d’accès aux API.
* Autonomie : être autonome sur la stack et capable d’intervenir efficacement sur les services en production.
* Astreinte : participer sereinement à la rotation d’astreinte et prendre en charge les incidents sur votre périmètre.
* Fiabilité : avoir mené un premier chantier significatif de fiabilisation, de résilience ou de durcissement de Keystone.
* Sécurité : maîtriser les principaux modèles d’authentification, d’autorisation et de fédération utilisés par la plateforme.
* DevOps : contribuer de manière autonome aux déploiements, automatisations et pipelines de la stack avec Terraform, Helm et les outils CI/CD.
* Collaboration : avoir établi des relations de travail efficaces avec les équipes IAM, sécurité, infrastructure et Public Cloud. Dans 1 an
* Expertise : être reconnu comme un référent interne sur OpenStack Keystone et les problématiques d’identité du Public Cloud.
* SLO : délivrer de manière prédictible tout en garantissant les objectifs de disponibilité, de performance et de fiabilité des services.
* Sécurité des API : être un appui technique solide sur les problématiques d’authentification, d’autorisation et de sécurisation des API.
* Résilience : contribuer directement à l’amélioration de la haute disponibilité et de la résilience des services critiques d’identité.
* Industrialisation : avoir renforcé l’automatisation des politiques, des tests de sécurité et des mécanismes de contrôle d’accès.
* Leadership technique : challenger les choix d’architecture et contribuer aux orientations techniques de l’équipe.
* Transmission : faire grandir l’équipe à travers le mentoring, le partage de connaissances et l’amélioration des standards d’ingénierie.
* Amélioration con
L’équipe est notamment responsable de OpenStack Keystone, le service d’identité du Public Cloud qui assure l’authentification des appels API, ainsi que des mécanismes de contrôle permettant de vérifier, à l’entrée, que chaque utilisateur ou service dispose des droits nécessaires. Ces composants se situent sur un chemin critique : leur disponibilité conditionne directement celle du Public Cloud et leur niveau de sécurité est essentiel à la protection de la plateforme. Keystone est intégré à l’IAM d’OVHcloud, opéré par une autre équipe. L’un des principaux enjeux consiste donc à assurer une intégration fiable, sécurisée et scalable entre ces différents systèmes d’identité à l’échelle du Public Cloud. Dans une logique de séparation des responsabilités, l’équipe est indépendante des équipes exploitant directement les infrastructures : les équipes qui définissent et contrôlent les accès ne sont pas celles qui administrent les ressources auxquelles ces accès donnent droit. En tant que SRE Senior, votre expertise portera principalement sur Keystone, l’Identity & Access Management et le contrôle d’accès aux API. Vous contribuerez à la fiabilité, à la sécurité et à l’évolution de services distribués critiques utilisés à grande échelle. Une astreinte 24/7 est assurée par rotation au sein de l’équipe et fait l’objet d’une contrepartie selon les dispositions en vigueur chez OVHcloud. Vos principales responsabilités
* Opérer et fiabiliser OpenStack Keystone dans un environnement Public Cloud distribué à grande échelle.
* Garantir la haute disponibilité, la cohérence multi-régions et la performance du service sur le chemin critique d’authentification.
* Concevoir et réaliser des migrations et évolutions sans interruption de service.
* Faire évoluer les modèles d’authentification et d’autorisation : permissions fines, scopes projet, domaine et région, RBAC et fédération d’identité.
* Assurer l’intégration et la fédération d’identité entre Keystone et l’IAM d’OVHcloud.
* Industrialiser les politiques d’autorisation à travers des approches de Policy as Code, des tests automatisés et des mécanismes de non-régression.
* Contribuer à la sécurisation des API, notamment à travers le filtrage applicatif, le WAF, le rate limiting et la détection des menaces.
* Définir, suivre et améliorer les SLO des services opérés.
* Participer au run et à l’astreinte, analyser les incidents et contribuer aux analyses de causes racines.
* Automatiser les opérations récurrentes afin d’améliorer la fiabilité, la sécurité et l’efficacité opérationnelle.
* Développer et maintenir les composants de la stack en Python et Go.
* Concevoir et maintenir les infrastructures et configurations as code avec notamment Terraform et Helm.
* Maintenir des standards DevOps élevés en matière de qualité de code, tests, CI/CD, documentation, sécurité et traçabilité.
* Contribuer à l’amélioration continue des pratiques techniques et accompagner la montée en compétences de l’équipe. Votre futur impact Dans les 6 mois
* Maîtrise du périmètre : comprendre l’architecture de Keystone, son intégration avec l’IAM OVHcloud et les mécanismes de contrôle d’accès aux API.
* Autonomie : être autonome sur la stack et capable d’intervenir efficacement sur les services en production.
* Astreinte : participer sereinement à la rotation d’astreinte et prendre en charge les incidents sur votre périmètre.
* Fiabilité : avoir mené un premier chantier significatif de fiabilisation, de résilience ou de durcissement de Keystone.
* Sécurité : maîtriser les principaux modèles d’authentification, d’autorisation et de fédération utilisés par la plateforme.
* DevOps : contribuer de manière autonome aux déploiements, automatisations et pipelines de la stack avec Terraform, Helm et les outils CI/CD.
* Collaboration : avoir établi des relations de travail efficaces avec les équipes IAM, sécurité, infrastructure et Public Cloud. Dans 1 an
* Expertise : être reconnu comme un référent interne sur OpenStack Keystone et les problématiques d’identité du Public Cloud.
* SLO : délivrer de manière prédictible tout en garantissant les objectifs de disponibilité, de performance et de fiabilité des services.
* Sécurité des API : être un appui technique solide sur les problématiques d’authentification, d’autorisation et de sécurisation des API.
* Résilience : contribuer directement à l’amélioration de la haute disponibilité et de la résilience des services critiques d’identité.
* Industrialisation : avoir renforcé l’automatisation des politiques, des tests de sécurité et des mécanismes de contrôle d’accès.
* Leadership technique : challenger les choix d’architecture et contribuer aux orientations techniques de l’équipe.
* Transmission : faire grandir l’équipe à travers le mentoring, le partage de connaissances et l’amélioration des standards d’ingénierie.
* Amélioration con