Site Reliability Engineer
Enregistrez cette offre et organisez votre recherche
Créez un compte gratuit pour enregistrer des offres d'emploi, créer des alertes et revenir à cette liste depuis votre tableau de bord.
Modulotech accélère et nos enjeux techniques évoluent avec nous. À mesure que nos produits et nos usages grandissent, notre infrastructure doit suivre : être plus robuste, plus observable, plus simple à faire évoluer… et mieux maîtrisée en termes de coûts.
Nous avons aujourd’hui une infrastructure principalement hébergée sur AWS, des environnements de production qui continuent de se structurer, et plusieurs chantiers à mener autour de notre architecture, de notre CI/CD et de l’optimisation de nos ressources.
L’enjeu est double : continuer à stabiliser notre production tout en réduisant le coût et la complexité de notre infrastructure.
C’est dans ce contexte que nous recrutons un(e) Site Reliability Engineer (SRE) pour renforcer notre équipe technique.
Tu travailleras aux côtés de notre DevOps déjà présent et de l’ensemble de l’équipe de développement.
Chez Modulotech, la technique est toujours au service du produit et de l’expérience utilisateur. Une infrastructure performante est une infrastructure que nos utilisateurs ne remarquent pas : stable, rapide et disponible.
À ce titre, tu seras amené(e) à :
Fiabilité & Production :
- Améliorer la stabilité, la résilience et la disponibilité de nos environnements de production.
- Identifier les principaux points de fragilité de notre infrastructure et construire les plans d’action associés.
- Faire évoluer notre observabilité : monitoring, logs, métriques, alerting et capacité à diagnostiquer rapidement les incidents.
- Structurer nos pratiques autour des incidents : analyse des causes racines, post-mortems et actions préventives.
- Définir et suivre les bons indicateurs de fiabilité (SLI/SLO) afin de piloter la qualité de notre production dans la durée.
- Automatiser les opérations répétitives et réduire progressivement le travail manuel nécessaire au maintien de la plateforme.
Infrastructure & AWS :
- Participer à la définition et à l’exécution de nos prochains chantiers de migration et d’évolution sur AWS.
- Challenger l’architecture existante et proposer des évolutions pragmatiques en fonction de nos besoins.
- Sécuriser les migrations et changements d’infrastructure sans dégrader la qualité de service.
- Améliorer notre Infrastructure as Code et notre capacité à déployer des environnements fiables et reproductibles.
- Travailler avec notre DevOps et les développeurs pour faire évoluer les bonnes pratiques infrastructure au sein de l’équipe.
Performance & FinOps :
- Analyser notre consommation AWS et identifier les principaux postes de coûts.
- Détecter les ressources surdimensionnées, inutilisées ou pouvant être remplacées par des solutions plus adaptées.
- Optimiser notre architecture en recherchant le bon équilibre entre coût, performance et résilience.
- Mettre en place les métriques et outils nécessaires pour suivre l’évolution de nos coûts d’infrastructure.
- Faire de l’optimisation cloud un sujet continu plutôt qu’un chantier ponctuel lorsque la facture augmente.
CI/CD & Developer Experience :
- Améliorer la fiabilité et les performances de nos pipelines CI/CD.
- Réduire les temps de build, de test et de déploiement lorsque cela est pertinent.
- Identifier les principaux coûts liés à notre CI et mettre en place les optimisations nécessaires.
- Fluidifier l’expérience des développeurs lorsqu’ils déploient, investiguent ou interviennent sur la production.
- Renforcer progressivement l’automatisation et la sécurité de nos mises en production.
Responsabilités clés :
- Être un référent technique sur les sujets de fiabilité et d’infrastructure.
- Faire progresser la stabilité de notre production de manière mesurable.
- Piloter avec l’équipe les principaux chantiers d’évolution et de migration de notre infrastructure AWS.
- Réduire et maîtriser durablement nos coûts cloud et CI/CD.
- Travailler en binôme avec notre DevOps et diffuser les bonnes pratiques SRE auprès de l’équipe de développement.
- Savoir arbitrer entre robustesse, performance, simplicité et coût sans tomber dans la sur-ingénierie.
Afin de te projeter dans le poste, nous te proposons un petit système d’auto-évaluation.Attribue-toi les points correspondant à ton profil.Expérience significative en SRE, Platform Engineering ou DevOps sur des environnements de production exigeants (+3 points)Très bonne maîtrise d’AWS et expérience concrète d’évolution ou de migration d’infrastructures en production (+3 points)Expérience solide sur les sujets de fiabilité : observabilité, monitoring, incident management, SLI/SLO et analyse des causes racines (+2 points)Maîtrise de l’Infrastructure as Code, notamment Terraform ou équivalent (+2 point