Ingénieur SysOps
Il y a 1 jour
Lille, Hauts-de-France
PROXIAD
Temps plein
Gratuit avec email ou Google
Enregistrez cette offre et organisez votre recherche
Créez un compte gratuit pour enregistrer des offres d'emploi, créer des alertes et revenir à cette liste depuis votre tableau de bord.
Gratuit avec email ou Google
En continuant, vous acceptez nos Conditions d’utilisation & Politique de confidentialité.
Bienvenue à bord de la galaxie Proxiad
Créée en 1997 et spécialisée dans les services numériques, Proxiad accompagne ses clients dans leurs projets innovants, grâce aux expertises de ses collaborateurs.
1200 salariés, répartis entre la France et l'étranger, développent chaque jour leur savoir-faire afin d'apporter de la valeur aux projets de nos entreprises partenaires.
Chez Proxiad, nous accordons une importance particulière à l'accompagnement de nos collaborateurs. Suivi RH personnalisé, proximité avec les équipes, montée en compétences, partage d'expertise... tout est mis en œuvre pour que chacun puisse évoluer dans un environnement stimulant.
Et parce que la convivialité fait aussi partie de notre ADN, nous organisons régulièrement des afterworks, meet-ups, événements techniques et moments d'équipe.
Côté avantages ? Une rémunération sur 12 mois, des titres-restaurant, une mutuelle familiale, une prime d'intéressement, un compte épargne-temps, une prime de cooptation ainsi que de nombreux avantages proposés par notre CSE.
Alors, envie de rejoindre l'aventure ?
Tu ne veux plus seulement traiter les incidents : tu souhaites construire une organisation Run robuste, automatisée et pilotée par l'observabilité ?
Nous recherchons un Ingénieur SysOps / Run & Reliability Senior H/F pour accompagner plusieurs produits digitaux critiques dans une phase de croissance et de transformation.
🚀 Le contexte
Tu occuperas un rôle de référent technique, sans management hiérarchique. Ta mission combinera la construction d'une stratégie Run, l'amélioration de l'observabilité, la résolution d'incidents complexes et l'accompagnement d'un ingénieur support plus junior.
🎯 Tes missions
Tes principales missions seront notamment de :
• Auditer l'organisation Run existante et identifier les points de fragilité.
• Définir, formaliser et automatiser le dispositif opérationnel multi-produits.
• Construire les processus de traitement, matrices d'escalade, indicateurs et objectifs de service.
• Concevoir une stratégie d'observabilité avancée avec des dashboards, des alertes proactives et des SLI/SLO pertinents.
• Prendre en charge les investigations complexes et contribuer directement à la résolution des incidents.
• Analyser les incidents récurrents, animer les revues de tickets et conduire les post-mortems.
• Transformer les causes racines identifiées en chantiers de fiabilité intégrés aux backlogs des équipes produit.
• Automatiser les tâches répétitives et développer les scripts ou outils nécessaires à l'efficacité du Run.
• Accompagner la montée en compétences d'un profil plus junior et diffuser une culture de la fiabilité auprès des équipes. 🛠️ Ton environnement technique Tu évolueras principalement autour des technologies et pratiques suivantes :
• Observabilité : Datadog, dashboards, logs, métriques, APM, alerting, SLI/SLO
• Architecture applicative : microservices, API et flux Kafka
• Data et investigation : SQL
• ITSM et collaboration : Jira, outils de gestion de services, Slack
• Automatisation : scripting et outillage interne
• Méthodes : gestion des incidents, problem management, post-mortems et amélioration continue 👤 Le
profil recherché
Tu disposes d'une expérience solide sur le Run applicatif, le SysOps, le SRE ou la fiabilité de produits digitaux à forts enjeux. Tu te reconnais si :
• Tu as déjà construit ou profondément transformé un dispositif Run.
• Tu maîtrises Datadog et sais concevoir un monitoring réellement actionnable.
• Tu es capable d'investiguer des incidents complexes sur des architectures distribuées.
• Tu pratiques SQL et tu comprends les API, les microservices et les flux Kafka.
• Tu as une forte appétence pour l'automatisation et les approches hands-on.
• Tu sais vulgariser, transmettre et embarquer des développeurs comme des Product Managers.
• Tu es rigoureux, orienté solution et à l'aise avec des interlocuteurs variés. Une expérience de mentoring, de définition de SLI/SLO ou de transformation d'un support réactif en dispositif proactif sera particulièrement valorisée. ⭐ Pourquoi rejoindre ce projet ? ✓ La possibilité de bâtir une stratégie Run de bout en bout. ✓ Un rôle de référent mêlant vision, expertise et exécution technique. ✓ Des enjeux d'observabilité et d'automatisation au cœur de la mission. ✓ Un impact direct sur la fiabilité de plusieurs produits critiques. Tu te reconnais dans ce descriptif ? Alors, n’attends plus une seconde : envoie-nous ta candidature et notre équipe Recrutement aura le plaisir de l’étudier 🚀 Proxiad est une entreprise inclusive, qui recrute et reconnaît tous les talents de manière égale.
• Auditer l'organisation Run existante et identifier les points de fragilité.
• Définir, formaliser et automatiser le dispositif opérationnel multi-produits.
• Construire les processus de traitement, matrices d'escalade, indicateurs et objectifs de service.
• Concevoir une stratégie d'observabilité avancée avec des dashboards, des alertes proactives et des SLI/SLO pertinents.
• Prendre en charge les investigations complexes et contribuer directement à la résolution des incidents.
• Analyser les incidents récurrents, animer les revues de tickets et conduire les post-mortems.
• Transformer les causes racines identifiées en chantiers de fiabilité intégrés aux backlogs des équipes produit.
• Automatiser les tâches répétitives et développer les scripts ou outils nécessaires à l'efficacité du Run.
• Accompagner la montée en compétences d'un profil plus junior et diffuser une culture de la fiabilité auprès des équipes. 🛠️ Ton environnement technique Tu évolueras principalement autour des technologies et pratiques suivantes :
• Observabilité : Datadog, dashboards, logs, métriques, APM, alerting, SLI/SLO
• Architecture applicative : microservices, API et flux Kafka
• Data et investigation : SQL
• ITSM et collaboration : Jira, outils de gestion de services, Slack
• Automatisation : scripting et outillage interne
• Méthodes : gestion des incidents, problem management, post-mortems et amélioration continue 👤 Le
profil recherché
Tu disposes d'une expérience solide sur le Run applicatif, le SysOps, le SRE ou la fiabilité de produits digitaux à forts enjeux. Tu te reconnais si :
• Tu as déjà construit ou profondément transformé un dispositif Run.
• Tu maîtrises Datadog et sais concevoir un monitoring réellement actionnable.
• Tu es capable d'investiguer des incidents complexes sur des architectures distribuées.
• Tu pratiques SQL et tu comprends les API, les microservices et les flux Kafka.
• Tu as une forte appétence pour l'automatisation et les approches hands-on.
• Tu sais vulgariser, transmettre et embarquer des développeurs comme des Product Managers.
• Tu es rigoureux, orienté solution et à l'aise avec des interlocuteurs variés. Une expérience de mentoring, de définition de SLI/SLO ou de transformation d'un support réactif en dispositif proactif sera particulièrement valorisée. ⭐ Pourquoi rejoindre ce projet ? ✓ La possibilité de bâtir une stratégie Run de bout en bout. ✓ Un rôle de référent mêlant vision, expertise et exécution technique. ✓ Des enjeux d'observabilité et d'automatisation au cœur de la mission. ✓ Un impact direct sur la fiabilité de plusieurs produits critiques. Tu te reconnais dans ce descriptif ? Alors, n’attends plus une seconde : envoie-nous ta candidature et notre équipe Recrutement aura le plaisir de l’étudier 🚀 Proxiad est une entreprise inclusive, qui recrute et reconnaît tous les talents de manière égale.