Expert Surveillance/Observabilité Grand Paris

Il y a 5 jours

VertleGrand, Île-de-France VivaTech Temps plein

Expert Surveillance/Observabilité Grand Paris (H/F) – RATP

Noisy-le-Grand (93) – CDI – Il y a 1 heure

Critères de l’offre

  • Métiers : Expert Exploitation DevOps & SRE (H/F)
  • Expérience min : 6 à 10 ans
  • Secteur : Logistique, Transport de biens, Courrier
  • Diplômes : Bac+5
  • Lieux : Noisy-le-Grand (93)
  • Conditions : CDI, 60 000 € - 70 000 € par an, Temps Plein, Télétravail partiel

L’entreprise : RATP

Le Groupe RATP, implanté dans 14 pays, sur quatre continents est le 5e groupe de transport public urbain au monde. Il est composé d'une maison‑mère qui exploite le réseau francilien, un réseau multimodal parmi les plus complexes et d'une centaine de filiales qui proposent une variété d'expertises en France et à l'International. C'est une entreprise intégrée qui détient une expertise globale : Ingénierie, exploitation et maintenance.

Plus d'infos sur RATP

Description du poste

Nous recherchons un profil Expert autour de l'outillage sur l'Observabilité capable d'assurer :

  • Le MCO des outils de supervision et d'observabilité.
  • Les évolutions techniques majeures et l'intégration de nouveaux périmètres.
  • L'industrialisation (Infrastructure as Code, automatisation, self‑service).
  • Une bonne connaissance transverse et opérationnelle de l'observabilité : métriques, logs, traces, et leur corrélation.
  • Quel sera votre quotidien ?
  • MCO / Support N3 & fiabilisation de la plateforme d'observabilité
  • Assurer le support N3 : analyse et résolution d'incidents complexes, traitement des problèmes récurrents et amélioration continue.
  • Réaliser les montées de version, gérer l'obsolescence et contribuer à la sécurité (patching, durcissement, conformité).
  • Concevoir et exécuter les campagnes de tests et de non‑régression.
  • Garantir la disponibilité, les performances et la scalabilité de la plateforme d'observabilité.
  • Évolutions, intégrations et extension du périmètre Grand Paris
  • Étendre et maintenir l'observabilité des environnements virtualisation, OS et Kubernetes, ainsi que des composants de sécurité et d'accès (sauvegarde, HA, bastions, certificats, API).
  • Mettre en oeuvre et faire évoluer les mécanismes de collecte, corrélation et alerting des métriques via les outils de supervision et d'observabilité (Centreon, Nagios, ELK, Datadog, APM...).
  • Développer et maintenir des collecteurs, plugins, probes et intégrations API pour industrialiser et étendre le périmètre supervisé.
  • Industrialisation, automatisation & self‑service
  • Industrialiser les déploiements et configurations via l'Infrastructure as Code et l'automatisation (Terraform, Ansible, scripts, API).
  • Mettre en place des standards et composants réutilisables pour accélérer l'onboarding, standardiser les dashboards/alertes et réduire les actions manuelles.
  • Contribuer à la documentation, aux guides d'onboarding et à l'amélioration de l'expérience utilisateur.
  • Une participation au roulement d'astreinte est à prévoir pour le poste.

Description du profil

Quels sont les prérequis ?

  • Avoir un BAC+5 Idéalement Dans Le Domaine Du Digital Et Justifier D'une Expérience Confirmée D'environ 5 Ans En Supervision /observabilité /exploitation /production à Enjeu, Au Cours De Laquelle Vous Avez Développé Des Compétences Sur Les Sujets Suivants :
  • Observabilité / Monitoring
  • Connaissance solide d'outils de supervision de métriques : Centreon, Nagios ou équivalents (Prometheus/Grafana, Zabbix...).
  • Connaissance d'outils d'observabilité end‑to‑end : Datadog / Dynatrace / Elastic / Grafana stack / APM (ou équivalents).
  • Capacité à mettre en oeuvre et maintenir des mécanismes d'alerting pertinents (qualité des alertes, réduction du bruit, corrélation).
  • Automatisation / IaC / DevOps
  • Terraform et/ou autres outils IaC.
  • Ansible et automatisation via API.
  • Scripting : Shell / PowerShell + un langage (Python/Perl...).
  • CI/CD : GitLab CI (ou équivalent) pour industrialiser les déploiements/configurations 'as code'.
  • Plateformes & infra
  • Linux (RHEL) & Windows Server
  • Virtualisation : VMware / Nutanix
  • Conteneurs :