Ingénieur Réseaux

Il y a 1 semaine

Antony, Île-de-France NTT DATA, Inc. Temps plein

Make an impact with NTT DATA Join a company that is pushing the boundaries of what is possible. We are renowned for our technical excellence and leading innovations, and for making a difference to our clients and society. Our workplace embraces diversity and inclusion – it’s a place where you can grow, belong and thrive.

Make an impact with NTT DATA Join a company that is pushing the boundaries of what is possible. We are renowned for our technical excellence and leading innovations, and for making a difference to our clients and society. Our workplace embraces diversity and inclusion – it’s a place where you can grow, belong and thrive.

Réseaux haute performance | Sécurité | DevOps | GPU | Kubernetes

Nous recherchons un Ingénieur Réseaux & Sécurité expérimenté et polyvalent, disposant d’une solide expertise Web/DevOps, pour concevoir, sécuriser et automatiser l’infrastructure réseau avancée de notre AI Factory.

Vous interviendrez sur des environnements à très haute performance (RoCE, InfiniBand) supportant des clusters GPU Dell/NVIDIA, et garantirez une connectivité sécurisée, résiliente et optimisée pour les charges de travail IA/ML.

Vous collaborerez étroitement avec les équipes DevOps et plateformes IA afin d’optimiser le déploiement, le monitoring et la gestion des incidents sur des environnements cloud-native (OpenShift / Kubernetes), tout en intégrant des solutions innovantes d’orchestration GPU et de gestion des données.

Vos missions

  • Concevoir, déployer et sécuriser des architectures réseau à très haut débit (RoCE v2) pour les environnements IA/ML.
  • Administrer les infrastructures GPU Dell/NVIDIA et configurer les switches backend/frontend (Z9432F, S5248F).
  • Concevoir et maintenir des architectures réseau sécurisées et évolutives (LAN/WAN, VXLAN-EVPN, Palo Alto).
  • Mettre en œuvre des contrôles de sécurité adaptés aux fabrics RDMA afin d’assurer l’isolation et l’intégrité des clusters GPU.
  • Déployer et optimiser des fabrics Data Center (VXLAN-EVPN).
  • Implémenter des politiques avancées de QoS en environnement haute performance : marquage, queuing, WRED, buffering adaptatif, ECMP intelligent, multi-path load balancing.
  • Administrer et maintenir les firewalls Palo Alto.
  • Superviser et analyser le trafic sur des fabrics 400G/800G via des outils de télémétrie.
  • Gérer les incidents de sécurité, conduire les analyses de causes racines et contribuer aux investigations forensiques.
  • Garantir la conformité aux standards et exigences réglementaires.
  • Déployer des stratégies de segmentation réseau en collaboration avec les équipes sécurité.

Web / DevOps & Cloud-Native

  • Intervenir sur des environnements d’orchestration (OpenShift, Kubernetes, Docker) avec gestion avancée des GPU (GPU-aware scheduling).
  • Mettre en œuvre des politiques réseau et des mécanismes de sécurité dans Kubernetes.
  • Intégrer les bonnes pratiques de sécurité dans les pipelines CI/CD.
  • Superviser les services web (performance, disponibilité, sécurité) via Prometheus, Grafana, ELK.
  • Participer aux tests de sécurité applicative (SAST/DAST) et à la remédiation des vulnérabilités.
  • Développer des scripts et outils d’automatisation (Python, Bash, PowerShell).
  • Contribuer à l’optimisation et à l’industrialisation des opérations.

Profil recherché

Compétences techniques clés

  • Expertise avancée en RoCE v2, InfiniBand et réseaux haut débit.
  • Expérience confirmée sur infrastructures GPU Dell/NVIDIA et gestion de switches (Z9432F, S5248F).
  • Solide maîtrise des technologies de sécurité réseau (notamment Palo Alto).
  • Très bonne connaissance des fabrics lossless pour IA/ML : PFC, DCQCN, RoCE Adaptive Routing, technologies NVIDIA.
  • Maîtrise des architectures QoS pour Data Centers haute performance.
  • Excellente maîtrise des fondamentaux réseaux : TCP/IP, routage, switching, VLAN, VPN.
  • Expérience avec Kubernetes et le networking container.
  • Connaissance des environnements CI/CD (Jenkins, GitLab CI, CircleCI).
  • Pratique des outils Infrastructure as Code (Terraform, Ansible, CloudFormation).
  • Compréhension des services web, API et concepts de sécurité HTTP.
  • Maîtrise des outils de monitoring (Prometheus, Grafana).
  • Forte capacité d’analyse et de résolution de problèmes, avec une approche orientée sécurité.

Atouts supplémentaires

  • Expérience en orchestration GPU (RUN:AI, NVIDIA Enterprise).
  • Expérience en segmentation réseau avancée.
  • Certifications type CCNP appréciées.
  • Expérience en environnement Agile / DevSecOps.

Formation

  • Diplôme Bac+5 (ou équivalent) en Informatique, Réseaux, Cybersécurité ou domaine connexe.

Pourquoi nous rejoindre ?

  • Travailler sur de