Ingénieur Réseaux

Il y a 1 semaine

Antony, Île-de-France NTT America, Inc. Temps plein

Make an impact with NTT DATA

Join a company that is pushing the boundaries of what is possible. We are renowned for our technical excellence and leading innovations, and for making a difference to our clients and society. Our workplace embraces diversity and inclusion – it’s a place where you can grow, belong and thrive.

Réseaux haute performance | Sécurité | DevOps | GPU | Kubernetes

Nous recherchons un Ingénieur Réseaux & Sécurité expérimenté et polyvalent , disposant d’une solide expertise Web/DevOps, pour concevoir, sécuriser et automatiser l’infrastructure réseau avancée de notre AI Factory .

Vous interviendrez sur des environnements à très haute performance (RoCE, InfiniBand) supportant des clusters GPU Dell/NVIDIA, et garantirez une connectivité sécurisée, résiliente et optimisée pour les charges de travail IA/ML.

Vous collaborerez étroitement avec les équipes DevOps et plateformes IA afin d’optimiser le déploiement, le monitoring et la gestion des incidents sur des environnements cloud-native (OpenShift / Kubernetes), tout en intégrant des solutions innovantes d’orchestration GPU et de gestion des données.

Vos missions

Réseaux & Sécurité

  • Concevoir, déployer et sécuriser des architectures réseau à très haut débit (RoCE v2) pour les environnements IA/ML.

  • Administrer les infrastructures GPU Dell/NVIDIA et configurer les switches backend/frontend (Z9432F, S5248F).

  • Concevoir et maintenir des architectures réseau sécurisées et évolutives (LAN/WAN, VXLAN-EVPN, Palo Alto).

  • Mettre en œuvre des contrôles de sécurité adaptés aux fabrics RDMA afin d’assurer l’isolation et l’intégrité des clusters GPU.

  • Déployer et optimiser des fabrics Data Center (VXLAN-EVPN).

  • Implémenter des politiques avancées de QoS en environnement haute performance :marquage, queuing, WRED, buffering adaptatif, ECMP intelligent, multi-path load balancing.

  • Administrer et maintenir les firewalls Palo Alto.

  • Superviser et analyser le trafic sur des fabrics 400G/800G via des outils de télémétrie.

  • Gérer les incidents de sécurité, conduire les analyses de causes racines et contribuer aux investigations forensiques.

  • Garantir la conformité aux standards et exigences réglementaires.

  • Déployer des stratégies de segmentation réseau en collaboration avec les équipes sécurité.

Web / DevOps & Cloud-Native

  • Intervenir sur des environnements d’orchestration (OpenShift, Kubernetes, Docker) avec gestion avancée des GPU (GPU-aware scheduling).

  • Mettre en œuvre des politiques réseau et des mécanismes de sécurité dans Kubernetes.

  • Intégrer les bonnes pratiques de sécurité dans les pipelines CI/CD.

  • Superviser les services web (performance, disponibilité, sécurité) via Prometheus, Grafana, ELK.

  • Participer aux tests de sécurité applicative (SAST/DAST) et à la remédiation des vulnérabilités.

  • Développer des scripts et outils d’automatisation (Python, Bash, PowerShell).

  • Contribuer à l’optimisation et à l’industrialisation des opérations.

Profil recherché

Compétences techniques clés

  • Expertise avancée en RoCE v2, InfiniBand et réseaux haut débit .

  • Expérience confirmée sur infrastructures GPU Dell/NVIDIA et gestion de switches (Z9432F, S5248F).

  • Solide maîtrise des technologies de sécurité réseau (notamment Palo Alto).

  • Très bonne connaissance des fabrics lossless pour IA/ML :PFC, DCQCN, RoCE Adaptive Routing, technologies NVIDIA.

  • Maîtrise des architectures QoS pour Data Centers haute performance.

  • Excellente maîtrise des fondamentaux réseaux : TCP/IP, routage, switching, VLAN, VPN.

  • Expérience avec Kubernetes et le networking container.

  • Connaissance des environnements CI/CD (Jenkins, GitLab CI, CircleCI)