R-141289 Ingénieur Réseaux & Sécurité – Environnement AI Factory (H/F)
Make an impact with NTT DATAJoin a company that is pushing the boundaries of what is possible. We are renowned for our technical excellence and leading innovations, and for making a difference to our clients and society. Our workplace embraces diversity and inclusion – it’s a place where you can grow, belong and thrive.Réseaux haute performance | Sécurité | DevOps | GPU | KubernetesNous recherchons un Ingénieur Réseaux & Sécurité expérimenté et polyvalent, disposant d’une solide expertise Web/DevOps, pour concevoir, sécuriser et automatiser l’infrastructure réseau avancée de notre AI Factory.Vous interviendrez sur des environnements à très haute performance (RoCE, InfiniBand) supportant des clusters GPU Dell/NVIDIA, et garantirez une connectivité sécurisée, résiliente et optimisée pour les charges de travail IA/ML.Vous collaborerez étroitement avec les équipes DevOps et plateformes IA afin d’optimiser le déploiement, le monitoring et la gestion des incidents sur des environnements cloud-native (OpenShift / Kubernetes), tout en intégrant des solutions innovantes d’orchestration GPU et de gestion des données.🎯 Vos missions🔐 Réseaux & SécuritéConcevoir, déployer et sécuriser des architectures réseau à très haut débit (RoCE v2) pour les environnements IA/ML.Administrer les infrastructures GPU Dell/NVIDIA et configurer les switches backend/frontend (Z9432F, S5248F).Concevoir et maintenir des architectures réseau sécurisées et évolutives (LAN/WAN, VXLAN-EVPN, Palo Alto).Mettre en œuvre des contrôles de sécurité adaptés aux fabrics RDMA afin d’assurer l’isolation et l’intégrité des clusters GPU.Déployer et optimiser des fabrics Data Center (VXLAN-EVPN).Implémenter des politiques avancées de QoS en environnement haute performance :marquage, queuing, WRED, buffering adaptatif, ECMP intelligent, multi-path load balancing.Administrer et maintenir les firewalls Palo Alto.Superviser et analyser le trafic sur des fabrics 400G/800G via des outils de télémétrie.Gérer les incidents de sécurité, conduire les analyses de causes racines et contribuer aux investigations forensiques.Garantir la conformité aux standards et exigences réglementaires.Déployer des stratégies de segmentation réseau en collaboration avec les équipes sécurité.🚀 Web / DevOps & Cloud-NativeIntervenir sur des environnements d’orchestration (OpenShift, Kubernetes, Docker) avec gestion avancée des GPU (GPU-aware scheduling).Mettre en œuvre des politiques réseau et des mécanismes de sécurité dans Kubernetes.Intégrer les bonnes pratiques de sécurité dans les pipelines CI/CD.Superviser les services web (performance, disponibilité, sécurité) via Prometheus, Grafana, ELK.Participer aux tests de sécurité applicative (SAST/DAST) et à la remédiation des vulnérabilités.Développer des scripts et outils d’automatisation (Python, Bash, PowerShell).Contribuer à l’optimisation et à l’industrialisation des opérations.✅ Profil recherchéCompétences techniques clésExpertise avancé...