AI Factory Operations Lead F/H
Nous recrutons un·e Architecte réseau afin de renforcer notre équipe AI Factory.
OUTSCALE, marque de Dassault Systèmes, est un opérateur souverain et durable de l’Expérience en tant que Service qui offre à ses clients des environnements technologiques de confiance.
Nous offrons des expériences uniques grâce au savoir-faire de nos équipes passionnées, qui se reflète notamment par la création de solutions de Business Expériences, le développement de notre propre orchestrateur Cloud, TINA OS, ou encore l’obtention de la qualification SecNumCloud.
L'AI Factory de Dassault Systèmes conçoit et opère la plateforme d'intelligence artificielle du groupe, de l'infrastructure matérielle jusqu'aux services PaaS exposés aux équipes produits. Notre salle héberge des racks NVIDIA GB200/300 NVL72, avec une périphérie réseau sécurisée par des firewalls Fortinet. À cette échelle, la performance des workloads IA (entraînement et inférence LLM) dépend directement de la qualité du réseau : débits est-ouest entre nœuds GPU, latence, dimensionnement de la périphérie de sécurité.
Dans ce cadre, nous recherchons un(e) AI Factory Operations Lead.
Vos missions
Rattaché(e) au responsable de l'AI Factory, vous serez en charge de :
Pilotage opérationnel de la plateforme : suivi quotidien du run(disponibilité, incidents, changements, capacité GPU), animation des rituels d'exploitation, arbitrage des priorités entre équipes utilisatrices, suivi des SLO et des indicateurs de service, escalade et coordination lors des incidents majeurs.
Animation et encadrement de l'équipe : coordination d'une équipe pluridisciplinaire (réseau, DevOps, infrastructure, sécurité), organisation du travail et des astreintes, suivi des objectifs individuels, participation aux recrutements et à l'intégration des nouveaux arrivants, développement des compétences.
Feuille de route et gestion de projets : déclinaison de la stratégie de la plateforme en plans d'action, suivi des chantiers structurants (extension du parc, industrialisation des services, intégration AI Factory / IaaS), planification, suivi des jalons, des risques et des dépendances, reporting régulier au responsable et à la direction.
Relation avec les équipes utilisatrices et partenaires : point d'entrée des équipes produits et data science pour la prise en compte de leurs besoins, cadrage des demandes, communication sur les évolutions et les incidents ;
coordination avec les équipes infrastructure, sécurité et réseau du groupe et avec les fournisseurs (NVIDIA, constructeurs, intégrateurs).
Gouvernance, capacité et budget : suivi de l'utilisation et de l'allocation des ressources GPU, prévisions de capacité, contribution à la préparation et au suivi du budget (matériel, licences, maintenance), suivi des contrats et des supports constructeurs.
Processus et qualité : formalisation et amélioration continue des processus d'exploitation (gestion des incidents, des changements, des demandes), pilotage des post-mortems et du suivi des actions correctives, contribution aux exigences de conformité et de sécurité de la plateforme.
Suppléance du responsable : représentation de l'AI Factory dans les instances internes et auprès des partenaires, prise de décision opérationnelle et continuité du pilotage en l'absence du responsable.
Stack technique
Matériel : racks NVIDIA GB200/300 NVL72, fabric haute performance, stockage
partagé, périphérie réseau sécurisée
Plateforme : Kubernetes, NVIDIA GPU Operator, ordonnanceur GPU, serveurs d'inférence LLM, frameworks d'entraînement (PyTorch)
Outillage : GitOps et Infrastructure as Code, Prometheus/Grafana, outils de ticketing et de gestion de projet, Git
Pratiques : gestion d'incidents et de changements, post-mortems, suivi de capacité, gestion de projet, astreinte possible selon organisation de l'équipe
Votre profil
- Diplômé(e) d'une école d'ingénieurs ou équivalent, vous possédez une expérience professionelle post diplôme minimum de 1 an en ingénierie réseau datacenter ou en exploitation d'infrastructures de production à fort enjeu.
- Vous êtes expert en réseaux TCP/IP et en troubleshooting de niveau 3 : vous savez instrumenter, mesurer, isoler et résoudre un problème de performance complexe.
- Vous maitirisez les architectures de datacenter modernes : routage BGP, fabrics leaf-spine, et en particulier EVPN-VXLAN => c'est la compétence structurante du poste, qui vous permettra de porter le chantier d'intégration AI Factory / IaaS.
- Vous maitrisez l'automatisation (Python, Ansible) et appréciez de travailler dans un environnement Linux.
- Idéalement, vous avez déjà une expérience dans les fabrics haute performance (InfiniBand, RoCE, Ethernet 400G) ou des environnements HPC/GPU; A défaut, une solide expérience datacenter et une envie réelle et sérieuse de monter sur ces technologies.
- Une expérience opérationnelle des Fortinet (FortiGate, NSE4+) est un plus, pas un prérequis.
- Anglais courant à l'écrit (documentation constructeur, support NVIDIA/Fortinet).
Nous rejoindre c'est aussi
- Intégrer une entreprise scientifique au cœur de l’innovation technologique, portée par une forte croissance depuis plus de 40 ans
- Vous souhaitez en savoir plus ? N'hésitez pas à nous suivre sur Linkedin et découvrez nos dernières offres et actus.
Principaux avantages et bénéfices :
Environnement multiculturel
Cadre de travail convivial axé sur le bien-être et la santé
Engagement en faveur de la diversité et de l’inclusion
Politique dynamique de développement de carrière : plan de formation, mobilités internes, etc.
Déclaration de diversité
Dassault Systèmes, avant-gardiste en matière de technologie et d’innovation durable, s’efforce de créer des équipes toujours plus inclusives et diverses à travers le monde. Nous avons la forte conviction que nos employés sont notre atout numéro 1 et nous voulons que tous, se sentent libres d’être pleinement qui ils sont vraiment. Notre objectif est qu’ils ressentent fierté et sentiment d’appartenance. En tant qu’entreprise à la pointe du changement, il nous incombe de favoriser l’inclusion de tous et participer à création du monde de demain.
Inclusion statement

OUTSCALE предлагает виртуальные двойники организаций и доверенные облачные среды, которые облегчают инновации и способствуют устойчивому повышению конкурентоспособности.
Хотите узнать больше?
Посетите другие разделы нашего веб-сайта, чтобы узнать больше.
Студенты и выпускники
Станьте частью нашего персонала будущего — ознакомьтесь с возможностями стажировки и трудоустройства.
Ваш путь получения работы
Узнайте о пути получения работы.
Наша культура и ценности
Познакомьтесь с нашей культурой и ценностями.