Ingénieur systèmes infrastructure IA H/F

Atos SE

Échirolles

Sur place

EUR 65 000 - 95 000

Plein temps

Il y a 6 jours
Soyez parmi les premiers à postuler
Générateur de candidature

Démarquez-vous pour ce poste — générez un CV personnalisé et une lettre de motivation en environ une minute.

Passez les filtres ATS

Résumé du poste

Bull, basé à Échirolles, recherche un ingénieur systèmes infrastructure IA pour piloter le déploiement et la validation des racks IA/HPC. Vous travaillerez avec les équipes produit et partenaires pour qualifier les configurations Bull et assurer une livraison fiable.

Le poste exige une expérience HPC/IA, des compétences Linux et réseau de haut niveau et comporte des déplacements en France. Anglais technique souhaité.

Qualifications

  • Expérience sur racks HPC/IA exigée.
  • Gestion et traçabilité rigoureuses.
  • Compétences Linux et automatisation souhaitées.

Responsabilités

  • Mise en route et validation des racks Bull (firmware, BMC, gestion des nœuds).
  • Définition et exécution du plan de validation (performance, thermique, énergie).
  • Qualifier les choix Bull vs référence du fournisseur et assurer le suivi technique jusqu’à résolution.
  • Documenter les défauts avec les équipes partenaires et assurer la traçabilité.
  • Contribuer aux revues techniques et supports portefeuilles avec partenaires et architects.
  • Soutenir le portfolio dans la définition produit et configurations client.
  • Mettre en place le labo d’ingénierie et automatiser les démarrages et tests reproductibles.
  • Produire documentation technique et guides de configuration.
  • Servir de point d’escalade technique de niveau 3.

Connaissances

Systèmes HPC/IA
Ingénierie Linux
Réseau HPC
Autonomie
Communication technique

Outils

Kubernetes
Slurm
OpenBMC
PCIe/NVLink
Firmware/BMC

Description du poste

Ingénieur systèmes infrastructure IA H/F

Échirolles, FR

Bull c’est une histoire. Un siècle d’innovation Européenne et un environnement de travail où des experts conçoivent des solutions numériques puissantes, durables et souveraines, permettant aux États et aux industries de garder la pleine maîtrise de leurs données et de leur IA.

Bull c’est aussi des milliers d’ingénieurs, de chercheurs, de passionnés de tech, façonnant l’avenir du calcul de haute performance, de l’IA et des technologies quantiques.

Chaque jour, nos équipes repoussent les limites du possible - des architectures HPC de nouvelle génération aux supercalculateurs exascale - soutenues par une R&D de rang mondial, plus de 1 600 brevets et des capacités de bout en bout uniques, couvrant la conception matérielle, l’ingénierie logicielle, la data science et la recherche quantique.

Centrés sur l’humain et portés par l’innovation, où la collaboration s’étend à l’Europe, aux Amériques et à l’Inde, nous partageons cette même vision d’une innovation responsable et durable, avec un impact concret pour nos clients.

L’IA et l’infrastructure cloud de Bull (ACI) construit un portefeuille d’infrastructures IA à l’échelle des racks pour les fournisseurs de services cloud, Neo Clouds et les programmes européens AI Gigafactory — en commençant par le NVIDIA NVL72 de marque Bull (génération Vera Rubin) fabriqué en Europe, suivi d’autres projets non divulgués. L’ingénieur transforme ces designs en systèmes fonctionnels et supportables : mise en route, intégration, validation et responsabilité technique de la configuration Bull, à l’interface entre les fournisseurs de silicium (NVIDIA, AMD), le partenaire de fabrication et les équipes produit, avant-vente et support de Bull.

Passez d'une plateforme IA à l'échelle d'une baie, du design de référence à un produit Bull validé et supportable : mettez en place les premiers systèmes, qualifiez la configuration spécifique Bull (options matérielles, firmware, pile de gestion, réseau), lancez les campagnes de validation avec les partenaires, et transformez les résultats en matériel de référence sur lequel la présales, la livraison et le support peuvent compter.

Responsabilités clefs :

Mise en route, intégration et validation :

  • Mettre en route et tester les premiers racks Bull (racks d'échantillons hébergés chez le partenaire, puis sur les systèmes Bull eux-mêmes) : firmware et pile BMC/gestion, gestion des nœuds et des racks, NVLink / architecture scale-up, réseau scale-out, télémétrie de refroidissement liquide.
  • Définir et exécuter le plan de validation de la configuration Bull : fonctionnement, performance (calcul, interconnexion, chemin de stockage), comportement thermique et consommation d'énergie, RAS et facilité de maintenance.
  • Qualifier les choix spécifiques à Bull par rapport à la référence du fournisseur : pièces de nomenclature provenant du partenaire, options de sécurité/root-of-trust de la plateforme.
  • Reproduire, isoler et documenter les défauts avec les équipes d'ingénierie du partenaire et du fournisseur ; assurer le suivi technique jusqu'à résolution.

Architecture de référence et responsabilité de conception (avec le Portfolio) :

  • Contribuer au contenu technique des revues de propositions de conception avec le partenaire de fabrication et des réponses aux programmes de qualification des partenaires du fournisseur.
  • Soutenir le Directeur du Portfolio sur la définition des produits et les Architectes Presales / Solutions sur les configurations spécifiques aux clients et la due diligence technique.

Outils, automatisation et labo :

  • Mettre en place et faire fonctionner l'environnement de labo d'ingénierie autour des racks : provisionnement / nœud principal, accès hors bande, suivi et collecte de télémétrie, modèle d'accès à distance avec le partenaire.
  • Automatiser les procédures de démarrage, de test et de collecte de données afin que les campagnes soient reproductibles à travers les générations et les sites partenaires.

Support, livraison et documentation :

  • Produire la documentation technique qui part de l'ingénierie : rapports de validation, guides de configuration, listes de problèmes connus, notes de support sur le terrain pour l'organisation de maintenance et de support.
  • Servir de point d'escalade technique de niveau 3 pour les systèmes déployés, en collaboration avec le partenaire de service.

Compétences requises :

Hard skills :
Personne n’est censé maîtriser les cinq domaines dès le premier jour : nous recherchons une bonne base dans les deux premiers, une expérience réelle dans au moins un des trois autres, et la volonté d’apprendre le reste sur le terrain.

Indispensables :

  • Systèmes à l’échelle des racks ou HPC/IA — expérience pratique dans le déploiement, l’intégration ou la validation de serveurs GPU accélérés ou de solutions à l’échelle des racks : BIOS / BMC / firmware, topologies PCIe et accélérateurs, NVLink ou réseau haute vitesse.
  • Ingénierie des systèmes Linux — provisionnement et gestion de configuration de flottes, piles noyau / pilotes, conteneurs, Slurm et/ou Kubernetes ; scripting (Python, Bash) pour l’automatisation.

A minima une — les autres à apprendre sur le terrain :

  • Réseautage pour clusters IA — Ethernet (RoCE, Spectrum-X ou équivalent) et/ou réseaux InfiniBand ; topologies multi-plans ; réseaux hors-bande et de gestion.
  • Couche physique des centres de données — refroidissement liquide (CDU, boucles de liquide, télémétrie), distribution et surveillance de l’alimentation des racks, câblage, pratiques de sécurité autour de haute ...
  • Esprit d'acteur / constructeur — à l'aise dans une équipe et sur un produit en cours de développement, où les procédures n'existent pas encore et où l'ingénieur les écrit.
  • Rigueur et traçabilité — faits mesurés, datés et sourcés ; une ligne claire entre ce qui est vérifié et ce qui est supposé.
  • Communication technique orientée partenaire — travaille avec des ingénieurs de fournisseurs et de partenaires de fabrication, souvent à distance et à travers différents fuseaux horaires.
  • Autonomie avec discernement — sait quand décider seul et quand escalader.

Profil recherché :

  • Profil senior, minimum d'environ 5 ans en ingénierie des systèmes, intégration matérielle, opérations HPC / IA ou infrastructure Cloud, ou validation de plateforme. Un profil intermédiaire à fort potentiel avec une grande capacité d'apprentissage et une solide culture hardware / Linux (les deux domaines incontournables mentionnés) sera également pris en compte.
  • Une expérience antérieure chez un fournisseur de serveurs, un partenaire ODM / fabricant, un intégrateur HPC, un hyperscaler ou un Neo Cloud est un atout majeur.
  • L'anglais est la langue de travail, le français est fortement apprécié.
  • Disponibilité pour voyager occasionnellement sur les sites partenaires (Taiwan, sites de production européens) et dans notre usine à Angers (France) pour des campagnes de mise en route.

Les plus :

  • Expérience pratique sur un rack de classe NVL ou sur d'autres serveurs GPU.
  • Connaissances en firmware / BMC (OpenBMC, DC-SCM, racine de confiance de la plateforme).
  • Expérience d'un programme de fabrication ou de NPI avec un ODM (revues de propositions de conception, jalons ES / QS / PS / MP).
  • Familiarité avec les références de conception partenaires cloud de NVIDIA et les logiciels de gestion, ou avec l'écosystème AMD ROCm.
  • Chinois parlé apprécié.

Ici, vos idées, votre curiosité et votre excellence technique contribuent directement à façonner la prochaine ère du calcul avancé - en créant de la valeur pour les entreprises, en accélérant le progrès scientifique et en générant un impact positif pour la société.

Obtenez votre examen gratuit et confidentiel de votre CV.

ou faites glisser et déposez votre fichier ici.

Similar jobs

Postes similaires à comparer

Ingénieur systèmes infrastructure IA H/F
Ingénieur systèmes infrastructure IA H/F

Atos • Échirolles

Sur place
EUR 75 000 - 115 000
Architecte Serveur Senior H/F
Architecte Serveur Senior H/F

Atos SE • France

Hybride
EUR 90 000 - 120 000
HPC System & Storage Engineer - F/H
HPC System & Storage Engineer - F/H

Atos • Toulouse

Hybride
EUR 65 000 - 100 000
Principal Hardware Server Architect H/F
Principal Hardware Server Architect H/F

Atos SE • Les Clayes-sous-Bois

Sur place
EUR 90 000 - 130 000
HPC System & Storage Engineer - F/H
HPC System & Storage Engineer - F/H

Bull • Toulouse

Hybride
EUR 65 000 - 100 000
Hybrid work
Head of Pre-sales H/F
Head of Pre-sales H/F

Atos • Paris

Sur place
EUR 180 000 - 240 000
Référent Technique Linux (H/F)
Référent Technique Linux (H/F)

Atos • Bruyères-le-Châtel

Sur place
EUR 50 000 - 65 000
Head of Pre-sales H/F
Head of Pre-sales H/F

Atos SE • Bordeaux

Sur place
EUR 150 000 - 190 000
Manager ingénierie système H/F
Manager ingénierie système H/F

Atos • Les Clayes-sous-Bois

Sur place
EUR 75 000 - 105 000
INGENIEUR SYSTEME HPC Senior H/F
INGENIEUR SYSTEME HPC Senior H/F

Bull • Bruyères-le-Châtel

Sur place
EUR 70 000 - 90 000