Administrateur(trice) Cluster IA

Alliance Services Plus

Fontenay-aux-Roses

Sur place

EUR 85 000 - 110 000

Plein temps

Il y a 2 jours
Soyez parmi les premiers à postuler
Générateur de candidature

Transformez ce poste en entretien — un CV et une lettre de motivation conçus selon ce que cet employeur recherche.

Passez les filtres ATS

Résumé du poste

Alliance Services Plus (AS+) recherche un(e) Ingénieur(e) Administration Cluster IA Senior pour accompagner un client public majeur en Île-de-France. Vous assurerez le MCO du cluster IA (GPU/CPU, stockage et réseau), administrerez Linux et Kubernetes, et assumerez le support et le traitement des incidents, avec une forte dimension ITIL et documentation.

Profil: Bac+5, 5 à 10 ans d’expérience en administration systèmes et infrastructures, maîtrise Linux, Kubernetes, NVIDIA CUDA/MIG et Ansible;

Qualifications

  • Bac+5 ingénieur ou équivalent requis.
  • 5–10 ans d’expérience en administration systèmes et infrastructures.
  • Maîtrise de Linux et de Kubernetes.
  • Expérience sur infrastructures GPU/IA et CUDA/MIG souhaitée.
  • Bonne maîtrise d’Ansible et scripting Bash/Python.
  • Expérience en supervision et gestion d’incidents.
  • Connaissance des environnements HPC/IA est appréciée.

Responsabilités

  • Assurer le MCO du cluster IA (GPU/CPU, stockage et réseau).
  • Administrer Linux et Kubernetes.
  • Support utilisateurs et traitement des incidents.
  • Gérer ressources, quotas, priorités et jobs sur la plateforme.
  • Gérer GPU NVIDIA, drivers, CUDA et MIG.
  • Automatiser les opérations d’exploitation et la documentation.

Connaissances

Linux
Kubernetes
Ansible
Scripting Bash/Python
GPU/IA infra
Monitoring Prometheus Grafana
ITIL/ITSM
Storage/Networking HPC/IA

Formation

Bac+5 Ingénieur / Master

Outils

Prometheus
Grafana
NVIDIA CUDA/MIG

Description du poste

Ingénieur Administration Cluster IA Senior

CDI | Senior (5 à 10 ans) | Île-de-France (site client)

Contexte du poste

Alliance Services Plus (AS+) recherche un(e) Ingénieur(e) Administration Cluster IA Senior pour accompagner l’un de ses clients dans l’administration et le maintien en conditions opérationnelles d’une plateforme dédiée à l’Intelligence Artificielle.

Notre client est un acteur public majeur dans les domaines de la sûreté nucléaire, de la recherche et de l’expertise scientifique. Ses activités s’appuient notamment sur des infrastructures de calcul intensif et des plateformes dédiées aux usages IA.

Vous interviendrez sur le MCO du cluster IA, le support aux utilisateurs, la gestion des incidents et l’automatisation des opérations d’exploitation.

Missions principales
  • Assurer le MCO du cluster IA : GPU, CPU, stockage et réseau
  • Administrer les environnements Linux et Kubernetes
  • Assurer le support aux utilisateurs et le traitement des incidents
  • Gérer les ressources, quotas, priorités et jobs sur la plateforme
  • Participer à la gestion des GPU NVIDIA, drivers, CUDA et MIG
  • Mettre en place et maintenir l’automatisation des opérations d’exploitation
  • Assurer la supervision et le monitoring de la plateforme
  • Participer au suivi des incidents matériels et aux échanges avec les mainteneurs
  • Contribuer à l’évolution et à l’optimisation de l’infrastructure IA
  • Rédiger et maintenir la documentation et les procédures d’exploitation
Environnement technique

Systèmes : Linux Ubuntu

Supervision : Prometheus, Grafana

Infrastructure : stockage haute performance, stockage objet, réseaux de clusters

Méthodes : ITIL / ITSM, gestion des incidents et des changements

Profil recherché
  • Formation Bac+5 (École d’Ingénieur, Master ou équivalent)
  • Expérience confirmée en administration systèmes et infrastructures
  • Bonne maîtrise de Linux et Kubernetes
  • Expérience sur des infrastructures GPU / IA
  • Connaissance de NVIDIA, CUDA et idéalement MIG
  • Bonne maîtrise d’Ansible et/ou du scripting Bash / Python
  • Expérience en supervision et gestion des incidents
  • Une connaissance des environnements de stockage et réseaux HPC/IA est appréciée
Qualités attendues :
  • Esprit d’analyse et capacité de diagnostic
  • Autonomie et rigueur
  • Sens du service et orientation utilisateur
  • Réactivité face aux incidents
  • Aisance dans les environnements techniques complexes
Obtenez votre examen gratuit et confidentiel de votre CV.

ou faites glisser et déposez votre fichier ici.

Similar jobs

Postes similaires à comparer

Ingénieur Admin Cluster IA Senior – MCO & Automatisation
Ingénieur Admin Cluster IA Senior – MCO & Automatisation

Alliance Services Plus • Fontenay-aux-Roses

Sur place
EUR 85 000 - 110 000
Ingénieur IA
Ingénieur IA

Alliance Services Plus • Fontenay-aux-Roses

Sur place
EUR 70 000 - 110 000
Expert kubernetes /ia (h/f) : kubernetes, prometheus
Expert kubernetes /ia (h/f) : kubernetes, prometheus

Onyx-Conseil • Fontenay-aux-Roses

Sur place
EUR 70 000 - 95 000
Administrateur Système / SysOps (H/F)
Administrateur Système / SysOps (H/F)

Abolis Biotechnologies • Paris

Sur place
EUR 70 000 - 95 000
Ingénieur(e) Support Applicatif HPC
Ingénieur(e) Support Applicatif HPC

Groupe EOLEN • Paris

Sur place
EUR 65 000 - 95 000
Administrateur Systèmes HPC
Administrateur Systèmes HPC

Groupe EOLEN • Paris

Sur place
EUR 50 000 - 70 000
Ingenieur DevOps Plateforme GPU - F/H
Ingenieur DevOps Plateforme GPU - F/H

Groupe Avanista • Guyancourt

Sur place
EUR 95 000 - 120 000
Télétravail 2j/sem
Administrateur Systèmes HPC
Administrateur Systèmes HPC

Groupe EOLEN • Toulouse

Sur place
EUR 45 000 - 60 000
Administrateur Système / SysOps (H/F)
Administrateur Système / SysOps (H/F)

Abolis Biotechnologies SAS • Paris

Hybride
EUR 60 000 - 90 000
Ingénieur(e) Support Applicatif HPC
Ingénieur(e) Support Applicatif HPC

Alliance Services Plus • Fontenay-aux-Roses

Sur place
EUR 65 000 - 90 000