Vi søker en svært dyktig og erfaren plattformingeniør som vil ha en sentral rolle i å bygge, drifte og kontinuerlig forbedre vår Sovereign AI Cloud-plattform. Rollen fokuserer på praktisk implementering, automatisering og operasjonell stabilitet i plattformlaget, og sikrer at plattformens kapabiliteter støtter produktets roadmap og behovene til DevSecOps- og produktteamene.
Den ideelle kandidaten har solid hands-on-erfaring med container- og Kubernetes-baserte plattformer, GPU-akselerert infrastruktur og infrastruktur som kode, og trives med å jobbe tett på både teknologi og mennesker.
Ansvarsområder
- Implementere, konfigurere og vedlikeholde multi-tenant clustertopologi og maskinvareprofiler for GPU- og CPU-miljøer
- Etablere og drifte GPUaaS- og bare-metal-miljøer, inkludert ressursisolering, kvoter og kapasitetsstyring
- Implementere og operere SDN-basert nettverk og høyytelses lagringsløsninger for AI-arbeidsbelastninger
- Automatisere plattform-lifecycle i stor skala ved bruk av Infrastructure as Code (Ansible/GitOps) og compliance-as-code
- Bidra til at plattformen er i tråd med NVIDIA Reference Architecture og NVIDIA Enterprise AI Factory Architecture
- Oversette produktets roadmap til konkrete plattformoppgaver i backloggen, og bidra aktivt i prioritering og gjennomføring
- Samarbeide tett med arkitekter, SRE, sikkerhet og leverandører ved oppgraderinger, feilretting og hendelseshåndtering
- Implementere og håndheve sikkerhet, RBAC/ABAC og revisjonsmekanismer gjennom automatiserte plattformprosesser
Ønskede ferdigheter og erfaring
- Praktisk erfaring med multi-tenant Kubernetes/OpenShift-miljøer
- Hands-on erfaring med Red Hat OpenShift Container Platform og Red Hat HyperShift
- Erfaring med GPU-integrasjon i Kubernetes, inkludert NVIDIA BCM og relaterte operatører
- God kjennskap til Red Hat Enterprise Linux
- Erfaring med Keycloak, KMS/Vault, OpenShift-lagring (CSI) og nettverk (CNI)
- Solid erfaring med automatiserings- og konfigurasjonsverktøy som Ansible, Terraform og Helm
- God forståelse for container-nettverk, lagring og sikkerhetsprinsipper
- Erfaring fra arbeid i DevOps- eller plattformteam med høye krav til stabilitet og sikkerhet
Kvalifikasjoner
- Bachelorgrad i informatikk, ingeniørfag eller tilsvarende relevant erfaring
- 4-7 års relevant erfaring med bygging og drift av plattform- og infrastruktur-løsninger i datasenter- og/eller cloud-native miljøer
- Solid praktisk erfaring med Kubernetes og/eller Red Hat OpenShift, inkludert multi-tenant ressursstyring
- God teknisk forståelse av nettverk (inkludert SDN-prinsipper) og høyytelses lagring for AI/ML-arbeidsbelastninger
- Erfaring med å implementere og videreutvikle plattformdesign i tråd med etablerte referansearkitekturer og tekniske føringer
- Praktisk erfaring med Infrastructure as Code og automatisering (f.eks. Ansible, GitOps, Terraform, Helm)
- Erfaring fra arbeid i DevOps- eller plattformteam, tett på både utvikling og drift
- Relevante sertifiseringer (f.eks. CKA/CKAD/CKS, Red Hat OpenShift, NVIDIA AI Enterprise) er en fordel, men ikke et krav