Site Reliability Engineer

OVH GmbH

Montreal (administrative region)

On-site

CAD 90,000 - 140,000

Full time

11 days ago

Get more replies from employers

Send a job-specific resume in minutes.

Benefits offered by this job

Télétravail hybride
Plan d'actionnariat salarié
Subventions vacances et sport
Crèche d'entreprise (selon site)
Formation et certification en ligne

Job summary

OVHcloud recherche un spécialiste SRE pour assurer l’exploitation et la fiabilité des plateformes VMware et Veeam. Vous gérerez les incidents N3, analyserez les causes racines et proposerez des correctifs tout en automatisant des tâches via CI/CD.

Vous rejoindrez une équipe orientée SRE dans un cadre hybride, avec des projets d’évolution continue et une forte culture d’amélioration produit et fiabilité.

Qualifications

  • Expérience dans un environnement d’exploitation ou SRE.
  • Bonne compréhension des méthodologies SRE et des pratiques d’exploitation.
  • Expérience avec les environnements de virtualisation VMware.
  • Connaissance des solutions de sauvegarde Veeam.
  • Compréhension des langages Go et Perl.
  • Maîtrise des outils et pratiques CI/CD.
  • Maîtrise du prompt engineering dans un contexte opérationnel : rédaction de system prompts efficaces, structuration de conversations multi-tours.
  • Capacité à analyser des incidents complexes et diagnostiquer les causes racines.
  • Travail en équipe et expérience dans un environnement Agile.
  • Capacité à évoluer dans un environnement d’incidentologie et de production.
  • Bilinguisme est nécessaire afin de répondre à des demandes de soutien à l'international

Responsibilities

  • Assurer le suivi quotidien de l’incidentologie sur les produits VMware et les solutions de backup (Veeam).
  • Participer à la gestion et la résolution des incidents de niveau 3.
  • Analyser les causes racines des incidents (RCA) et mettre en place les actions correctives nécessaires.
  • Contribuer à l’amélioration du produit Managed VMware vSphere, notamment via le développement de correctifs et d’automatisations.
  • Participer aux tâches de migration, de mise à jour et aux projets d’évolution des plateformes VMware.
  • Développer et maintenir des scripts ou correctifs simples à intermédiaires afin de réduire la récurrence des incidents.
  • Participer aux rotations d’astreinte afin d’assurer la continuité du service.
  • Contribuer à l’automatisation et à l’amélioration des opérations via des outils CI/CD.
  • Collaborer avec les équipes techniques dans un environnement Agile.
  • Participer aux amelioration continue des processus SRE et opérationnels

Skills

SRE expérience
VMware
Veeam
Go
Perl
CI/CD
Prompt engineering
Agile
Incident analysis
Bilinguisme (FR/EN)

Tools

VMware
Veeam

Job description

1. Échange avec notre recruteuse/recruteur:

2. Entretien avec la/le responsable d'équipe:

3. Cas pratique (si pertinent)
4. Rencontre avec un pair, un membre de l'équipe ou de la direction
5. Débriefing ensemble
  • Une politique de télétravail hybride
  • Un plan d'actionnariat salarié
  • Un programme de reconnaissance de l'ancienneté
  • Des subventions vacances et sport
  • Berceau et crèche d'entreprise (selon site)
Mais aussi :
  • Des équipes multiculturelles
  • Des locaux bien équipés
  • Une plateforme de formation et de certification en ligne
  • Une offre d'accompagnement médical et social digitalisée pour vous et votre famille

OVHcloud valorise la diversité des personnes qu'elle embauche et accompagne.

La diversité pour nous, c’est favoriser un milieu de travail où les différences individuelles sont reconnues, appréciées et respectées de façon à développer le plein potentiel et les forces de chacune et chacun.

Soyez libre d’être vous-même!

L'intelligence artificielle réinvente nos métiers au quotidien.

Rejoignez-nous pour explorer ses immenses possibilités et coconstruire l'avenir !

Nous savons que les femmes peuvent parfois s'abstenir de postuler si elles ne répondent pas à 100% des critères d'une offre.

Nous souhaitons clarifier : nos fiches de poste sont des repères, pas des barrières. Nous avons hâte de recevoir votre candidature.

Vous voulez contribuer à des projets uniques pour construire ensemble un service infonuagique libre ? Allons-y! Chez OVHcloud, nous sommes animés par la même volonté, celle de construire l’avenir ensemble pour défendre la liberté d'innover.

L’équipe est responsable de l’exploitation, de la fiabilité et de l’amélioration continue des plateformes de virtualisation VMware ainsi que des solutions de sauvegarde associées.

Dans un environnement orienté SRE et opérations cloud, l’équipe assure la gestion des incidents, l’évolution des plateformes et la fiabilité des services pour les solutions existantes, récentes et futures.

Vous intégrerez une équipe responsable des produits :

Vos principales responsabilités

Assurer le suivi quotidien de l’incidentologie sur les produits VMware et les solutions de backup (Veeam)

Participer à la gestion et la résolution des incidents de niveau 3

Analyser les causes racines des incidents (RCA) et mettre en place les actions correctives nécessaires

Contribuer à l’amélioration du produit Managed VMware vSphere, notamment via le développement de correctifs et d’automatisations

Participer aux tâches de migration, de mise à jour et aux projets d’évolution des plateformes VMware

Développer et maintenir des scripts ou correctifs simples à intermédiaires afin de réduire la récurrence des incidents

Participer aux rotations d’astreinte afin d’assurer la continuité du service

Contribuer à l’automatisation et à l’amélioration des opérations via des outils CI/CD

Collaborer avec les équipes techniques dans un environnement Agile

Participer aux amelioration continue des processus SRE et opérationnels

Votre futur impact

Dans les 6 mois

Autonomie opérationnelle : gérer de façon indépendante les incidents N3 sur vSphere et Public VCFaaS, incluant l'analyse de root cause et la production de post-mortems.

Début des rotations d'astreintes.

Développement : prendre en charge des correctifs de code de complexité simple à intermédiaire (Go / Perl) sans supervision systématique.

Documenter les problemes via jira et prendre en charge tout le cycle du jira de sa création a sa resolution.

Prompt engineering : appliquer des workflows IA efficaces en contexte SRE et partager ses pratiques avec l'équipe.

Autonomie : gérer la majorité des incidents N3 de façon indépendante sur l'ensemble du périmètre (vSphere, Public et Private VCFaaS, Veeam), tout en ayant accès à du soutien au besoin.

Efficacité et qualité : atteindre constamment les indicateurs clés de performance (KPI) liés à la fiabilité et à la satisfaction client.

Connaissance des produits : développer une connaissance approfondie de l'ensemble du portfolio Cloud VMware et contribuer activement aux projets d'amélioration du produit.

Compétences requises

Expérience dans un environnement d’exploitation ou SRE

Bonne compréhension des méthodologies SRE et des pratiques d’exploitation

Expérience avec les environnements de virtualisation VMware

Connaissance des solutions de backup Veeam

Compréhension des langages Go et Perl

Maîtrise des outils et pratiques CI/CD

Maîtrise du prompt engineering dans un contexte opérationnel :

rédaction de system prompts efficaces

structuration de conversations multi-tours

utilisation de techniques avancées (few-shot, chain-of-thought, self-consistency)

Capacité à analyser des incidents complexes et diagnostiquer les causes racines

Travail en équipe et expérience dans un environnement Agile

Capacité à évoluer dans un environnement d’incidentologie et de production

Bilinguisme est nécessaire afin de répondre à des demandes de soutien à l'international

Atouts

Expérience avec VMware Cloud Foundation (VCF) ou d’autres solutions de virtualisation

Expérience avec les technologies de sauvegarde Veeam

Informations complémentaires

Participation à une rotation d’astreinte afin d’assurer un service 24/7/365

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Ingénieur SRE VMware
Ingénieur SRE VMware

OVHcloud • Montreal (administrative region)

On-site
CAD 90,000 - 130,000
Administrateur de systèmes et bureautique
Administrateur de systèmes et bureautique

Nöord Technologies • Granby

Hybrid
CAD 65,000 - 90,000
Hybride : 3 jours/semaine
Rémunération compétitive
Administrateur des systèmes ti
Administrateur des systèmes ti

MAAX Bath Inc. • Sainte-Marie

On-site
CAD 75,000 - 110,000
Administrateur Stockage (Senior)
Administrateur Stockage (Senior)

SII Canada • Montreal (administrative region)

On-site
CAD 80,000 - 100,000
Administrateur Informatique Junior
Administrateur Informatique Junior

Indigo-Park-Canada-Inc.-4 • Montreal (administrative region)

On-site
CAD 45,000 - 65,000
System Administrator – Infrastructure
System Administrator – Infrastructure

IT Unlock • Montreal (administrative region)

On-site
CAD 80,000 - 120,000
Conseiller Sénior aux Opérations
Conseiller Sénior aux Opérations

Solution SFT • Quebec

On-site
CAD 80,000 - 100,000
Chef d’équipe – cloud et hébergement
Chef d’équipe – cloud et hébergement

ALFACONSEIL.CA • Boucherville

On-site
CAD 80,000 - 100,000
Conseiller Sénior aux Opérations
Conseiller Sénior aux Opérations

Services SFT • Quebec

On-site
CAD 75,000 - 95,000
Conseiller Sénior aux Opérations
Conseiller Sénior aux Opérations

Services SFT • Montreal (administrative region)

On-site
CAD 80,000 - 100,000