Senior Site Reliability Engineer

Orion Innovation

British Columbia

On-site

CAD 100,000 - 130,000

Full time

14 days+
Application generator

Stand out for this role — generate a tailored resume and cover letter in about a minute.

Get past ATS filters

Job summary

A leading tech firm in British Columbia is looking for a Senior Site Reliability Engineer to design and maintain resilient systems. The ideal candidate will have extensive experience in Kubernetes, expertise in observability and compliance in secure environments. This full-time role requires a strong capability for troubleshooting complex infrastructures and a background in air-gapped settings.

Qualifications

  • 8+ years of Site Reliability Experience.
  • Strong background in Site Reliability Engineering and implementing observability strategies.
  • Experience in air-gapped environments and protecting classified data.

Responsibilities

  • Design and maintain reliable, multi-tenant systems using Kubernetes.
  • Implement and manage observability solutions for system health.
  • Ensure deployments meet compliance standards and optimize performance.

Skills

Kubernetes
Rancher
Prometheus
Grafana
Splunk
Elastic
Sonar
Troubleshooting

Tools

RKE2
Ingress
Artifactory

Job description

Overview

Senior Site Reliability Engineer (SRE) with Kubernetes and Rancher. Full-time role focused on building and maintaining highly resilient, secure systems, including in air-gapped environments.

Responsibilities
  • System Architecture & Management: Design, architect, and maintain highly reliable, multi-tenant systems using Kubernetes and related tools (RKE2). Includes components such as Ingress, Kong, Artifactory, and Sonar.
  • Observability & Monitoring: Implement and manage observability solutions with Prometheus, Grafana, Splunk, and Elastic to ensure deep visibility into system health and performance, including in air-gapped settings.
  • Compliance & Optimization: Ensure deployments meet stringent compliance standards and are optimized for performance and security.
  • Code Quality & Security: Perform regular code quality analysis and security assessments using Sonar to identify and mitigate vulnerabilities.
  • Incident Response: Collaborate with leads and specialized teams to resolve incidents quickly and improve resilience and recovery procedures.
  • Documentation: Create and maintain documentation for system configurations, runbooks, and disaster recovery plans for managing systems in sensitive environments.
Required Skills and Qualifications
  • 8+ years of Site Reliability Experience.
  • Experience with Kubernetes and Rancher.
  • Technical Expertise: Proficiency with RKE2, Kubernetes, Ingress, Kong, Artifactory, Prometheus, Grafana, Splunk, Elastic, and Sonar.
  • SRE & Observability: Strong background in Site Reliability Engineering and implementing comprehensive observability strategies.
  • Secure Environments: Experience in air-gapped or zero-connectivity environments and protecting classified data.
  • Troubleshooting: Ability to troubleshoot and optimize complex, multi-tenant infrastructures under pressure.
Preferred Qualifications
  • Relevant SRE or DevOps certifications (e.g., CKAD, CKA).
  • Experience in government or defense-related SRE roles.
  • Experience with Rancher and its ecosystem.
Seniority level
  • Mid-Senior level
Employment type
  • Full-time
Job function
  • Engineering and Information Technology
Industries
  • IT Services and IT Consulting
Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Site Reliability Engineer
Site Reliability Engineer

Compunnel, Inc. • Montreal (administrative region)

On-site
CAD 90,000 - 130,000
Senior Site Reliability Engineer
Senior Site Reliability Engineer

iManage • Toronto

On-site
CAD 90,000 - 120,000
Market-competitive salary
Annual performance-based bonus
Comprehensive Health, Vision, Dental, and Life insurance
+4
Senior Site Reliability Engineer (Observability & Analytics, Platform Infra)
Senior Site Reliability Engineer (Observability & Analytics, Platform Infra)

Elastic • Ottawa

Hybrid
CAD 120,000 - 170,000
Health coverage for you and family
Flexible location and schedule
Generous vacation days
+3
Site Reliability Engineer (Linux / Cloud Infrastructure)
Site Reliability Engineer (Linux / Cloud Infrastructure)

Atlantis IT Group • Montreal

On-site
CAD 80,000 - 100,000
Site Reliability Engineer - Security Engineer
Site Reliability Engineer - Security Engineer

Telna • Canada

On-site
CAD 80,000 - 110,000
Senior Site Reliability Engineer
Senior Site Reliability Engineer

Orion Innovation • Quebec

On-site
CAD 90,000 - 120,000
Cloud Site Reliability Engineer (SRE) — AWS, Kubernetes
Cloud Site Reliability Engineer (SRE) — AWS, Kubernetes

OpenText • Waterloo

On-site
CAD 70,000 - 100,000
Senior Site Reliability Engineer (Remote-First)
Senior Site Reliability Engineer (Remote-First)

VySystems • Canada

Remote
CAD 90,000 - 120,000
Senior Site Reliability Engineer
Senior Site Reliability Engineer

Sage Recruiting Inc. • Canada

On-site
CAD 180,000 - 200,000
Unlimited vacation
Comprehensive health and dental benefits
SRE x 2
SRE x 2

HRB • Montreal (administrative region)

On-site
CAD 110,000 - 170,000