Senior Site Reliability Engineer

Orion Innovation

British Columbia

On-site

CAD 100,000 - 130,000

Full time

14 days+

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

A leading tech firm in British Columbia is looking for a Senior Site Reliability Engineer to design and maintain resilient systems. The ideal candidate will have extensive experience in Kubernetes, expertise in observability and compliance in secure environments. This full-time role requires a strong capability for troubleshooting complex infrastructures and a background in air-gapped settings.

Qualifications

  • 8+ years of Site Reliability Experience.
  • Strong background in Site Reliability Engineering and implementing observability strategies.
  • Experience in air-gapped environments and protecting classified data.

Responsibilities

  • Design and maintain reliable, multi-tenant systems using Kubernetes.
  • Implement and manage observability solutions for system health.
  • Ensure deployments meet compliance standards and optimize performance.

Skills

Kubernetes
Rancher
Prometheus
Grafana
Splunk
Elastic
Sonar
Troubleshooting

Tools

RKE2
Ingress
Artifactory

Job description

Overview

Senior Site Reliability Engineer (SRE) with Kubernetes and Rancher. Full-time role focused on building and maintaining highly resilient, secure systems, including in air-gapped environments.

Responsibilities
  • System Architecture & Management: Design, architect, and maintain highly reliable, multi-tenant systems using Kubernetes and related tools (RKE2). Includes components such as Ingress, Kong, Artifactory, and Sonar.
  • Observability & Monitoring: Implement and manage observability solutions with Prometheus, Grafana, Splunk, and Elastic to ensure deep visibility into system health and performance, including in air-gapped settings.
  • Compliance & Optimization: Ensure deployments meet stringent compliance standards and are optimized for performance and security.
  • Code Quality & Security: Perform regular code quality analysis and security assessments using Sonar to identify and mitigate vulnerabilities.
  • Incident Response: Collaborate with leads and specialized teams to resolve incidents quickly and improve resilience and recovery procedures.
  • Documentation: Create and maintain documentation for system configurations, runbooks, and disaster recovery plans for managing systems in sensitive environments.
Required Skills and Qualifications
  • 8+ years of Site Reliability Experience.
  • Experience with Kubernetes and Rancher.
  • Technical Expertise: Proficiency with RKE2, Kubernetes, Ingress, Kong, Artifactory, Prometheus, Grafana, Splunk, Elastic, and Sonar.
  • SRE & Observability: Strong background in Site Reliability Engineering and implementing comprehensive observability strategies.
  • Secure Environments: Experience in air-gapped or zero-connectivity environments and protecting classified data.
  • Troubleshooting: Ability to troubleshoot and optimize complex, multi-tenant infrastructures under pressure.
Preferred Qualifications
  • Relevant SRE or DevOps certifications (e.g., CKAD, CKA).
  • Experience in government or defense-related SRE roles.
  • Experience with Rancher and its ecosystem.
Seniority level
  • Mid-Senior level
Employment type
  • Full-time
Job function
  • Engineering and Information Technology
Industries
  • IT Services and IT Consulting
Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Senior Site Reliability Engineer (SRE) – Kubernetes
Senior Site Reliability Engineer (SRE) – Kubernetes

Software Mind • Montreal (administrative region)

Hybrid
CAD 120,000 - 170,000
Competitive salary
Laptop provided
Professional development
+2
[8SN] Senior Site Reliability Engineer (SRE) – Kubernetes
[8SN] Senior Site Reliability Engineer (SRE) – Kubernetes

Worky • Montreal (administrative region)

On-site
CAD 120,000 - 170,000
Laptop
Flexible work arrangements
Professional development and training
Site Reliability Engineer (SRE) – UI/UX
Site Reliability Engineer (SRE) – UI/UX

Software Mind • Montreal (administrative region)

Hybrid
CAD 110,000 - 165,000
Competitive salary
Laptop provided
Professional development
+2
Senior Site Reliability Engineer (SRE) – Kubernetes
Senior Site Reliability Engineer (SRE) – Kubernetes

Software Mind Americas • Montreal (administrative region)

On-site
CAD 110,000 - 170,000
Competitive salary
Laptop provided
Professional development
+2
Site Reliability Engineer (SRE)
Site Reliability Engineer (SRE)

TEEMA • Vancouver

On-site
CAD 83,000 - 110,000
Senior Software Engineer, Platform (SRE)
Senior Software Engineer, Platform (SRE)

HRB • Kitchener, Southwestern Ontario

On-site
CAD 120,000 - 180,000
Site Reliability Engineer
Site Reliability Engineer

Compunnel, Inc. • Montreal (administrative region)

Hybrid
CAD 90,000 - 130,000
Senior Site Reliability Engineer
Senior Site Reliability Engineer

iManage • Toronto

Hybrid
CAD 90,000 - 120,000
Market-competitive salary
Annual performance-based bonus
Comprehensive Health, Vision, Dental, and Life insurance
+4
Site Reliability Engineer (Linux / Cloud Infrastructure)
Site Reliability Engineer (Linux / Cloud Infrastructure)

Atlantis IT Group • Montreal

On-site
CAD 80,000 - 100,000
Site Reliability Engineer
Site Reliability Engineer

Mantu • Montreal (administrative region)

On-site
CAD 90,000 - 130,000