Remote Site Reliability Engineer – Cloud & Automation

TOTEM

Toronto

On-site

CAD 110,000 - 160,000

Full time

10 days ago

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

TOTEM is seeking an experienced Site Reliability Engineer to join a team responsible for the reliability, performance, and resilience of high-availability SaaS platforms. You will work in an AWS and Kubernetes environment, designing, automating, monitoring, and continuously improving the infrastructure powering critical cloud-based services.

This role combines hands-on engineering with operational leadership, giving you ownership of system availability, scalability, and incident response.

Qualifications

  • Extensive experience in SRE/Cloud/DevOps for SaaS environments.
  • Hands-on with AWS, Kubernetes, and EKS.
  • Proficient in Terraform and CI/CD tooling.
  • Experience with on-call rotations and incident response.
  • Strong collaboration across engineering teams.

Responsibilities

  • Partner with engineering during design, capacity planning, and deployment.
  • Monitor and improve service availability, latency, and health.
  • Address recurring issues with scalable, resilient solutions.
  • Define observability practices: dashboards, alerts, SLOs, SLIs.
  • Build and maintain automated infrastructure with Terraform and CI/CD.
  • Develop tooling to reduce manual work and enable self-healing systems.
  • Coordinate incident response and act as Incident Commander.
  • Lead blameless post-incident reviews and track corrective actions.
  • Leverage AI-assisted tools to accelerate development and ops.
  • Maintain documentation and advance SRE practices.

Skills

SRE / Cloud Engineering
DevOps practices
AWS cloud services
Kubernetes
Terraform
CI/CD pipelines
Observability
Python/Bash scripting
Incident response
Cross-team collaboration

Tools

GitLab/Jenkins CI/CD
Datadog/Prometheus/Grafana
Terraform
AWS multi-account & EKS

Job description

TOTEM is seeking an experienced Site Reliability Engineer to join a team responsible for the reliability, performance, and resilience of high-availability SaaS platforms. You will work in an AWS and Kubernetes environment, designing, automating, monitoring, and continuously improving the infrastructure powering critical cloud-based services.

This role combines hands-on engineering with operational leadership, giving you ownership of system availability, scalability, and incident response.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Senior SRE: Cloud, Automation & Observability
Senior SRE: Cloud, Automation & Observability

RXinsider LTD. • Montreal (administrative region)

Hybrid
CAD 100,000 - 150,000
Senior Site Reliability Engineer – Cloud & Automation Lead
Senior Site Reliability Engineer – Cloud & Automation Lead

Tecsys Inc. • Toronto

Remote
CAD 90,000 - 120,000
Digital-first work environment
Collaborative workspaces
Continuous learning opportunities
Site Reliability Engineer — Scale & Automate Globally
Site Reliability Engineer — Scale & Automate Globally

Tipalti • Vancouver

Hybrid
CAD 100,000 - 125,000
Hybrid work model (in-office Mon Tue &
Competitive salary & equity
RRSP matching
+7
Site Reliability Engineer
Site Reliability Engineer

Gemini Solutions Pvt Ltd • Toronto

On-site
CAD 120,000 - 170,000
Senior Site Reliability Engineer: Cloud, Kubernetes & CI/CD
Senior Site Reliability Engineer: Cloud, Kubernetes & CI/CD

OpenText • Southwestern Ontario

On-site
CAD 118,000 - 168,000
Site Reliability Engineer
Site Reliability Engineer

Mantu • Montreal (administrative region)

On-site
CAD 90,000 - 130,000
Founding SRE: Cloud Reliability & Platform Lead
Founding SRE: Cloud Reliability & Platform Lead

Katalyze AI, Inc. • Toronto

On-site
CAD 120,000 - 180,000
Senior Cloud Reliability Engineer | AWS & Automation
Senior Cloud Reliability Engineer | AWS & Automation

Jobber • Vancouver

On-site
CAD 146,000 - 197,000
Senior Site Reliability Engineer – Cloud & Automation
Senior Site Reliability Engineer – Cloud & Automation

Electronic Arts (EA) • Toronto

On-site
CAD 122,000 - 160,000
Site Reliability Engineer — Kubernetes & Terraform
Site Reliability Engineer — Kubernetes & Terraform

Future Secure AI • Toronto

On-site
CAD 90,000 - 130,000