Cloud SRE II: Observability, K8s & Equity Options

Barracuda

Ottawa

On-site

CAD 100,000 - 120,000

Full time

6 days ago
Be an early applicant
Application generator

Don’t send a generic resume — generate a resume and cover letter tailored to this exact role.

Get past ATS filters

Benefits offered by this job

Equity options
Health benefits
Retirement plan with employer match
Career growth opportunities
Flexible time off

Job summary

Barracuda is seeking a Cloud Site Reliability Engineer II to join the CloudOps Platform team in Ottawa. You will focus on observability, monitoring, dashboards, and automation for a multi-tenant Kubernetes platform across AWS and Azure.

You’ll build centralized telemetry stacks, design dashboards, and implement automated telemetry pipelines with GitOps, Terragrunt, and modern AI tooling. Collaboration with product teams is essential for observability onboarding and performance tuning.

Qualifications

  • 2-4 years of public cloud infrastructure experience (AWS/Azure).
  • 1-2+ years deploying or operating containerized workloads in Kubernetes (EKS/AKS).
  • Experience configuring dashboards in Grafana/ELK/Splunk stacks.
  • IaC with Terraform/Terragrunt and GitOps workflows (ArgoCD/Flux).
  • Scripting skills in Python or Bash for automation.

Responsibilities

  • Operate, scale, and automate centralized LGTM telemetry infrastructure (Loki, Mimir/Prometheus, Tempo, Grafana).
  • Design intuitive Grafana dashboards and health overviews for platform services and tenant workloads.
  • Establish reliable alerting and SLO/SLI tracking with proactive degradation detection.
  • Automate deployment of log collectors, metric exporters, and monitoring agents across multi-cluster EKS/AKS with GitOps (ArgoCD) and Terragrunt.
  • Contribute to MTK Kubernetes platform health and modernization.
  • Leverage AI coding tools to build automation and diagnostics.
  • Collaborate with product/tenant teams on observability onboarding and performance troubleshooting.

Skills

Kubernetes
Observability
Grafana
Prometheus
Terragrunt
Terraform
ArgoCD
Python
GitOps
Cloud infrastructure

Tools

Grafana
Prometheus
Mimir
Tempo
Loki
OpenTelemetry
Terragrunt
Terraform
ArgoCD
Kubernetes

Job description

Barracuda is seeking a Cloud Site Reliability Engineer II to join the CloudOps Platform team in Ottawa. You will focus on observability, monitoring, dashboards, and automation for a multi-tenant Kubernetes platform across AWS and Azure.

You’ll build centralized telemetry stacks, design dashboards, and implement automated telemetry pipelines with GitOps, Terragrunt, and modern AI tooling. Collaboration with product teams is essential for observability onboarding and performance tuning.

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Cloud SRE Lead: Multi-Region Kubernetes & Azure
Cloud SRE Lead: Multi-Region Kubernetes & Azure

barracuda-networks-inc • Ottawa

Hybrid
CAD 110,000 - 140,000
Equity options
Internal mobility
Cross training opportunities
Cloud Site Reliability Engineer II
Cloud Site Reliability Engineer II

Barracuda • Ottawa

On-site
CAD 100,000 - 120,000
Equity options
Health benefits
Retirement plan with employer match
+2
Senior Cloud SRE — Scale SaaS & Multi-Region Infra
Senior Cloud SRE — Scale SaaS & Multi-Region Infra

Jobvite, Inc. • Ottawa

Hybrid
CAD 110,000 - 140,000
Equity options (non-qualifying)
Cloud Site Reliability Senior Engineer
Cloud Site Reliability Senior Engineer

barracuda-networks-inc • Ottawa

Hybrid
CAD 110,000 - 140,000
Equity options
Internal mobility
Cross training opportunities
Cloud Site Reliability Senior Engineer
Cloud Site Reliability Senior Engineer

Jobvite, Inc. • Ottawa

On-site
CAD 110,000 - 140,000
Equity options (non-qualifying)
Senior SRE: Cloud Reliability & Observability
Senior SRE: Cloud Reliability & Observability

Redwood Software • Markham

On-site
CAD 125,000 - 145,000
Manager, Cloud Services and Site Reliability
Manager, Cloud Services and Site Reliability

Barracuda • Ottawa

On-site
CAD 136,000 - 182,000
Equity options
Health benefits
Retirement plan
+3
Site Reliability Engineer (SRE) – Observability
Site Reliability Engineer (SRE) – Observability

Astra-North Infoteck Inc. ~ Conquering today’s challenges, achieving tomorrow’s vision! • Toronto

On-site
CAD 75,000 - 95,000
Senior Cloud Reliability Engineer (AWS/Kubernetes)
Senior Cloud Reliability Engineer (AWS/Kubernetes)

Enverus • Calgary

On-site
CAD 120,000 - 180,000
Cloud Site Reliability Engineer (SRE) — AWS, Kubernetes
Cloud Site Reliability Engineer (SRE) — AWS, Kubernetes

OpenText • Waterloo

On-site
CAD 70,000 - 100,000