AWS Site Reliability Engineer

Marks Sattin

Greater London

On-site

GBP 60,000 - 80,000

Full time

14 days+

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

A leading technology-driven organization in Glasgow is seeking an experienced Site Reliability Engineer (SRE) to enhance their cloud-native data platform. Responsibilities include automating infrastructure, leading reliability initiatives, and building observability solutions. The ideal candidate has strong AWS experience and a solid understanding of SRE principles. This is an excellent opportunity to drive operational excellence and resilience in critical data services.

Qualifications

  • Strong knowledge of SRE principles and practical experience defining SLAs, SLOs, and error budgets.
  • Demonstrated AWS expertise in production environments.
  • Experience with observability tools, monitoring, and alerting practices.

Responsibilities

  • Automate infrastructure provisioning and platform operations using Infrastructure as Code and CI/CD tools.
  • Lead and execute reliability initiatives including disaster recovery planning.
  • Define and manage service health metrics for measurable improvements.

Skills

SRE principles
AWS expertise
Automation
Infrastructure as Code
Observability tools
Python scripting

Tools

Terraform
CloudFormation
Snowflake
Databricks

Job description

An established technology-driven organisation is seeking an experienced Site Reliability Engineer (SRE) in Glasgow to strengthen and scale their cloud-native data platform, utilising AWS, Snowflake, and Databricks. This position offers the opportunity to drive automation, resilience, and operational excellence across critical data services.

Key Responsibilities:

  • Automate infrastructure provisioning and platform operations using Infrastructure as Code and CI/CD tools.
  • Lead and execute reliability initiatives including disaster recovery planning, failure testing, and resilience validation.
  • Define and manage service health metrics (SLIs/SLOs/SLAs) to drive measurable improvements in reliability.
  • Build observability solutions to monitor AWS, Snowflake, and Databricks workloads.
  • Collaborate with engineering teams to embed reliability best practices throughout platform development.
  • Analyse incidents and proactively address root causes to improve availability and performance.
  • Provide operational support, drive incident resolution, and implement automated fixes for recurring issues.

Requirements:

  • Strong knowledge of SRE principles and practical experience defining SLAs, SLOs, and error budgets.
  • Demonstrated AWS expertise (e.g., EC2, S3, IAM, VPC, CloudWatch) in production environments.
  • Experience with observability tools, monitoring, and alerting practices.
  • Proficient in automation, Infrastructure as Code (Terraform, CloudFormation, or CDK), and scripting (Python/Bash).
  • Exposure to Snowflake and/or Databricks data platforms.
  • Background in DR/chaos engineering, CI/CD pipelines, GitOps, or supporting large-scale data environments.
Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Site Reliability Engineer
Site Reliability Engineer

Paritas Recruitment • Glasgow

On-site
AWS SRE Engineer
AWS SRE Engineer

TekWissen UK • Glasgow

On-site
GBP 75,000 - 110,000
AWS SRE: Cloud Data Platform Reliability & Automation
AWS SRE: Cloud Data Platform Reliability & Automation

Marks Sattin • Greater London

On-site
GBP 60,000 - 80,000
Site Reliability Engineer (SRE) - Cloud Engineer - GCP & Azure
Site Reliability Engineer (SRE) - Cloud Engineer - GCP & Azure

Deloitte - Recruitment • Glasgow

Hybrid
GBP 60,000 - 90,000
AWS SRE for Data Platform Reliability (Contract)
AWS SRE for Data Platform Reliability (Contract)

Paritas Recruitment • Glasgow

On-site
GBP 100,000 - 125,000
Site Reliability Engineer
Site Reliability Engineer

Reward Gateway • Greater London

Hybrid
GBP 70,000 - 110,000
Life assurance
Pension
Employee Share Plan
+3
Site Reliability Engineer
Site Reliability Engineer

DNS INFO LTD • City Of London

On-site
GBP 70,000 - 95,000
SRE
SRE

SR2 REC LTD • Greater London

Hybrid
GBP 70,000 - 110,000
Site Reliability Engineer
Site Reliability Engineer

Incite-Insight.co.uk • West of England

On-site
GBP 70,000 - 95,000
Tech Lead (Site Reliability Engineering)
Tech Lead (Site Reliability Engineering)

London Stock Exchange • Nottingham

On-site
GBP 90,000 - 120,000