AWS SRE Devops engineer

Marks Sattin (UK) Ltd

Glasgow

On-site

GBP 70,000 - 100,000

Full time

3 days ago
Be an early applicant
Application generator

Stand out for this role — generate a tailored resume and cover letter in about a minute.

Get past ATS filters

Job summary

Marks Sattin (UK) Ltd is seeking an experienced Site Reliability Engineer to strengthen and scale a cloud-native data platform built on AWS, Snowflake, and Databricks. The role emphasizes automation, resilience, and operational excellence across critical data services.

You will automate infrastructure, drive DR planning, define SLIs/SLOs/SLAs, and implement observability to improve reliability and performance across services.

Qualifications

  • Strong knowledge of SRE principles and SLAs/SLOs.
  • AWS production experience (EC2, S3, IAM, VPC, CloudWatch).
  • Observability, monitoring, and alerting experience.
  • IaC and scripting: Terraform, CloudFormation, CDK, Python/Bash.
  • Exposure to Snowflake and/or Databricks.

Responsibilities

  • Automate infrastructure provisioning and platform operations using IaC and CI/CD tools.
  • Lead and execute reliability initiatives including disaster recovery planning and resilience testing.
  • Define and manage service health metrics (SLIs/SLOs/SLAs).
  • Build observability solutions for AWS, Snowflake, and Databricks workloads.
  • Collaborate with engineering to embed reliability best practices across development.
  • Analyze incidents and address root causes to improve availability and performance.
  • Provide operational support and implement automated fixes for recurring issues.

Skills

SRE principles
AWS
Observability
Automation
IaC
Python
Bash

Tools

Terraform
CloudFormation
CDK

Job description

An established technology-driven organisation is seeking an experienced Site Reliability Engineer (SRE) to strengthen and scale their cloud-native data platform, utilising AWS, Snowflake, and Databricks. This position offers the opportunity to drive automation, resilience, and operational excellence across critical data services.

Key Responsibilities:
  • Automate infrastructure provisioning and platform operations using Infrastructure as Code and CI/CD tools.
  • Lead and execute reliability initiatives including disaster recovery planning, failure testing, and resilience validation.
  • Define and manage service health metrics (SLIs/SLOs/SLAs) to drive measurable improvements in reliability.
  • Build observability solutions to monitor AWS, Snowflake, and Databricks workloads.
  • Collaborate with engineering teams to embed reliability best practices throughout platform development.
  • Analyse incidents and proactively address root causes to improve availability and performance.
  • Provide operational support, drive incident resolution, and implement automated fixes for recurring issues.
Requirements:
  • Strong knowledge of SRE principles and practical experience defining SLAs, SLOs, and error budgets.
  • Demonstrated AWS expertise (e.g., EC2, S3, IAM, VPC, CloudWatch) in production environments.
  • Experience with observability tools, monitoring, and alerting practices.
  • Proficient in automation, Infrastructure as Code (Terraform, CloudFormation, or CDK), and scripting (Python/Bash).
  • Exposure to Snowflake and/or Databricks data platforms.
Desirable:
  • Background in DR/chaos engineering, CI/CD pipelines, GitOps, or supporting large-scale data environments.

We're committed to protecting the privacy of all our candidates and clients.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

AWS Site Reliability Engineer
AWS Site Reliability Engineer

Marks Sattin • Greater London

On-site
GBP 60,000 - 80,000
Site Reliability Engineer
Site Reliability Engineer

Paritas Recruitment • Glasgow

On-site
AWS SRE DevOps Engineer: Cloud Reliability & Automation
AWS SRE DevOps Engineer: Cloud Reliability & Automation

Marks Sattin (UK) Ltd • Glasgow

On-site
GBP 70,000 - 100,000
AWS SRE: Cloud Data Platform Reliability & Automation
AWS SRE: Cloud Data Platform Reliability & Automation

Marks Sattin • Greater London

On-site
GBP 60,000 - 80,000
SRE
SRE

Technopride Ltd • Hove

Hybrid
GBP 60,000 - 80,000
Site Reliability Engineer
Site Reliability Engineer

SR2 | Socially Responsible Recruitment | Certified B Corporation • Slough

Hybrid
GBP 65,000 - 90,000
DevOps / Site Reliability Engineer (SRE)
DevOps / Site Reliability Engineer (SRE)

SCC • United Kingdom

Hybrid
GBP 70,000 - 110,000
Senior AWS Site Reliability Engineer
Senior AWS Site Reliability Engineer

Spectrum IT Recruitment • City Of London

Hybrid
GBP 65,000 - 120,000
Life Insurance 4x Annual Salary
Private Medical Insurance
Bonus Scheme
+3
Site Reliability Engineer
Site Reliability Engineer

ReVybe IT Recruitment Limited • Greater London

Hybrid
GBP 51,000 - 85,000
Bonus
Benefits
Site Reliability Engineer (SRE)
Site Reliability Engineer (SRE)

Xpertise Recruitment • West Drayton

On-site
GBP 60,000 - 80,000