AWS SRE DevOps Engineer: Cloud Reliability & Automation

Marks Sattin (UK) Ltd

Glasgow

On-site

GBP 70,000 - 100,000

Full time

3 days ago
Be an early applicant
Application generator

Stand out for this role — generate a tailored resume and cover letter in about a minute.

Get past ATS filters

Job summary

Marks Sattin (UK) Ltd is seeking an experienced Site Reliability Engineer to strengthen and scale a cloud-native data platform built on AWS, Snowflake, and Databricks. The role emphasizes automation, resilience, and operational excellence across critical data services.

You will automate infrastructure, drive DR planning, define SLIs/SLOs/SLAs, and implement observability to improve reliability and performance across services.

Qualifications

  • Strong knowledge of SRE principles and SLAs/SLOs.
  • AWS production experience (EC2, S3, IAM, VPC, CloudWatch).
  • Observability, monitoring, and alerting experience.
  • IaC and scripting: Terraform, CloudFormation, CDK, Python/Bash.
  • Exposure to Snowflake and/or Databricks.

Responsibilities

  • Automate infrastructure provisioning and platform operations using IaC and CI/CD tools.
  • Lead and execute reliability initiatives including disaster recovery planning and resilience testing.
  • Define and manage service health metrics (SLIs/SLOs/SLAs).
  • Build observability solutions for AWS, Snowflake, and Databricks workloads.
  • Collaborate with engineering to embed reliability best practices across development.
  • Analyze incidents and address root causes to improve availability and performance.
  • Provide operational support and implement automated fixes for recurring issues.

Skills

SRE principles
AWS
Observability
Automation
IaC
Python
Bash

Tools

Terraform
CloudFormation
CDK

Job description

Marks Sattin (UK) Ltd is seeking an experienced Site Reliability Engineer to strengthen and scale a cloud-native data platform built on AWS, Snowflake, and Databricks. The role emphasizes automation, resilience, and operational excellence across critical data services.

You will automate infrastructure, drive DR planning, define SLIs/SLOs/SLAs, and implement observability to improve reliability and performance across services.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

AWS SRE Devops engineer
AWS SRE Devops engineer

Marks Sattin (UK) Ltd • Glasgow

On-site
GBP 70,000 - 100,000
AWS Site Reliability Engineer
AWS Site Reliability Engineer

Marks Sattin • Greater London

On-site
GBP 60,000 - 80,000
Site Reliability Engineer
Site Reliability Engineer

Paritas Recruitment • Glasgow

On-site
AWS SRE: Cloud Data Platform Reliability & Automation
AWS SRE: Cloud Data Platform Reliability & Automation

Marks Sattin • Greater London

On-site
GBP 60,000 - 80,000
AWS SRE for Data Platform Reliability (Contract)
AWS SRE for Data Platform Reliability (Contract)

Paritas Recruitment • Glasgow

On-site
GBP 100,000 - 125,000
Remote AWS SRE: Build Resilient Cloud Platforms
Remote AWS SRE: Build Resilient Cloud Platforms

SPECTRUM IT • England

On-site
GBP 70,000 - 110,000
Fully remote (UK)
24/7 shift pattern
Bonus & benefits
Azure SRE - Production Reliability & Automation
Azure SRE - Production Reliability & Automation

delinea • United Kingdom

On-site
GBP 90,000 - 140,000
Healthcare insurance
Pension matching
Life insurance
+4
On-Site SRE: Cloud Reliability & Automation
On-Site SRE: Cloud Reliability & Automation

Talenzon group • Greater London

Hybrid
GBP 70,000 - 110,000
Azure SRE Engineer: Cloud Reliability & CI/CD Expert
Azure SRE Engineer: Cloud Reliability & CI/CD Expert

Hamilton Barnes Associates Limited • York and North Yorkshire

On-site
GBP 51,000 - 69,000
SRE Engineer – FinTech Reliability, Observability & Cloud
SRE Engineer – FinTech Reliability, Observability & Cloud

Hamilton Barnes Associates Limited • Greater London

On-site
GBP 90,000 - 130,000
Global engineering organisation
Engineering-led culture
Technically challenging problems
+1