AWS SRE: Cloud Data Platform Reliability & Automation
Marks Sattin
Greater London
On-site
GBP 60,000 - 80,000
Full time
14 days+
Get more replies from employers
Send a job-specific resume in minutes.
Start fresh or import an existing resume
Job summary
A leading technology-driven organization in Glasgow is seeking an experienced Site Reliability Engineer (SRE) to enhance their cloud-native data platform. Responsibilities include automating infrastructure, leading reliability initiatives, and building observability solutions. The ideal candidate has strong AWS experience and a solid understanding of SRE principles. This is an excellent opportunity to drive operational excellence and resilience in critical data services.
Qualifications
Strong knowledge of SRE principles and practical experience defining SLAs, SLOs, and error budgets.
Demonstrated AWS expertise in production environments.
Experience with observability tools, monitoring, and alerting practices.
Responsibilities
Automate infrastructure provisioning and platform operations using Infrastructure as Code and CI/CD tools.
Lead and execute reliability initiatives including disaster recovery planning.
Define and manage service health metrics for measurable improvements.
Skills
SRE principles
AWS expertise
Automation
Infrastructure as Code
Observability tools
Python scripting
Tools
Terraform
CloudFormation
Snowflake
Databricks
Job description
A leading technology-driven organization in Glasgow is seeking an experienced Site Reliability Engineer (SRE) to enhance their cloud-native data platform. Responsibilities include automating infrastructure, leading reliability initiatives, and building observability solutions. The ideal candidate has strong AWS experience and a solid understanding of SRE principles. This is an excellent opportunity to drive operational excellence and resilience in critical data services.