SRE

Technopride Ltd

Hove

Hybrid

GBP 60,000 - 80,000

Full time

14 days+
Application generator

Turn this role into an interview — a resume and cover letter built around what this employer wants.

Get past ATS filters

Job summary

A leading technology firm in Hove, UK, is seeking an experienced Site Reliability Engineer (SRE) to modernize IT operations through observability practices and automation. The successful candidate will enhance system reliability and operational efficiency while reducing manual tasks. Responsibilities include collaborating with teams to implement modern reliability practices, developing AI-driven alerting strategies, and mentoring team members. Candidates should have a strong background in SRE principles, observability solutions, and automation.

Qualifications

  • Strong expertise in Site Reliability Engineering (SRE) principles and practices.
  • Hands-on experience implementing observability solutions.
  • Strong scripting and automation experience using Python and Ansible.

Responsibilities

  • Collaborate with engineering teams to modernize IT operations.
  • Design and implement observability platforms.
  • Develop strategies for AI-driven alerting and proactive anomaly detection.
  • Establish and enforce SRE best practices.
  • Define and implement an AIOps roadmap.
  • Automate repetitive operational tasks.
  • Implement self-healing systems and automated incident response mechanisms.
  • Lead incident management and root cause analysis.
  • Promote shift-left reliability practices.
  • Mentor team members.

Skills

Site Reliability Engineering principles
Observability solutions (Dynatrace, Datadog)
Scripting and automation (Python, Ansible)
AWS
Azure
Containerization and orchestration (Docker, Kubernetes)
Cloud-native distributed systems
Microservices architectures

Job description

Role: SRE

Location: Hove, UK

Is it Permanent / Contract: Open for both Perm/Contract

Is it Onsite/Remote/Hybrid: 2 days per week from office

No. of Positions: 1

We are seeking an experienced Site Reliability Engineer (SRE) to drive the modernization of IT operations through the implementation of observability practices, automation, and reliability engineering principles. The role requires a strategic thinker with strong hands‑on expertise who can enhance system reliability, scalability, and operational efficiency while reducing manual operational tasks.

The successful candidate will work closely with engineering, architecture, and product teams to implement modern reliability practices, automate operational workflows, and establish robust monitoring and incident management frameworks.

Key Responsibilities
  • Collaborate with engineering teams to modernize IT operations by improving observability, automation, and operational efficiency.
  • Design and implement observability platforms to effectively monitor system health, performance, and reliability.
  • Develop strategies for AI-driven alerting and proactive anomaly detection to reduce Mean Time to Detect (MTTD) and Mean Time to Resolve (MTTR).
  • Establish and enforce SRE best practices, including Service Level Indicators (SLIs), Service Level Objectives (SLOs), and Error Budgets.
  • Define and implement an AIOps roadmap to enhance operational intelligence and automation.
  • Automate repetitive operational tasks (toil reduction) using scripting, orchestration tools, and automation frameworks.
  • Implement self‑healing systems and automated incident response mechanisms to support autonomous operations.
  • Collaborate with cross‑functional teams to ensure systems are scalable, resilient, and maintainable.
  • Lead incident management, root cause analysis, and post‑incident improvement initiatives.
  • Promote shift‑left reliability practices across engineering and product teams.
  • Mentor team members and advocate for a culture of reliability, automation, and continuous improvement.
Required Skills & Experience
  • Strong expertise in Site Reliability Engineering (SRE) principles and practices.
  • Hands‑on experience implementing observability solutions, particularly with Dynatrace and Datadog.
  • Strong scripting and automation experience using Python and Ansible.
  • Experience working with cloud platforms such as AWS and Azure.
  • Solid understanding of containerization and orchestration technologies, including Docker and Kubernetes.
  • Experience working with cloud‑native distributed systems and microservices architectures.
Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Senior SRE
Senior SRE

Pulse Recruit • Greater London

On-site
GBP 65,000 - 85,000
Site Reliability Engineer
Site Reliability Engineer

Insight International (UK) Ltd • Bournemouth

On-site
GBP 55,000 - 75,000
Site Reliability Engineer
Site Reliability Engineer

SR2 | Socially Responsible Recruitment | Certified B Corporation • Slough

On-site
GBP 65,000 - 90,000
Site Reliability Engineer
Site Reliability Engineer

Mphasis • Greater London

On-site
GBP 90,000 - 120,000
SRE Engineer
SRE Engineer

Savant Recruitment • Greater London

On-site
GBP 60,000 - 80,000
Senior Site Reliability Engineer
Senior Site Reliability Engineer

RELX International • Greater London

On-site
GBP 90,000 - 120,000
Site Reliability Engineer (SRE) – Cloud Platforms
Site Reliability Engineer (SRE) – Cloud Platforms

Talenzon group • Greater London

On-site
GBP 70,000 - 110,000
Site Reliability Engineer (SRE)
Site Reliability Engineer (SRE)

Xpertise Recruitment • West Drayton

On-site
GBP 60,000 - 80,000
Site Reliability Engineering Manager
Site Reliability Engineering Manager

Gravitas Recruitment Group (Global) Ltd • Greater London

On-site
GBP 75,000 - 100,000
Site Reliability Engineer (SRE) - Cloud Kubernetes Platform
Site Reliability Engineer (SRE) - Cloud Kubernetes Platform

Intuition IT Solutions Ltd • Glasgow

Hybrid
GBP 60,000 - 75,000
Hybrid work model