SRE

Technopride Ltd

Hove

Hybrid

GBP 60,000 - 80,000

Full time

14 days+

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

A leading technology firm in Hove, UK, is seeking an experienced Site Reliability Engineer (SRE) to modernize IT operations through observability practices and automation. The successful candidate will enhance system reliability and operational efficiency while reducing manual tasks. Responsibilities include collaborating with teams to implement modern reliability practices, developing AI-driven alerting strategies, and mentoring team members. Candidates should have a strong background in SRE principles, observability solutions, and automation.

Qualifications

  • Strong expertise in Site Reliability Engineering (SRE) principles and practices.
  • Hands-on experience implementing observability solutions.
  • Strong scripting and automation experience using Python and Ansible.

Responsibilities

  • Collaborate with engineering teams to modernize IT operations.
  • Design and implement observability platforms.
  • Develop strategies for AI-driven alerting and proactive anomaly detection.
  • Establish and enforce SRE best practices.
  • Define and implement an AIOps roadmap.
  • Automate repetitive operational tasks.
  • Implement self-healing systems and automated incident response mechanisms.
  • Lead incident management and root cause analysis.
  • Promote shift-left reliability practices.
  • Mentor team members.

Skills

Site Reliability Engineering principles
Observability solutions (Dynatrace, Datadog)
Scripting and automation (Python, Ansible)
AWS
Azure
Containerization and orchestration (Docker, Kubernetes)
Cloud-native distributed systems
Microservices architectures

Job description

Role: SRE

Location: Hove, UK

Is it Permanent / Contract: Open for both Perm/Contract

Is it Onsite/Remote/Hybrid: 2 days per week from office

No. of Positions: 1

We are seeking an experienced Site Reliability Engineer (SRE) to drive the modernization of IT operations through the implementation of observability practices, automation, and reliability engineering principles. The role requires a strategic thinker with strong hands‑on expertise who can enhance system reliability, scalability, and operational efficiency while reducing manual operational tasks.

The successful candidate will work closely with engineering, architecture, and product teams to implement modern reliability practices, automate operational workflows, and establish robust monitoring and incident management frameworks.

Key Responsibilities
  • Collaborate with engineering teams to modernize IT operations by improving observability, automation, and operational efficiency.
  • Design and implement observability platforms to effectively monitor system health, performance, and reliability.
  • Develop strategies for AI-driven alerting and proactive anomaly detection to reduce Mean Time to Detect (MTTD) and Mean Time to Resolve (MTTR).
  • Establish and enforce SRE best practices, including Service Level Indicators (SLIs), Service Level Objectives (SLOs), and Error Budgets.
  • Define and implement an AIOps roadmap to enhance operational intelligence and automation.
  • Automate repetitive operational tasks (toil reduction) using scripting, orchestration tools, and automation frameworks.
  • Implement self‑healing systems and automated incident response mechanisms to support autonomous operations.
  • Collaborate with cross‑functional teams to ensure systems are scalable, resilient, and maintainable.
  • Lead incident management, root cause analysis, and post‑incident improvement initiatives.
  • Promote shift‑left reliability practices across engineering and product teams.
  • Mentor team members and advocate for a culture of reliability, automation, and continuous improvement.
Required Skills & Experience
  • Strong expertise in Site Reliability Engineering (SRE) principles and practices.
  • Hands‑on experience implementing observability solutions, particularly with Dynatrace and Datadog.
  • Strong scripting and automation experience using Python and Ansible.
  • Experience working with cloud platforms such as AWS and Azure.
  • Solid understanding of containerization and orchestration technologies, including Docker and Kubernetes.
  • Experience working with cloud‑native distributed systems and microservices architectures.
Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Site Reliability Engineer (SRE)
Site Reliability Engineer (SRE)

Reward Gateway • Greater London

Hybrid
GBP 60,000 - 65,000
Hybrid work option
Senior SRE
Senior SRE

Pulse Recruit • Greater London

Hybrid
GBP 65,000 - 85,000
Site Reliability Engineer
Site Reliability Engineer

Insight International (UK) Ltd • Bournemouth

On-site
GBP 55,000 - 75,000
Software Engineer/ SRE (Linux)
Software Engineer/ SRE (Linux)

United States Digital Space LLC • Basingstoke

Hybrid
GBP 60,000 - 90,000
SRE Architect (68019)
SRE Architect (68019)

Hitachi Digital Services • Greater London

On-site
GBP 90,000 - 150,000
SRE Architect (68019) (DEAI DS) Cloud & Data Engineering United Kingdom
SRE Architect (68019) (DEAI DS) Cloud & Data Engineering United Kingdom

Hitachids • Greater London

On-site
GBP 90,000 - 140,000
Head of Site Reliability Engineering – SRE
Head of Site Reliability Engineering – SRE

Jobtailor • Bristol

On-site
GBP 110,000 - 140,000
Site Reliability Engineer
Site Reliability Engineer

DNS INFO LTD • City Of London

On-site
GBP 70,000 - 95,000
Site Reliability Engineer (Sre)
Site Reliability Engineer (Sre)

Focus Cloud • Greater London

Hybrid
GBP 118,000 - 159,000
SRE Engineer
SRE Engineer

Savant Recruitment • Greater London

On-site
GBP 60,000 - 80,000