Site Reliability Engineer

ALLEGIS GROUP SINGAPORE PRIVATE LIMITED

Singapore

On-site

SGD 120,000 - 180,000

Full time

14 days+

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

Allegis Group Singapore Pte Ltd in Singapore seeks a Site Reliability Engineer to join a global engineering team supporting mission-critical financial platforms undergoing cloud modernization and security enhancements. The role blends Production Engineering and Cloud Operations, focusing on stability and automation.

You will work hybrid, maintain production systems, build CI/CD pipelines, and collaborate with Engineering, Security, and Operations to improve monitoring and resilience.

Qualifications

  • 5+ years in SRE/DevOps/Cloud Operations
  • Hands-on AWS experience
  • Strong Linux administration
  • Python and Shell scripting experience
  • Experience with CI/CD pipelines
  • Strong incident management and RCA skills
  • Experience with monitoring/observability tools

Responsibilities

  • Provide L2/L3 support for business-critical production applications
  • Troubleshoot and resolve incidents in production infrastructure and platforms
  • Perform root cause analysis and implement preventative improvements
  • Build and maintain CI/CD pipelines and deployment automation
  • Develop automation solutions using Python and Shell scripting
  • Support AWS-based cloud environments and platform modernisation
  • Improve monitoring, observability, and operational processes
  • Collaborate with Engineering, Security, and Operations teams

Skills

AWS
Python
Shell scripting
CI/CD pipelines
Linux admin
Monitoring tools
Datadog
Splunk
BigPanda
Root cause analysis
Incident management
Stakeholder comms

Tools

Datadog
Splunk
BigPanda

Job description

About the Role

We're hiring a Site Reliability Engineer (SRE) to join a global engineering team supporting mission-critical financial markets platforms undergoing a large-scale cloud, cyber security, and platform modernisation programme.


This is a hybrid Production Engineering and Cloud Operations role where you'll help maintain the stability of business-critical systems while driving automation, operational improvements, and cloud transformation initiatives. It's an excellent opportunity for engineers who enjoy troubleshooting complex production environments, improving platform reliability, and reducing manual operational effort through automation within a highly regulated, enterprise-scale environment.


Key Responsibilities


  • Provide L2/L3 support for business-critical production applications

  • Troubleshoot and resolve application, infrastructure, and platform incidents

  • Perform root cause analysis and implement preventative improvements

  • Build and maintain CI/CD pipelines and deployment automation

  • Develop automation solutions using Python and Shell scripting

  • Support AWS-based cloud environments and platform modernisation initiatives

  • Improve monitoring, observability, and operational processes

  • Partner with Engineering, Security, and Operations teams to deliver platform improvements

  • Support vulnerability remediation, patching, and security compliance activities

  • Contribute to platform reliability, resilience, and continuous improvement initiatives


Requirements


  • 5+ years of experience in Site Reliability Engineering, DevOps, Production Engineering, Cloud Operations, or Infrastructure Engineering

  • Strong experience supporting production-critical environments

  • Hands-on AWS experience

  • Strong Linux administration experience

  • Python and Shell scripting experience

  • Experience with CI/CD pipelines and deployment automation

  • Strong incident management and root cause analysis skills

  • Experience with monitoring and observability tools such as Datadog, BigPanda, or Splunk

  • Excellent communication and stakeholder management skills


Preferred Skills


  • Red Hat Enterprise Linux (RHEL)

  • Ansible

  • Terraform

  • HashiCorp Vault

  • Artifactory

  • Security remediation or cyber security programme experience

  • Financial Services experience

  • Experience supporting global platforms across multiple regions


We regret to inform that only shortlisted candidates will be notified.


EA registration number : ANDREW JONAS MATTHEW, R21103843


Allegis Group Singapore Pte Ltd, Company Reg No. 200909448N, EA Licence No. 10C4544

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Site Reliability Engineer
Site Reliability Engineer

Allegis Group Singapore Pte Ltd • Singapore

Hybrid
SGD 120,000 - 180,000
Site Reliability Engineer
Site Reliability Engineer

TEKsystems • Singapore

Hybrid
SGD 120,000 - 180,000
Site Reliability Engineer
Site Reliability Engineer

Dexian • Singapore

Hybrid
SGD 120,000 - 180,000
Site Reliability Engineer
Site Reliability Engineer

BEATHCHAPMAN (PTE. LTD.) • Singapore

Hybrid
SGD 120,000 - 180,000
Hybrid working arrangement
Production Engineer (DevOps / SRE)
Production Engineer (DevOps / SRE)

Ambition • Singapore

On-site
SGD 110,000 - 170,000
SRE Engineer
SRE Engineer

BOUNTEOUSXACCOLITE SINGAPORE PTE. LTD. • Singapore

On-site
SGD 90,000 - 180,000
Senior SRE: Cloud Ops, Automation & Resilience (Hybrid)
Senior SRE: Cloud Ops, Automation & Resilience (Hybrid)

TEKsystems • Singapore

Hybrid
SGD 120,000 - 180,000
SRE: Cloud Reliability & Automation Engineer (AWS)
SRE: Cloud Reliability & Automation Engineer (AWS)

ALLEGIS GROUP SINGAPORE PRIVATE LIMITED • Singapore

Hybrid
SGD 120,000 - 180,000
Site Reliability Engineer
Site Reliability Engineer

Quesscorp Singapore Pte Ltd • Singapore

On-site
SGD 75,000 - 120,000
Site Reliability Engineer
Site Reliability Engineer

Auxo Talent • Singapore

On-site
SGD 90,000 - 150,000