SRE & Production Support Engineer - Cloud & Observability

SCIENTE INTERNATIONAL PTE. LTD.

Singapore

On-site

SGD 120,000 - 190,000

Full time

9 days ago

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

SCIENTE INTERNATIONAL PTE. LTD. seeks a proactive Production Support / Site Reliability Engineer to join the Data Analytics and Reporting Platform team. The role blends production support, cloud tech, data analytics, observability, automation, and financial markets knowledge.

You will own incident management during Asia trading hours, contribute to reliability, security, and operational excellence, and drive automation and AI-assisted improvements across the platform.

Qualifications

  • Bachelor's or Master's degree in Computer Science, Mathematics, Finance, Engineering, or a related discipline.
  • 3-4 years of experience in supporting Google Cloud technologies such as Terraform, BigQuery, Cloud Composer, Dataflow.
  • Understanding of financial markets products (Rates, Fixed Income, Repos, FX, Money Markets).
  • Experience with SRE principles, observability, and operational resilience.
  • Experience applying AI or ML to IT operations (AIOps, alerting, anomaly detection).
  • Experience with production support, incident and problem management.
  • Hands-on monitoring/observability tools (Grafana, Prometheus, ELK/Kibana).
  • Understanding of CI/CD, DevOps/SRE practices, and iterative software delivery.
  • ITIL processes and security concepts (SOx, certificates, authentication).
  • Strong troubleshooting and communication with stakeholders.
  • Experience supporting platforms during market hours.
  • Strong communication and stakeholder-management skills.

Responsibilities

  • Provide operational support for the Data Analytics and Reporting platform during Asia trading hours.
  • Take ownership of production incidents and coordinate resolution with stakeholders.
  • Drive problem management by identifying recurring issues and prioritizing improvements.
  • Enhance platform reliability, performance, security, and operational excellence.
  • Drive automation and AI-assisted operational improvements.
  • Support testing, release, and deployment activities for production changes.
  • Maintain and improve runbooks, knowledge articles, and user guidance.
  • Collaborate with Trading, Risk, and Infrastructure teams to resolve issues.
  • Participate in a shared global standby rotation (about one week per month).
  • Work in an Agile/Scrum squad with a Product Owner-prioritized backlog.

Skills

Production support
Site Reliability Engineering
Incident management
Observability
Automation
AI/ML in IT operations
Cloud technologies
Stakeholder communication
Troubleshooting

Education

Bachelor's or Master's degree in Computer Science / related

Tools

Terraform
BigQuery
Cloud Composer
Dataflow
Grafana
Prometheus
ELK/Kibana
CI/CD
ITIL familiarity

Job description

SCIENTE INTERNATIONAL PTE. LTD. seeks a proactive Production Support / Site Reliability Engineer to join the Data Analytics and Reporting Platform team. The role blends production support, cloud tech, data analytics, observability, automation, and financial markets knowledge.

You will own incident management during Asia trading hours, contribute to reliability, security, and operational excellence, and drive automation and AI-assisted improvements across the platform.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Cloud-Native SRE for Data Analytics Platform
Cloud-Native SRE for Data Analytics Platform

SCIENTE • Singapore

On-site
SGD 90,000 - 130,000
SRE: Cloud Reliability & Automation Engineer (AWS)
SRE: Cloud Reliability & Automation Engineer (AWS)

ALLEGIS GROUP SINGAPORE PRIVATE LIMITED • Singapore

Hybrid
SGD 120,000 - 180,000
Site Reliability Engineer
Site Reliability Engineer

TEKsystems • Singapore

Hybrid
SGD 120,000 - 180,000
Site Reliability Engineer
Site Reliability Engineer

ALLEGIS GROUP SINGAPORE PRIVATE LIMITED • Singapore

Hybrid
SGD 120,000 - 180,000
Production Support / Site Reliability Engineer- Cloud Native Data Analytics Platform
Production Support / Site Reliability Engineer- Cloud Native Data Analytics Platform

SCIENTE • Singapore

On-site
SGD 90,000 - 130,000
Production Support / Site Reliability Engineer- Cloud Native Data Analytics Platform (JD#11280)
Production Support / Site Reliability Engineer- Cloud Native Data Analytics Platform (JD#11280)

SCIENTE INTERNATIONAL PTE. LTD. • Singapore

On-site
SGD 120,000 - 190,000
Senior Site Reliability Engineer - Automation & Incident
Senior Site Reliability Engineer - Automation & Incident

TRINITY CONSULTING SERVICES PTE. LTD. • Singapore

On-site
SGD 60,000 - 90,000
Senior SRE: Cloud Ops, Automation & Resilience (Hybrid)
Senior SRE: Cloud Ops, Automation & Resilience (Hybrid)

TEKsystems • Singapore

Hybrid
SGD 120,000 - 180,000
SRE & Observability Engineer — Reliability & Automation
SRE & Observability Engineer — Reliability & Automation

FPT Asia Pacific • Singapore

On-site
SGD 120,000 - 180,000
Site Reliability Engineer
Site Reliability Engineer

BEATHCHAPMAN (PTE. LTD.) • Singapore

Hybrid
SGD 120,000 - 180,000
Hybrid working arrangement