Senior Site Reliability Engineer - Data Platform & AI Ops

SCIENTE

Singapore

On-site

SGD 120,000 - 180,000

Full time

2 days ago
Be an early applicant
Application generator

An application made for this job — a tailored resume and cover letter that speak straight to the posting.

Get past ATS filters

Job summary

SCIENTE in Singapore is seeking a proactive Production Support / Site Reliability Engineer to join the team supporting the Data Analytics and Reporting Platform. This role combines production support, cloud technology, data analytics, observability, automation, and financial markets knowledge.

You will own incident management, implement automated root-cause analysis, and collaborate with Trading, Risk, Infrastructure teams to improve platform reliability during market hours.

Qualifications

  • Bachelor's or Master's degree in Computer Science, Mathematics, Finance, Engineering, or a related discipline.
  • 3-4 years of experience in supporting GCP and Google Cloud technologies (Terraform, BigQuery, Cloud Composer, Dataflow).
  • Understanding of financial markets products (Rates, Fixed Income, Repos, FX, Money Markets).
  • Experience with SRE, observability, and operational resilience.
  • Experience applying AI/ML to IT operations (AIOps, intelligent alerting, anomaly detection).
  • Production support, incident management, problem management, and operational processes.
  • Hands-on with Grafana, Prometheus, ELK/Kibana, or similar.
  • Understanding CI/CD, DevOps/SRE, and iterative software delivery.
  • Familiarity with ITIL processes in production environments.
  • Knowledge of IT risk and security concepts (SOx, certificates, authentication).
  • Strong troubleshooting and stakeholder communication skills.
  • Experience supporting business-critical platforms during market hours.

Responsibilities

  • Provide operational support for the Data Analytics and Reporting platform during Asia trading hours.
  • Own production incidents and coordinate resolutions with stakeholders.
  • Drive problem management and preventive improvements with the squad backlog.
  • Enhance platform reliability, performance, security, and observability.
  • Drive automation and AI-assisted operational improvements.
  • Support testing, release, and deployment activities for safe production changes.
  • Maintain runbooks, knowledge articles, and user guidance for onboarding.
  • Understand the full stack and its role in the platform ecosystem.
  • Collaborate with Trading, Risk, and Infrastructure teams to improve stability.
  • Participate in a global standby rotation and Agile/Scrum backlog reviews.

Skills

GCP
Terraform
BigQuery
Cloud Composer
Dataflow
Observability
SRE principles
Incident management
Prometheus
Grafana
ELK/Kibana
CI/CD
ITIL awareness
Security concepts

Education

Bachelor's or Master's degree in Computer Science/Math/Engineering

Tools

Grafana
Prometheus
ELK/Kibana

Job description

SCIENTE in Singapore is seeking a proactive Production Support / Site Reliability Engineer to join the team supporting the Data Analytics and Reporting Platform. This role combines production support, cloud technology, data analytics, observability, automation, and financial markets knowledge.

You will own incident management, implement automated root-cause analysis, and collaborate with Trading, Risk, Infrastructure teams to improve platform reliability during market hours.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

SRE & Production Support Engineer - Cloud & Observability
SRE & Production Support Engineer - Cloud & Observability

SCIENTE INTERNATIONAL PTE. LTD. • Singapore

On-site
SGD 120,000 - 190,000
AI-Driven Site Reliability Engineer
AI-Driven Site Reliability Engineer

SINGAPORE EXCHANGE LIMITED • Singapore

On-site
SGD 120,000 - 160,000
Senior Site Reliability Engineer: AI-Driven Platform Automation
Senior Site Reliability Engineer: AI-Driven Platform Automation

SGX Group • Singapore

On-site
SGD 90,000 - 130,000
Production Support / Site Reliability Engineer- Cloud Native Data Analytics Platform
Production Support / Site Reliability Engineer- Cloud Native Data Analytics Platform

SCIENTE • Singapore

On-site
SGD 120,000 - 180,000
Production Support / Site Reliability Engineer- Cloud Native Data Analytics Platform (JD#11280)
Production Support / Site Reliability Engineer- Cloud Native Data Analytics Platform (JD#11280)

SCIENTE INTERNATIONAL PTE. LTD. • Singapore

On-site
SGD 120,000 - 190,000
VP, Site Reliability Engineering — AI-Driven Platform & Reliability
VP, Site Reliability Engineering — AI-Driven Platform & Reliability

Singapore Exchange Limited • Singapore

On-site
SGD 120,000 - 160,000
AWS AI Apps Operations Engineer - Production Reliability
AWS AI Apps Operations Engineer - Production Reliability

SCIENTEC CONSULTING PTE. LTD. • Singapore

Hybrid
SGD 112,000 - 134,000
Site Reliability Engineer: Automate & Harden Production
Site Reliability Engineer: Automate & Harden Production

Singapore Exchange Limited • Singapore

On-site
SGD 90,000 - 130,000
AWS Operations Engineer: API & Production Reliability
AWS Operations Engineer: API & Production Reliability

SCIENTE INTERNATIONAL PTE. LTD. • Singapore

On-site
SGD 90,000 - 130,000
Senior Site Reliability Engineer - Automation & Incident
Senior Site Reliability Engineer - Automation & Incident

TRINITY CONSULTING SERVICES PTE. LTD. • Singapore

On-site
SGD 60,000 - 90,000