Datadog Engineer

OPTIMUM SOLUTIONS (SINGAPORE) PTE LTD

Singapore

On-site

SGD 120,000 - 180,000

Full time

7 days ago
Be an early applicant

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

OPTIMUM SOLUTIONS (SINGAPORE) PTE LTD in Singapore seeks a Datadog Engineer to lead enterprise observability and SRE initiatives across critical infrastructure and applications.

You will deploy and optimize platforms like Datadog, Dynatrace, Splunk and implement automation with Python, Terraform, Ansible; work with AWS and Azure, aligning with governance standards.

Qualifications

  • Degree in Computer Science/Information Technology or related field.
  • At least 5 years in Infra, Cloud or SRE roles; 3+ years in SRE SME.
  • Last 2+ years hands-on Datadog administrator, end-to-end.
  • Hands-on with Datadog, Dynatrace, Splunk, ELK.
  • Hands-on with Terraform, Ansible, Python, CI/CD tools.
  • Experience with AWS (CloudWatch, X-Ray, CloudTrail) and Azure (Monitor, Log Analytics, App Insights).
  • Strong understanding of SRE principles, health modelling, error budgets, auto-remediation.
  • Familiarity with financial sector regulatory/compliance and incident governance.
  • Certifications: Datadog Certified Observability Professional or Dynatrace Associate; Terraform/Ansible/Python Certified Expert.
  • Nice-to-have: AWSCertified DevOps/Azure DevOps, SRE Foundation/Practitioner, ITIL v4.

Responsibilities

  • Observability Strategy and Governance: define and own Enterprise Observability Architecture aligned with resilience mandates.
  • Deploy and optimize observability platforms (Datadog, Dynatrace, Splunk) for full-stack visibility.
  • Reliability Engineering and Automation: implement SRE frameworks for infrastructure and apps.
  • Automate runbooks, alerts, self-healing actions, and auto-remediation workflows via Python, Ansible, Terraform.

Skills

SRE Principles
Observability
Cloud Infrastructure
Automation
Python Scripting
Incident Governance

Education

Bachelors in CS/IT

Tools

Datadog
Dynatrace
Splunk
ELK
Terraform
Ansible
Python
CI/CD Tools
AWS
Azure

Job description

Essential Key Technical Requirement:
  • Role: Datadog Engineer
  • Possess a degree in Computer Science/Information Technology or related fields.
  • At least 5 years of experience in Infrastructure, Cloud, or Site Reliability Engineering (SRE) related roles, with minimum 3 years in an SRE SME capacity, ideally within financial institutions or regulated environments.
  • Mandatory is : Should have recent 2+ years hands-on working experience asa Datadog administrator who can manage the Datadog platformend-to-end
  • Must have recent working experience in Datadog platform end-to-end
  • Must: Hands-on expertise with Observability Platforms: Datadog, Dynatrace, Splunk, ELK.
  • Must: Hands-on expertise with Automation/IaC: Terraform, Ansible, Python, CI/CD tools.
  • Must: Hands-on expertise with Cloud Platforms: AWS (CloudWatch, X-Ray, CloudTrail), Azure (Monitor, Log Analytics, App Insights).
  • Deep understanding of SRE principles, service health modelling, error budgets, and auto-remediation design.
  • Familiarity with financial sector operational resilience frameworks, regulatory compliance, and incident governance.
  • Certification in at least one of the following required :
  • Datadog CertifiedObservability Professional / Dynatrace Certified Associate
  • Terraform/Ansible/Python Certified Expert
  • Certification in the following will be advantageous:
  • AWSCertified DevOps Engineer / Azure DevOps Expert
  • SRE Foundation/Practitioner (DevOps Institute)ITIL v4 Managing Professional
Project Summary:

Develop and execute enterprise observability and service reliability strategy across all infrastructure and application domains, driving proactive monitoring, automation, and resilience initiatives.

Key Responsibilities:
  • ObservabilityStrategy and Governance:
    • Define and own Enterprise Observability Architecture aligned with operational resilience mandates (MAS TRM, DORA, APRA CPS 230).
    • Deploy and optimize observability platforms (Datadog, Dynatrace, Splunk) for full-stack visibility across infra, application, network, and user experience.
  • ReliabilityEngineering and Automation:
    • Implement SRE frameworks for infrastructure and business-critical applications.
    • Automate runbooks, alerts, self-healing actions, and auto-remediationworkflows via Python, Ansible, and Terraform.
Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Observability Engineer
Observability Engineer

U3 SOLUTIONS PTE. LTD. • Singapore

On-site
SGD 120,000 - 180,000
Datadog Engineer
Datadog Engineer

EXASOFT PTE. LTD. • Singapore

On-site
SGD 90,000 - 130,000
Datadog Engineer
Datadog Engineer

AVATAR MODERN TECHNO SERVICES PTE. LTD. • Singapore

On-site
SGD 90,000 - 130,000
Observability Engineer
Observability Engineer

U3 INFOTECH PTE. LTD. • Singapore

On-site
SGD 120,000 - 180,000
Senior Observability & Reliability Engineer
Senior Observability & Reliability Engineer

U3 INFOTECH PTE. LTD. • Singapore

On-site
SGD 120,000 - 180,000
Data Engineer - Observability / SRE
Data Engineer - Observability / SRE

NEXBRIDGE RECRUITMENT PTE. LTD. • Singapore

On-site
SGD 90,000 - 150,000
Observability Engineer - SRE / Cloud Data
Observability Engineer - SRE / Cloud Data

NEXBRIDGE RECRUITMENT PTE. LTD. • Singapore

On-site
SGD 90,000 - 150,000
Observability Engineer
Observability Engineer

GOLDTECH RESOURCES PTE LTD • Singapore

On-site
SGD 120,000 - 180,000
Senior Datadog Engineer - Observability & SRE Automation
Senior Datadog Engineer - Observability & SRE Automation

EXASOFT PTE. LTD. • Singapore

On-site
SGD 90,000 - 130,000
Observability Engineer
Observability Engineer

NSEARCH GLOBAL PTE. LTD. • Singapore

On-site
SGD 90,000 - 150,000