Observability Engineer - Infrastructure & Application Monitoring

Nexus Recruitment Group

Pasig

On-site

PHP 900,000 - 1,500,000

Full time

2 days ago
Be an early applicant
Application generator

An application made for this job — a tailored resume and cover letter that speak straight to the posting.

Get past ATS filters

Job summary

Nexus Recruitment Group is seeking a highly technical Observability Engineer to enhance monitoring, logging, and alerting across enterprise systems, applications, and cloud infrastructure. This role is central to improving system reliability, availability, and performance by providing visibility into complex distributed environments in financial or high-regulation industries.

The ideal candidate has experience implementing observability tools and best practices in cloud-native and hybrid

Qualifications

  • Bachelor's degree in CS/IT or related field.
  • 3–5 years in observability, monitoring, or SRE in enterprise/cloud environments.
  • Hands-on with Grafana/Prometheus/ELK; experience with Datadog/AppDynamics or similar.
  • Knowledge of AWS/Azure/GCP, Kubernetes, and microservices.
  • Scripting (Python/Bash) and IaC (Terraform/Ansible) is a plus.
  • Strong analytics and collaboration across DevOps/SRE teams.

Responsibilities

  • Design, implement, and maintain observability frameworks across systems and infrastructure.
  • Deploy and configure monitoring tools to ensure visibility into health.
  • Work with DevOps, infra, and apps teams to define SLOs/SLAs and alerts.
  • Develop dashboards, metrics, and synthetic monitoring for real-time insights.
  • Support RCAs and post-incident reviews with actionable data.
  • Automate alerting and anomaly detection to reduce MTTR/MTTD.
  • Establish observability standards across teams.
  • Support monitoring integrations in CI/CD pipelines.

Skills

Observability
SRE
Cloud experience
Scripting
Terraform

Education

Bachelor's degree in CS/IT

Tools

Grafana
Prometheus
ELK
Datadog
AppDynamics
New Relic

Job description

Observability Engineer - Infrastructure & Application Monitoring

Job Openings Observability Engineer - Infrastructure & Application Monitoring

About the job Observability Engineer - Infrastructure & Application Monitoring
Job Summary:

We are seeking a highly technical and proactive Observability Engineer to enhance monitoring, logging, and alerting capabilities across enterprise systems, applications, and cloud infrastructure. This role is central to improving system reliability, availability, and performance by providing visibility into complex distributed environments in financial or high-regulation industries.

The ideal candidate has experience implementing observability tools and best practices in cloud-native and hybrid environments, with a strong foundation in infrastructure monitoring, APM (Application Performance Monitoring), and log analytics.

Key Responsibilities:
  • Design, implement, and maintain observability frameworks across systems, services, and infrastructure.
  • Deploy and configure monitoring tools (e.g., Prometheus, Grafana, Datadog, New Relic, AppDynamics, ELK) to ensure visibility into application and system health.
  • Work closely with DevOps, infrastructure, and application teams to define SLOs, SLAs, and alerts for proactive incident management.
  • Develop dashboards, custom metrics, and synthetic monitoring for real-time performance insights.
  • Support root cause analysis and post-incident reviews with actionable monitoring data.
  • Automate alerting and anomaly detection to reduce mean time to detect (MTTD) and mean time to resolve (MTTR).
  • Establish observability standards and best practices across development and operations teams.
  • Provide support for integration of monitoring into CI/CD pipelines and deployment workflows.
Qualifications:
  • Bachelors degree in Computer Science, Information Technology, or related field.
  • 3-5 years of experience in systems monitoring, observability, or SRE within enterprise or cloud environments.
  • Hands-on experience with observability platforms like Grafana, Prometheus, ELK, Datadog, AppDynamics, or similar tools.
  • Solid understanding of cloud services (AWS, Azure, or GCP), container orchestration (Kubernetes), and microservice architectures.
  • Proficiency in scripting (Python, Bash, etc.) and infrastructure-as-code (Terraform, Ansible) is a plus.
  • Familiarity with log aggregation, APM tools, distributed tracing, and alerting configurations.
  • Strong analytical and troubleshooting skills, with an ability to interpret system metrics and logs effectively.
  • Excellent communication and collaboration skills in cross-functional DevOps/SRE teams.
Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Observability Engineer: Infra & App Monitoring
Observability Engineer: Infra & App Monitoring

Nexus Recruitment Group • Pasig

On-site
PHP 900,000 - 1,500,000
Site Reliability Engineer - Cloud & Platform Resilience
Site Reliability Engineer - Cloud & Platform Resilience

Nexus Recruitment Group • Pasig

On-site
PHP 900,000 - 1,300,000
Senior ITSMA Observability Engineer
Senior ITSMA Observability Engineer

HedgeServ • Manila

On-site
PHP 1,200,000 - 1,800,000
Observability & AIOps Architect | 3i Infotech | Navi Mumbai, India
Observability & AIOps Architect | 3i Infotech | Navi Mumbai, India

Tech Junction Ltd • Hinoba-an

On-site
PHP 2,653,000 - 4,642,000
Site Reliability Engineer
Site Reliability Engineer

Oliver Bernard • España

On-site
PHP 4,891,684 - 6,568,832
Observability Engineer
Observability Engineer

Avaloq Philippines Inc. • Makati

Hybrid
PHP 900,000 - 1,300,000
Hybrid work model
Flexible working
Splunk Manager - Performance & Observability Engineering
Splunk Manager - Performance & Observability Engineering

Axos Business Center • Manila

On-site
PHP 1,200,000 - 1,800,000
Site Reliability Engineer | Hybrid - Centris/Makati
Site Reliability Engineer | Hybrid - Centris/Makati

TASQ • Makati

Hybrid
PHP 900,000 - 1,500,000
Lead DevOps Engineer
Lead DevOps Engineer

iScale Solutions • Philippines

On-site
PHP 900,000 - 1,500,000
Site Reliability Engineer | Hybrid - Centris/Makati
Site Reliability Engineer | Hybrid - Centris/Makati

Tasq Work • Makati

On-site
PHP 1,500,000 - 2,300,000
Hybrid work arrangement
Night shift