Senior Site Reliability Engineer: Cloud & Observability

Omilia

Philippines

On-site

PHP 1,000,000 - 1,800,000

Full time

14 days+

Get more replies from employers

Send a job-specific resume in minutes.

Benefits offered by this job

Fixed compensation
Vacation leaves
Professional development opportunities
Global impact projects
Friendly colleagues
Apple gear

Job summary

Omilia is seeking a Senior Site Reliability Engineer with strong cloud platform experience to join a team responsible for operating and maintaining production clusters and building observability solutions. You will contribute to automation, monitoring, alerting, and reliability across environments.

You will collaborate with engineering squads to embed reliability into the software delivery lifecycle and develop runbooks, dashboards, and run-time tooling.

Qualifications

  • Bachelor's/Master's in Engineering or equivalent.
  • Experience operating Kubernetes or Docker Swarm.
  • Experience with production services at scale.
  • Experience with ELK.
  • Experience with AWS.
  • Experience with Grafana/Prometheus stack.
  • Strong scripting skills (Bash, Python or Go).
  • Excellent communication skills.
  • Think creatively and work in agile/lean environments.
  • Team player and cross-functional collaboration.

Responsibilities

  • Ensure platform reliability and availability across production and pre-production environments through proactive monitoring, alerting, and automation.
  • First response for incidents, contribute to problem management and root cause analysis.
  • Support development team toward reliability, embedding reliability into the lifecycle.
  • Develop troubleshooting documentation for production support resources.
  • Collaborate with Engineering teams to develop runbooks, documentation and automation of tasks.
  • Embed reliability and performance into the software delivery lifecycle.
  • Design, implement observability solutions (metrics, logs, traces, dashboards) using Prometheus, Grafana, ELK.
  • Participate in on-call rotations and improve alert quality and response processes.
  • Champion a culture of reliability, performance, and continuous improvement.

Skills

Team collaboration
Proactive problem solving
Strong communication
Agile/lean mindset

Education

Bachelor's or MS in Engineering or equivalent

Tools

Kubernetes
Docker Swarm
ELK
Prometheus
Grafana
AWS
Bash/Python/Go

Job description

Omilia is seeking a Senior Site Reliability Engineer with strong cloud platform experience to join a team responsible for operating and maintaining production clusters and building observability solutions. You will contribute to automation, monitoring, alerting, and reliability across environments.

You will collaborate with engineering squads to embed reliability into the software delivery lifecycle and develop runbooks, dashboards, and run-time tooling.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Senior Site Reliability Engineer: Cloud Observability Lead
Senior Site Reliability Engineer: Cloud Observability Lead

Omilia Natural Language Solutions Ltd • Philippines

Remote
PHP 1,200,000 - 1,600,000
Fixed compensation
Long-term employment with vacation days
Professional growth development
+3
Senior Site Reliability Engineer
Senior Site Reliability Engineer

Doist • Philippines

On-site
PHP 1,500,000 - 2,700,000
Senior Site Reliability Engineer
Senior Site Reliability Engineer

Omilia • Philippines

On-site
PHP 1,000,000 - 1,800,000
Fixed compensation
Vacation leaves
Professional development opportunities
+3
Senior SRE: Cloud Reliability, Observability & Automation
Senior SRE: Cloud Reliability, Observability & Automation

Doist • Philippines

On-site
PHP 1,500,000 - 2,700,000
Senior Site Reliability Engineer - Cloud & Observability
Senior Site Reliability Engineer - Cloud & Observability

Dencom Consultancy and Manpower Services • Parañaque

On-site
Senior Observability Engineer - Hybrid & Cloud
Senior Observability Engineer - Hybrid & Cloud

Avaloq • Makati

Hybrid
PHP 900,000 - 1,500,000
Hybrid work model
Flexible working
Senior Data Platform Reliability Engineer
Senior Data Platform Reliability Engineer

TerraBarn Inc. • Cebu City

On-site
PHP 1,200,000 - 2,400,000
HMO
Site Reliability Engineer — Automation & Observability Lead
Site Reliability Engineer — Automation & Observability Lead

Trends Group, Inc. • Makati

On-site
PHP 900,000 - 1,500,000
Senior SRE - Cloud Automation & Observability
Senior SRE - Cloud Automation & Observability

broadridge • Philippines

Hybrid
PHP 1,000,000 - 2,400,000
Hybrid work model
Senior SRE: Cloud Reliability, Automation & Observability
Senior SRE: Cloud Reliability, Automation & Observability

Broadridge Financial Solutions • Manila, Hinoba-an

On-site
PHP 1,800,000 - 2,600,000