Site Reliability Engineer (SRE)

Blackfort Consulting, Inc..

Pateros

On-site

PHP 1,200,000 - 2,000,000

Full time

5 days ago
Be an early applicant
Application generator

Turn this role into an interview — a resume and cover letter built around what this employer wants.

Get past ATS filters

Job summary

Blackfort Consulting, Inc. is seeking a senior Reliability Engineer to drive SRE adoption, define SLOs/SLIs, and lead incident management across platforms. You will design automation, perform capacity planning, and partner with cross-functional teams to improve availability and performance.

You will mentor engineers, conduct post-incident reviews, and implement NFRs throughout the software lifecycle. The ideal candidate has 5+ years in SRE/DevOps, strong English, and hands-on experience with

Qualifications

  • Bachelor's degree in Computer Science, Information Technology, Software Engineering, or related discipline.
  • Experience defining, implementing, and managing SLOs, SLIs, and Error Budgets.
  • Minimum 5 years in SRE/DevOps/Platform Engineering or related roles.

Responsibilities

  • Drive SRE adoption with SLOs/SLIs and error budgets.
  • Design automation to improve efficiency and reliability.
  • Lead incident management and post-incident reviews.

Skills

SRE principles
Cross-functional collaboration
Incident management
RCA & post-incident reviews
Automation engineering
Monitoring & observability
Python / scripting
Cloud & container tech

Education

Bachelor's degree in CS/IT/Software Eng

Tools

Prometheus
Grafana
Dynatrace / Datadog / Splunk
Kubernetes
Docker
IaC / GitOps tooling

Job description

Job Description
Reliability Engineering & Operations
  • Drive the adoption of Site Reliability Engineering (SRE) principles, including Service Level Objectives (SLOs), Service Level Indicators (SLIs), Error Budgets, monitoring, and alerting.
  • Design and implement automation solutions that improve operational efficiency, reduce manual effort, and increase service reliability.
  • Perform capacity planning, performance analysis, and system design to ensure platforms can scale effectively with business growth.
  • Lead troubleshooting efforts for complex production issues and perform root cause analyses (RCA) to prevent recurrence.
  • Participate in incident management processes, including major incidents, service outages, and on-call support when required.
  • Conduct post-incident reviews and drive corrective and preventive actions to continuously improve platform stability.
  • Leverage operational metrics and data-driven insights to proactively identify and mitigate potential risks.
  • Support engineering teams in adopting tools, processes, and best practices that improve reliability, maintainability, scalability, and extensibility.
  • Collaborate across Enterprise Platform teams to ensure standardized platforms meet enterprise-grade reliability and performance standards.
  • Champion the implementation of Non-Functional Requirements (NFRs), including availability, performance, security, and resilience, throughout the software development lifecycle.
  • Lead deep-dive investigations into problematic applications and services, identifying opportunities for architectural and operational improvements.
  • Oversee vulnerability management, platform lifecycle governance, and End-of-Life (EOL) remediation activities across supported products and services.
Leadership & Strategic Responsibilities

As a senior member of the team, you will:

  • Lead and coordinate strategic initiatives and key deliverables within the Platform SRE function.
  • Serve as an advocate for SRE principles and operational excellence across the Enterprise Platform organization and broader business community.
  • Review engineering practices, operational processes, and team outputs to drive continuous improvement.
  • Foster strong collaboration with development, infrastructure, security, and business teams.
  • Contribute to the long-term strategy, roadmap, and maturity of the Platform SRE function.
Required Qualifications
  • Bachelor's degree in Computer Science, Information Technology, Software Engineering, or a related discipline.
  • Practical experience defining, implementing, and managing SLOs, SLIs, and Error Budgets.
  • Minimum of 5 years of experience supporting and operating production environments in SRE, DevOps, Platform Engineering, or related roles.
  • Experience or familiarity with monitoring and observability tools (e.g., Prometheus, preferably Grafana)
  • Professional fluency in English.
  • Proven ability to collaborate effectively within cross-functional teams.
  • Strong commitment to continuous learning, operational excellence, and continuous improvement.
Preferred Qualifications
  • Experience with Infrastructure as Code (IaC) and GitOps practices.
  • Knowledge of CI/CD platforms such as GitHub Actions, Jenkins, Azure DevOps, or GitLab.
  • Experience implementing Auto-Remediation and AIOps capabilities.
  • Understanding of security best practices, vulnerability management, and compliance frameworks.
  • AWS, Kubernetes, Terraform, or SRE-related certifications are advantageous.
  • Hands-on experience with observability, monitoring, logging, and alerting platforms such as Dynatrace, Datadog, Splunk, or similar tools.
  • Experience building automation solutions using technologies such as Python, Shell Scripting, PowerShell, Terraform, Ansible, Chef, Puppet, SQL, or equivalent.
  • Experience supporting middleware and platform technologies, including databases, web servers, messaging systems (MQ), and Kafka.
  • Familiarity with containerization and orchestration technologies such as Docker and Kubernetes.
Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Site Reliability Engineer (SRE)
Site Reliability Engineer (SRE)

Astek • Santo Niño 1st

On-site
PHP 1,100,000 - 1,900,000
Site Reliability & Cloud Operations Engineer (SRE)
Site Reliability & Cloud Operations Engineer (SRE)

CloudRaiden • Metro Manila

On-site
PHP 900,000 - 1,700,000
VS01700 - SRE & Production Reliability Engineer
VS01700 - SRE & Production Reliability Engineer

E4 Software Services Pvt Ltd. • Hinoba-an

On-site
PHP 893,000 - 1,674,000
Site Reliability Engineer
Site Reliability Engineer

V2 Solutions • Hinoba-an

On-site
PHP 900,000 - 1,500,000
Technical Lead - Site Reliability Engineering
Technical Lead - Site Reliability Engineering

LSEG • Taguig

On-site
PHP 4,914,004 - 7,371,007
Healthcare
Retirement planning
Paid volunteering days
+1
SRE (Site Reliability Engineer)
SRE (Site Reliability Engineer)

GCash • Manila

On-site
PHP 892,800 - 1,116,000
Opportunity for career growth and development
Dynamic collaborative team environment
Highly competitive compensation and benefits package
Platform Site Reliability Engineer (SRE)
Platform Site Reliability Engineer (SRE)

Broadridge • Metro Manila

On-site
PHP 1,000,000 - 1,500,000
Platform Site Reliability Engineer (SRE)
Platform Site Reliability Engineer (SRE)

Broadridge Connectivity Solutions • Manila

On-site
PHP 1,000,000 - 1,600,000
Principal SRE Engineer/ Architect
Principal SRE Engineer/ Architect

InfoVision Inc. • Mexico

On-site
PHP 1,800,000 - 3,000,000
Competitive salary and benefits
Career growth opportunities
Associate Site Reliability Engineer
Associate Site Reliability Engineer

Railway Corp • Mexico

On-site
PHP 5,474,000 - 7,908,000