Senior Site Reliability Engineer Observability & Automation

Artha Nexgen

Northern (KY)

Hybrid

USD 150,000 - 156,000

Full time

8 days ago
Application generator

Turn this role into an interview — a resume and cover letter built around what this employer wants.

Get past ATS filters

Benefits offered by this job

Contract 7 months
Onsite 4 days/week
Remote 2 days

Job summary

BCforward is seeking a Site Reliability Engineer III to design, build, and support tooling, automation frameworks, and observability capabilities for critical trading and business services. The role emphasizes SRE best practices, operational efficiency, and reliability improvements.

The position starts onsite four days per week for six months, then shifts to three onsite and two remote days. The candidate will contribute to CI/CD and cloud modernization efforts, working with multiple teams to

Qualifications

  • Strong Linux administration and troubleshooting.
  • Proficiency in Python and Shell scripting or similar automation languages.
  • Hands-on experience with observability platforms such as Dynatrace, Splunk, Grafana, and Prometheus.
  • Experience implementing monitoring, alerting, and operational dashboards.
  • Incident management, production support, and root cause analysis expertise.
  • Experience integrating systems via APIs and service interfaces.
  • Knowledge of cloud platforms and distributed systems architecture.
  • Experience with CI/CD pipelines and deployment automation.
  • Understanding of database technologies such as MySQL and MongoDB, and familiarity with Node.js.
  • Strong analytical, problem-solving, and debugging skills.
  • Experience in a Site Reliability Engineering organization with cross-team collaboration.
  • Hands-on experience defining and implementing SLIs, SLOs, and error budgets.

Responsibilities

  • Design, develop, and maintain SRE tooling, automation frameworks, and engineering utilities.
  • Implement and optimize observability using platforms such as Dynatrace, Splunk, Grafana, and Prometheus.
  • Define and operationalize SLIs, SLOs, and error budgets to improve service reliability.
  • Build monitoring, alerting, and operational dashboards to support production excellence.
  • Lead and support incident management, root cause analysis, and continuous improvement actions.
  • Integrate systems and services through APIs and service interfaces to streamline workflows.
  • Contribute to CI/CD pipeline design and deployment automation for reliable releases.
  • Partner with application, infrastructure, and production support teams to embed SRE practices.
  • Conduct reliability engineering, resiliency assessments, and operational readiness reviews.
  • Support cloud migration and modernization programs with reliable architectures.

Skills

Linux administration
Python scripting
Dynatrace
Prometheus
Grafana
CI/CD pipelines
APIs integration
Cloud platforms
MySQL
MongoDB
OpenTelemetry

Tools

Kubernetes
Terraform
Ansible
OpenShift

Job description

BCforward is seeking a Site Reliability Engineer III to design, build, and support tooling, automation frameworks, and observability capabilities for critical trading and business services. The role emphasizes SRE best practices, operational efficiency, and reliability improvements.

The position starts onsite four days per week for six months, then shifts to three onsite and two remote days. The candidate will contribute to CI/CD and cloud modernization efforts, working with multiple teams to

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Site Reliability Engineer III — Hybrid Onsite/Remote
Site Reliability Engineer III — Hybrid Onsite/Remote

US Diversity Job Search • Pennington (NJ)

On-site
USD 84,000 - 119,000
Site Reliability Engineer III
Site Reliability Engineer III

US Diversity Job Search • Pennington (NJ)

On-site
USD 84,000 - 119,000
B Site Reliability Engineer Iii BC Forward Pennington, New Jersey, US $73.67-73.67
B Site Reliability Engineer Iii BC Forward Pennington, New Jersey, US $73.67-73.67

Artha Nexgen • Northern (KY)

Hybrid
USD 150,000 - 156,000
Contract 7 months
Onsite 4 days/week
Remote 2 days
Senior Staff SRE — Reliability, Observability & Automation
Senior Staff SRE — Reliability, Observability & Automation

Early Warning Services LLC • Scottsdale (AZ)

Hybrid
USD 150,000 - 200,000
Healthcare coverage
401(k) with company match
Paid time off & holidays
+2
Senior Site Reliability Engineer — Remote, AWS & Observability
Senior Site Reliability Engineer — Remote, AWS & Observability

Prove • United States

Hybrid
USD 140,000 - 190,000
Wellbeing reimbursement
401k Match
Parental Leave Policy
+5
Senior Site Reliability Engineer – Observability & Cloud
Senior Site Reliability Engineer – Observability & Cloud

Cosm Inc. • El Segundo (CA), Northern (KY)

Hybrid
USD 110,000 - 145,000
Senior SRE - Hybrid, Observability & Reliability
Senior SRE - Hybrid, Observability & Reliability

Early Warning Services LLC • Chicago (IL)

Hybrid
USD 106,000 - 130,000
Healthcare Coverage
401(k) Plan with match
PTO and Holidays
+1
Senior SRE: Scale Reliability, Observability & Resilience
Senior SRE: Scale Reliability, Observability & Resilience

Early Warning Services LLC • Scottsdale (AZ)

Hybrid
USD 106,000 - 130,000
Healthcare Coverage
401(k) Retirement Plan
Paid Time Off
+2
Senior SRE: AI-Driven Observability & Auto‑Remediation
Senior SRE: AI-Driven Observability & Auto‑Remediation

RiseMe • Minneapolis (MN)

On-site
USD 80,000 - 140,000
Total Rewards Program
Bonuses and flexible benefits
Stock options
+3
Remote Site Reliability Engineer - Observability Expert
Remote Site Reliability Engineer - Observability Expert

Codevertex Innovations • Northern (KY)

Hybrid
USD 140,000 - 195,000