Site Reliability Engineer III — Hybrid Onsite/Remote

US Diversity Job Search

Pennington (NJ)

On-site

USD 84,000 - 119,000

Full time

14 days+
Application generator

Don’t send a generic resume — generate a resume and cover letter tailored to this exact role.

Get past ATS filters

Job summary

BCforward is seeking a Site Reliability Engineer III to design, build, and operate tooling, automation frameworks, and observability capabilities for critical trading services at scale.

The role emphasizes reliability, incident management, CI/CD, cloud migration, and collaboration with cross-functional teams; onsite 4 days weekly for the first six months, then 3 days onsite and 2 days remote.

Qualifications

  • Strong Linux administration and troubleshooting skills.
  • Proficiency in Python and Shell scripting or similar automation languages.
  • Hands-on experience with observability platforms such as Dynatrace, Splunk, Grafana, and Prometheus.
  • Experience implementing monitoring, alerting, and operational dashboards.
  • Incident management, production support, and root cause analysis expertise.
  • Experience integrating systems via APIs and service interfaces.
  • Knowledge of cloud platforms and distributed systems architecture.
  • Experience with CI/CD pipelines and deployment automation.
  • Understanding of database technologies such as MySQL and MongoDB, and familiarity with Node.js.
  • Strong analytical, problem-solving, and debugging skills.
  • Experience in a Site Reliability Engineering organization with cross-team collaboration.
  • Hands-on experience defining and implementing SLIs, SLOs, and error budgets.

Responsibilities

  • Design, develop, and maintain SRE tooling, automation frameworks, and engineering utilities.
  • Implement and optimize observability using Dynatrace, Splunk, Grafana, and Prometheus.
  • Define and operationalize SLIs, SLOs, and error budgets to improve service reliability.
  • Build monitoring, alerting, and operational dashboards to support production excellence.
  • Lead and support incident management, root cause analysis, and continuous improvement actions.
  • Integrate systems and services through APIs and service interfaces to streamline workflows.
  • Contribute to CI/CD pipeline design and deployment automation for reliable releases.
  • Partner with application, infrastructure, and production support teams to embed SRE practices.
  • Conduct reliability engineering, resiliency assessments, and operational readiness reviews.
  • Support cloud migration and modernization programs with reliable architectures.

Skills

Linux
Python
Shell scripting
Dynatrace
Splunk
Grafana
Prometheus
APIs
CI/CD
Cloud platforms
OpenTelemetry
MySQL
MongoDB
Node.js

Tools

Kubernetes
OpenShift
Terraform
Ansible
OpenTelemetry

Job description

BCforward is seeking a Site Reliability Engineer III to design, build, and operate tooling, automation frameworks, and observability capabilities for critical trading services at scale.

The role emphasizes reliability, incident management, CI/CD, cloud migration, and collaboration with cross-functional teams; onsite 4 days weekly for the first six months, then 3 days onsite and 2 days remote.

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Senior Site Reliability Engineer Observability & Automation
Senior Site Reliability Engineer Observability & Automation

Artha Nexgen • Northern (KY)

Hybrid
USD 150,000 - 156,000
Contract 7 months
Onsite 4 days/week
Remote 2 days
Site Reliability Engineer III
Site Reliability Engineer III

US Diversity Job Search • Pennington (NJ)

On-site
USD 84,000 - 119,000
B Site Reliability Engineer Iii BC Forward Pennington, New Jersey, US $73.67-73.67
B Site Reliability Engineer Iii BC Forward Pennington, New Jersey, US $73.67-73.67

Artha Nexgen • Northern (KY)

Hybrid
USD 150,000 - 156,000
Contract 7 months
Onsite 4 days/week
Remote 2 days
Site Reliability Engineer
Site Reliability Engineer

Optomi • Charlotte (NC)

On-site
USD 120,000 - 180,000
Senior Cloud Reliability Engineer — Remote/Hybrid
Senior Cloud Reliability Engineer — Remote/Hybrid

Western National Group & Umialik Insurance • Edina (MN)

Hybrid
USD 112,000 - 161,000
Medical insurance
Dental and Vision insurance
401(k) matching
+2
Hybrid Site Reliability Engineer - Cloud, CI/CD & Infra
Hybrid Site Reliability Engineer - Cloud, CI/CD & Infra

Interactive Brokers • Greenwich (CT)

Hybrid
USD 110,000 - 140,000
Competitive salary and annual performance-based bonus
401(k) retirement plan
Excellent health and wellness benefits
+3
Site Reliability Engineer III _Hybrid (w2 only )
Site Reliability Engineer III _Hybrid (w2 only )

Prudent Technologies and Consulting, Inc. • Arlington (TX)

Hybrid
USD 110,000 - 130,000
Senior Site Reliability Engineer: Scalable Infra & Observability
Senior Site Reliability Engineer: Scalable Infra & Observability

Early Warning • Chicago (IL)

Hybrid
USD 106,000 - 130,000
Healthcare Coverage
401(k) Matching
Paid Time Off
+1
Senior Site Reliability Engineer - Hybrid, High Impact
Senior Site Reliability Engineer - Hybrid, High Impact

Early Warning • Scottsdale (AZ)

Hybrid
USD 106,000 - 156,000
Healthcare Coverage
401(k) Retirement Plan
Paid Time Off
+2
Senior Site Reliability Engineer: Scalable Hybrid Infra
Senior Site Reliability Engineer: Scalable Hybrid Infra

Redwood Materials • Nevada (IA)

On-site
USD 140,000 - 180,000