Site Reliability Engineer

TechDigital Group

Englewood Cliffs (NJ)

On-site

USD 110,000 - 130,000

Full time

14 days+

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

A leading tech firm is seeking a DevOps/SRE professional to enhance observability across production systems and maintain SLIs/SLOs. Candidates should have 5+ years of experience with high-traffic platforms, CI/CD pipelines, and cloud services like AWS or GCP. Strong scripting skills in Python, Bash, or Groovy are essential. The role involves participating in on-call rotations and supporting performance excellence across digital platforms. Competitive compensation and benefits offered.

Qualifications

  • 5+ years of experience managing and supporting high-traffic digital platforms.
  • Strong experience with CI/CD pipelines and deployment automation.
  • Experience supporting large scale websites, mobile and OTT applications, microservices, APIs, and distributed systems.

Responsibilities

  • Support and enhance observability across production systems.
  • Help maintain SLIs/SLOs for key services.
  • Participate in incident response and on-call rotations for critical services.

Skills

CI/CD
AWS
GCP
Python
Bash
Groovy
Datadog
Ansible
JMeter

Tools

Terraform
Chef
New Relic
AppDynamics

Job description

Mandatory skill

CI/CD, AWS and/or GCP, Python or Bash or Groovy, monitoring tools like Datadog, Ansible, JMeter.

Key Responsibilities
  • Support and enhance observability (monitoring, logging, alerting) across production systems
  • Help maintain SLIs/SLOs for key services
  • Participate in evaluating services for production readiness
  • Collaborate with development teams to identify reliability risks and improve system architecture
  • Contribute to automation of operations, including CI/CD pipelines, incident response, and infrastructure provisioning
  • Participate in incident response and on-call rotations for critical services
  • Contribute to post-incident analysis and drive reliability improvements
  • Partner with security, infrastructure, and product teams to support performance, compliance, and operational excellence
Must-Haves
  • Willingness to work onsite and participate in a 24/7 on-call rotation as needed
  • 5+ years of experience managing and supporting high-traffic digital platforms
  • Strong experience with CI/CD pipelines and deployment automation
  • Experience with cloud platforms such as AWS and/or GCP
  • Solid scripting skills (e.g., Python, Bash, Groovy)
  • Hands-on experience with observability and monitoring tools like Datadog, New Relic, AppDynamics, or similar
  • Understanding of web, mobile, and OTT architectures
  • Experience supporting large scale websites, Mobile and OTT applications, microservices, APIs, and distributed systems
  • Experience with infrastructure-as-code tools such as Ansible, Terraform, or Chef
  • Familiarity with performance testing tools like JMeter or k6
  • Hands on experience with debugging tools like Charles Proxy or Fiddler
Preferred Qualifications
  • Experience working with CDNs (e.g., Akamai) and reverse proxies (e.g., NGINX, Varnish)
  • Exposure to video streaming platforms and Familiarity with application/infrastructure security controls and best practices
  • Certifications in SRE, DevOps, or Performance Engineering are a plus
Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Site Reliability Engineer
Site Reliability Engineer

Shrive Technologies LLC • Schaumburg (IL)

On-site
USD 110,000 - 170,000
Site Reliability Engineer
Site Reliability Engineer

Shrive Technologies • Schaumburg (IL)

On-site
USD 120,000 - 180,000
Site Reliability Engineer
Site Reliability Engineer

TalentDome Staffing • United States

On-site
USD 140,000 - 210,000
Site Reliability Engineer
Site Reliability Engineer

TechDigital Group • Houston (TX), Juno Beach (FL)

On-site
USD 120,000 - 180,000
Site Reliability Engineer
Site Reliability Engineer

SRE • Puerto Rico

Hybrid
USD 120,000 - 180,000
Site Reliability Engineer
Site Reliability Engineer

Jobtailor • New Hampshire

On-site
USD 110,000 - 160,000
Site Reliability Engineer
Site Reliability Engineer

Jobtailor • California (MO)

Hybrid
USD 120,000 - 160,000
SRE/Ops Engineer
SRE/Ops Engineer

L&T Technology Services • Englewood (NJ)

On-site
USD 80,000 - 110,000
Paid Leave
Health Insurance
Group Life Insurance
+2
Site Reliability Engineer (SRE)
Site Reliability Engineer (SRE)

Virtual Tech Gurus • Puerto Rico

On-site
USD 140,000 - 210,000
Senior Site Reliability Engineer
Senior Site Reliability Engineer

Veloc Inc • Coppell (TX)

On-site
USD 140,000 - 190,000