Senior SRE: Scale Systems with Automation & Observability

Tata Consultancy Services

Englewood Cliffs (NJ)

On-site

USD 110,000 - 125,000

Full time

2 days ago
Be an early applicant
Application generator

An application made for this job — a tailored resume and cover letter that speak straight to the posting.

Get past ATS filters

Job summary

Tata Consultancy Services in Englewood Cliffs, NJ is seeking a seasoned Site Reliability Engineer to design, implement, and operate highly available production systems. The role emphasizes automation, cloud proficiency, and strong Linux administration.

You will manage AWS services (EC2, RDS, S3, IAM, VPC), monitor health with Grafana/Prometheus, and participate in incident management with RCA. Collaboration with dev, QA, and support teams is essential.

Qualifications

  • 6-7 years of experience in SRE, production support, DevOps, or infra ops.
  • Strong Linux administration and troubleshooting.
  • Hands-on with AWS (EC2, RDS, IAM, VPC, CloudWatch, S3).
  • Experience with monitoring, alerting, observability tools.
  • Knowledge of incident management, RCA processes.
  • Automation and scripting with Shell and/or Python.
  • Working knowledge of PostgreSQL and MySQL.
  • Git version control and CI/CD concepts (Jenkins).

Responsibilities

  • Design, implement, and maintain highly available production systems.
  • Automate tasks and infra management using Shell, Python, Ansible, or Terraform.
  • Manage AWS services including EC2, RDS, S3, IAM, and VPC.
  • Perform Linux server administration, patching, and tuning.
  • Monitor health using Grafana, Prometheus, CloudWatch, Datadog, Splunk.
  • Participate in incident management and RCA activities.
  • Define and maintain SLIs, SLOs, and SLAs.
  • Support PostgreSQL and MySQL for basic admin tasks.
  • Collaborate with development, QA, cloud, and support teams.
  • Drive automation, observability, capacity planning, security, and best practices.
  • Participate in on-call and production issue resolution.

Skills

Linux administration
AWS
Monitoring & observability
Incident management
Automation scripting
PostgreSQL
MySQL
Git
CI/CD (Jenkins)

Tools

Jenkins
Ansible
Terraform
Grafana
Prometheus
Datadog
Splunk
CloudWatch

Job description

Tata Consultancy Services in Englewood Cliffs, NJ is seeking a seasoned Site Reliability Engineer to design, implement, and operate highly available production systems. The role emphasizes automation, cloud proficiency, and strong Linux administration.

You will manage AWS services (EC2, RDS, S3, IAM, VPC), monitor health with Grafana/Prometheus, and participate in incident management with RCA. Collaboration with dev, QA, and support teams is essential.

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Senior SRE & Automation Engineer (AWS, Observability)
Senior SRE & Automation Engineer (AWS, Observability)

Tata Consultancy Services • Englewood Cliffs (NJ)

On-site
USD 110,000 - 125,000
Senior SRE: Scale Reliability, Observability & Resilience
Senior SRE: Scale Reliability, Observability & Resilience

Early Warning Services LLC • Scottsdale (AZ)

Hybrid
USD 106,000 - 130,000
Healthcare Coverage
401(k) Retirement Plan
Paid Time Off
+2
Senior SRE: Scale Reliability & Observability
Senior SRE: Scale Reliability & Observability

Megaport • Abbeyville (CO)

On-site
USD 130,000 - 190,000
Contractor (PJ)
Paid Time Off
Competitive Compensation
+4
Senior SRE: Observability, Automation & Scalable Systems
Senior SRE: Observability, Automation & Scalable Systems

Replit • Northern (KY)

Hybrid
USD 140,000 - 190,000
Competitive Salary & Equity
401(k) 4% match (US)
Health, Dental, Vision & Life
+7
Senior SRE — Scale, Automation & Uptime
Senior SRE — Scale, Automation & Uptime

Hirebridge • Northern (KY)

Hybrid
USD 110,000 - 145,000
Bonus
SRE II: Scale Systems with Automation & Observability
SRE II: Scale Systems with Automation & Observability

DAT Freight & Analytics • Seattle (WA)

Hybrid
USD 95,000 - 134,000
Medical insurance
Dental insurance
Vision insurance
+5
Senior SRE - Scale, Reliability & Observability
Senior SRE - Scale, Reliability & Observability

SHEIN • San Diego (CA)

On-site
USD 92,000 - 149,000
Health Savings Account
Flexible Spending Accounts
401(k) Savings Plan
+2
Senior Site Reliability Engineer: Scale, Automate, Observe
Senior Site Reliability Engineer: Scale, Automate, Observe

TalentDome Staffing • United States

On-site
USD 140,000 - 210,000
Senior SRE: Observability & Automation Lead
Senior SRE: Observability & Automation Lead

ISO New England Inc. • Holyoke (MA)

Hybrid
USD 134,000 - 170,000
Enhanced 401(k) and financial planning
Tuition reimbursement and professional
Onsite gym and wellness programs
+4
Senior SRE: Observability, Automation & Hybrid Cloud
Senior SRE: Observability, Automation & Hybrid Cloud

Colorado-Public-Employees • Denver (CO)

Hybrid
USD 140,000 - 165,000
Hybrid work option
On-call rotation
Work from home eligibility