Senior Engineer Site Reliability Engineer

Tata Consultancy Services

Englewood Cliffs (NJ)

On-site

USD 110,000 - 125,000

Full time

11 days ago
Application generator

An application made for this job — a tailored resume and cover letter that speak straight to the posting.

Get past ATS filters

Job summary

Tata Consultancy Services in Englewood Cliffs, NJ is seeking a seasoned Site Reliability Engineer to design, implement, and operate highly available production systems. The role emphasizes automation, cloud proficiency, and strong Linux administration.

You will manage AWS services (EC2, RDS, S3, IAM, VPC), monitor health with Grafana/Prometheus, and participate in incident management with RCA. Collaboration with dev, QA, and support teams is essential.

Qualifications

  • 6-7 years of experience in SRE, production support, DevOps, or infra ops.
  • Strong Linux administration and troubleshooting.
  • Hands-on with AWS (EC2, RDS, IAM, VPC, CloudWatch, S3).
  • Experience with monitoring, alerting, observability tools.
  • Knowledge of incident management, RCA processes.
  • Automation and scripting with Shell and/or Python.
  • Working knowledge of PostgreSQL and MySQL.
  • Git version control and CI/CD concepts (Jenkins).

Responsibilities

  • Design, implement, and maintain highly available production systems.
  • Automate tasks and infra management using Shell, Python, Ansible, or Terraform.
  • Manage AWS services including EC2, RDS, S3, IAM, and VPC.
  • Perform Linux server administration, patching, and tuning.
  • Monitor health using Grafana, Prometheus, CloudWatch, Datadog, Splunk.
  • Participate in incident management and RCA activities.
  • Define and maintain SLIs, SLOs, and SLAs.
  • Support PostgreSQL and MySQL for basic admin tasks.
  • Collaborate with development, QA, cloud, and support teams.
  • Drive automation, observability, capacity planning, security, and best practices.
  • Participate in on-call and production issue resolution.

Skills

Linux administration
AWS
Monitoring & observability
Incident management
Automation scripting
PostgreSQL
MySQL
Git
CI/CD (Jenkins)

Tools

Jenkins
Ansible
Terraform
Grafana
Prometheus
Datadog
Splunk
CloudWatch

Job description

Job Description
Must Have Technical/Functional Skills
  • 6-7 years of experience in Site Reliability Engineering, Production Support, DevOps, or Infrastructure Operations.
  • Strong understanding of Linux administration and troubleshooting.
  • Hands-on experience with AWS cloud services (EC2, RDS, IAM, VPC, CloudWatch, S3).
  • Experience with monitoring, alerting, and observability tools.
  • Knowledge of incident management, problem management, and RCA processes.
  • Experience with automation and scripting using Shell and/or Python.
  • Working knowledge of PostgreSQL and MySQL databases.
  • Experience with Git version control.
  • Understanding of CI/CD concepts and tools such as Jenkins.
Roles & Responsibilities
  • Design, implement, and maintain highly available and reliable production systems.
  • Automate operational tasks and infrastructure management using Shell, Python, Ansible, or Terraform.
  • Manage and support AWS services including EC2, RDS, S3, IAM, VPC, CloudWatch, and related cloud services.
  • Perform Linux server administration, troubleshooting, patching, and performance tuning.
  • Monitor application and infrastructure health using tools such as Grafana, Prometheus, CloudWatch, Datadog, Splunk.
  • Participate in incident management, root cause analysis (RCA), and problem management activities.
  • Define and maintain SLIs, SLOs, and SLAs to ensure service reliability.
  • Support PostgreSQL and MySQL databases for operational and basic administration tasks.
  • Collaborate with development, QA, cloud, and support teams to improve system reliability and deployment processes.
  • Drive automation, observability, capacity planning, security, and operational best practices.
  • Participate in on-call support and production issue resolution.

Salary Range: $110,000-$125,000 a year

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

SRE Engineer
SRE Engineer

Tata Consultancy Services • Englewood Cliffs (NJ)

On-site
USD 110,000 - 125,000
Site Reliability Engineer
Site Reliability Engineer

Request Technology, LLC • Chicago (IL)

On-site
USD 150,000 - 155,000
Senior Site Reliability Engineer
Senior Site Reliability Engineer

MeridianLink, Inc. • Northern (KY)

On-site
USD 120,000 - 170,000
Site Reliability Engineer
Site Reliability Engineer

TalentDome Staffing • United States

On-site
USD 140,000 - 210,000
Site Reliability Engineering Manager
Site Reliability Engineering Manager

O.C. Tanner • Salt Lake City (UT)

On-site
USD 180,000 - 240,000
Site Reliability Engineer Lead
Site Reliability Engineer Lead

Good co India • United States

Remote
USD 120,000 - 160,000
Senior Site Reliability Engineer (AWS)
Senior Site Reliability Engineer (AWS)

MeridianLink, Inc. • United States

On-site
USD 120,000 - 160,000
Site Reliability Engineer
Site Reliability Engineer

Harvey Nash • United States

Remote
USD 120,000 - 150,000
Senior Site Reliability Engineer
Senior Site Reliability Engineer

Apply • Northern (KY)

On-site
USD 120,000 - 150,000
Senior Site Reliability Engineer
Senior Site Reliability Engineer

MeridianLink • United States

On-site
USD 140,000 - 180,000