Site Reliability Engineer

Infitoo Systems

Dadri

On-site

INR 2,400,000 - 3,600,000

Full time

5 days ago
Be an early applicant
Application generator

Don’t send a generic resume — generate a resume and cover letter tailored to this exact role.

Get past ATS filters

Job summary

Infitoo Systems is seeking an experienced Site Reliability Engineer (SRE) to own the reliability of production workloads. The role involves incident management, MTTR improvements, and platform engineering on AWS EKS, with a strong emphasis on automation and scalable CI/CD practices.

You will implement IaC, manage multi-account AWS environments, and enforce security and observability standards. This onsite, Noida-based role targets professionals with 5–10 years of relevant experience.

Qualifications

  • 5–10 years of experience in SRE/DevOps
  • Strong experience with Kubernetes, AWS and CI/CD
  • Hands-on with IaC tools (Terraform, CloudFormation, CDK)
  • Experience with incident management, postmortems and RCA
  • Knowledge of monitoring, logging and tracing tools

Responsibilities

  • Own availability, latency, performance, and capacity of production workloads.
  • Define and track SLIs, SLOs, error budgets, and reliability KPIs.
  • Lead incident management including on-call, triage, RCA, postmortems, and preventive actions.
  • Improve MTTR through automation, runbooks, and self-healing mechanisms.
  • Operate and improve AWS EKS clusters and deployment strategies (Blue/Green, Canary).
  • Configure security controls (RBAC, Network Policies, Secrets Management).
  • Promote IaC and Git-based deployment across environments.
  • Implement observability via CloudWatch/OpenSearch/OpenTelemetry.

Skills

SRE core
Incident management
Automation
Cloud fundamentals
On-call readiness

Tools

AWS
Kubernetes
GitHub Actions
Jenkins
GitLab CI
Helm & Kustomize
Terraform

Job description

Full time role with Client (no third party)

Role : SRE (Site Reliability Engineer)

Location: Noida

Exp-5 to 10 years

Employment type- Full time (Onsite)

Note- Immediate joiners preferred

Reliability & Operations (SRE Core)

  • Own the availability, latency, performance, and capacity of production workloads.
  • Define and track SLIs, SLOs, error budgets, and reliability KPIs.
  • Lead incident management, including on-call support, triage, root cause analysis (RCA), postmortems, and preventive actions.
  • Improve Mean Time to Recovery (MTTR)through automation, runbooks, and self-healing mechanisms.

Kubernetes & Platform Engineering (EKS)
  • Operate and continuously improve AWS EKSclusters across multiple namespaces and environments.
  • Manage deployments using Helmand Kustomize, enabling safe rollout strategies such as Blue/Greenand Canary deployments.
  • Configure and manage:
  • AWS ALB/NLB Ingress
  • Service Discovery
  • Horizontal Pod Autoscaler (HPA)
  • Vertical Pod Autoscaler (VPA)
  • Cluster Autoscaler
  • Enforce Kubernetes security using:
  • RBAC
  • Network Policies
  • Pod Security Standards
  • Secrets Management

CI/CD & Release Engineering
  • Build and maintain CI/CD pipelines using GitHub Actions, Jenkins, or GitLab CI(based on organizational standards).
  • Promote an "Everything as Code"approach by storing infrastructure, application configurations, and deployment manifests in Git.

Infrastructure as Code (IaC) & Cloud Automation
  • Provision and manage cloud infrastructure using Terraform, AWS CloudFormation, or AWS CDK.
  • Manage multi-account AWS environments using IAM roles, federation, and AWS SSO.
  • Implement cloud cost optimization practices, including:
  • Resource tagging standards
  • Budget alerts
  • Right-sizing recommendations
  • Savings Plans guidance

Observability (Monitoring, Logging & Tracing):
  • CloudWatch, ELK, or OpenSearch.
  • Enable distributed tracing using OpenTelemetry, AWS X-Ray, or Jaeger, where applicable.

Security & Governance (DevSecOps):
  • Implement application and edge security using AWS WAFand CloudFront, ensuring controlled and secure rollouts.
Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Site Reliability Engineer
Site Reliability Engineer

Mumba Technologies, Inc. • Gurugram District

Hybrid
INR 2,500,000 - 4,000,000
Senior Site Reliability Engineer
Senior Site Reliability Engineer

VMC Soft Technologies, Inc • Hyderabad

Hybrid
INR 1,500,000 - 2,000,000
Site Reliability Engineer
Site Reliability Engineer

Arch Systems • Hyderabad

On-site
INR 2,800,000 - 4,200,000
Senior Site Reliability Engineer - Cloud Infrastructure
Senior Site Reliability Engineer - Cloud Infrastructure

WITS Innovation Lab • Chandigarh

On-site
INR 1,800,000 - 3,000,000
Site Reliability Engineer
Site Reliability Engineer

SourcingXPress • Maharashtra

On-site
INR 700,000 - 1,800,000
Site Reliability Engineer
Site Reliability Engineer

SourcingXPress • Mumbai

On-site
INR 800,000 - 1,200,000
Site Reliability Engineering (SRE)
Site Reliability Engineering (SRE)

Lyzr AI • Bengaluru

Hybrid
INR 1,000,000 - 2,000,000
Lead Site Reliability Engineer
Lead Site Reliability Engineer

VMC Soft Technologies, Inc • Bengaluru Urban

On-site
INR 960,000 - 1,600,000
Site Reliability Engineer
Site Reliability Engineer

Spot Your Leaders & Consulting • Pune District

On-site
INR 2,500,000 - 4,000,000
Senior Site Reliability Engineer
Senior Site Reliability Engineer

Hilabs • Bengaluru

On-site
INR 2,200,000 - 3,500,000