Site Reliability Engineer

Experis

Bengaluru

On-site

INR 1,200,000 - 2,400,000

Full time

14 days+

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

Experis is seeking a Site Reliability Engineer specializing in AWS for Bengaluru to strengthen cloud infrastructure and operations.

You will design, build, and maintain scalable, resilient systems; implement Terraform, Docker, Kubernetes, and CI/CD pipelines; and lead incident response with advanced observability tools.

The role demands strong Linux networking skills and a proactive approach to reliability and performance.

Qualifications

  • Proficient in AWS services including EC2, ECS, VPC, Lambda, SQS, SNS, S3, AWS Glue, DynamoDB, AWS Secrets Manager, Athena and IAM.
  • Experience with Serverless Computing architectures and implementations.
  • Strong experience in infrastructure provisioning using Terraform modules and best practices.
  • Hands-on Kubernetes: Deployments, StatefulSets, DaemonSets, Ingress, Helm Charts, Secrets Management.
  • Experience deploying and managing containerized applications at scale.
  • Strong Linux administration and troubleshooting skills.
  • Expertise in network-level debugging and performance analysis.
  • Ability to design, develop, and maintain CI/CD pipelines (Jenkins/GitHub Actions).
  • Experience with monitoring and logging tools (Instana, Kibana, Grafana, Prometheus, Runscope).
  • Experience in incident debugging, RCA, and incident response.
  • Understanding of SLI/SLO/SLAs, MTTR, reliability concepts, and SRE best practices.
  • Certificate management and secret management practices; TLS/CDN related skills.
  • SQL queries and relational database concepts knowledge, basic administration.

Responsibilities

  • Site Reliability Engineering and AWS-based platform management.
  • Design, implement and operate scalable, reliable cloud infrastructure.
  • Build and maintain CI/CD pipelines and deployment processes.
  • Monitor systems with observability tools and respond to incidents.
  • Troubleshoot performance issues and conduct RCAs for outages.

Tools

AWS EC2
AWS ECS
AWS VPC
AWS Lambda
AWS SQS
AWS SNS
AWS S3
AWS Glue
DynamoDB
AWS Secrets Manager
Athena
IAM
Terraform
Kubernetes
Docker
Linux
Networking
CDK
Jenkins
GitHub Actions
Monitoring tools

Job description

Role & responsibilities

Site Reliability Engineering + AWS

Preferred candidate profile
AWS (Must Have) Advanced
  • Proficient in AWS services including EC2, ECS, VPC, Lambda, SQS, SNS, S3, AWS Glue, DynamoDB, AWS Secrets Manager, Athena, and IAM.
  • Experience with Serverless Computing architectures and implementations.
Terraform - Advanced
  • Strong experience in infrastructure provisioning and management using Terraform modules and best practices.
Docker & Kubernetes - Advanced
  • Hands-on experience with Kubernetes Deployments, StatefulSets, DaemonSets, Ingress, Helm Charts, and Secrets Management.
  • Experience deploying and managing containerized applications at scale.
Linux, Networking & CDN - Advanced
  • Strong Linux administration and troubleshooting skills.
  • Expertise in network-level debugging and performance analysis.
CI/CD (Jenkins/GitHub Actions) - Intermediate
  • Ability to design, develop, and maintain CI/CD pipelines.
  • Experience troubleshooting pipeline failures and recommending architectural improvements.
Observability (Must Have) - Advanced
  • Experience with monitoring and logging tools such as Instana, Kibana, Grafana, Prometheus, and Runscope.
  • Ability to perform troubleshooting using logs and events.
  • Hands-on experience in alert configuration, tuning, and monitoring optimization.
Incident Management - Advanced
  • Experience in incident debugging, root cause analysis (RCA), and issue resolution.
  • Ability to drive incident response activities and ensure service restoration.
SRE Principles (Must Have) - Intermediate
  • Solid understanding of SLI, SLO, SLA, MTTR, MTTE, MTTD, error budgets, reliability, and availability concepts.
  • Familiarity with Site Reliability Engineering best practices.
SSL Management - Intermediate
  • Hands-on experience with certificate management, secret management, and renewal processes.
SQL & Databases - Intermediate
  • Experience writing and troubleshooting SQL queries.
  • Working knowledge of relational database concepts and administration.
AWS CDK (Good to Have)
  • Basic experience with infrastructure definition and automation using AWS Cloud Development Kit (CDK).
Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Aws Devops Engineer
Aws Devops Engineer

Experis • Bengaluru

Hybrid
INR 1,800,000 - 3,200,000
Site Reliability Engineer
Site Reliability Engineer

Innodata Inc. • India

On-site
INR 2,400,000 - 4,000,000
Site Reliability Engineering (SRE)
Site Reliability Engineering (SRE)

Lyzr AI • Bengaluru

Hybrid
INR 1,000,000 - 2,000,000
Site Reliability Engineer
Site Reliability Engineer

Sonata Software • Hyderabad, Chennai District, Bengaluru

Hybrid
INR 1,500,000 - 2,100,000
SRE+AWS Devops
SRE+AWS Devops

Virtusa • Bengaluru Urban

On-site
INR 1,500,000 - 2,500,000
Site Reliability Engineer
Site Reliability Engineer

Tekskills • Chennai District

On-site
INR 1,800,000 - 3,000,000
Site Reliability Engineer
Site Reliability Engineer

Tekskills • Pune District

On-site
INR 1,200,000 - 1,800,000
Restaurant d'entreprise
Indemnités de stage/alternance
Site Reliability Engineer
Site Reliability Engineer

Tekskills • Bengaluru

On-site
INR 1,500,000 - 2,500,000
SRE-AWS/GCP
SRE-AWS/GCP

Sailssoftware • Visakhapatnam

On-site
INR 1,500,000 - 2,500,000
AWS Site Reliability Engineer (SRE)
AWS Site Reliability Engineer (SRE)

Zensar • Hyderabad, Pune District

Hybrid
INR 1,500,000 - 2,100,000