Senior Data Site Reliability Engineer | GCP is mandatory

Anlage Infotech

Chennai District

On-site

INR 3,500,000 - 6,000,000

Full time

4 days ago
Be an early applicant

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

Anlage Infotech in Chennai is seeking a Senior Data Site Reliability Engineer to join the Data Platform team. You will build highly reliable, scalable data systems across cloud environments and work at the intersection of Data engineering, SRE, and Platform Automation.

The role emphasizes automation-first approaches for data pipelines, self-healing systems, and robust monitoring. You will own reliability, performance, and cost optimization while collaborating with data engineers and platform

Qualifications

  • 7+ years in SRE/DevOps or data platform roles.
  • Strong Python automation and scripting skills.
  • Hands-on with cloud infrastructure and data pipelines.
  • Experience with CI/CD, monitoring, and observability.

Responsibilities

  • Design automation-first solutions for data platform operations.
  • Own reliability, availability, and performance of data pipelines.
  • Develop self-healing systems and alerting frameworks.
  • Implement CI/CD for data pipelines and deployment workflows.
  • Provision environments with IaC (Terraform).
  • Work with GCP services and data tooling.
  • Improve observability using logs and metrics.
  • Lead incident management and RCA postmortems.
  • Collaborate with data engineers and platform teams.
  • Build internal tooling for efficiency.

Skills

SRE / DevOps / Data Platform Eng
Python automation
CI/CD pipelines
Data pipelines / data systems

Tools

Kubernetes (GKE)
GCP (BigQuery, Pub/Sub, Cloud Run)
Terraform
Datadog / Cloud Monitoring
Kafka / Pub/Sub messaging
Helm

Job description

We are looking for a Senior Data Site Reliability Engineer (SRE) to join our Data Platform team. This role focuses on building highly reliable, scalable, and automated data systems across cloud environments.
You will work at the intersection of Data engineering, SRE, and Platform Automation, ensuring our data pipelines, ingestion systems, and infrastructure run efficiently with minimal manual intervention.

Key Responsibilities
  • Design and build automation-first solutions for data platform operations
  • Own reliability, availability, and performance of data pipelines and ingestion systems
  • Develop and maintain self-healing systems, monitoring, and alerting frameworks
  • Build tools to automate:
  • Job orchestration and recovery
  • Deployment workflows (CI/CD for data pipelines)
  • Environment provisioning and configuration
  • Work with GCP services (GKE, Cloud Run, Pub/Sub, BigQuery, etc.)
  • Improve system observability using logs, metrics, and tracing
  • Drive incident management, root cause analysis (RCA), and postmortems
  • Optimize infrastructure costs and performance
  • Collaborate with data engineers and platform teams to enforce SRE best practices
  • Build internal tools (CLI/UI/AI-based agents) for operational efficiency
Required Skills & Experience
  • 7+ years in SRE / DevOps / Data Platform Engineering/ Data Engineering
  • Strong experience in Python (automation, tooling, scripting)
  • Hands-on experience with:
  • Kubernetes (GKE preferred)
  • Cloud platforms (GCP strongly preferred)
  • CI/CD pipelines
  • Experience with data systems:
  • Batch & streaming pipelines
  • Pub/Sub, Kafka, or similar messaging systems
  • Strong understanding of:
  • Monitoring (Datadog, Cloud Monitoring, etc.)
  • Logging and observability
  • Experience in infrastructure as code (Terraform or equivalent)
  • Solid debugging and production troubleshooting skills
Good to Have
  • Experience with AlloyDB / PostgreSQL / Database reliability
  • Experience building internal platforms or developer tools
  • Knowledge of Helm, container lifecycle, and image management
  • Experience with large-scale data ingestion systems
What Were Looking For
  • Strong ownership mindset - you build it, you run it
  • Automation-first thinking - eliminate manual processes wherever possible
  • Ability to work in ambiguous environments and define solutions
  • Focus on reliability, scalability, and long-term maintainability
  • Good communication and collaboration skills

Location Chennai : Resource has to work based out of Chennai Ingram office(Guindy) daily.

Locations

Chennai

Skill Set

Python,Continuous integration (CI) and continuous delivery (CD),Kubernetes (GKE preferred),Kafka,CKAD,Terraform,GCP Cloud

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Site Reliability Engineer (SRE) – GCP Platform
Site Reliability Engineer (SRE) – GCP Platform

ITC Infotech • Bengaluru

On-site
INR 900,000 - 1,300,000
Site Reliability Engineer- GCP
Site Reliability Engineer- GCP

Aziro • Hyderabad

Hybrid
INR 1,400,000 - 2,100,000
Site Reliability Engineer
Site Reliability Engineer

MNR Solutions Pvt. Ltd. • Bengaluru

On-site
INR 900,000 - 1,500,000
Site Reliability Engineer (SRE) - Google Cloud Platform
Site Reliability Engineer (SRE) - Google Cloud Platform

Aziro • Hyderabad

Hybrid
INR 1,500,000 - 3,200,000
Intermediate Applications Developer
Intermediate Applications Developer

UPS • Chennai District

On-site
INR 1,500,000 - 2,000,000
Site Reliability Engineering (SRE) -GCP Devops-Hyderabad.Chennai,Bangalore-6 to 10 yrs
Site Reliability Engineering (SRE) -GCP Devops-Hyderabad.Chennai,Bangalore-6 to 10 yrs

Tata Consultancy Services • Bengaluru

On-site
INR 800,000 - 1,200,000
Sr DevOps Engineer
Sr DevOps Engineer

METRO France • Wagholi

Hybrid
INR 2,400,000 - 3,600,000
Senior Site Reliability Engineer
Senior Site Reliability Engineer

VMC Soft Technologies, Inc • Hyderabad

Hybrid
INR 1,500,000 - 2,000,000
Senior Site Reliability Engineer
Senior Site Reliability Engineer

UST • Pune District

On-site
INR 1,800,000 - 3,000,000
Senior Site Reliability Engineer
Senior Site Reliability Engineer

AcquireX • Pune District

On-site
INR 1,200,000 - 1,800,000
Health insurance
Flexible working hours
Training opportunities