Senior Site Reliability Engineer — AWS, Kubernetes, SRE

Hispanic Alliance for Career Enhancement

United States

Hybrid

USD 114,000 - 165,300

Full time

14 days+

Get more replies from employers

Send a job-specific resume in minutes.

Benefits offered by this job

Medical, dental, vision and life
401(k) with company match
Tuition reimbursement
Paid time off + holidays
Volunteer time
BRGs for inclusion

Job summary

Hispanic Alliance for Career Enhancement is seeking a Lead Site Reliability Engineer to drive reliability across our financial services platform. You will lead SREs, define standards, and guide infrastructure strategy using AWS, Kubernetes, and Terraform.

You will set SLOs/SLIs, manage incidents, and lead disaster recovery efforts while mentoring engineers and aligning reliability work with business priorities. A strong production HPM mindset and collaboration with Security are essential.

Qualifications

  • Bachelor's degree or equivalent practical experience.
  • 7–10 years of Site Reliability Engineering experience with leadership.
  • Proven ability to lead technical teams and drive projects to completion.
  • Extensive AWS knowledge for multi-region architectures.
  • Deep Kubernetes expertise and production-scale operations.
  • Terraform for shared platforms and frameworks.
  • Production experience with Python and/or Go.
  • Observability with Datadog and Splunk at scale.
  • Strong CI/CD and enterprise pipelines.

Responsibilities

  • Lead cross-functional reliability initiatives across value streams.
  • Define and evolve SRE best practices, tools, and methodologies.
  • Architect multi-region AWS infrastructure balancing reliability, cost, and security.
  • Establish SLOs/SLIs and incident postmortems with action items.
  • Lead disaster recovery planning for critical services.
  • Build Infrastructure as Code foundations with Terraform.
  • Design production-scale Kubernetes patterns and security.
  • Establish observability standards using Datadog and Splunk.
  • Set CI/CD standards and progressive delivery at scale.
  • Lead chaos engineering and game days for reliability testing.
  • Drive FinOps initiatives to optimize cloud spend while maintaining reliability.
  • Mentor SREs and partner with leadership to align with business priorities.

Skills

AWS
Kubernetes
Terraform
Python
Go
Datadog
Splunk
CI/CD
Incident management
Security basics
Communication
Mentoring

Education

Bachelor's degree in Computer Science/IT or related field

Tools

Terraform
Kubernetes
Datadog
Splunk

Job description

Hispanic Alliance for Career Enhancement is seeking a Lead Site Reliability Engineer to drive reliability across our financial services platform. You will lead SREs, define standards, and guide infrastructure strategy using AWS, Kubernetes, and Terraform.

You will set SLOs/SLIs, manage incidents, and lead disaster recovery efforts while mentoring engineers and aligning reliability work with business priorities. A strong production HPM mindset and collaboration with Security are essential.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Remote Senior Site Reliability Lead - AWS, Kubernetes, CI/CD
Remote Senior Site Reliability Lead - AWS, Kubernetes, CI/CD

Empower • United States

On-site
USD 114,000 - 166,000
401(k) with company matching
Tuition reimbursement
Paid volunteer time
+1
Lead SRE - Remote/Hybrid, Enterprise-Scale Reliability
Lead SRE - Remote/Hybrid, Enterprise-Scale Reliability

Empower Retirement • Greenwood Village (CO)

Hybrid
USD 114,000 - 166,000
Medical insurance
401(k) with company match
Tuition reimbursement
+3
Senior Site Reliability Engineer - Scale, Observability & HA
Senior Site Reliability Engineer - Scale, Observability & HA

Involved Solutions • Austin (TX)

On-site
Site Reliability Engineer
Site Reliability Engineer

TalentDome Staffing • United States

On-site
USD 140,000 - 210,000
Senior Site Reliability Engineer
Senior Site Reliability Engineer

Axiom Pursuits • San Francisco (CA)

On-site
USD 150,000 - 180,000
Lead Site Reliability Engineer: AWS Cloud & Automation
Lead Site Reliability Engineer: AWS Cloud & Automation

Selby Jennings • Wilmington (NC)

On-site
USD 140,000 - 200,000
SRE Lead engineer
SRE Lead engineer

TechDigital Group • Bellevue (WA)

On-site
USD 100,000 - 130,000
Site Reliability Engineer
Site Reliability Engineer

Brooksource • Hapeville (GA)

On-site
USD 110,000 - 170,000
Senior Site Reliability Engineer: Cloud, Kubernetes & CI/CD
Senior Site Reliability Engineer: Cloud, Kubernetes & CI/CD

Amiri Recruiting • Mountain View (CA)

On-site
USD 130,000 - 160,000
Site Reliability Engineer
Site Reliability Engineer

Involved Solutions • Austin (TX)

On-site
USD 110,000 - 150,000