Lead Software Engineer - AWS/SRE Engineer

engineeringjobs.net, Inc.

Columbus (OH)

On-site

USD 120,000 - 170,000

Full time

3 days ago
Be an early applicant
Application generator

A complete application in a minute — tailored resume and cover letter, ready to send.

Get past ATS filters

Benefits offered by this job

Health care coverage
On-site health and wellness centers
Retirement savings plan
Backup childcare
Tuition reimbursement
Mental health support
Financial coaching

Job summary

engineeringjobs.net, Inc. seeks a senior leader to drive production operations and SRE for mission-critical cloud services in a regulated environment. You will manage incident response, observability, and remediation while guiding secure AI-assisted development across teams.

Responsibilities include shaping AWS architecture, optimizing costs, ensuring resiliency, and implementing automation. Strong leadership during major incidents is essential.

Qualifications

  • Requires formal training or certification in software engineering concepts and at least five years of applied experience.
  • Deep AWS expertise and proven experience managing production services.
  • Strong SRE and observability skills; leadership in major incidents and remediation.
  • Ability to guide secure, compliant AI-assisted development in a regulated environment.

Responsibilities

  • Lead production operations and SRE practices for business-critical cloud services, including incident response, observability, reliability objectives, capacity planning, and durable remediation.
  • Shape AWS architecture, cost optimization, resiliency, automation, and responsible AI-assisted engineering practices across teams.

Skills

AWS Cloud Architecture
Site Reliability Engineering
Live Site Management
Production Operations
Incident Response
Observability
SLI/SLO Definition
Distributed Tracing
Capacity Planning
Infrastructure as Code
Cloud Cost Optimization
Disaster Recovery
Executive Communication
AI-Assisted Development

Education

Formal training or certification in software engineering

Job description

Lead production operations and SRE practices for business-critical cloud services, including incident response, observability, reliability objectives, capacity planning, and durable remediation. Shape AWS architecture, cost optimization, resiliency, automation, and responsible AI-assisted engineering practices across teams.

Requirements

Requires formal training or certification in software engineering concepts and at least five years of applied experience, along with deep AWS expertise and proven experience managing production services. Candidates should demonstrate strong SRE and observability skills, leadership in major incidents and remediation, and the ability to guide secure, compliant AI-assisted development in a regulated environment.

Key Skills

AWS Cloud Architecture, Site Reliability Engineering, Live Site Management, Production Operations, Incident Response, Root-Cause Analysis, Observability, SLI/SLO Definition, Distributed Tracing, Capacity Planning, Performance Engineering, Infrastructure as Code, Cloud Cost Optimization, Disaster Recovery, AI-Assisted Software Development, Executive Communication

Benefits

Health Care Coverage, On-Site Health and Wellness Centers, Retirement Savings Plan, Backup Childcare, Tuition Reimbursement, Mental Health Support, Financial Coaching

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Lead AWS SRE & Cloud Reliability Engineer
Lead AWS SRE & Cloud Reliability Engineer

engineeringjobs.net, Inc. • Columbus (OH)

On-site
USD 120,000 - 170,000
Health care coverage
On-site health and wellness centers
Retirement savings plan
+4
Site Reliability Engineer Lead
Site Reliability Engineer Lead

Good co India • United States

Remote
USD 120,000 - 160,000
Senior Lead Site Reliability Engineer
Senior Lead Site Reliability Engineer

JPMorgan Chase & Co. • Jersey City (NJ)

On-site
USD 150,000 - 210,000
Principal Site Reliability Engineer
Principal Site Reliability Engineer

Prosum • Scottsdale (AZ)

On-site
USD 150,000 - 190,000
Site Reliability Engineer
Site Reliability Engineer

TalentDome Staffing • United States

On-site
USD 140,000 - 210,000
Cloud/DevOps Engineer - III
Cloud/DevOps Engineer - III

Compunnel, Inc. • Dallas (TX)

On-site
USD 120,000 - 150,000
Senior Site Reliability Engineer
Senior Site Reliability Engineer

MeridianLink, Inc. • Northern (KY)

On-site
USD 120,000 - 170,000
Sr SRE Automation Engineer
Sr SRE Automation Engineer

Compunnel, Inc. • Austin (TX), Northern (KY)

On-site
USD 130,000 - 180,000
Senior Site Reliability Engineer (AWS)
Senior Site Reliability Engineer (AWS)

MeridianLink, Inc. • United States

On-site
USD 120,000 - 160,000
Senior Software Engineer, Cloud Infrastructure / SRE
Senior Software Engineer, Cloud Infrastructure / SRE

Oscar Health • Phoenix (AZ)

On-site
USD 150,000 - 190,000
Medical benefits
Dental benefits
Vision benefits
+10