VP of Reliability & Tech Operations Excellence

Antares Capital LP

Chicago (IL)

On-site

USD 175,000 - 225,000

Full time

14 days+
Application generator

Stand out for this role — generate a tailored resume and cover letter in about a minute.

Get past ATS filters

Benefits offered by this job

Medical benefits
Dental benefits
Vision benefits
Disability insurance
Life insurance
401(k)
Profit sharing
Paid time off
Maven family benefits
Parental leave

Job summary

Antares Capital LP seeks a VP of Reliability Engineering & Technology Operations to lead production operations, reliability engineering, observability, and automation across cloud platforms. You will partner with Engineering, Infrastructure, Cybersecurity, Data, and Business teams to ensure systems are secure, observable, scalable, and operationally mature.

This leadership role drives AI-enabled operational capabilities, service ownership, and KPI-driven improvements, shaping the future of

Qualifications

  • 7+ years of experience in software engineering, platform engineering, cloud engineering, infrastructure engineering, DevOps, technology operations, or related technical disciplines.
  • 3-5+ years of experience leading engineering, reliability, platform, cloud, DevOps, or technology operations teams.
  • Strong experience operating and supporting applications within Microsoft Azure environments.
  • Hands-on experience with Kubernetes and container-based platforms.
  • Experience supporting distributed systems and cloud-native architectures.
  • Strong understanding of application architecture, system dependencies, and production support models.
  • Experience leading major incident response activities and outage management processes.
  • Experience implementing monitoring, observability, and alerting solutions using tools such as Datadog, Grafana, Splunk, Dynatrace, New Relic, or similar platforms.
  • Experience building automation solutions using scripting languages, APIs, orchestration tools, and workflow platforms.
  • Strong understanding of DevOps, CI/CD, release management, and software delivery practices.
  • Demonstrated ability to define, measure, and improve KPIs related to reliability, availability, operational efficiency, and service quality.
  • Excellent communication and stakeholder management skills with the ability to influence technical and business leaders.
  • Preferred: Experience building or leading Reliability Engineering, Production Engineering, DevOps, or Platform Engineering organizations.
  • Experience implementing AI-assisted operational workflows, AIOps platforms, AI agents, or intelligent automation solutions.
  • Experience with ServiceNow, Control-M, or equivalent enterprise operational platforms.
  • Experience operating within highly regulated environments.
  • Financial services experience, including asset management, lending, banking, private credit, or investment management.

Responsibilities

  • Lead Reliability Engineering function; define strategies to improve reliability, resiliency, scalability, and operational excellence.
  • Oversee production operations; establish support models, ownership boundaries, and service management processes.
  • Provide Azure Cloud & Kubernetes operations leadership; optimize reliability and capacity.
  • Be executive incident leader during major production events and coordinate cross-functional teams.
  • Champion automation and AI-enabled operations; drive self-healing capabilities.
  • Mentor high-performing teams and build partnerships across Engineering, Infrastructure, Data, and Business units.
  • Manage vendor relationships and ensure service commitments.
  • Ensure disaster recovery and business continuity readiness; develop recovery automation.
  • Define and report operational KPIs; drive continuous improvement across the org.

Skills

Leadership
Reliability engineering
Cloud computing
Automation
Observability
Incident management

Tools

Azure
Kubernetes
Datadog
Grafana
Splunk
Dynatrace
New Relic
ServiceNow
Control-M

Job description

Antares Capital LP seeks a VP of Reliability Engineering & Technology Operations to lead production operations, reliability engineering, observability, and automation across cloud platforms. You will partner with Engineering, Infrastructure, Cybersecurity, Data, and Business teams to ensure systems are secure, observable, scalable, and operationally mature.

This leadership role drives AI-enabled operational capabilities, service ownership, and KPI-driven improvements, shaping the future of

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

VP, Lead Infrastructure Operations
VP, Lead Infrastructure Operations

Antares Capital LP • Illinois

On-site
USD 175,000 - 190,000
Vice President, Reliability Engineering & Technology Operations
Vice President, Reliability Engineering & Technology Operations

Antares Capital LP • Chicago (IL)

On-site
USD 175,000 - 225,000
Medical benefits
Dental benefits
Vision benefits
+7
VP, Global Production Ops & Reliability Scale & Resilience
VP, Global Production Ops & Reliability Scale & Resilience

Everbridge • United States

Remote
USD 195,000 - 270,000
Health insurance
Dental coverage
Parental planning
+6
Cloud Operations & Reliability Director — AI-Driven Ops
Cloud Operations & Reliability Director — AI-Driven Ops

LexisNexis Risk Solutions • Alpharetta (GA)

On-site
USD 118,000 - 220,000
Health benefits
401(k) with match
Wellness platform
+4
Solutions Architect, Technology Operations & Service Delivery
Solutions Architect, Technology Operations & Service Delivery

Antares Capital LP • Chicago (IL)

On-site
USD 160,000 - 225,000
Medical, dental, and vision coverage
401(k) and profit sharing
Parental leave
Director, Cloud Reliability & AI-Driven Operations
Director, Cloud Reliability & AI-Driven Operations

Talent Octopusventures • Alpharetta (GA)

On-site
USD 118,000 - 220,000
Health Benefits
401(k) with match and Employee Share
Wellbeing platform and Headspace app
+4
Global Production & Reliability Leader
Global Production & Reliability Leader

Everbridge • Northern (KY)

Hybrid
USD 195,000 - 270,000
Head of Cloud Reliability & AI Operations
Head of Cloud Reliability & AI Operations

RELX • Alpharetta (GA)

On-site
USD 118,000 - 220,000
Health Benefits
Retirement Benefits
Wellbeing program
+5
Director of Production Reliability & AI Ops
Director of Production Reliability & AI Ops

Carson Wealth • Northern (KY)

Hybrid
USD 127,000 - 167,000
401(k) with company matching
Health benefits
Bonus potential
Global Production Ops & Reliability Leader
Global Production Ops & Reliability Leader

Everbridge • United States

On-site
USD 195,000 - 270,000
Healthcare
Dental
Parental planning
+6