Technical Program Manager SRE Kubernetes Cloud AI

IPolarity LLC

Whippany (NJ)

Hybrid

USD 130,000 - 170,000

Full time

8 days ago

Get more replies from employers

Send a job-specific resume in minutes.

Benefits offered by this job

Flexible work options

Job summary

IPolarity LLC seeks an experienced Technical Program Manager to lead SRE, Kubernetes, cloud, and AI initiatives across large-scale systems. You will drive reliability, automation, and observability while coordinating cross-functional teams.

This role emphasizes platform resilience, incident management, canary deployments, and data-driven improvements with flexible work options.

Qualifications

  • Experience leading complex SRE, cloud, and platform reliability initiatives.
  • Strong knowledge of Kubernetes platforms and automation.
  • Proficiency in Python/Java/Node.js for automation.

Responsibilities

  • Lead complex SRE, cloud, Kubernetes, and platform reliability initiatives.
  • Manage and improve Kubernetes platforms including GKE and Rancher RKE2.
  • Build automation and operational tools using Python, Java, and Node.js.
  • Leverage Generative AI/LLMs for alert analysis, incident response, and automation.
  • Implement API/microservice reliability with Apigee/Apigee X, REST, GraphQL.
  • Drive high availability, disaster recovery, and multi-datacenter deployments.
  • Develop observability with Splunk, Datadog, Grafana, AppDynamics.
  • Advise on SRE best practices, incident management, and continuous improvement.
  • Collaborate with cross-functional teams to deliver measurable outcomes.

Skills

Kubernetes
GKE
SRE
Cloud Automation
Python
Java
Node.js
APIs & Microservices
Apigee
Datadog
Grafana
AppDynamics
GenAI / LLM / AIOps
Technical Program & Leadership

Tools

Kubernetes
GKE
Rancher RKE2
Apigee X
REST/GraphQL
Splunk
Datadog
Grafana
AppDynamics

Job description

Hiring: Technical Program Manager - SRE / Kubernetes / Cloud / AI

We are hiring an experienced Program Manager to lead complex technology initiatives focused on platform reliability, observability, automation, and application performance across large-scale systems.

Location: Hartford, CT Experience: 10-14 Years

Key Responsibilities
  • Lead complex SRE, cloud, Kubernetes, and platform reliability initiatives
  • Manage and improve Kubernetes platforms, including GKE and Rancher RKE2
  • Build automation and operational tools using Python, Java, and Node.js
  • Leverage Generative AI/LLMs such as Gemini, Llama, Mistral, and Qwen for alert analysis, incident response, and operational automation
  • Implement reliable API and microservice solutions using Apigee/Apigee X, REST APIs, GraphQL, traffic routing, canary deployments, and failover strategies
  • Drive high availability, active-active deployments, disaster recovery, and multi-datacenter Kubernetes environments
  • Develop and enhance observability using Splunk, Datadog, Grafana, and AppDynamics
  • Drive SRE best practices, incident management, reliability engineering, and continuous improvement
  • Collaborate with cross-functional engineering, operations, and business teams to deliver measurable outcomes
Ideal Candidate
  • Kubernetes & GKE
  • SRE & Cloud Automation
  • Python / Java / Node.js
  • Datadog / Splunk / Grafana / AppDynamics
  • Apigee & API/Microservices Reliability
  • High Availability & Disaster Recovery
  • GenAI / LLM / AIOps
  • Technical Program & Cross-Functional Leadership

Flexible work from home options available.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Technical Program Manager SRE Kubernetes Cloud AI
Technical Program Manager SRE Kubernetes Cloud AI

IPolarity • Hanover Township (NJ)

Hybrid
USD 140,000 - 190,000
Flexible remote options
Technical Program Manager — SRE, Kubernetes & Cloud AI
Technical Program Manager — SRE, Kubernetes & Cloud AI

IPolarity • Hanover Township (NJ)

Hybrid
USD 140,000 - 190,000
Flexible remote options
Senior AI-Enabled Platform / SRE Engineer
Senior AI-Enabled Platform / SRE Engineer

ZipStaff Inc. • Dallas (TX)

Hybrid
USD 124,000 - 207,000
Site Reliability Engineer
Site Reliability Engineer

Compunnel, Inc. • Greenwood Village (CO)

On-site
USD 120,000 - 150,000
Site Reliability Engineer
Site Reliability Engineer

Compunnel, Inc. • Austin (TX)

On-site
USD 140,000 - 190,000
Site Reliability Engineer
Site Reliability Engineer

Optomi • New York (NY)

On-site
USD 140,000 - 200,000
Site Reliability Engineer
Site Reliability Engineer

Optomi • Seattle (WA)

On-site
USD 140,000 - 180,000
Java SRE Engineer
Java SRE Engineer

EITACIES Inc. • Santa Clara (CA)

On-site
USD 120,000 - 160,000
Senior/Staff Cloud Reliability Engineer
Senior/Staff Cloud Reliability Engineer

Cerebras • Mountain View (CA)

On-site
USD 190,000 - 240,000
Senior DevOps Engineer/Site Reliability Engineer-East Coast
Senior DevOps Engineer/Site Reliability Engineer-East Coast

Stellar Cyber • New Jersey

On-site
USD 165,000 - 215,000
Pre-IPO Stock Options
Medical, Dental & Vision care
401(k)
+2