Senior Data Center SRE: Hybrid Cloud & On-Prem Ops

PathAI

Boston

Hybrid

PHP 9,187,000 - 14,133,000

Full time

13 days ago
Application generator

Don’t send a generic resume — generate a resume and cover letter tailored to this exact role.

Get past ATS filters

Job summary

PathAI is seeking a Senior/Staff Site Reliability Engineer to design, build, and operate our on-prem/cloud data center for a rapid-growing ML team. You will implement SRE best practices, manage hybrid cloud integration, and ensure high availability with automation, monitoring, and secure NIST/ISO-compliant environments.

This hybrid role supports Boston-area data centers and occasional travel, with relocation not offered. Join a team transforming pathology with AI-powered healthcare solutions.

Qualifications

  • BS in Computer Science, Computer Engineering, Electrical Engineering, Software Engineering or related field.
  • 8 years of experience in physical hardware/facilities, networking, automation or related areas.
  • Experience with modern datacenter network designs and operating across network layers.
  • Administered physical hardware stacks in production (iDRAC/IPMI/Nvidia UFM/Juniper).
  • Experience with virtualization, containerization, or orchestration (EKS-Anywhere/ClusterAPI/KVM).
  • Expertise in storage solutions for high-performance workloads (Quobyte, S3, FSx, EFS).
  • Proficient with automation tools; automate using scripting and configuration management (Ansible/RedFish).
  • Built monitoring with Datadog, Grafana, Prometheus.
  • Operational background managing critical production systems, incident response, scaling, and high-growth environments.
  • Willingness to travel to onsite Data Center locations.

Responsibilities

  • Advance operations by implementing SRE best practices focused on users, monitoring, and automation.
  • Design, build, and operate our data center for our ML team.
  • Build secure on-premises environments meeting NIST/ISO standards.
  • Integrate on-prem data centers with cloud infrastructure for hybrid cloud.
  • Improve reliability and resilience via root-cause analysis and design reviews.
  • Participate in platform on-call rotations and assist incident response.

Skills

SRE experience
Data center operations
Networking
Automation scripting
Observability tooling
Incident response
Travel to on-site data centers

Education

BS in Computer Science/Engineering

Tools

iDRAC/IPMI
NVIDIA UFM
Juniper networks
KVM
EKS-Anywhere/ClusterAPI
Ansible/RedFish
Datadog/Grafana/Prometheus
Quobyte/S3/FSx/EFS

Job description

PathAI is seeking a Senior/Staff Site Reliability Engineer to design, build, and operate our on-prem/cloud data center for a rapid-growing ML team. You will implement SRE best practices, manage hybrid cloud integration, and ensure high availability with automation, monitoring, and secure NIST/ISO-compliant environments.

This hybrid role supports Boston-area data centers and occasional travel, with relocation not offered. Join a team transforming pathology with AI-powered healthcare solutions.

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Senior/Staff Site Reliability Engineer - Data Center
Senior/Staff Site Reliability Engineer - Data Center

PathAI • Boston

Hybrid
PHP 9,187,000 - 14,133,000
Site Reliability Engineer
Site Reliability Engineer

CodeRound AI • Hinoba-an

On-site
PHP 1,000,000 - 1,800,000
Hybrid Cloud SRE: Observability & Automation
Hybrid Cloud SRE: Observability & Automation

NICE • Manila

Hybrid
PHP 669,600 - 892,800
Senior Windows SRE — Hybrid Infra (On-Prem/AWS)
Senior Windows SRE — Hybrid Infra (On-Prem/AWS)

Broadridge Financial Solutions • Manila

On-site
PHP 1,200,000 - 2,100,000
SR. Data Platform Reliability Engineer/SRE DevOps/Data Engr. (Permanent)- Onsite
SR. Data Platform Reliability Engineer/SRE DevOps/Data Engr. (Permanent)- Onsite

ATS CONSULTING SERVICES PH INC. • Mandaluyong

On-site
PHP 1,800,000 - 2,400,000
Senior Cloud SRE - 4-Day Week, Hybrid, Global Platform Ops
Senior Cloud SRE - 4-Day Week, Hybrid, Global Platform Ops

Nasdaq • Taguig

Hybrid
PHP 1,200,000 - 2,000,000
HMO coverage
Employee stock purchase plan
Equity grant
+4
Senior Data Platform Reliability Engineer
Senior Data Platform Reliability Engineer

TerraBarn Inc. • Cebu City

On-site
PHP 1,200,000 - 2,400,000
HMO
Senior Cloud SRE — AWS, Automation & Observability
Senior Cloud SRE — AWS, Automation & Observability

Broadridge • Metro Manila

On-site
PHP 1,200,000 - 2,400,000
Senior SRE: Cloud Reliability, Automation & Observability
Senior SRE: Cloud Reliability, Automation & Observability

Broadridge Financial Solutions • Manila, Hinoba-an

On-site
PHP 1,800,000 - 2,600,000
Principal SRE - Remote Cloud & Healthcare
Principal SRE - Remote Cloud & Healthcare

Harris Computer • Manila

Hybrid
PHP 7,538,000 - 11,307,000
Shape Smarter Healthcare
Genuine Flexibility options
Top-Tier Health Benefits
+1