Cloud Platform SRE — Automation & Uptime

OXIO Corporation

United States

Remote

USD 120,000 - 190,000

Full time

14 days+
Application generator

A complete application in a minute — tailored resume and cover letter, ready to send.

Get past ATS filters

Job summary

OXIO Corporation is seeking a Site Reliability Engineer to design and run scalable, reliable cloud platforms for our NeoTelco ecosystem. You will automate deployments, scaling, and recovery, while ensuring 24/7 uptime for critical services.

You will work with Linux systems, Docker/Kubernetes, and modern CI/CD pipelines, contributing to incident management and blameless postmortems. This role requires collaboration across engineering, telecom, and data teams in a fast-paced environment.

Qualifications

  • Linux/Unix administration and networking fundamentals are required.
  • Proficiency in at least one programming language (Python, Go, or Ruby) and strong scripting (Bash, Perl).
  • Experience with infrastructure provisioning tools (Terraform, CloudFormation, Ansible).
  • Familiarity with containerization (Docker) and orchestration (Kubernetes).
  • Experience with monitoring/observability tools (Prometheus, Grafana, Datadog).
  • Knowledge of incident management, runbooks, and blameless postmortems.
  • Experience building CI/CD pipelines (Jenkins, GitLab CI, CircleCI).
  • Hands-on with cloud providers (AWS, Google Cloud, Azure) and cloud-native architectures.

Responsibilities

  • Design and implement cloud-based platform to support backend services.
  • Automate deployments, scaling, and recovery processes.
  • Monitor production infrastructure to maximize uptime and reliability.
  • Participate in on-call rotations and postmortem-driven improvements.
  • Provide tooling and support to engineering teams for service operations.

Skills

Linux/Unix
Programming (Python/Go/Ruby)
Scripting (Bash/Perl)
IaC (Terraform/CloudFormation/Ansible)
Docker
Kubernetes
Monitoring (Prometheus/Grafana/Datadog

Tools

Terraform
CloudFormation
Ansible
Docker
Kubernetes
Prometheus
Grafana
Datadog
Jenkins
GitLab CI
CircleCI
AWS
GCP
Azure

Job description

OXIO Corporation is seeking a Site Reliability Engineer to design and run scalable, reliable cloud platforms for our NeoTelco ecosystem. You will automate deployments, scaling, and recovery, while ensuring 24/7 uptime for critical services.

You will work with Linux systems, Docker/Kubernetes, and modern CI/CD pipelines, contributing to incident management and blameless postmortems. This role requires collaboration across engineering, telecom, and data teams in a fast-paced environment.

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Site Reliability Engineer - Cloud Platform & Automation
Site Reliability Engineer - Cloud Platform & Automation

oxio • United States

Remote
USD 120,000 - 160,000
Site Reliability Engineer
Site Reliability Engineer

oxio • United States

Remote
USD 120,000 - 160,000
Site Reliability Engineer
Site Reliability Engineer

OXIO Corporation • United States

Remote
USD 120,000 - 190,000
Senior Cloud SRE: Reliability, Automation & Remote Work
Senior Cloud SRE: Reliability, Automation & Remote Work

Embedded Shishya • United States

Remote
USD 120,000 - 180,000
Base salary and permanent contract
Paid certifications
Career plan
+9
Senior Site Reliability Engineer - Cloud Platform & Growth
Senior Site Reliability Engineer - Cloud Platform & Growth

RXinsider LTD. • Cranberry Township

Hybrid
USD 120,000 - 180,000
Remote Cloud SRE & NOC Reliability Lead
Remote Cloud SRE & NOC Reliability Lead

AXON Networks • Irvine (CA)

On-site
USD 160,000 - 200,000
Senior Cloud SRE — 24/7 Global Infra, AI & Automation
Senior Cloud SRE — 24/7 Global Infra, AI & Automation

Oracle • Reston (VA)

On-site
USD 81,200 - 187,000
Medical, dental, and vision insurance
401(k) Savings and Investment Plan
Paid time off
+2
Senior SRE: Scale Resilient AI Platforms & Automation
Senior SRE: Scale Resilient AI Platforms & Automation

Relx Plc • Philadelphia

Hybrid
USD 95,000 - 159,000
Global Cloud SRE – Reliability, Security & Observability
Global Cloud SRE – Reliability, Security & Observability

Fideo Intelligence • United States

On-site
USD 90,000 - 100,000
Network SRE: Reliability & Automation for Cloud Infra
Network SRE: Reliability & Automation for Cloud Infra

Nebius • United States

Remote
USD 140,000 - 210,000