Site Reliability Engineer I: Observability & Cloud Ops

KFC

Plano (TX)

On-site

USD 96,000 - 120,000

Full time

6 days ago
Be an early applicant
Application generator

Get a reply from this employer — a resume and cover letter tailored to exactly what they’re hiring for.

Get past ATS filters

Benefits offered by this job

Medical insurance
Dental insurance
Vision insurance
401(k) plan
Paid vacation and holidays
Volunteer time off

Job summary

KFC is seeking a Site Reliability Engineer I to uphold reliability, availability, and operational health of production systems. You will collaborate with Platform Engineering, Development, and Product teams to monitor, troubleshoot, and improve observability.

Responsibilities include incident response, cloud and containerized infrastructure support, infrastructure as code with Terraform/Ansible, and automation using Python/Go.

Qualifications

  • Bachelor’s Degree preferred or equivalent technical experience.
  • 1 to 3+ years of experience in Site Reliability Engineering, DevOps, Platform Engineering, infrastructure, application support, software engineering, or a related technical role.
  • 1+ year’s experience with cloud platforms such as AWS, Azure, or GCP, including compute and networking concepts.
  • 1+ year’s experience with monitoring and observability platforms such as Datadog, Elastic, Dynatrace, Prometheus, or Grafana.
  • 1+ year’s experience with Incident and Problem Management tools such as ServiceNow, Jira, Confluence, Incident.io.

Responsibilities

  • Observability - Monitor production environments with Datadog, create dashboards, alerts, logging, and telemetry.
  • Incident Response - Investigate, troubleshoot, restore, and post-incident actions.
  • Cloud & Infrastructure - Support cloud-based and containerized infrastructure.
  • Infrastructure as Code - Deploy and maintain via Terraform, Ansible, and GitLab.
  • Automation - Develop scripts/tools using Python, Go, Bash, REST APIs.
  • Reliability Engineering - Improve availability, scalability, resilience, and performance.
  • Deployment & Production Support - Assist with deployment readiness and production checks.
  • Documentation & Continuous Improvement - Maintain runbooks and RCA actions.
  • SRE 24/7 on-call rotation.
  • Education/Certifications - Bachelor’s Degree preferred or equivalent.

Skills

Observability monitoring
Troubleshooting
SRE best practices
Communication
Collaboration
SRE tooling
Linux command line
Networking basics
Incident response
Cloud fundamentals

Education

Bachelor’s Degree preferred or equivalent experience

Tools

Datadog
Terraform
Ansible
GitLab
Python
Go
Bash
REST APIs
Kubernetes
EKS
Cloud platforms (AWS/Azure/GCP)
CI/CD tooling
Jira
Confluence

Job description

KFC is seeking a Site Reliability Engineer I to uphold reliability, availability, and operational health of production systems. You will collaborate with Platform Engineering, Development, and Product teams to monitor, troubleshoot, and improve observability.

Responsibilities include incident response, cloud and containerized infrastructure support, infrastructure as code with Terraform/Ansible, and automation using Python/Go.

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Site Reliability Engineer I — Production & Cloud Ops
Site Reliability Engineer I — Production & Cloud Ops

KFC Corporation • Plano (TX)

On-site
USD 80,000 - 110,000
Site Reliability Engineer I — Hybrid, Cloud & Observability
Site Reliability Engineer I — Hybrid, Cloud & Observability

YUM • Plano (TX)

Hybrid
USD 96,000 - 120,000
Vacation time
Paid holidays
Floating day
+4
Site Reliability Engineer: Cloud, Automation & Observability
Site Reliability Engineer: Cloud, Automation & Observability

TechDigital Group • Houston (TX), Juno Beach (FL)

On-site
USD 120,000 - 180,000
Site Reliability Engineer: Observability & Incidents
Site Reliability Engineer: Observability & Incidents

Zoolatech • Buffalo (NY)

Hybrid
USD 110,000 - 150,000
Senior Site Reliability Engineer: Observability & Cloud
Senior Site Reliability Engineer: Observability & Cloud

VBeyond Corporation • Jersey City (NJ)

On-site
USD 100,000 - 260,000
Site Reliability Engineer II: Cloud, Automation & Observability
Site Reliability Engineer II: Cloud, Automation & Observability

Restaurant365 • San Francisco (CA)

Hybrid
USD 98,583 - 138,016
Comprehensive medical benefits, 100% paid for employee
401k + matching
Equity Option Grant
+2
Site Reliability Engineer II: Reliability & Observability
Site Reliability Engineer II: Reliability & Observability

Early Warning Services LLC • Scottsdale (AZ)

Hybrid
USD 83,000 - 132,000
Healthcare Coverage
401(k) Retirement Plan
Paid Time Off
+1
Global Cloud SRE – Reliability, Security & Observability
Global Cloud SRE – Reliability, Security & Observability

Fideo Intelligence • United States

On-site
USD 90,000 - 100,000
Contract Site Reliability Engineer - Automation & Observability
Contract Site Reliability Engineer - Automation & Observability

Skill • Southlake (TX)

On-site
USD 66,000 - 73,000
Health insurance
Vision insurance
Dental insurance
+2
Site Reliability Engineer
Site Reliability Engineer

Hidden Jobs • United States

On-site
USD 150,000 - 190,000
Healthcare
Retirement matching
Paid family leave
+3