SRE II — Cloud Analytics Reliability & Automation

Oracle

United Kingdom

On-site

GBP 90,000 - 140,000

Full time

12 days ago
Application generator

An application made for this job — a tailored resume and cover letter that speak straight to the posting.

Get past ATS filters

Job summary

Oracle is seeking a hands-on Site Reliability Engineer to join the OASE UK GOV SRE team working with Oracle Analytics development to improve reliability, uptime, and performance of Oracle Analytics Cloud services.

The role involves diagnosing complex issues across distributed systems, automation, and enterprise applications, contributing to incident response, tooling, and continuous service improvement in an agile, customer-focused environment.

Qualifications

  • BS or MS in Computer Science, Engineering, or equivalent practical experience.
  • Experience supporting cloud infrastructure, networking, applications, services, tools, and operational processes.
  • Strong understanding of networking and TCP/IP fundamentals, including DNS, HTTP/HTTPS, TLS, load balancing, and service connectivity.
  • Linux/Unix system-administration experience, including troubleshooting processes, memory, CPU, filesystem, and network issues.
  • Experience developing, operating, or supporting cloud services and large-scale distributed applications in production.
  • Demonstrated ability to troubleshoot complex technical issues methodically, including investigation of existing applications and code.
  • Experience creating and maintaining technical documentation, runbooks, knowledge articles, and operational guides.
  • Experience working in agile development and operational environments.
  • Strong written and verbal communication skills, including the ability to work effectively with remote global teams.
  • Ability to work independently, manage competing priorities, and participate in on-call, after-hours maintenance, and weekend support as needed.

Responsibilities

  • Perform SRE activities supporting Oracle Analytics customers, engineering teams, and release cycles in both pre-production and production environments.
  • Participate in a follow-the-sun model providing 24x7 operational support for Oracle Analytics services.
  • Respond to incidents, troubleshoot complex service issues, drive mitigation to completion, and contribute to root-cause analysis and post-incident actions.
  • Read, understand, and troubleshoot existing application and service code to diagnose complex production issues, identify root causes, and support safe remediation.
  • Develop deep expertise in Oracle Analytics services to prevent regressions, resolve customer issues effectively, and reduce recurring incidents.
  • Build, maintain, and improve operational tooling, automation, dashboards, monitoring, run-books, and knowledge-base documentation.
  • Build and maintain AI-assisted and automation tools as needed to improve SRE workflows, including incident investigation, monitoring, remediation, operational reporting, and knowledge management.
  • Develop scripts and services for monitoring, telemetry collection, capacity analysis, patching, remediation, and operational reporting.
  • Analyze service health, workload patterns, CPU, memory, query activity, and capacity trends to identify reliability and scaling risks.
  • Execute interim patches, hot fixes, upgrades, and maintenance activities with operational excellence.
  • Partner with Development, Support, Product Management, and other engineering teams to investigate and resolve service failures and outages.
  • Improve CI/CD processes, deployment practices, operational readiness, and release support-ability.
  • Share operational knowledge, and continuously improve team processes.
  • Follow established security, compliance, change-management, and operational procedures.

Skills

SRE experience
Cloud infrastructure
Networking fundamentals
Linux administration
Incident response
Automation scripting
Communication
On-call readiness
Agile collaboration

Education

BS/MS in Computer Science or Engineering

Tools

Python
Bash
JavaScript/Node.js
Ansible
Kubernetes
Docker
Git
Jira
Confluence
Terraform

Job description

Oracle is seeking a hands-on Site Reliability Engineer to join the OASE UK GOV SRE team working with Oracle Analytics development to improve reliability, uptime, and performance of Oracle Analytics Cloud services.

The role involves diagnosing complex issues across distributed systems, automation, and enterprise applications, contributing to incident response, tooling, and continuous service improvement in an agile, customer-focused environment.

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Senior SRE: Cloud Storage & Data Reliability Engineer
Senior SRE: Cloud Storage & Data Reliability Engineer

Oracle • Leeds

On-site
GBP 70,000 - 100,000
SRE
SRE

Technopride Ltd • Hove

On-site
GBP 60,000 - 80,000
SRE & Reliability Lead — AI-Ops & Observability
SRE & Reliability Lead — AI-Ops & Observability

LexisNexis Risk Solutions • Carshalton

On-site
GBP 90,000 - 130,000
Senior SRE: Cloud Reliability & Observability Leader
Senior SRE: Cloud Reliability & Observability Leader

Omilia • United Kingdom

On-site
GBP 90,000 - 130,000
Fixed compensation
Long-term employment
Professional growth
+1
Senior SRE: Cloud Reliability, Observability & Automation
Senior SRE: Cloud Reliability, Observability & Automation

Omilia Natural Language Solutions Ltd • United Kingdom

On-site
GBP 70,000 - 90,000
Fixed compensation
Long-term employment with vacation
Professional growth opportunities
+1
Senior SRE: Cloud Reliability & Observability
Senior SRE: Cloud Reliability & Observability

Renesas Electronics Corp. • Cambridge

On-site
GBP 90,000 - 120,000
Senior SRE: Cloud Platform Reliability & Observability
Senior SRE: Cloud Platform Reliability & Observability

Renesas Electronics Corporation • Cambridge

Hybrid
GBP 90,000 - 120,000
Senior SRE: Cloud Reliability & Observability Lead
Senior SRE: Cloud Reliability & Observability Lead

Omilia Natural Language Solutions Ua Ltd • United Kingdom

On-site
GBP 85,000 - 120,000
Fixed compensation
Long-term employment with the working
Development in professional growth (ca
+1
Senior Cloud SRE: Multi-Cloud Reliability & Automation
Senior Cloud SRE: Multi-Cloud Reliability & Automation

Elasticsearch B.V. • United Kingdom

Remote
GBP 75,000 - 140,000
Health coverage
Flexible locations and schedules
Generous vacation days
+4
AWS SRE: Cloud Data Platform Reliability & Automation
AWS SRE: Cloud Data Platform Reliability & Automation

Marks Sattin • Greater London

On-site
GBP 60,000 - 80,000