SRE - Data Infrastructure: Large-Scale Linux/Kafka Automation

Tribus

Sydney

On-site

AUD 150,000 - 210,000

Full time

3 days ago
Be an early applicant
Application generator

A complete application in a minute — tailored resume and cover letter, ready to send.

Get past ATS filters

Job summary

Tribus in Sydney is seeking a Site Reliability Engineer focused on data infrastructure. You will operate and improve a multi-petabyte environment powering millions of queries daily, spanning Linux, Kafka, HDFS, Kubernetes, and distributed query platforms.

The role emphasizes production reliability, monitoring, on-call rotation, and automation using Python. You will collaborate with traders, researchers, and developers to solve data infrastructure problems and to deploy robust, scalable systems.

Qualifications

  • Hands-on Linux systems administration and troubleshooting experience.
  • Experience owning production systems, including monitoring, incidents and on-call.
  • Operator-side experience with Kafka, HDFS or Kubernetes.
  • Python experience for infrastructure automation or operational tooling.
  • Understanding of networking, storage, processes, memory and system performance.
  • Experience with infrastructure automation, CI/CD or configuration management.

Responsibilities

  • Operate and improve large-scale distributed data infrastructure.
  • Work with technologies including Kafka, HDFS, Kubernetes and distributed query platforms.
  • Own monitoring, alerting, incident response and production reliability.
  • Automate infrastructure deployment, upgrades and operational processes using Python.
  • Troubleshoot Linux, networking, storage and distributed systems issues.
  • Improve capacity, resilience, failure handling and deployment processes.
  • Work directly with traders, researchers and developers to solve data infrastructure problems.
  • Participate in an on-call rotation and engineer out recurring issues.

Skills

Linux admin
Production systems
Kafka
HDFS
Kubernetes
Python
Networking
CI/CD

Tools

CI/CD tooling

Job description

Tribus in Sydney is seeking a Site Reliability Engineer focused on data infrastructure. You will operate and improve a multi-petabyte environment powering millions of queries daily, spanning Linux, Kafka, HDFS, Kubernetes, and distributed query platforms.

The role emphasizes production reliability, monitoring, on-call rotation, and automation using Python. You will collaborate with traders, researchers, and developers to solve data infrastructure problems and to deploy robust, scalable systems.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Site Reliability Engineer - Data Infrastructure
Site Reliability Engineer - Data Infrastructure

Tribus • Sydney

On-site
AUD 150,000 - 210,000
Real-Time Trading SRE — Resilient Infra & Automation
Real-Time Trading SRE — Resilient Infra & Automation

Tribus • Sydney

On-site
AUD 150,000 - 190,000
Data Platform SRE: Scale & Automate Data Pipelines
Data Platform SRE: Scale & Automate Data Pipelines

IMC Trading • Sydney

On-site
AUD 120,000 - 170,000
Data Platform SRE (Big Data, Kafka, Kubernetes)
Data Platform SRE (Big Data, Kafka, Kubernetes)

Linuxconfig • Australia

On-site
AUD 120,000 - 160,000
Site Reliability Engineer
Site Reliability Engineer

Tribus • Sydney

On-site
AUD 150,000 - 190,000
Site Reliability Engineer - Data Engineering
Site Reliability Engineer - Data Engineering

IMC Trading • Sydney

On-site
AUD 120,000 - 170,000
SRE — Infrastructure & Assurance Services (Hybrid US)
SRE — Infrastructure & Assurance Services (Hybrid US)

TikTok • Council of the City of Sydney

Hybrid
AUD 100,000 - 130,000
Site Reliability Engineer — Automation & Uptime
Site Reliability Engineer — Automation & Uptime

TECHNIX INDIA • New South Wales

On-site
AUD 100,000 - 130,000
Site Reliability Engineer – Monitoring, Troubleshooting & Automation
Site Reliability Engineer – Monitoring, Troubleshooting & Automation

Tata Consultancy Services Limited • Sydney

On-site
AUD 90,000 - 120,000
Data - Site Reliability Engineer
Data - Site Reliability Engineer

Optiver • Sydney

On-site
AUD 90,000 - 130,000
Performance-based bonus
Training & mentorship
Daily breakfast & in-house barista
+3