Senior Site Reliability & Observability Engineer (Kubernetes)

Recruit Logic Limited

Hong Kong

On-site

HKD 900,000 - 1,300,000

Full time

6 days ago
Be an early applicant

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

Recruit Logic Limited in Hong Kong is seeking a Site Reliability Engineer focused on observability, Kubernetes platform reliability, and SRE operations to ensure highly reliable, available, and performant systems.

You will build and maintain monitoring solutions using Prometheus, VictoriaMetrics, ITRS Geneos, Elasticsearch, and Grafana; optimize alerting, dashboards, and pipelines while collaborating with cross-functional teams.

Qualifications

  • Bachelor’s degree in CS/Engineering required.
  • 8–10 years in IT, ideally SRE or production support in financial services.
  • Experience configuring monitoring/observability platforms including ITRS Geneos, Prometheus, VictoriaMetrics, Elasticsearch, Grafana, Kibana.
  • Hands-on Prometheus pipelines and exporters, scraping configurations, and long-term storage integrations.
  • Experience building and maintaining Logstash pipelines for ingestion, parsing, filtering, enrichment, and routing to Elasticsearch.
  • Strong Linux administration skills (RHEL 7/8/9) and troubleshooting abilities.

Responsibilities

  • Own monitoring and platform reliability for critical systems.
  • Build and maintain dashboards and alerting to improve observability.
  • Troubleshoot Linux servers and perform upgrades, patching, and maintenance.
  • Operate Kubernetes environments, ensure cluster health and capacity planning.
  • Collaborate with engineering, application, and infrastructure teams to improve resilience and security.
  • Participate in on-call rotations, including after-hours support.
  • Continuously research and adopt modern monitoring practices and tools.

Skills

Monitoring & observability
Kubernetes
Linux administration
SRE / reliability engineering
Automation & scripting
Log analysis

Education

Bachelor's degree in Computer Science / Engineering

Tools

ITRS Geneos
Prometheus
VictoriaMetrics
Elasticsearch
Grafana
Kibana
Logstash
Bash
Python
Ansible
CI/CD tools
Kubernetes

Job description

Recruit Logic Limited in Hong Kong is seeking a Site Reliability Engineer focused on observability, Kubernetes platform reliability, and SRE operations to ensure highly reliable, available, and performant systems.

You will build and maintain monitoring solutions using Prometheus, VictoriaMetrics, ITRS Geneos, Elasticsearch, and Grafana; optimize alerting, dashboards, and pipelines while collaborating with cross-functional teams.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Sr. Manager, Site Reliability & Innovation, IT
Sr. Manager, Site Reliability & Innovation, IT

CLSA • Hong Kong

On-site
HKD 900,000 - 1,200,000
Senior SRE & Platform Innovation Lead
Senior SRE & Platform Innovation Lead

CLSA • Hong Kong

On-site
HKD 900,000 - 1,200,000
Senior SRE & DevOps Engineer: Platform Reliability
Senior SRE & DevOps Engineer: Platform Reliability

TEKsystems • Hong Kong

On-site
HKD 500,000 - 900,000
Site Reliability Engineer, Observability, Investment Bank
Site Reliability Engineer, Observability, Investment Bank

Recruit Logic Limited • Hong Kong

On-site
HKD 900,000 - 1,300,000
Kubernetes & SRE Engineer – Automation & Ops
Kubernetes & SRE Engineer – Automation & Ops

Recruit Squad Limited • Hong Kong

On-site
HKD 420,000 - 640,000
Senior Site Reliability Engineer
Senior Site Reliability Engineer

Oracle Systems Hong Kong Ltd • Hong Kong

On-site
HKD 900,000 - 1,200,000
SRE / Cloud Operations Engineer (Kubernetes) - J13129
SRE / Cloud Operations Engineer (Kubernetes) - J13129

Pinpoint Asia • Hong Kong Island

On-site
HKD 420,000 - 700,000
Site Reliability Engineer (SRE) / DevOps Engineer
Site Reliability Engineer (SRE) / DevOps Engineer

TEKsystems • Hong Kong

On-site
HKD 500,000 - 900,000
Senior Kubernetes & SRE Engineer - Automation & Reliability
Senior Kubernetes & SRE Engineer - Automation & Reliability

Michael Page International (HK) Ltd • Hong Kong

On-site
HKD 720,000 - 1,200,000
SRE CloudOps Engineer (Kubernetes) — Automate Production
SRE CloudOps Engineer (Kubernetes) — Automate Production

Pinpoint Asia • Hong Kong Island

On-site
HKD 420,000 - 700,000