Site Reliability Engineer (Vietnamese speaker)

AGAPI Technologies

United Arab Emirates

On-site

AED 300,000 - 520,000

Full time

4 days ago
Be an early applicant
Application generator

Don’t send a generic resume — generate a resume and cover letter tailored to this exact role.

Get past ATS filters

Benefits offered by this job

Competitive pay
Accommodation
Meal allowance
Visa support
Year-end bonuses
MacBook & iPhone

Job summary

AGAPI Technologies is seeking a Site Reliability Engineer (Vietnamese speaker) in Dubai to design, build, and maintain scalable infrastructure. You will define SLIs, SLOs, and SLAs, develop robust monitoring and alerting, and respond to incidents with RCA-driven improvements.

The role requires 4+ years in SRE/DevOps, hands-on Kubernetes, IaC with Terraform (or Pulumi) across AWS, and strong scripting skills (Python/Go/Bash). AWS certification is preferred.

Qualifications

  • 4 years in an SRE, DevOps, or platform engineering role with production ownership at scale.
  • Hands-on Kubernetes experience in a production environment.
  • IaC fluency with Terraform or Pulumi across a major cloud provider (AWS preferred).
  • Observability stack experience with Prometheus, Grafana, or equivalent.
  • Proficiency in scripting/Programming (Python, Go, or Bash).
  • AWS certification (Solutions Architect, DevOps Engineer, or SysOps Administrator).

Responsibilities

  • Design, build, and maintain highly available, scalable, and resilient infrastructure.
  • Define, implement, and monitor SLIs, SLOs, and SLAs for reliability.
  • Develop and maintain monitoring, logging, tracing, and alerting systems.
  • Respond to production incidents, perform RCA, and drive postmortem improvements.
  • Automate tasks and deployments using scripts and IaC.
  • Optimize performance, availability, and cost efficiency.
  • Implement DR/backups and business continuity strategies.
  • Capacity planning and infrastructure scaling based on demand.
  • Collaborate with development teams to improve reliability and observability.
  • Define and enforce operational best practices and security standards.
  • Continuously improve platform automation and self-healing capabilities.
  • Evaluate new technologies to enhance reliability and productivity.

Skills

Kubernetes
Terraform
Pulumi
Prometheus
Grafana
Python
Go
Bash
AWS Certification

Job description

Home / Job opening / Site Reliability Engineer (Vietnamese speaker)

Site Reliability Engineer (Vietnamese speaker)

Dubai

Job Responsibilities:
  • Design, build, and maintain highly available, scalable, and resilient infrastructure.
  • Define, implement, and monitor SLIs, SLOs, and SLAs to ensure service reliability.
  • Develop and maintain monitoring, logging, tracing, and alerting systems.
  • Respond to production incidents, perform root cause analysis (RCA), and drive postmortem improvements.
  • Automate operational tasks, deployments, backups, and recovery processes using scripts and Infrastructure as Code (IaC).
  • Optimize system performance, availability, scalability, and cost efficiency.
  • Implement disaster recovery (DR), backup, and business continuity strategies.
  • Perform capacity planning and infrastructure scaling based on traffic growth and business demands.
  • Collaborate with development teams to improve application reliability, observability, and operational readiness.
  • Define and enforce operational best practices, security standards, and reliability engineering principles.
  • Continuously improve platform automation, self-healing capabilities, and operational efficiency.
  • Evaluate and adopt new technologies, tools, and practices to enhance platform reliability and developer productivity.
Job Requirements:
  • 4 years in an SRE, DevOps, or platform engineering role with production ownership at scale.
  • Hands-on Kubernetes experience — deployment, scaling, networking, and troubleshooting in a production environment.
  • Infrastructure-as-code fluency with Terraform (or Pulumi) across a major cloud provider (AWS preferred).
  • Observability stack experience — Prometheus, Grafana, and/or equivalent tools with a track record of building meaningful dashboards and alerts.
  • Proficiency in at least one scripting or programming language (Python, Go, or Bash) for automation and tooling.
  • AWS certification (Solutions Architect, DevOps Engineer, or SysOps Administrator).
What we offer:
  • Competitive Compensation: Enjoy a salary package tailored to your skills and experience, along with performance-based bonuses.
  • Comprehensive Benefits: We support your well-being with accommodation, meal allowances, and assistance with work visa processing.
  • Work-Life Balance: Unwind with generous holiday and New Year bonuses.
  • Top-Tier Equipment: Stay productive with the latest tools, including a MacBook and Iphone.
  • Thriving Culture: Immerse yourself in a dynamic, inclusive work environment that fosters growth.
Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Site Reliability Engineer (SRE)
Site Reliability Engineer (SRE)

Epergne Solutions • Abu Dhabi

On-site
AED 180,000 - 250,000
Site Reliability Engineer (SRE)
Site Reliability Engineer (SRE)

Epergne Solutions • Dubai

On-site
AED 200,000 - 300,000
Vietnamese-Speaking SRE | Kubernetes + AWS
Vietnamese-Speaking SRE | Kubernetes + AWS

AGAPI Technologies • United Arab Emirates

On-site
AED 300,000 - 520,000
Competitive pay
Accommodation
Meal allowance
+3
Site Reliability Engineer (SRE)
Site Reliability Engineer (SRE)

Epergne Solutions • Ras Al Khaimah

On-site
AED 469,000 - 603,000
Senior Site Reliability Engineer (Azure)
Senior Site Reliability Engineer (Azure)

SALT • United Arab Emirates

On-site
AED 420,000 - 540,000
Lead Incident / Site Reliability Engineer
Lead Incident / Site Reliability Engineer

Nameless Ventures • Dubai

On-site
AED 446,000 - 502,000
Annual bonus
Full VISA sponsorship
Private medical insurance for you and/
Lead Site Reliability Engineer at HCLTech
Lead Site Reliability Engineer at HCLTech

HCLTech • United Arab Emirates

On-site
AED 120,000 - 160,000
Site Reliability Engineer - AIOps
Site Reliability Engineer - AIOps

DiceTek UAE • Al Ruways Industrial City

On-site
Backend Developer - Golang (Vietnamese speaker)
Backend Developer - Golang (Vietnamese speaker)

AGAPI Technologies • United Arab Emirates

On-site
AED 446,000 - 781,000
Competitive compensation
Accommodation
Meal allowances
+3
Senior DevOps / Site Reliability Engineer (SRE)
Senior DevOps / Site Reliability Engineer (SRE)

Stellar Technologies • Abu Dhabi

On-site
AED 360,000 - 540,000