SRE (Site Reliability Engineer)

Sabiá Gaming

Belo Horizonte

Presencial

BRL 180 000 - 240 000

Tempo integral

Há 5 dias
Torna-te num dos primeiros candidatos
Gerador de candidaturas

Transforma esta função numa entrevista — um currículo e uma carta de apresentação criados à volta do que este empregador procura.

Ultrapassa os filtros ATS

Resumo da oferta

A Sabiá Gaming procura um SRE (Site Reliability Engineer) para reforçar a confiabilidade da plataforma Cometa Gaming. O ambiente iGaming apresenta alta criticidade, com picos de tráfego diários e necessidade constante de disponibilidade e resposta a incidentes.

O foco é manter produção estável, reduzir MTTR e melhorar observabilidade com Docker/Kubernetes, CI/CD, IaC e práticas GitOps em multi-cloud. A posição oferece autonomia para propor melhorias e aprender continuamente.

Qualificações

  • Experiência prática como SRE/DevOps com resposta a incidentes.
  • Conhecimento sólido em Kubernetes, containers e nuvem (AWS/GCP/Azure).
  • Domínio de CI/CD, IaC e automação de ambientes.
  • Conhecimento de ferramentas de monitoramento e segurança em cloud-native.
  • Proatividade para investigar problemas complexos.

Responsabilidades

  • Confiabilidade de incidentes: investigação de causa raiz, mitigação e post-mortem blameless, definição de SLIs/SLOs e reduction de toil.
  • Automação CI/CD: criar/evoluir pipelines e estratégias GitOps.
  • IaC: provisionar/manter infraestrutura com Terraform, Terragrunt e Ansible em multi-cloud.
  • Orquestração Observabilidade: gerenciar Docker/Kubernetes com observabilidade (Datadog, Grafana, Prometheus).
  • DevEx Segurança: apoiar equipes com foco em resiliência, performance e segurança cloud-native.

Conhecimentos

SRE
DevOps
Kubernetes
Docker
Terraform
CI/CD
GitOps
Linux
Observability
Cloud

Ferramentas

ArgoCD
Flux
Datadog
Grafana
Prometheus
Jenkins
GitHub Actions

Descrição da oferta de emprego

Sobre a Vaga: Estamos procurand uma pessoa SRE (Site Reliability Engineer) para reforçar a confiabilidade e resiliência da nossa plataforma na Cometa Gaming. Operamos no setor de iGaming/apostas: um ambiente de altíssima criticidade, com desafios diários e picos de tráfego constantes — é praticamente uma Black Friday todo dia, e garantir a disponibilidade é inegociável. O foco principal é manter os ambientes de produção estáveis e responder a incidentes com agilidade (investigar, mitigar, resolver e reduzir o MTTR), transformando cada ocorrência em melhoria contínua. Trabalhamos com a filosofia AI-first (usando inteligência artificial para acelerar nossas entregas), em um ambiente descontraído, de aprendizado constante e com total autonomia para propor e executar.

Responsabilidades
  • Confiabilidade Incidentes: Atuar ativamente em incidentes de produção (investigação de causa raiz, mitigação e post-mortem blameless), definindo/acompanhando SLIs, SLOs e Error Budgets, reduzindo toil via automação e realizando troubleshooting avançado em Linux e sistemas distribuídos.
  • Automação CI/CD: Criar e evoluir pipelines de CI/CD e estratégias GitOps (ArgoCD, Flux ou similares).
  • Infraestrutura como Código (IaC): Provisionar e manter infraestrutura com Terraform, Terragrunt e Ansible em múltiplos cloud providers (AWS, GCP ou Azure).
  • Orquestração Observabilidade: Gerenciar ambientes baseados em Docker e Kubernetes, implementando e aprimorando a observabilidade (Datadog, Grafana, Prometheus).
  • DevEx Segurança: Apoiar os teams de desenvolvimento com foco na experiência do desenvolvedor (DevEx), garantindo resiliência, performance e segurança cloud-native.
Requisitos
  • Experiência: Vivência prática prévia como SRE, DevOps Engineer ou equivalente, com experiência real em resposta a incidentes em produção (plantão/on-call).
  • Orquestração Nuvem: Sólidos conhecimentos em Kubernetes, contêineres e infraestrutura em nuvem (AWS, GCP ou Azure).
  • Práticas Modernas: Domínio de CI/CD, IaC, automação de ambientes e conceitos de Site Reliability Engineering (SLOs, Error Budget, redução de toil).
  • Observabilidade Segurança: Familiaridade com ferramentas de monitoramento/telemetria e segurança em ambientes cloud-native.
  • Perfil: Proatividade para investigação de problemas complexos e paixão por boas práticas de engenharia.
Diferenciais
  • Experiência com plataformas internas de desenvolvimento (IDP) e foco em DevEx.
  • Conhecimento de pipelines avançadas (GitHub Actions, GitLab CI, Jenkins).
  • Nivelamento básico em backend (Laravel) e ciclo de vida de aplicações web.
  • Certificações na área (ex: CKA, AWS Certified Solutions Architect).
  • Contribuições em projetos Open Source.
Obtém a tua avaliação gratuita e confidencial do currículo.
ou arrasta e larga o ficheiro aqui.
Similar jobs

Ofertas semelhantes que vale a pena comparar

Site Reliability Engineer (SRE)
Site Reliability Engineer (SRE)

Proative Technology • Barueri

Presencial
BRL 180 000 - 240 000
Analista Desenvolvedor
Analista Desenvolvedor

Bsa • Recife

Presencial
BRL 134 000 - 246 000
Engenheiro de Confiabilidade Pleno - SRE
Engenheiro de Confiabilidade Pleno - SRE

Reclame AQUI • Brasil

Presencial
BRL 180 000 - 240 000
Site Reliability Engineer (SRE) / Cloud Architect
Site Reliability Engineer (SRE) / Cloud Architect

EEMOVEL SERVICOS DE INFORMACOES S/A • Cascavel

Presencial
Site Reliability Engineer (SRE)
Site Reliability Engineer (SRE)

Ernst & Young Advisory Services Sdn Bhd • Pompeia

Híbrido
Analista SRE Sênior
Analista SRE Sênior

ZG Soluções • Brasil

Híbrido
BRL 180 000 - 300 000
Site Reliability Engineer (SRE) Sênior
Site Reliability Engineer (SRE) Sênior

Radartec • São Paulo

Híbrido
BRL 180 000 - 260 000
Hybrid work model
Vagas para 2 profissionais
SRE Sr
SRE Sr

MaisTODOS • Brasil

Teletrabalho
BRL 240 000 - 320 000
SRE | Analista DevOps Pleno
SRE | Analista DevOps Pleno

Pmweb • Brasil

Presencial
BRL 90 000 - 130 000
ESPECIALISTA DE SRE I - Remoto
ESPECIALISTA DE SRE I - Remoto

Inmetrics • São Paulo

Presencial
BRL 240 000 - 360 000