Site Reliability Engineer

Banco Daycoval

São Paulo

Presencial

BRL 180 000 - 240 000

Tempo integral

Há 3 dias
Torna-te num dos primeiros candidatos
Gerador de candidaturas

Uma candidatura completa num minuto — currículo e carta de apresentação personalizados, prontos a enviar.

Ultrapassa os filtros ATS

Resumo da oferta

Banco Daycoval busca profissional de SRE/Observabilidade para garantir confiabilidade e desempenho de serviços em produção. O papel envolve definir SLIs/SLOs/SLAs, projetar soluções de observabilidade e atuar na resposta a incidentes com foco na melhoria contínua.

O candidato ideal possui experiência em Linux, redes, Docker e Kubernetes, além de ferramentas de observabilidade como Datadog, Prometheus, Grafana e ELK stack. Conhecimento em Python/Go e IaC (Ansible) é desejável.

Qualificações

  • Conhecimento sólido em Linux, redes, Docker e Kubernetes.
  • Experiência com ferramentas de observabilidade (Datadog, Prometheus, Grafana, Jaeger, ELK Stack ou similares).
  • Experiência em construção de scripts e automações para operações (Python, Go ou Shell Script).
  • Conhecimento dos conceitos de SRE: error budgets, SLIs/SLOs/SLAs e incident management.
  • Experiência com infraestrutura como código (Ansible ou similares).
  • Conhecimento em pipelines CI/CD e práticas de entrega contínua.

Responsabilidades

  • Garantir a confiabilidade, disponibilidade e performance dos serviços e sistemas em produção.
  • Definir e acompanhar SLIs, SLOs e SLAs em conjunto com os times de desenvolvimento
  • Projetar e implementar soluções de observabilidade (métricas, logs e traces) para identificação proativa de incidentes.
  • Realizar análises de causa raiz (post-mortems) e propor ações corretivas e preventivas.
  • Participar de discussões técnicas sobre arquitetura, capacidade e resiliência dos sistemas.
  • Atuar na resposta a incidentes e na melhoria contínua dos processos.

Conhecimentos

Linux
Redes
Docker
Kubernetes
Datadog
Prometheus
Grafana
Jaeger
ELK Stack
Python
Go
Shell Script
SLIs/SLOs/SLAs
Incident management
Error budgets
Ansible
CI/CD pipelines

Ferramentas

CI/CD pipelines

Descrição da oferta de emprego

Garantir a confiabilidade, disponibilidade e performance dos serviços e sistemas em produção.

Definir e acompanhar SLIs, SLOs e SLAs em conjunto com os times de desenvolvimento

Projetar e implementar soluções de observabilidade (métricas, logs e traces) para identificação proativa de incidentes.

Realizar análises de causa raiz (post-mortems) e propor ações corretivas e preventivas.

Participar de discussões técnicas sobre arquitetura, capacidade e resiliência dos sistemas.

Atuar na resposta a incidentes e na melhoria contínua dos processos.

Requisitos e qualificações:

É muito importante que você tenha e/ou saiba:

  • Sólidos conhecimentos em Linux, redes, Docker e Kubernetes.
  • Experiência com ferramentas de observabilidade (Datadog, Prometheus, Grafana, Jaeger, ELK Stack ou similares).
  • Experiência em construção de scripts e automações para operações (Python, Go ou Shell Script).
  • Conhecimento dos conceitos de SRE: error budgets, SLIs/SLOs/SLAs e incident management.
  • Experiência com infraestrutura como código (Ansible ou similares).
  • Conhecimento em pipelines CI/CD e práticas de entrega contínua.
Diferenciais:
  • Experiência com Chaos Engineering
  • Conhecimento em CNI Cilium
  • Engenharia de plataforma e construção de Internal Developer Platforms (IDPs).
  • Experiência em projetos de desenvolvimento de software.
Obtém a tua avaliação gratuita e confidencial do currículo.
ou arrasta e larga o ficheiro aqui.
Similar jobs

Ofertas semelhantes que vale a pena comparar

Site Reliability Engineer (SRE)
Site Reliability Engineer (SRE)

Proative Technology • Barueri

Presencial
BRL 180 000 - 240 000
SRE (Site Reliability Engineer)
SRE (Site Reliability Engineer)

Sabiá Gaming • Belo Horizonte

Presencial
BRL 180 000 - 240 000
Site Reliability Engineer (SRE) SR
Site Reliability Engineer (SRE) SR

SysMap Solutions • Brasil

Presencial
BRL 120 000 - 180 000
Site Reliability Engineer (SRE) / Cloud Architect
Site Reliability Engineer (SRE) / Cloud Architect

EEMOVEL SERVICOS DE INFORMACOES S/A • Cascavel

Presencial
Site Reliability Engineer (SRE)
Site Reliability Engineer (SRE)

Ernst & Young Advisory Services Sdn Bhd • Pompeia

Híbrido
SRE Sr
SRE Sr

MaisTODOS • Brasil

Presencial
BRL 240 000 - 320 000
ESPECIALISTA DE SRE I - Remoto
ESPECIALISTA DE SRE I - Remoto

Inmetrics • São Paulo

Presencial
BRL 240 000 - 360 000
Engenheiro de Confiabilidade Pleno - SRE
Engenheiro de Confiabilidade Pleno - SRE

Reclame AQUI • Brasil

Presencial
BRL 180 000 - 240 000
SRE Devops Sênior
SRE Devops Sênior

mottu.com.br • São Paulo

Híbrido
BRL 180 000 - 240 000
SRE Devops Sênior
SRE Devops Sênior

Mottu • São Paulo

Presencial
BRL 180 000 - 240 000