SRE Engineer

Verity

Brasil

Teletrabalho

BRL 120 000 - 200 000

Tempo integral

Há 11 dias
Gerador de candidaturas

Não envies um currículo genérico — gera um currículo e uma carta de apresentação adaptados a esta função específica.

Ultrapassa os filtros ATS

Resumo da oferta

Verity está buscando um Site Reliability Engineer para fortalecer a confiabilidade de plataformas em nuvem. Atuar com SRE, acompanhar SLI/SLO/SLA, MTTR e MTTD, além de estabelecer práticas de observabilidade, monitoramento e APM.

Trabalhará com Kubernetes/Docker e conduzirá análises de causa raiz para evitar recorrências. É essencial experiência com ambientes Cloud (GCP/AWS/Azure), Linux, automação e pipelines CI/CD.

Qualificações

  • Experiência como Site Reliability Engineer, SRE ou função equivalente.
  • Experiência prática com ambientes Cloud, utilizando GCP, AWS e/ou Azure.
  • Conhecimento em Kubernetes e Docker.
  • Experiência com observabilidade, monitoramento, alertas e APM.
  • Conhecimento em métricas e práticas de SRE, como SLI, SLO, SLA, MTTR e MTTD.
  • Experiência em gestão, investigação e resolução de incidentes.
  • Conhecimento em troubleshooting de aplicações e infraestrutura.
  • Experiência com administração de ambientes Linux.
  • Conhecimento em redes, segurança, performance e alta disponibilidade.
  • Experiência com automação e Infrastructure as Code.
  • Vivência com pipelines de CI/CD.

Responsabilidades

  • Definir e acompanhar SLIs, SLOs, SLAs, MTTR e MTTD.
  • Implementar observabilidade, monitoramento, alertas e APM.
  • Monitorar latência, tráfego, erros, saturação, disponibilidade e performance.
  • Atuar na prevenção, identificação e resolução de incidentes.
  • Conduzir análises de causa raiz e definir ações para evitar recorrências.
  • Identificar riscos, gargalos e pontos únicos de falha.
  • Apoiar o desenho de soluções resilientes, escaláveis e altamente disponíveis.
  • Automatizar atividades operacionais e reduzir tarefas manuais.
  • Operar e evoluir ambientes Kubernetes e Docker.
  • Apoiar estratégias de capacidade, continuidade e recuperação de desastres.
  • Participar de deploys e apoiar a estabilização das aplicações.
  • Trabalhar com os times para melhorar a confiabilidade desde a concepção das soluções.
  • Criar e manter dashboards, alertas, procedimentos e documentação operacional.
  • Promover uma cultura de confiabilidade, observabilidade e melhoria contínua.

Conhecimentos

SRE experience
Cloud platforms
Incident management
CI/CD pipelines
Observability mindset

Ferramentas

Kubernetes
Docker
GCP
AWS
Azure

Descrição da oferta de emprego

Responsabilidades e atribuições
  • Definir e acompanhar SLIs, SLOs, SLAs, MTTR e MTTD.
  • Implementar observabilidade, monitoramento, alertas e APM.
  • Monitorar latência, tráfego, erros, saturação, disponibilidade e performance.
  • Atuar na prevenção, identificação e resolução de incidentes.
  • Conduzir análises de causa raiz e definir ações para evitar recorrências.
  • Identificar riscos, gargalos e pontos únicos de falha.
  • Apoiar o desenho de soluções resilientes, escaláveis e altamente disponíveis.
  • Automatizar atividades operacionais e reduzir tarefas manuais.
  • Operar e evoluir ambientes Kubernetes e Docker.
  • Apoiar estratégias de capacidade, continuidade e recuperação de desastres.
  • Participar de deploys e apoiar a estabilização das aplicações.
  • Trabalhar com os times para melhorar a confiabilidade desde a concepção das soluções.
  • Criar e manter dashboards, alertas, procedimentos e documentação operacional.
  • Promover uma cultura de confiabilidade, observabilidade e melhoria contínua.
Requisitos e qualificações
  • Experiência como Site Reliability Engineer, SRE ou função equivalente.
  • Experiência prática com ambientes Cloud, utilizando GCP, AWS e/ou Azure.
  • Conhecimento em Kubernetes e Docker.
  • Experiência com observabilidade, monitoramento, alertas e APM.
  • Conhecimento em métricas e práticas de SRE, como SLI, SLO, SLA, MTTR e MTTD.
  • Experiência em gestão, investigação e resolução de incidentes.
  • Conhecimento em troubleshooting de aplicações e infraestrutura.
  • Experiência com administração de ambientes Linux.
  • Conhecimento em redes, segurança, performance e alta disponibilidade.
  • Experiência com automação e Infrastructure as Code.
  • Vivência com pipelines de CI/CD.
Obtém a tua avaliação gratuita e confidencial do currículo.

ou arrasta e larga o ficheiro aqui.

Similar jobs

Ofertas semelhantes que vale a pena comparar

Site Reliability Engineer (SRE)
Site Reliability Engineer (SRE)

Proative Technology • Barueri

Presencial
BRL 180 000 - 240 000
Site Reliability Engineer
Site Reliability Engineer

Banco Daycoval • São Paulo

Presencial
BRL 180 000 - 240 000
Senior Site Reliability Engineer
Senior Site Reliability Engineer

Unik RH • Belo Horizonte

Presencial
BRL 180 000 - 280 000
SRE (Site Reliability Engineer)
SRE (Site Reliability Engineer)

Sabiá Gaming • Belo Horizonte

Presencial
BRL 180 000 - 240 000
SRE/Analista DevOps SR
SRE/Analista DevOps SR

Objective • Brasil

Teletrabalho
BRL 180 000 - 320 000
SRE Sr
SRE Sr

MaisTODOS • Brasil

Presencial
BRL 240 000 - 320 000
SRE Partner
SRE Partner

Jusbrasil • São Paulo

Presencial
BRL 279 000 - 446 400
Engenheiro de Confiabilidade Pleno - SRE
Engenheiro de Confiabilidade Pleno - SRE

Reclame AQUI • Brasil

Presencial
BRL 180 000 - 240 000
Site Reliability Engineer (SRE)
Site Reliability Engineer (SRE)

Ernst & Young Advisory Services Sdn Bhd • Pompeia

Presencial
BRL 167 400 - 279 000
SRE Especialista
SRE Especialista

VR • Brasil

Teletrabalho
BRL 180 000 - 240 000