Analista SRE Sênior

ZG Soluções

Brasil

Híbrido

BRL 180 000 - 300 000

Tempo integral

14 dias+
Gerador de candidaturas

Uma candidatura completa num minuto — currículo personalizado e carta de apresentação, prontos a enviar.

Ultrapassa os filtros ATS

Resumo da oferta

A ZG Soluções procura um profissional SRE/DevOps sênior para atuar na confiabilidade de ambientes produtivos críticos, em cloud pública, datacenters com virtualização e infraestrutura privada de clientes.

Você automatizará provisioning com Terraform e Ansible, operará clusters Kubernetes em produção, manterá redes, storage, Linux, observabilidade (Prometheus, Grafana, Zabbix) e entregas GitOps com ArgoCD, assegurando alta disponibilidade.

Qualificações

  • Experiência sólida como SRE/DevOps em ambientes de produção críticos.
  • Domínio de redes (TCP/IP, DNS, TLS) e proxy reverso com NGINX.
  • Automação de infra com Terraform e Ansible.
  • Gerenciamento de clusters Kubernetes em produção e resolução de falhas.
  • Conhecimentos avançados de Linux e scripting Shell/Bash.
  • Experiência com Git e práticas de CI/CD.

Responsabilidades

  • Automatizar o provisionamento e a configuração da infraestrutura com Terraform e Ansible.
  • Operar e evoluir clusters Kubernetes em produção, incluindo networking, storage, RBAC e estratégias de atualização.
  • Construir e manter imagens Docker enxutas e reprodutíveis.
  • Sustentar conectividade entre ambientes: VPN, DNS, TLS, firewall e proxy reverso (NGINX).
  • Administrar virtualização e Linux que suportam a plataforma (preferência Proxmox).
  • Manter a arquitetura com foco em resiliência e alta disponibilidade.
  • Evoluir CI/CD e entrega via GitOps (ArgoCD).
  • Promover observabilidade com Prometheus, Grafana e Zabbix.
  • Conduzir incidentes até a raiz e documentar correções estruturais.

Descrição da oferta de emprego

Buscamos um profissional Sênior de infraestrutura e confiabilidade, com estrada real em ambientes produtivos críticos.

Nossos ambientes são híbridos: cargas em cloud pública, cargas em datacenter com virtualização e cargas dentro da infraestrutura privada dos nossos clientes. Isso exige alguém que domine a base (rede, virtualização e Linux) e que automatize tudo o que sustenta essa base.

Atuando conosco, você será responsável por provisionar infraestrutura de forma automatizada, operar nossos clusters Kubernetes em produção e garantir a resiliência e a observabilidade das aplicações em todos esses ambientes.

Avaliamos profundidade técnica e capacidade de diagnóstico. Não avaliamos exposição, palestras ou presença em redes sociais.

RESPONSABILIDADES E ATRIBUIÇÕES
  • Automatizar o provisionamento e a configuração da infraestrutura com Terraform e Ansible;
  • Operar e evoluir clusters Kubernetes em produção, incluindo networking, storage, RBAC e estratégias de atualização;
  • Construir e manter imagens e containers Docker enxutos e reprodutíveis;
  • Sustentar a conectividade entre nossos ambientes e os dos clientes: roteamento, VPN, DNS, TLS, firewall e proxy reverso;
  • Administrar e dimensionar a camada de virtualização e os sistemas Linux que suportam a plataforma;
  • Manter e evoluir a arquitetura com foco em resiliência e alta disponibilidade;
  • Evoluir a esteira de CI/CD e a entrega via GitOps (ArgoCD);
  • Promover observabilidade e monitoramento com Prometheus, Grafana e Zabbix, reduzindo ruído de alerta;
  • Conduzir a análise de incidentes até a causa raiz e transformá-la em correção estrutural documentada;
  • Sustentar a operação de aplicações Java e de bancos de dados PostgreSQL em produção;
  • Promover a gestão de segurança nos servidores e serviços do ecossistema.
REQUISITOS E QUALIFICAÇÕES
  • Experiência sólida como SRE, DevOps ou Infraestrutura em ambientes produtivos críticos, com atuação direta em incidentes de impacto real;
  • Domínio de redes: TCP/IP, roteamento, DNS, NAT, TLS/SSL, VPN, firewall e proxy reverso com NGINX;
  • Experiência em administração de virtualização em produção, preferencialmente Proxmox (VMware, KVM ou equivalente também são considerados);
  • Operação avançada de Linux e automação com Shell/Bash;
  • Automação de provisionamento com Terraform e Ansible em uso real e mantidos ao longo do tempo;
  • Gerenciamento de clusters Kubernetes em produção, com capacidade de investigar e resolver falhas de workload, tráfego e nó;
  • Construção, atualização e gerenciamento de imagens e containers Docker;
  • Experiência em processos de CI/CD e em entrega via GitOps (ArgoCD ou equivalente);
  • Experiência com ferramentas de monitoramento e observabilidade (Prometheus, Grafana, Zabbix);
  • Controle de versão com Git como prática diária;
  • Autonomia para assumir um problema mal definido, investigar até o fim e entregar a solução;
  • Comunicação clara e documentação técnica de qualidade, principalmente durante incidentes.
VOCÊ VAI SE DESTACAR SE TIVER
  • Experiência em ambientes com exigência regulatória (saúde, financeiro ou setor público) e familiaridade com LGPD;
  • Vivência em troubleshooting de sistemas distribuídos e falhas intermitentes;
  • Experiência com middleware e servidores de aplicação Java, filas e API Gateways;
  • Prática em hardening, gestão de segredos e de vulnerabilidades;
  • PostgreSQL em nível de tuning, replicação e recuperação;
  • Certificações que sustentem a prática (CKA/CKS, RHCE, LPIC, rede ou cloud);
  • Capacidade de escrever a própria ferramenta quando não existe pronta (Python, Go ou equivalente);
  • Uso de IA no dia a dia técnico, para construir ferramentas e automações e acelerar a resolução de problemas.
ESTA VAGA NÃO É PARA VOCÊ SE
  • Sua experiência com Kubernetes se resume a aplicar manifestos escritos por outra pessoa;
  • Você trata rede como caixa-preta e escala para terceiros o que não está na aplicação;
  • Você provisiona por console gráfico e não versiona infraestrutura.
Obtém a tua avaliação gratuita e confidencial do currículo.

ou arrasta e larga o ficheiro aqui.

Similar jobs

Ofertas semelhantes que vale a pena comparar

SRE Devops Sênior
SRE Devops Sênior

Mottu • São Paulo

Presencial
BRL 180 000 - 240 000
Site Reliability Engineer (SRE)
Site Reliability Engineer (SRE)

Proative Technology • Barueri

Presencial
BRL 180 000 - 240 000
SRE | Analista DevOps Pleno
SRE | Analista DevOps Pleno

Pmweb • Brasil

Presencial
BRL 90 000 - 130 000
Analista de Infraestrutura
Analista de Infraestrutura

Cappta • Brasil

Presencial
BRL 120 000 - 210 000
SRE (Site Reliability Engineer)
SRE (Site Reliability Engineer)

Sabiá Gaming • Belo Horizonte

Presencial
BRL 180 000 - 240 000
Analista de Infraestrutura de TI Sr. (Sysadmin Linux)
Analista de Infraestrutura de TI Sr. (Sysadmin Linux)

Nexera Talent Solutions • Brasília

Presencial
BRL 120 000 - 180 000
Engenheiro de Confiabilidade Pleno - SRE
Engenheiro de Confiabilidade Pleno - SRE

Reclame AQUI • Brasil

Presencial
BRL 180 000 - 240 000
Engenheiro(a) Sênior de Confiabilidade de Sites (SRE) - Server
Engenheiro(a) Sênior de Confiabilidade de Sites (SRE) - Server

Dell GmbH • Brasil

Presencial
BRL 180 000 - 260 000
Cybersecurity Analyst III (CloudSec/SRE)
Cybersecurity Analyst III (CloudSec/SRE)

Oportunidade Mercado Bitcoin • São Paulo

Presencial
BRL 260 000 - 420 000
Kafka security ops
Multi-Cloud experience
Certificações em segurança
Cybersecurity Analyst III (CloudSec/SRE)
Cybersecurity Analyst III (CloudSec/SRE)

Mercado Bitcoin • São Paulo

Híbrido
BRL 180 000 - 300 000