Devops/SRE Tech Lead I Observabilidade

BigDataCorp

Rio de Janeiro

Teletrabalho

BRL 180 000 - 320 000

Tempo integral

Há 7 dias
Torna-te num dos primeiros candidatos
Gerador de candidaturas

Uma candidatura completa num minuto — currículo e carta de apresentação personalizados, prontos a enviar.

Ultrapassa os filtros ATS

Vantagens oferecidas por esta oferta de emprego

Remoto 100%
Escritório RJ/SP opcional
Plano de saúde Bradesco

Resumo da oferta

A BigDataCorp busca um(a) engenheiro(a) de infraestrutura sênior para atuar em um ambiente 100% remoto, com escritório opcional no RJ/SP. Você irá liderar a arquitetura de observabilidade, gerenciar clusters Kubernetes em produção e evoluir pipelines de entrega contínua, sempre com foco na escalabilidade, segurança e eficiência de custos.

O candidato ideal possui experiência prática com AWS, IaC, Kubernetes e ferramentas de observabilidade, além de habilidade para orientar o time e negociar

Qualificações

  • Experiência prática com Kubernetes em produção e gestão de clusters
  • Conhecimentos sólidos em IaC (Terraform, Pulumi ou similar) e Helm
  • Experiência com plataformas de observabilidade (Prometheus, OpenTelemetry, Grafana)
  • Familiaridade com pipelines CI/CD (GitLab CI, GitHub Actions, Jenkins) e automação
  • Capacidade de codificar para automação (Python, Go, Bash)
  • Inglês técnico é desejável e negociação com times globais

Responsabilidades

  • Projetar, implantar e manter infraestrutura de nuvem escalável e disponível
  • Configurar e manter o ecossistema de observabilidade (Prometheus, OpenTelemetry, Grafana)
  • Gerir Kubernetes em produção, com foco em segurança e custo
  • Conduzir CI/CD eficientes com redução de toil
  • Liderar e orientar time de infraestrutura, priorizando backlog
  • Comunicar prioridades técnicas de forma clara aos times de produto e engenharia

Conhecimentos

Kubernetes
Infraestrutura como Código
Observabilidade
CI/CD
Python
Cloud AWS
Docker
Comunicação

Ferramentas

Terraform
Helm
OpenTelemetry
Grafana
Datadog

Descrição da oferta de emprego

Sobre a BigDataCorp

A BigDataCorp é a maior datatech da América Latina, e democratiza, desde 2013, o acesso aos dados, aumentando possibilidades e certezas em um mundo repleto de incertezas.

Somos pioneiros na captura, estruturação, armazenamento e distribuição de dados no Brasil. Nosso processo é único. Já nascemos adequados à LGPD e às demais regulamentações, garantindo a origem das informações fornecidas, obtidas sempre de forma ética.

Sobre a área e a vaga

Os times de infraestrutura são responsáveis por organizar, manter e evoluir as diferentes plataformas que constituem a base da operação da empresa, da organização dos serviços de computação na nuvem empregados pelos diferentes times técnicos até a definição e implantação de processos relacionados com a segurança da informação na empresa como um todo.

O que vai fazer no dia a dia
  • Arquitetura de Observabilidade: Projetar, implantar e manter a infraestrutura de telemetria (OpenTelemetry Collectors, agentes de métricas/logs/traces, concentradores e ferramentas de visualização), garantindo alta disponibilidade da própria plataforma de observabilidade.
  • Governança de Alertas e Métricas: Configurar o ecossistema de observabilidade para coletar dados de aplicações e infraestrutura, definindo regras de alerta acionáveis (Alertmanager/Incident.io) e reduzindo o ruído operando no modelo Observability-as-a-Service para os times de desenvolvimento.
  • Arquitetura e Nuvem: Projetar, operar e evoluir a infraestrutura em AWS utilizando Infraestrutura como Código (IaC).
  • Gestão de Kubernetes: Administrar clusters em produção, garantindo escalabilidade, segurança e controle de custos.
  • CI/CD e Automação: Construir e otimizar pipelines de entrega contínua rápidas e confiáveis, eliminando trabalho operacional repetitivo (toil).
  • Liderança e Mentoria: Guiar o time de infraestrutura/plataforma, organizar o backlog, distribuir tarefas e atuar como mentor(a) para os demais engenheiros.
  • Ponte com Produto: Negociar prioridades técnicas com os times de desenvolvimento e produto.
Habilidades necessárias
  • Cloud: Experiência profunda com provedores de nuvem pública (preferencialmente AWS).
  • Containers: Domínio avançado de Kubernetes e ecossistema de containers (Docker/containerd).
  • Vivência madura na operação e sustentação de sistemas distribuídos e de alta disponibilidade em produção.
  • Infraestrutura de Observabilidade (Hands-on): Experiência comprovada implantando e configurando a pilha de observabilidade via código (IaC/Helm). É necessário dominar o deploy e gerenciamento de ferramentas como Prometheus Operator, OpenTelemetry Collector, Grafana Stack (Loki, Tempo, Mimir) ou agentes/arquitetura em soluções proprietárias (Datadog, New Relic, Dynatrace), incluindo gestão de retenção e custo de dados de telemetria.
  • Capacidade de desenhar arquiteturas resilientes e escaláveis na nuvem.
  • Visão sistêmica de ciclo de vida de desenvolvimento de software (SDLC) para melhorar a experiência dos desenvolvedores (DevEx).
  • Visão de Engenharia de Telemetria: Entendimento profundo de como os dados de observabilidade são gerados, coletados, processados e armazenados (não apenas criar dashboards, mas entender o caminho que o log, a métrica e o trace percorrem desde a aplicação até o banco de dados de telemetria).
  • Experiência em protocolos de resposta a incidentes.
  • Experiência ou forte aptidão para facilitação de ritos ágeis e gestão de entregas de um pequeno time técnico.
  • IaC: Proficiência em Infraestrutura como Código (Terraform, Pulumi ou similar).
  • Programação/Scripting: Capacidade real de codificar para automação (Python, Go ou Bash avançado).
  • CI/CD: Experiência na construção e manutenção de pipelines (GitLab CI, GitHub Actions, Jenkins, etc.).
  • Comunicação e Negociação: Saber traduzir dívidas técnicas e riscos de infraestrutura para uma linguagem de negócios, conseguindo negociar espaço no backlog com os demais times internos.
  • Inteligência Emocional: Resiliência e frieza para tomar decisões rápidas sob pressão durante incidentes (quedas de produção).
  • Perfil Mentoria (Servant Leadership): Gostar de ensinar, destravar o time e formar novos talentos, não apenas querer brilhar sozinho no código.
  • Pragmatismo: Saber equilibrar a "arquitetura perfeita" com as necessidades reais e o tempo de entrega que o negocio exige.
  • Requisitos diferenciais:
    • GitOps & Service Mesh: Prática com Argo CD, Flux, Istio ou Linkerd.
    • FinOps: Experiência prática na redução e otimização de custos de infraestrutura em nuvem.
    • Observabilidade Avançada e eBPF: Uso de eBPF (Cilium, Pixie) para observabilidade sem instrumentação pesada no código.
    • Otimização de Custos em Observabilidade: Estratégias de amostragem (sampling) de traces, agregação/descarte de logs em nível de coletor para evitar explosão de custos de ingestão na nuvem ou SaaS.
    • Segurança (DevSecOps): Gestão de segredos, políticas como código (ex: OPA/Gatekeeper) e segurança de supply chain.
    • Certificações: CKA (Certified Kubernetes Administrator), AWS Solutions Architect ou equivalentes.
    • Idiomas: Inglês técnico avançado (para leitura, conversação e condução de fóruns com eventuais fornecedores/times globais).
O que oferecemos
  • Trabalho 100% remoto (trabalhe de onde quiser);
  • Escritório em RJ e SP com ambiente de trabalho descontraído (para quem quiser utilizar);
  • Oportunidades de crescimento e desenvolvimento;
  • Flexibilidade de horários (sim, mesmo em home office);
  • Férias flexíveis (além do regime CLT);
  • Plano de saúde e dental Bradesco;
  • Seguro de vida em grupo;
  • Benefício Refeição via cartão Caju;
  • Auxílio mensal ao home office (móveis e internet);
  • Vale Home Office;
  • OrienteMe (apoio psicológico);
  • Conexa Saúde (apoio psicológico e nutricional);
  • Wellhub;
  • Day Off para aniversários;
  • Licença Maternidade de 6 meses;
  • Licença Paternidade de 1 mês;
  • Auxílio-creche;
  • Convênio SESC;
  • Game night (presencial no escritório do RJ e online no Discord);
  • BDC Learning e BDC Decola (programa de desenvolvimento e crescimento dos nossos profissionais através do subsídio de treinamentos diversos, como cursos, palestras, livros e outros);
  • Equipe unida e sempre pronta para apoiar.
Obtém a tua avaliação gratuita e confidencial do currículo.

ou arrasta e larga o ficheiro aqui.

Similar jobs

Ofertas semelhantes que vale a pena comparar

Tech Lead Barueri - SP and Hybrid Full-time employee
Tech Lead Barueri - SP and Hybrid Full-time employee

Vertem • Barueri

Híbrido
BRL 240 000 - 360 000
Flex Office (2 dias home office)
Plano de saúde
Seguro de vida
+4
Desenvolvedor Backend V
Desenvolvedor Backend V

EXA • Brasil

Híbrido
BRL 180 000 - 300 000
Assistência médica
Seguro de vida
Auxílio home office
+2
DevOps Sênior
DevOps Sênior

Aarin • Brasil

Teletrabalho
BRL 200 000 - 320 000
Seguro de Vida
Auxílio alimentação
Parcerias com TotalPass/Wellhub
+2
Analista DevOps
Analista DevOps

Attus Procuradoria Digital • Brasil

Presencial
BRL 201 000 - 312 000
Plano de saúde
Seguro de vida
Vale-alimentação
+2
Analista de SRE Pleno (Remoto)
Analista de SRE Pleno (Remoto)

Cooperflora • São Paulo

Teletrabalho
BRL 89 280 - 133 920
Auxílio médico
Wellhub
Terapia online
+7
Analista DevOps Remote Work Full-time employee
Analista DevOps Remote Work Full-time employee

Attus • Brasil

Teletrabalho
BRL 180 000 - 300 000
Plano de saúde
Seguro de vida
Vale-alimentação
+4
Pessoa Desenvolvedora Backend Sênior
Pessoa Desenvolvedora Backend Sênior

Aarin • Brasil

Teletrabalho
BRL 180 000 - 320 000
Seguro de Vida
Auxílio Alimentação
Parcerias educacionais
+5
Analista de Qualidade Pleno Barueri - SP and Hybrid Full-time employee
Analista de Qualidade Pleno Barueri - SP and Hybrid Full-time employee

Vertem • Barueri

Híbrido
BRL 100 000 - 145 000
Flex Office – 2 dias de home office e
Day Off no aniversário
Seguro de vida Sul América
+7
Java Developer Sênior - Vaga Exclusiva PCD
Java Developer Sênior - Vaga Exclusiva PCD

Confidencial • Campinas

Teletrabalho
BRL 240 000 - 400 000
Vale Refeição/Alimentação
Plano de Saúde
Plano Odontológico
+6
Analista de Infraestrutura & DevSecOps Senior
Analista de Infraestrutura & DevSecOps Senior

Laqus • São Paulo

Presencial
BRL 180 000 - 300 000
Vale Refeição
Vale Alimentação
Plano de Saúde sem coparticipação
+5