Infrastructure Automation Engineer

Dell GmbH

Eldorado do Sul

Presencial

BRL 180 000 - 280 000

Tempo integral

14 dias+
Gerador de candidaturas

Não envies um currículo genérico — gera um currículo e uma carta de apresentação adaptados a esta função específica.

Ultrapassa os filtros ATS

Resumo da oferta

A Dell GmbH procura Engenheiro(a) de Automação de Infraestrutura para projetar, desenvolver e operar uma plataforma de automação que habilite operações de infraestrutura em grande escala. Você trabalhará com SRE, Observabilidade e Governança para criar frameworks de automação orientados a eventos e capacidades de remediação inteligente.

O papel envolve integração com ServiceNow CMDB, NetBox e APIs de fornecedores, bem como definição de SLIs/SLOs, com foco em confiabilidade e escalabilidade.

Qualificações

  • Mais de 5 anos de experiência em automação de infraestrutura, engenharia de plataformas, DevOps ou SRE.
  • Sólida experiência em Python para soluções de produção.
  • Experiência avançada com Ansible em grande porte.
  • Experiência com CI/CD, preferencialmente GitLab CI.
  • Integração de plataformas por meio de APIs em pelo menos dois domínios tecnológicos.

Responsabilidades

  • Projetar, desenvolver e manter a plataforma de automação compartilhada usada pelas equipes de SRE.
  • Desenvolver capacidades orientadas a eventos, remediação com IA e integrações com serviços corporativos.
  • Definir padrões de automação, governança e API contracts para onboarding de automações.

Conhecimentos

Python
Ansible
GitLab CI
APIs
Git
GitOps
CI/CD
IaC

Ferramentas

ServiceNow CMDB
NetBox
Moogsoft
Cribl
Kafka
Zabbix
vROps
Dynatrace

Descrição da oferta de emprego

Engenheiro(a) de Automação de Infraestrutura

O(A) Engenheiro(a) de Automação de Infraestrutura é responsável por projetar, desenvolver e operar uma plataforma compartilhada de automação que habilita operações de infraestrutura nos domínios de computação, rede e armazenamento em escala corporativa. A função tem foco na criação de capacidades de automação orientadas a eventos, remediação autônoma, integração de plataformas e excelência operacional por meio de práticas de engenharia de software, permitindo que as equipes de Site Reliability Engineering (SRE) automatizem e escalem operações de infraestrutura de forma eficiente.

Junte-se a nós para realizar o melhor trabalho da sua carreira e gerar um impacto significativo como Engenheiro(a) de Automação de Infraestrutura na equipe Infrastructure Reliability & Intelligent Systems (I.R.I.S.).

O que você irá alcançar

Nesta função, você será responsável por projetar e entregar capacidades compartilhadas de automação que suportam operações de infraestrutura em múltiplos domínios tecnológicos. Você trabalhará em parceria com equipes de SRE, Engenharia, Observabilidade e Governança para desenvolver frameworks de automação, fluxos orientados a eventos, serviços de integração e capacidades de remediação inteligente que aumentem a eficiência operacional, confiabilidade e conformidade.

Você irá:

  • Projetar, desenvolver, manter e evoluir a plataforma compartilhada de automação utilizada pelas equipes de SRE, incluindo frameworks Ansible, roles compartilhadas, inventários dinâmicos, padrões de execução, templates GitLab CI/CD e bibliotecas de integração via API.
  • Desenvolver, orquestrar e aprimorar continuamente capacidades de plataforma agentic, incluindo agentes de remediação baseados em LLM responsáveis por consumir telemetria, correlacionar eventos, executar runbooks automatizados e aumentar os índices de resolução autônoma.
  • Desenvolver e manter frameworks de automação orientados a eventos, garantindo mecanismos de concorrência, segurança operacional, rollback e confiabilidade da plataforma.
  • Criar padrões reutilizáveis de automação para provisionamento zero-touch, gerenciamento de firmware, correção de desvios de configuração, gestão de capacidade e remediação automática de incidentes.
  • Desenvolver e administrar integrações entre a plataforma de automação e sistemas corporativos, incluindo ServiceNow CMDB, ServiceNow ITSM, NetBox, Jira, Archer e APIs de fornecedores de infraestrutura.
  • Colaborar com equipes de Observabilidade para garantir o correto fluxo, processamento e consumo de telemetria para suportar decisões automatizadas e operações orientadas a eventos.
  • Construir e manter bases estruturadas de conhecimento para armazenar e disponibilizar informações de resolução de incidentes para usuários e agentes inteligentes.
  • Definir e manter contratos de API, SDKs e padrões de integração para onboarding de automações específicas de domínio na plataforma compartilhada.
  • Definir e monitorar SLIs, SLOs e error budgets da plataforma de automação, incluindo confiabilidade de execução, latência de agentes, eficiência de resolução autônoma e qualidade da base de conhecimento.
  • Implementar e evoluir práticas de observabilidade da própria plataforma, garantindo monitoramento, alertas, análise de falhas e capacidades de auto recuperação.
  • Liderar análises pós-incidente sem atribuição de culpa, produzindo documentação estruturada de causa raiz e relatórios executivos quando falhas da plataforma ou automações gerarem impacto operacional.
  • Identificar oportunidades de automação compartilhada entre diferentes domínios de infraestrutura e implementar soluções de plataforma reutilizáveis.
  • Trabalhar em parceria com equipes de SRE de Computação, Rede e Armazenamento para definir integrações, controles de segurança, requisitos de testes e adoção da plataforma.
  • Colaborar com equipes de Engenharia para suportar novos requisitos tecnológicos e desenvolver capacidades de automação alinhadas aos roadmaps futuros.
  • Contribuir para iniciativas de policy-as-code, incluindo controles de mudança, restrições operacionais, trilhas de auditoria, geração de evidências de conformidade e controles de impacto.
  • Trabalhar em parceria com equipes de Governança, Risco e Compliance para garantir que os processos automatizados atendam requisitos de auditoria e conformidade regulatória.
  • Gerenciar o roadmap de capacidades da plataforma com base em métricas de cobertura de automação, resolução autônoma e impacto operacional.
  • Avaliar novas tecnologias e ferramentas, conduzindo análises de build versus buy e integrando novas capacidades quando apropriado.
  • Participar da escala de plantão da plataforma compartilhada de automação, apoiando a restauração de serviços em casos de falhas de integrações, pipelines ou execução de agentes.
Requisitos Essenciais
  • Mais de 5 anos de experiência em automação de infraestrutura, engenharia de plataformas, DevOps, SRE ou áreas correlatas em ambientes corporativos de grande escala.
  • Sólida experiência em desenvolvimento de software utilizando Python para construção de soluções de produção.
  • Experiência avançada com Ansible em ambientes corporativos de grande porte.
  • Experiência no desenvolvimento de capacidades de CI/CD, preferencialmente utilizando GitLab CI.
  • Experiência em integração de plataformas de infraestrutura por meio de APIs corporativas em pelo menos dois domínios tecnológicos relevantes.
  • Conhecimento sólido de Git, GitOps, infraestrutura como código e governança de desenvolvimento.
  • Capacidade comprovada de diagnosticar falhas complexas de automação envolvendo múltiplas camadas de infraestrutura.
  • Forte capacidade analítica para investigação de incidentes, análise de causa raiz e evolução de processos de automação.
Requisitos Desejáveis
  • Experiência com arquiteturas de automação orientadas a eventos.
  • Experiência com plataformas de IA generativa, LLMs ou sistemas agentic aplicados a operações.
  • Conhecimento de ServiceNow CMDB e NetBox.
  • Experiência com Moogsoft ou plataformas similares de AIOps.
  • Experiência com tecnologias de pipelines de dados e telemetria, como Cribl ou Kafka.
  • Experiência de integração com plataformas de observabilidade como Zabbix, vROps e Dynatrace.
  • Familiaridade com ambientes regulados por SOX, PCI-DSS e ISO 27001.
  • Experiência na construção de plataformas internas para desenvolvedores ou operadores.
Obtém a tua avaliação gratuita e confidencial do currículo.
ou arrasta e larga o ficheiro aqui.
Similar jobs

Ofertas semelhantes que vale a pena comparar

Engenheiro(a) Sênior de Confiabilidade de Sites (SRE) - Server
Engenheiro(a) Sênior de Confiabilidade de Sites (SRE) - Server

Dell Technologies • Eldorado do Sul

Presencial
BRL 180 000 - 260 000
Engenheiro(a) Sênior de Confiabilidade de Sites (SRE) - Server
Engenheiro(a) Sênior de Confiabilidade de Sites (SRE) - Server

Dell GmbH • Brasil

Presencial
BRL 180 000 - 260 000
Staff Platform Engineer
Staff Platform Engineer

mottu.com.br • São Paulo

Híbrido
BRL 300 000 - 420 000
Analista Pleno De Observabilidade E Operações De Ia (Aiops)
Analista Pleno De Observabilidade E Operações De Ia (Aiops)

Vertis Solutions • Caucaia

Presencial
BRL 112 000 - 201 000
Engenheiro de Suporte Técnico Senior
Engenheiro de Suporte Técnico Senior

Digisystem • São Paulo

Presencial
BRL 120 000 - 180 000
DevOps Sênior
DevOps Sênior

Rhf talentos • São Paulo

Presencial
BRL 240 000 - 320 000
SRE Partner
SRE Partner

Jusbrasil • São Paulo

Presencial
Desenvolvedor RPA Sênior (UiPath)
Desenvolvedor RPA Sênior (UiPath)

Grupo SysMap • Brasil

Presencial
BRL 120 000 - 180 000
SRE Devops Sênior
SRE Devops Sênior

mottu.com.br • São Paulo

Híbrido
BRL 180 000 - 240 000
SRE Devops Sênior
SRE Devops Sênior

Mottu • São Paulo

Presencial
BRL 180 000 - 240 000