DEVOPS/SRE II
Resumo: Atuar como responsável por garantir a confiabilidade, disponibilidade, desempenho e escalabilidade dos ambientes e aplicações da organização e terá papel fundamental na evolução das práticas de confiabilidade, automação operacional e observabilidade, trabalhando em parceria com equipes de desenvolvimento, infraestrutura, segurança e operações para promover uma cultura orientada à estabilidade e melhoria contínua.
DEVOPS/SRE II Resumo: Atuar como responsável por garantir a confiabilidade, disponibilidade, desempenho e escalabilidade dos ambientes e aplicações da organização e terá papel fundamental na evolução das práticas de confiabilidade, automação operacional e observabilidade, trabalhando em parceria com equipes de desenvolvimento, infraestrutura, segurança e operações para promover uma cultura orientada à estabilidade e melhoria contínua.
Responsabilidades
- Garantir a disponibilidade, estabilidade e performance dos ambientes produtivos.
- Atuar na investigação, mitigação e resolução de incidentes em ambientes críticos.
- Participar de war rooms, apoiando a análise técnica e a restauração dos serviços.
- Implementar e manter soluções de observabilidade, monitoramento, logs, métricas e alertas.
- Desenvolver e manter automações operacionais para reduzir atividades manuais e recorrentes.
- Executar rotinas de sustentação, deploy, troubleshooting e validação de ambientes.
- Apoiar iniciativas de segurança operacional, correção de vulnerabilidades e aplicação de boas práticas.
- Acompanhar pipelines, integrações e processos de CI/CD, atuando na resolução de falhas.
- Participar de análises de causa raiz (RCA) e apoiar a elaboração de planos de ação.
- Conduzir revisões pós-incidente com foco em aprendizado contínuo e melhoria dos processos.
- Definir, acompanhar e reportar indicadores de confiabilidade, disponibilidade, incidentes e performance.
- Realizar capacity planning e identificar gargalos de infraestrutura, aplicações e serviços.
- Propor melhorias em automações, monitoramento, pipelines e processos operacionais.
- Apoiar a evolução de práticas de SRE alinhadas às necessidades das áreas técnicas e de negócio.
- Acompanhar a evolução das demandas analíticas, priorizando entregas conforme impacto para o negócio.
- Participar da definição de estratégias de alta disponibilidade, recuperação de desastres e continuidade de serviços.
- Contribuir para a evolução das práticas de SRE e DevOps, alinhando confiabilidade, eficiência operacional e objetivos do negócio.
- Apoiar decisões técnicas relacionadas à arquitetura operacional, resiliência e escalabilidade dos ambientes.
- Identificar oportunidades de melhoria estrutural para aumentar maturidade, confiabilidade e eficiência dos serviços.
Requisitos da vaga
- Ensino super completo em Ciência da Computação; Engenharia da Computação; Sistemas de Informação; Redes de computadores; Segurança da Informação.
- Conceitos de redes: (TCP/IP, DNS, HTTP/HTTPS, Balanceamento de carga, Firewalls, VPN, Certificados SSL/TLS);
- Cloud Computing (AWS preferencialmente)
- Containers e Orquestração;
- Ferramentas de observabilidade e monitoramento (Prometheus, Grafana, Datadog, New Relic, Zabbix)
- Automação (Python, bash, powershell);
- Conhecimentos de Banco de Dados SQL e Postgress (diferencial).
Benefícios
- Vale Refeição ou Alimentação.
- Cartão multibenefícios.
- Assistência Odontológica.
- Convênio médico.
- Seguro de Vida.
- Vale Transporte.
- Parcerias com faculdades.
- Parceria com o SESC.
- Day Off no mês do aniversário.
- Wellhub.