Procuramos um(a) Site Reliability Engineer (SRE) com forte orientação para operações, para integrar uma equipa tecnológica dinâmica e inovadora.
O(A) profissional será responsável por garantir a estabilidade, disponibilidade e fiabilidade de aplicações distribuídas por diferentes regiões, trabalhando com tecnologias cloud, Kubernetes e arquiteturas de microserviços.
Principais responsabilidades
- Assegurar o suporte operacional e a resolução de problemas técnicos em aplicações distribuídas por várias regiões.
- Diagnosticar problemas ao nível dos serviços, recorrendo a ferramentas de observabilidade como Grafana, Loki e Mimir.
- Investigar incidentes relacionados com microserviços, bases de dados e sistemas de mensageria.
- Participar na resposta a incidentes, análise de causas-raiz (Root Cause Analysis) e restabelecimento dos serviços.
- Operar e prestar suporte a aplicações em ambientes Kubernetes na Microsoft Azure.
- Colaborar com as equipas de infraestrutura e desenvolvimento na identificação e resolução de problemas.
- Identificar, documentar e reportar bugs e problemas técnicos às equipas de produto e plataforma.
- Licenciatura em Engenharia Informática, Ciências da Computação ou experiência profissional equivalente.
- Experiência mínima de 5 anos em funções de Site Reliability Engineering ou similares.
- Experiência sólida com Kubernetes e Microsoft Azure.
- Conhecimentos de bases de dados e sistemas de mensageria, nomeadamente MongoDB, MSSQL, PostgreSQL e Kafka.
- Experiência com ferramentas de observabilidade e monitorização, como Grafana, Loki e Mimir.
- Conhecimentos de Helm, Kustomize e ferramentas GitOps.
- Familiaridade com Git, Azure DevOps, ArgoCD e Terraform.
- Bons conhecimentos de inglês, falado e escrito.
- Capacidade de análise, resolução de problemas e trabalho em equipa.
- Certificações AZ-104 (Microsoft Azure Administrator Associate) e/ou CKA (Certified Kubernetes Administrator).
- Experiência na gestão e resolução de incidentes em ambientes de produção.
- Conhecimentos aprofundados de networking, storage, escalabilidade e troubleshooting em Kubernetes.
- Experiência em ambientes de microserviços e infraestruturas cloud distribuídas.
Se tens experiência em Site Reliability Engineering, gostas de resolver desafios técnicos complexos e procuras um novo desafio profissional em ambientes cloud, queremos conhecer-te.
Envia-nos o teu CV em Inglês e candidata-te a esta oportunidade!