Procuras uma empresa sólida nas áreas de Project Management, Business Analysis e Agile Transformation?
A PPM Coachers, com 17 anos de experiência no mercado, atua na capacitação, consultoria e reforço de equipas, apoiando organizações na definição de modelos operacionais, melhoria contínua e transformação ágil.
Porquê a PPM Coachers?
- Participação em projetos estratégicos de grande impacto.
- Possibilidade de colaboração com equipas multidisciplinares e em contextos de evolução digital.
- Acompanhamento próximo, desenvolvimento contínuo e integração numa equipa experiente e orientada para a excelência.
A PPM Coachers está a recrutar para a função de Site Reliability Engineer (SRE) | Azure & Kubernetes!
Integrar uma equipa internacional de tecnologia, assumindo um papel ativo na operação, monitorização e fiabilidade de aplicações distribuídas em ambiente cloud. A função envolve a gestão operacional de workloads em Azure e Kubernetes, o diagnóstico de incidentes complexos e a colaboração com equipas de plataforma e de desenvolvimento para garantir a disponibilidade, o desempenho e a resiliência dos serviços.
- Assumir a responsabilidade técnica de primeira linha pelas aplicações executadas em diferentes localizações regionais.
- Realizar diagnósticos aprofundados ao nível dos serviços, recorrendo a ferramentas de observabilidade como Grafana, Loki e Mimir, bem como métricas, logs e traces.
- Monitorizar e analisar o comportamento de aplicações distribuídas e microserviços.
- Trabalhar com bases de dados e sistemas de messaging para identificar e resolver problemas ao nível dos serviços.
- Participar na resposta a incidentes, na análise de causa raiz (RCA) e na recuperação dos serviços.
- Operar e suportar workloads executados em plataformas Kubernetes baseadas em Microsoft Azure.
- Analisar o ciclo de vida dos pods, networking, storage, scaling e diferentes cenários de falha em Kubernetes.
- Colaborar com as equipas de Platform Engineering na resolução de problemas ao nível dos clusters.
- Trabalhar em conjunto com as equipas de desenvolvimento na resolução de problemas ao nível das aplicações e serviços.
- Identificar e reportar bugs e problemas às equipas de Product e Platform quando estes não puderem ser resolvidos através de diagnóstico técnico.
- Contribuir para a melhoria contínua da fiabilidade, disponibilidade e performance dos sistemas.
- Trabalhar com práticas de GitOps, CI/CD e Infrastructure as Code (IaC).
- Utilizar tecnologias como Helm, Kustomize, Terraform, Git, Azure DevOps e ArgoCD.
- Trabalhar com diferentes tecnologias de bases de dados e messaging, incluindo MongoDB, Microsoft SQL Server, PostgreSQL e Kafka.