Procuramos um/a Platform & Cloud Engineer (Senior) para garantir estabilidade, performance e melhoria contínua de serviços de infraestrutura e cloud (Azure + on‑prem), com foco em operações robustas, troubleshooting eficaz e execução de mudanças com mínimo downtime.
Localização | Modelo de trabalho
Tempo mínimo de experiência necessária
- 7+ anos em Infraestrutura/Plataformas (contexto enterprise) com responsabilidade real de operação
- 3+ anos de Azure IaaS em produção (administração e troubleshooting)
- Português fluente e Inglês mínimo nível B2.
- Experiência sólida em operações de plataforma híbrida: compute, virtualização, storage, rede e serviços base
- Administração e evolução de Azure IaaS (VMs, VNets, NSGs, Load Balancers, etc.)
- Boa prática de governança operacional em Azure (diagnostics, policy baseline, tagging)
- Troubleshooting e gestão de componentes críticos, incluindo:
- Azure Kubernetes Service (AKS) (consumo/integração operacional e troubleshooting com equipas especialistas quando necessário)
- Azure SQL & Microsoft SQL Server (operação, disponibilidade, manutenção)
- Application Servers (IIS e equivalentes)
- Azure ARC (governança/gestão híbrida)
- Azure DevOps (repos/pipelines/boards em articulação com automação e delivery)
- Fundamentos fortes de networking e segurança (RBAC, least privilege)
- Conhecimento prático de Windows Server/IIS e SQL Server operations
- Experiência comprovada em upgrades/migrações com planeamento, janelas de mudança e minimização de downtime
- (Valorizado) Automação/IaC (Terraform, Ansible) e CI/CD (Azure DevOps)
Descrição das responsabilidades
- Operar e evoluir a plataforma híbrida (cloud + on‑prem quando aplicável), assegurando resiliência e padrões de excelência operacional
- Administrar e melhorar serviços Azure IaaS e a respetiva governança operacional
- Gerir e resolver incidentes/problemas em componentes críticos (AKS, App Services, SQL Server, IIS, Storage, Arc, APIM, Azure Local)
- Planear e executar upgrades, patching, capacity management e lifecycle, com evidências, critérios de aceite e foco em continuidade de serviço
- Criar e manter runbooks e documentação operacional, incluindo troubleshooting e critérios de rollback
- Trabalhar em parceria com equipas de Observability e Automação para: Melhorar a qualidade do sinal (alertas acionáveis) | Reduzir esforço manual através de automações e standards repetíveis