Somos uma empresa líder em consultoria em nuvem, focada em criar soluções inovadoras e personalizadas que fazem os negócios decolarem! Nossa equipe é formada por especialistas comprometidos em entregar excelência e superar expectativas. Em um mundo cada vez mais digital, nossa missão é ajudar empresas de todos os tamanhos a otimizar seus processos e infraestrutura na nuvem, garantindo segurança, escalabilidade e eficiência.
Missão da vaga
Coordenar tecnicamente e operacionalmente a equipe de sustentação AWS em modelo MSP, garantindo a estabilidade, disponibilidade, segurança e evolução contínua dos ambientes dos clientes sob gestão. Ser responsável pela gestão completa do ciclo de vida de tickets proativos e reativos, assegurando o cumprimento dos SLAs contratuais e a excelência operacional. Atuar como referência técnica e líder de pessoas para o time, promovendo as melhores práticas em Gestão de Incidentes, Gestão de Problemas (RCA), Patch Management, Gestão de Backup, Segurança Gerenciada da Conta AWS e FinOps.
Principais responsabilidades
- Gerenciar a fila de tickets proativos (monitoramento 24x7, alertas de infraestrutura, varreduras de segurança/boas práticas) e reativos (incidentes por severidade e solicitações de serviço), garantindo cumprimento dos SLAs contratuais.
- Coordenar a resposta a Incidentes Críticos (P1/P2) com atuação autônoma 24x7, incluindo War Room e escalonamento em até 15 minutos.
- Conduzir e garantir a entrega de RCAs (Root Cause Analysis) em D+1 para incidentes críticos, propondo e acompanhando ações corretivas junto ao cliente.
- Manter a Matriz de Dependências atualizada e conduzir o Onboarding de novos Workloads (6 semanas): mapeamento, instruções de trabalho, Ações de Recuperação e aceite do cliente.
- Garantir cobertura de observabilidade (métricas, logs e alertas) em ≥ 95% dos ambientes monitorados.
- Liderar iniciativas de automação operacional: respostas automatizadas para incidentes recorrentes, scripts de recuperação, alertas proativos e tickets evitados.
- Apoiar estratégias de FinOps para otimização de custos AWS dos clientes (recursos ociosos, reservas, alertas de variação de consumo).
- Fornecer insumos operacionais para Operational Reviews e QBRs: métricas de SLA, relatório de utilização de horas, incidentes, RCAs, Cartas de Risco e recomendações FinOps.
- Desenvolver e gerir a equipe por meio de 1:1 quinzenais, PDI, feedback contínuo e identificação de gaps de competência.
- Produzir e manter documentação técnica (Knowledge Base) com cobertura ≥ 80%.
Competências técnicas
- Amazon Web Services (AWS): arquitetura, redes, segurança e serviços gerenciados.
- Monitoramento 24x7 e Observabilidade (CloudWatch, Grafana, Zabbix, endpoints, certificados, domínios).
- Segurança Cloud (Cloud Security) e varreduras de boas práticas (Well-Architected Framework).
- FinOps e Otimização de Custos AWS.
- Automação e Infraestrutura como Código (Terraform, CloudFormation).
- Gestão de Incidentes, Problemas e Tickets (ITIL/ITSM, SLA, RCA, Carta de Risco).
- IA e GenAI AWS (Bedrock, Amazon Q, automação inteligente) — desejável.
Competências comportamentais
- Ownership: assumir responsabilidade ponta a ponta pelos ambientes, tickets e SLAs — sem tickets órfãos, sem ambientes sem mapeamento.
- Deliver Results: foco em metas e KPIs, garantindo SLA ≥ 95%, FCR ≥ 70% e entregas dentro do prazo.
- Dive Deep: investigar causas raiz com profundidade, documentar RCAs e reduzir tickets recorrentes.
- Hire and Develop the Best: montar time forte, desenvolver cada pessoa via PDI e feedback contínuo.
- Bias for Action: atuar com autonomia em incidentes críticos, priorizando alertas proativos para evitar escalada.
- Earn Trust: construir confiança com clientes e equipe por meio de transparência, cumprimento de SLAs e comunicação eficiente.
- Insist on the Highest Standards: manter padrão elevado em documentação, categorização de tickets, qualidade das RCAs e varreduras de segurança.
Formações e certificações
- Graduação em Ciência da Computação, Sistemas de Informação, Engenharia da Computação, Redes de Computadores, Tecnologia da Informação ou áreas correlatas.
- Pós-graduação (desejável): MBA ou Especialização em Gestão de Pessoas, Gestão de TI, Gestão de Projetos ou Cloud Computing.
- Certificações obrigatórias: AWS Cloud Practitioner e AWS Solutions Architect – Associate.
- Certificações desejáveis: AWS Solutions Architect – Professional e AWS Security Specialty.
- Mínimo de 3 anos de experiência em operação/sustentação de ambientes cloud AWS, com vivência em gestão de equipes técnicas e gestão de incidentes.
Informações adicionais
Na Cloudster, buscamos oferecer uma experiência que una desenvolvimento, reconhecimento e bem-estar. Por isso, contamos com benefícios pensados para apoiar sua rotina, seu crescimento profissional e sua qualidade de vida.
- Salário competitivo + pacote de benefícios
- VR: R$ 35,00/dia no Cartão Flash
- Plano de saúde Bradesco: sem custo para o colaborador
- Plano odontológico SulAmérica: sem custo para o colaborador
- Seguro de vida
- Vale Transporte ou Auxílio Combustível
- TotalPass: saúde, atividade física e bem-estar
- Conexa Saúde: plataforma de saúde e bem-estar
- Auxílio Educação
- Treinamentos e Certificações AWS
- Auxílio Creche
- Cesta Boas-Vindas ao Bebê
- Day off no aniversário
- Presente personalizado em datas comemorativas
- Programa de indicação premiada (Indicou/Ganhou)
- Salário competitivo
- Plano de saúde em grupo AMIL
- TotalPass: saúde, atividade física e bem-estar
- Conexa Saúde: plataforma de saúde e bem-estar
- Treinamentos e Certificações AWS
- Day off no aniversário
- Presente personalizado em datas comemorativas