Empresa confidencial | São Paulo - SP | Híbrido
Buscamos um(a) Coordenador(a) de Sustentação para liderar uma equipe técnica responsável pela estabilidade, disponibilidade e qualidade de aplicações e sistemas críticos em produção.
Procuramos profissionais que tenham construído sua trajetória na sustentação de sistemas e evoluído para posições de liderança técnica, supervisão ou coordenação, mantendo proximidade com a operação, a investigação de problemas e o desenvolvimento da equipe.
A posição terá responsabilidade direta pela gestão de pessoas e pela coordenação da operação, conduzindo incidentes críticos e trabalhando em parceria com Desenvolvimento, Produto e Infraestrutura, além de manter relacionamento próximo com clientes.
Principais responsabilidades
- Coordenar a operação de sustentação, organizando demandas, prioridades e responsabilidades para garantir a estabilidade e a qualidade dos sistemas em produção.
- Acompanhar chamados, requisições e incidentes, considerando SLAs, criticidade, volumetria, tempos de resposta e resolução e qualidade dos atendimentos.
- Conduzir incidentes críticos, coordenando a investigação técnica, os escalonamentos, os planos de ação e a comunicação com clientes e áreas internas.
- Acompanhar o monitoramento e a observabilidade das aplicações e ambientes, utilizando dashboards, alertas e indicadores para identificar desvios, gargalos e riscos à operação.
- Orientar e acompanhar análises de causa raiz (RCA) e pós-incidente, garantindo o encaminhamento de ações para prevenir recorrências.
- Planejar e acompanhar implantações, atualizações e mudanças em produção, avaliando requisitos técnicos, riscos, dependências, critérios de aceite e estratégias de contingência e rollback.
- Atuar em parceria com Desenvolvimento, Produto e Infraestrutura na priorização de correções e melhorias e na avaliação das necessidades de capacidade dos ambientes.
- Manter relacionamento próximo com clientes, acompanhando suas necessidades, a qualidade do atendimento e a comunicação em situações de maior criticidade.
- Acompanhar indicadores operacionais e promover melhorias nos processos de sustentação, atendimento e gestão de incidentes.
- Liderar, desenvolver e engajar a equipe de Sustentação, promovendo um ambiente colaborativo, de alta performance e foco em resultados.
- Realizar rituais periódicos de gestão, incluindo reuniões individuais (1:1), reuniões de acompanhamento da operação, alinhamentos de equipe e ciclos de feedback e desenvolvimento.
- Definir e acompanhar metas individuais e coletivas, realizar avaliações de desempenho e construir planos de desenvolvimento com os profissionais da equipe.
- Planejar a capacidade da equipe, identificar necessidades de capacitação e contratação e participar das decisões de movimentação do time.
- Apoiar a equipe de Atração e Seleção nos processos seletivos e conduzir a integração de novos colaboradores, assegurando o fortalecimento contínuo do time e a disseminação da cultura organizacional.
Requisitos
- Experiência em sustentação de aplicações e sistemas críticos em produção.
- Experiência em liderança técnica, supervisão ou coordenação de equipes de sustentação, incluindo organização de demandas, orientação de profissionais e condução de incidentes.
- Experiência com gestão ou acompanhamento do desenvolvimento de profissionais, incluindo feedbacks, reuniões individuais (1:1) e acompanhamento de metas e desempenho.
- Experiência com gestão de incidentes e crises, SLAs, escalonamentos e análises de causa raiz.
- Vivência com monitoramento e observabilidade de aplicações e ambientes, acompanhando disponibilidade, performance, capacidade e alertas.
- Capacidade de acompanhar investigações técnicas e discutir diagnósticos e soluções com equipes de Desenvolvimento, Infraestrutura e bancos de dados.
- Conhecimentos de infraestrutura, redes, servidores, sistemas operacionais e cloud para compreender dependências e impactos na operação.
- Vivência com implantação, atualização e mudanças de sistemas em produção, incluindo avaliação de riscos e planejamento de contingência.
- Experiência no relacionamento com clientes e na comunicação de incidentes, impactos e planos de ação.
- Capacidade de utilizar indicadores operacionais para definir prioridades e direcionar melhorias.
- Boa comunicação, organização e capacidade de tomada de decisão em situações de alta criticidade.
Conhecimentos e experiências desejáveis
- SQL e bancos de dados: consultas, joins, filtros e agregações para análise de dados e investigação de incidentes.
- APIs REST e Postman: compreensão de métodos HTTP, autenticação, headers, requisições e respostas, com utilização de ferramentas para testes e diagnóstico de integrações.
- Lógica de programação e leitura de código: compreensão de fluxos sistêmicos e apoio à investigação de falhas em conjunto com Desenvolvimento.
- Microsserviços e Git: familiaridade com arquiteturas distribuídas e processos de versionamento de aplicações.
- RabbitMQ e Redis: conhecimentos para apoiar a análise de fluxos de mensagens, eventos e comportamento das aplicações.
- Zabbix e Elasticsearch: familiaridade com monitoramento de ambientes, análise de logs e identificação de incidentes.
- Mercado financeiro: atuação com sistemas de pagamentos, Pix ou integrações com o Banco Central.
- Pós-graduação em Tecnologia da Informação ou áreas correlativas.