Uma candidatura completa num minuto — currículo e carta de apresentação personalizados, prontos a enviar.
Netvagas procura Engenheiro de Dados Sênior com perfil mão na massa e foco em infraestrutura para expandir e manter a plataforma de dados. O papel envolve lakehouse, pipelines, Dataflows Gen2, integração com Databricks e adoção de tecnologias Azure, com 100% remoto.
Você trabalhará com SQL avançado, Python para ETL, modelagem de dados no Power BI e práticas de CI/CD, além de governança e documentação de dados. Fluência em inglês técnico é um diferencial.
Sobre a Vaga:
Estamos em busca de um(a) Engenheiro(a) de Dados Sênior com perfil mão-na-massa e foco em infraestrutura para expandir, otimizar e manter nossa plataforma de dados baseada em Microsoft Fabric. Você atuará em uma arquitetura lakehouse, pipelines de dados, fluxos de integração e contribuirá ativamente com o plano de adoção do Databricks. Esta é uma oportunidade para quem deseja se aprofundar como especialista em plataforma de dados, lakehouse e tecnologias de ponta do ecossistema Azure.
Principais Atividades (O que você fará):
Projetar e manter a arquitetura lakehouse seguindo o padrão Medallion (Bronze / Silver / Gold) no Microsoft Fabric.
Desenvolver, otimizar e monitorar pipelines de dados e fluxos de orquestração.
Implementar Dataflows Gen2 para integração e transformação de dados.
Apoiar iniciativas de análises em tempo real e streaming.
Escrever e otimizar consultas SQL avançadas para transformações, verificações de qualidade e troubleshooting.
Desenvolver scripts em Python para lógica de pipeline, processamento de dados e automação de tarefas.
Construir e manter modelos semânticos no Power BI (datasets, DAX, relacionamentos — sem atuação na criação de relatórios visuais).
Implementar práticas de CI/CD utilizando Azure DevOps e Git/GitHub.
Contribuir com o planejamento de adoção do Databricks, desenvolvimento de provas de conceito (POCs) e estratégias de migração.
Garantir a qualidade, governança, linhagem e documentação dos dados em toda a plataforma.
Colaborar com stakeholders internos (finanças, comercial, laboratório, RH) para entregar soluções de dados confiáveis e alinhadas ao negócio.
Documentar decisões de arquitetura, desenhos de pipelines e procedimentos operacionais.
Requisitos Obrigatórios:
Experiência: de 3 a 8 anos em engenharia de dados ou áreas correlatas.
Formação: Superior em Ciência da Computação, Engenharia de Dados, Sistemas de Informação ou áreas afins.
Microsoft Fabric (nível intermediário/avançado): lakehouses, pipelines, Dataflows Gen2 e real-time analytics.
SQL (avançado): consultas complexas, otimização de performance e modelagem de dados.
Python (nível intermediário/avançado): scripts para engenharia de dados, lógica ETL e automação.
Git/GitHub: estratégias de branch, versionamento e fluxos de code review.
Power BI: modelagem semântica (design de datasets, fundamentos de DAX e otimização).
Arquitetura de dados: compreensão sólida do padrão medallion, design de lakehouse e princípios de governança.
Experiência com Databricks (notebooks, Unity Catalog, Delta Lake).
Conhecimento em Spark (PySpark / Scala).
Integrações com APIs e endpoints REST.
Vivência com outros serviços Azure (Data Factory, Synapse, Azure SQL).
Familiaridade com conceitos de Data Mesh ou Data Products.
Idiomas (Obrigatórios):
Inglês: Fluente ou Avançado para comunicação tecnica em inglês e participação de reuniões internacionais.
Informações Gerais da Alocação:
Tempo estimado das alocações: 6 a 10 meses (com possibilidade de prorrogação e oportunidade de longo prazo)
Modelo de trabalho: 100% Remoto