Databricks Data Engineer| Senior | (Remote)

AI/R

Brasil

Presencial

BRL 180 000 - 280 000

Tempo integral

Há 10 dias

Recebe mais respostas dos empregadores

Envia um currículo específico para a oferta em poucos minutos.

Resumo da oferta

Compass UOL está buscando um Engenheiro de Dados para reconstruir pipelines do DW legado em Databricks, utilizando PySpark e Spark SQL. A posição envolve implementação das camadas bronze/silver/gold, ingestão CDC/batch e validação de paridade com o Lakehouse.

Você trabalhará com Databricks, Delta Lake e ferramentas de CI/CD, além de otimizar performance e custos. Experiência em AWS e Azure Synapse é desejável e haverá documentação técnica das regras migradas.

Qualificações

  • Experiência sólida com Engenharia de Dados.
  • Desenvolvimento de pipelines batch em escala com PySpark e Python.
  • SQL avançado e modelagem de dados em DW.
  • Databricks e Delta Lake em produção, com arquitetura bronze/silver/gold.
  • Migração/reconstrução de pipelines ETL com CDC/batch de fontes legadas para Spark.
  • Ecossistema AWS e Azure Synapse.
  • Git e CI/CD aplicados a pipelines de dados.

Responsabilidades

  • Reconstruir pipelines do DW legado em Databricks (PySpark / Spark SQL) a partir de especificações.
  • Implementar camadas bronze, silver e gold seguindo o template medalhão e padrões de ingestão.
  • Executar waves de reconstrução por domínio, em coexistência com o DW legado até o cutover.
  • Implementar regras de negócio e transformações com testes automatizados nos pipelines.
  • Realizar reconciliação e validação de paridade entre DW legado e Lakehouse.
  • Otimizar performance e custo dos pipelines (particionamento, OPTIMIZE/Z-ORDER, dimensionamento).
  • Contribuir com documentação técnica das regras migradas e apoiar priorização das waves.

Conhecimentos

PySpark
Python
SQL
Data Engineering
Testes de pipelines

Ferramentas

Databricks
Delta Lake
Delta Live Tables
Lakeflow
Git & CI/CD
AWS (S3, Glue, EMR, Athena, Lambda, DMS, Step Functions)
Azure Synapse

Descrição da oferta de emprego

Responsabilidades e atribuições
  • Reconstruir os pipelines do DW legado em Databricks (PySpark / Spark SQL), a partir das especificações geradas pela engenharia reversa;
  • Implementar as camadas bronze, silver e gold seguindo o template medalhão, os padrões de ingestão (CDC/batch) e o padrão de reconstrução definidos pelo projeto;
  • Executar as waves de reconstrução por domínio, em coexistência com o DW legado até o cutover;
  • Implementar regras de negócio e transformações com testes automatizados nos pipelines;
  • Realizar a reconciliação e a validação de paridade dos dados entre o DW legado e o Lakehouse;
  • Otimizar performance e custo dos pipelines (particionamento, OPTIMIZE/Z-ORDER, dimensionamento de jobs);
  • Contribuir com a documentação técnica das regras migradas e apoiar a priorização das waves.
Requisitos e qualificações
  • Experiência sólida com Engenharia de Dados;
  • PySpark e Python avançados: desenvolvimento de pipelines batch em escala, com testes e boas práticas de engenharia;
  • SQL avançado e modelagem de dados: transformações complexas, tuning de performance e modelagem relacional/dimensional em contexto de DW;
  • Databricks e Delta Lake: jobs, workflows e arquitetura medalhão (bronze, silver, gold) em produção; Delta Live Tables / Lakeflow e Asset Bundles;
  • Migração / reconstrução de pipelines ETL: tradução de regras de negócio de ferramentas legadas para Spark (sem lift-and-shift), com ingestão CDC/batch de bancos relacionais;
  • Ecossistema AWS: S3, Glue, EMR, Athena, Lambda, DMS e Step Functions;
  • Azure Synapse: experiência com o ambiente legado (SQL pools e pipelines) para apoiar a engenharia reversa;
  • Qualidade e reconciliação de dados: testes automatizados, DQ gates e comparação legado × novo para aceite de paridade;
  • Git e CI/CD aplicados a pipelines de dados.
Desejáveis
  • Conhecimento de DataStage (leitura de jobs para engenharia reversa) — diferencial importante;
  • Experiência prévia em programas de migração de DW para lakehouse — diferencial importante;
  • Unity Catalog (permissões, lineage) e contratos de dados;
  • Experiência no mercado financeiro ou de crédito;
  • Certificações Databricks (Data Engineer Associate / Professional).

Become a Compasser, be part of AI/R.

Compass UOL is a global firm and part of the AI Revolution Company, together transforming organizations using Artificial Intelligence, Generative AI, and other of today’s most advanced technologies.

We equip our team with proprietary and external AI-driven tools to design and build digital-native platforms, integrating cutting-edge technologies and enabling companies to innovate, transform their businesses, and drive success in their markets.

To achieve this, we attract and develop the best talent, creating opportunities that enhance people’s lives and highlight the positive impact of disruptive technologies.

We empower borderless talent and promote knowledge and opportunities in the latest market trends, driving significant personal and professional growth.

Join us and be part of the AI-driven revolution.

Obtém a tua avaliação gratuita e confidencial do currículo.
ou arrasta e larga o ficheiro aqui.
Similar jobs

Ofertas semelhantes que vale a pena comparar

Databricks Lakehouse Analytics Engineer | Sênior (Remote)
Databricks Lakehouse Analytics Engineer | Sênior (Remote)

AI/R • Brasil

Presencial
BRL 140 000 - 190 000
Databricks Data Engineer | Senior (Remote)
Databricks Data Engineer | Senior (Remote)

AI/R • Brasil

Presencial
BRL 120 000 - 190 000
Consultor de Data Engineer
Consultor de Data Engineer

Jobtailor • Recife

Presencial
BRL 120 000 - 190 000
Databricks Lakehouse Engenheiro(a) de Dados | Sênior (Remote)
Databricks Lakehouse Engenheiro(a) de Dados | Sênior (Remote)

Compass UOL • Brasil

Teletrabalho
BRL 300 000 - 420 000
Engenheiro de Dados Azure Sênior - Banco de Talentos (Remoto)
Engenheiro de Dados Azure Sênior - Banco de Talentos (Remoto)

Cooperflora • Campos dos Goytacazes

Teletrabalho
Auxílio médico
Wellhub
Terapia online
+7
DataBricks Data Engineer
DataBricks Data Engineer

Infosys Limited • São Paulo

Híbrido
BRL 180 000 - 240 000
Vale Transporte
Vale Refeição
Auxílio Creche
+3
Consultor(a) Data Engineer
Consultor(a) Data Engineer

Avanade • São Paulo

Presencial
BRL 180 000 - 240 000
Vale refeição ou alimentação
Cartão Multibenefícios
Convênio médico e odontológico
+11
Data Engineer (Databricks) | PL (Remote)
Data Engineer (Databricks) | PL (Remote)

AI/R • Brasil

Presencial
BRL 120 000 - 190 000
Engenheiro de Dados Azure Sênior (Remoto)
Engenheiro de Dados Azure Sênior (Remoto)

Cooperflora • Campo Grande

Teletrabalho
Auxílio médico
Wellhub
Terapia online
+7
Sr Data Platform Engineer | Azure | Databricks | Python Remote Work Full-time employee
Sr Data Platform Engineer | Azure | Databricks | Python Remote Work Full-time employee

Smarthis • Brasil

Híbrido
BRL 180 000 - 240 000