Engenheiro de Dados - Sênior

BRQ

Brasil

Remote

BRL 180,000 - 240,000

Full time

16 hours ago
Be an early applicant
Application generator

An application made for this job — a tailored resume and cover letter that speak straight to the posting.

Get past ATS filters

Job summary

BRQ procura engenheiro(a) de dados para construir a fundação de dados com Databricks e PySpark. Você criará pipelines automatizados, organizará dados em camadas e assegurará logs, qualidade e governança.

Experiência com Databricks, PySpark e Python é essencial, assim como visão de arquitetura de data lake, orquestração e controle de acesso. Remoto com colaboração entre áreas e foco em escalabilidade sustentável.

Qualifications

  • Experiência em engenharia de dados e desenvolvimento de pipelines.
  • Experiência com Databricks e PySpark.
  • Conhecimento de Python e Apache Spark.
  • Conhecimento de arquitetura medalhão e organização de dados em camadas.
  • Experiência com ingestão, persistência, transformação e disponibilização de dados.
  • Conhecimento de orquestração, monitoramento, logs e tratamento de falhas em pipelines.
  • Vivência com práticas de qualidade, validação e reconciliação de dados.
  • Conhecimento de governança, controle de acesso e segurança de dados.

Responsibilities

  • Desenvolver e automatizar a ingestão das fontes de dados mapeadas na plataforma Databricks.
  • Persistir, processar e transformar dados com Python e PySpark.
  • Organizar os dados em arquitetura medalhão, da camada bruta às camadas tratadas e prontas para consumo.
  • Criar e manter pipelines orquestrados, monitorados e preparados para lidar com falhas e reprocessamentos.
  • Implementar logs, alertas, validações de qualidade e reconciliações de dados.
  • Contribuir para a governança de acesso, a segregação de ambientes e o tratamento adequado das informações.
  • Assegurar a rastreabilidade entre as fontes, as transformações e os dados disponibilizados.
  • Documentar fontes, layouts, regras, linhagem e procedimentos técnicos e operacionais.
  • Identificar oportunidades para reutilizar fontes e dados comuns entre processos, evitando ingestões e tratamentos duplicados.
  • Acompanhar a observabilidade e os custos da plataforma, apoiando sua evolução sustentável.
  • Trabalhar com as áreas envolvidas para priorizar a expansão da solução conforme o valor para o negócio, a maturidade do mapeamento e as dependências técnicas.

Skills

Databricks
PySpark
Python
Data lakes/arquitetura em camadas
Ingestão de dados
Orquestração/monitoramento
Governança de dados
Documentação técnica

Tools

Delta Lake

Job description

Sobre a vaga

O projeto Databricks e MCCD tem como objetivo criar a fundação de dados. A iniciativa busca evoluir de uma execução predominantemente manual para pipelines automatizados, confiáveis e monitorados, usando Databricks para organizar e processar dados desde a ingestão das fontes até a disponibilização de informações e produtos de dados.

A arquitetura deverá permitir a expansão gradual para novos processos, com reutilização de fontes, conectores, regras e domínios de dados. O foco inicial é estabelecer uma base técnica segura, rastreável e sustentável, que não dependa do conhecimento individual para ser operada.

Principais responsabilidades
  • Desenvolver e automatizar a ingestão das fontes de dados mapeadas na plataforma Databricks.
  • Persistir, processar e transformar dados com Python e PySpark.
  • Organizar os dados em arquitetura medalhão, da camada bruta às camadas tratadas e prontas para consumo.
  • Criar e manter pipelines orquestrados, monitorados e preparados para lidar com falhas e reprocessamentos.
  • Implementar logs, alertas, validações de qualidade e reconciliações de dados.
  • Contribuir para a governança de acesso, a segregação de ambientes e o tratamento adequado das informações.
  • Assegurar a rastreabilidade entre as fontes, as transformações e os dados disponibilizados.
  • Documentar fontes, layouts, regras, linhagem e procedimentos técnicos e operacionais.
  • Identificar oportunidades para reutilizar fontes e dados comuns entre processos, evitando ingestões e tratamentos duplicados.
  • Acompanhar a observabilidade e os custos da plataforma, apoiando sua evolução sustentável.
  • Trabalhar com as áreas envolvidas para priorizar a expansão da solução conforme o valor para o negócio, a maturidade do mapeamento e as dependências técnicas.
Requisitos
  • Experiência em engenharia de dados e desenvolvimento de pipelines.
  • Experiência com Databricks e PySpark.
  • Conhecimento de Python e Apache Spark.
  • Conhecimento de arquitetura medalhão e organização de dados em camadas.
  • Experiência com ingestão, persistência, transformação e disponibilização de dados.
  • Conhecimento de orquestração, monitoramento, logs e tratamento de falhas em pipelines.
  • Vivência com práticas de qualidade, validação e reconciliação de dados.
  • Conhecimento de governança, controle de acesso e segurança de dados.
  • Capacidade de produzir documentação técnica e operacional clara.
  • Experiência na construção ou evolução de data lakes ou plataformas analíticas em Databricks.
  • Gestão de features
  • Apresentações coorporativas
  • Gestão de roadmap técnico
Diferenciais
  • Familiaridade com Delta Lake e recursos relacionados do ecossistema Databricks.
  • Experiência com observabilidade e otimização de custos em plataformas de dados.
  • Familiaridade com práticas de CI/CD e gestão de ambientes de dados.

Cultura na BRQ

Chamamos de BRQ Way o nosso jeito de cuidar das pessoas, com iniciativas de carreira e desenvolvimento, saúde e bem-estar, e comunicação e conexão. Trabalhamos com flexibilidade de acordo com o contexto do projeto (anywhere office, híbrido ou presencial) e investimos em desenvolvimento contínuo com BRQ Academy, mentoria, incentivo a certificações e programas de idiomas, entre outras frentes.

Diversidade, inclusão e liberdade fazem parte do nosso dia a dia. Incentivamos a candidatura de pessoas com perfis, trajetórias e realidades diversas, além de contarmos com oportunidades afirmativas para pessoas com deficiência e mulheres. Também temos três Grupos de Afinidade, chamados de Roars, que criam espaços de troca e impulsionam iniciativas inclusivas na empresa. https://www.brq.com/carreiras/

Vaga c6effe

#LI-Remote

#LI-WL1

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Engenheiro de Dados - Pleno
Engenheiro de Dados - Pleno

BRQ • São Paulo

Hybrid
BRL 120,000 - 180,000
Engenheiro de Dados Pl
Engenheiro de Dados Pl

BRQ • São Paulo

Hybrid
BRL 180,000 - 300,000
Engenheiro(a) de Dados Sênior (Arquitetura, Pipelines & Big Data)
Engenheiro(a) de Dados Sênior (Arquitetura, Pipelines & Big Data)

BRQ • São Paulo

Hybrid
BRL 201,000 - 357,000
Engenheiro(a) de Dados Sênior (Plataforma de Dados, Cloud & Big Data)
Engenheiro(a) de Dados Sênior (Plataforma de Dados, Cloud & Big Data)

BRQ Digital Solutions • São Paulo

Hybrid
BRL 180,000 - 300,000
Plano de Saúde
Plano Odontológico
Seguro de Vida
+7
Engenheiro de Dados - Pleno
Engenheiro de Dados - Pleno

BRQ Digital Solutions • São Paulo

Hybrid
BRL 134,000 - 201,000
Plano de Saúde
Plano Odontológico
Seguro de Vida
+8
Engenheiro(a) de Dados Sênior Databricks
Engenheiro(a) de Dados Sênior Databricks

Extractta • Brazil

On-site
BRL 220,000 - 360,000
Vale alimentação ou refeição
Convênio SESI/Sesc
Engenheiro(a) de Dados Sênior
Engenheiro(a) de Dados Sênior

Grupo Panvel • Eldorado do Sul

Hybrid
BRL 180,000 - 280,000
Refeitório no local
Plano de Saúde & Odonto
Transporte Fretado
+2
Engenheiro de Dados Sênior
Engenheiro de Dados Sênior

4DF Connect • São Paulo

On-site
BRL 260,000 - 360,000
Engenheiro(a) de Dados Sênior
Engenheiro(a) de Dados Sênior

Grupo Panvel | Corporativo • Eldorado do Sul

Hybrid
BRL 180,000 - 240,000
Refeitório no local
TotalPass
Plano de Saúde & Odonto
+2
Engenheiro de Dados Pleno
Engenheiro de Dados Pleno

QUESTOR SISTEMAS S.A • São Paulo

On-site
BRL 140,000 - 210,000
Cartão Flash tecnológico
Bônus por metas
Plano de Saúde Bradesco
+5