Engenheiro de Dados

Distrito

São Paulo

Presencial

BRL 180 000 - 280 000

Tempo integral

Há 2 dias
Torna-te num dos primeiros candidatos
Gerador de candidaturas

Transforma esta função numa entrevista — um currículo e uma carta de apresentação criados à volta do que este empregador procura.

Ultrapassa os filtros ATS

Vantagens oferecidas por esta oferta de emprego

Vale-refeição/vale-alimentação
Convênio médico
Plano odontológico
Seguro de vida
Ambiente dinâmico
Oportunidades de crescimento

Resumo da oferta

A Distrito, com atuação em São Paulo, procura um Data Engineer focado em AI para construir a infra que viabiliza ML e aplicações de Generative AI. O papel exige foco em arquitetura, escalabilidade e performance.

Você garantirá dados confiáveis, acessíveis e escaláveis para treinamento e inferência, trabalhando com data lakes, data warehouses, indexação vetorial e pipelines de embeddings.

Qualificações

  • Experiência com pipelines de dados para ML/AI.
  • Conhecimento avançado de SQL e modelagem de dados.
  • Experiência com ETL/ELT em ambientes distribuídos.

Responsabilidades

  • Construir pipelines de ingestão batch e streaming.
  • Estruturar data lakes e data warehouses.
  • Criar datasets otimizados para ML.
  • Implementar pipelines de embeddings.
  • Construir indexação vetorial para RAG.
  • Garantir qualidade, governança e segurança de dados.
  • Otimizar custos de armazenamento e processamento.
  • Colaborar com AI Engineers para estruturar feature stores.

Conhecimentos

Python
SQL avançado
Pandas
PySpark
Spark
Airflow
dbt
Prefect
Kubernetes
Docker

Ferramentas

BigQuery
Snowflake
S3/GCS/Azure Blob
FAISS / Pinecone

Descrição da oferta de emprego

  • Implementar pipelines de embeddings
  • Scala (opcional)
  • Prefect
  • Pandas
  • Bancos NoSQL

O Data Engineer focado em AI é responsável por construir a infraestrutura que viabiliza Machine Learning e aplicações de Generative AI. Ele garante que dados estejam organizados, confiáveis, acessíveis e escaláveis para treinamento e inferência.

É um perfil orientado a arquitetura, escalabilidade e performance.

Responsabilidades
  • Construir pipelines de ingestão batch e streaming
  • Estruturar data lakes e data warehouses
  • Criar datasets otimizados para ML
  • Implementar pipelines de embeddings
  • Construir indexação vetorial para RAG
  • Garantir qualidade, governança e segurança de dados
  • Otimizar custo de armazenamento e processamento
  • Trabalhar com AI Engineers para estruturar feature stores
Requisitos
  • Python
  • SQL avançado
  • Scala (opcional)
Orquestração & Transformação
  • Apache Airflow
  • dbt
  • Prefect
Processamento de Dados
  • Spark
  • Pandas
  • PySpark
Armazenamento
  • Data Lakes (S3, GCS, Azure Blob)
  • Data Warehouses (BigQuery, Snowflake, Redshift)
  • Bancos NoSQL
  • Bancos vetoriais (Pinecone, Weaviate, FAISS)
Streaming
  • Kafka
  • Pub/Sub
Infraestrutura
  • Docker
  • Kubernetes
  • Cloud (AWS, GCP ou Azure)
Hard Skills
  • Modelagem de dados
  • ETL / ELT
  • Processamento distribuído
  • SQL avançado
  • Arquitetura de dados escalável
  • Experiência com dados não estruturados (texto, logs, PDF)
  • Conceitos de DataOps
  • Versionamento e qualidade de dados
Benefícios
  • Vale-refeição e/ou vale-alimentação de R$950,00 por mês no cartão Ifood
  • Convênio Médico SulAmérica (100% custeado pela empresa)
  • Plano Odontológico MetLife
  • Plano de saúde Pet
  • Seguro de vida
  • Totalpass e Wellhub para manter as atividades físicas a qualquer hora e lugar
  • Birthday Day Off para curtir no seu aniversário como quiser
  • Parceria com o Sesc
  • Parceria com a OnHappy (descontos em hotéis e passagens)
  • Parceria com instituições de ensino
  • Reembolso creche
  • Equipamentos de trabalho (Pode parecer óbvio, mas achamos importante reforçar)
  • Cultura de feedback e desenvolvimento
  • Ambiente dinâmico e com grandes oportunidades de crescimento
  • Empréstimo consignado com as menores taxas de juros
  • Remuneração variável em reconhecimento de desempenho, performance e alinhamento de cultura
Obtém a tua avaliação gratuita e confidencial do currículo.
ou arrasta e larga o ficheiro aqui.
Similar jobs

Ofertas semelhantes que vale a pena comparar

Pessoa Engenheira de Dados - Sênior - Modelo Híbrido
Pessoa Engenheira de Dados - Sênior - Modelo Híbrido

DTI Digital • Belo Horizonte

Híbrido
BRL 180 000 - 300 000
Previdência Privada
Vale Refeição
Plano de Saúde
+2
ENGENHEIRO DE DADOS PLENO
ENGENHEIRO DE DADOS PLENO

Quality Digital • Brasil

Presencial
BRL 120 000 - 180 000
Vale alimentação/VR
Assistência médica e odontológica
Convênio com farmácias
+4
Tech Lead Dados - Segmento de Tecnologia
Tech Lead Dados - Segmento de Tecnologia

DB • Brasil

Presencial
BRL 180 000 - 300 000
Vale alimentação
Plano de Saúde
Plano Odontológico
+1
Engenheiro de Dados
Engenheiro de Dados

Cooperflora • São Bernardo do Campo

Presencial
VR/VA Flash Benefícios
Assistência Médica - Bradesco Saúde
Assistência Odontológica - Bradesco
+7
Pessoa Engenheira de Dados - Pleno/Sênior - Modelo Híbrido
Pessoa Engenheira de Dados - Pleno/Sênior - Modelo Híbrido

DTI Digital • Belo Horizonte

Híbrido
BRL 180 000 - 320 000
Previdência Privada (6% do salário com
Vale Refeição e/ou Vale alimentação (R
Plano de Saúde sem desconto para os
+4
Engenheiro de Dados | Python & SQL
Engenheiro de Dados | Python & SQL

Avanade • São Paulo

Presencial
BRL 120 000 - 180 000
Vale refeição/alimentação
Convênio médico
Seguro de vida
+5
Pessoa Engenheira de Dados Sênior
Pessoa Engenheira de Dados Sênior

Zup Innovation • São Paulo

Teletrabalho
Liberdade para trabalhar de onde quiser
Horários flexíveis
Auxílio Educação
+3
DATA COORDINATOR
DATA COORDINATOR

Inter • Belo Horizonte

Presencial
Vale-alimentação
Plano de saúde e odontológico
Seguro de vida
+1
Engenheiro de Dados AWS Pleno - Remoto
Engenheiro de Dados AWS Pleno - Remoto

Dataside • Brasil

Teletrabalho
BRL 120 000 - 180 000
Auxílio médico
Wellhub
Terapia online
+7
Analytics Engineer Pleno
Analytics Engineer Pleno

XP Inc. • São Paulo

Híbrido
Plano de saúde
Plano odontológico
Gympass
+4