Data Engineer (Databricks) | Specialist (Remoto)

AI/R

Brasil

Presencial

BRL 180 000 - 280 000

Tempo integral

Há 6 dias
Torna-te num dos primeiros candidatos
Gerador de candidaturas

Transforma esta função numa entrevista — um currículo e uma carta de apresentação criados à volta do que este empregador procura.

Ultrapassa os filtros ATS

Resumo da oferta

AI/R busca profissional para atuar na construção de pipelines de dados escaláveis e confiáveis, utilizando Databricks, PySpark e Spark, com foco em MLops desde o discovery até a produção.

O candidato trabalhará com Delta Lake, Unity Catalog e integrações com BigQuery, MLflow e DBT, em ambiente ágil com sprints e revisões periódicas. Conhecimento em AWS Glue e bancos SQL/NoSQL é valorizado.

Qualificações

  • Experiência com Databricks.
  • Experiência com PySpark e Apache Spark.
  • Experiência com Apache Airflow.
  • Experiência com BigQuery.
  • Experiência com integração e utilização do MLflow.
  • Conhecimento em AWS Glue.
  • Experiência com bancos de dados SQL e NoSQL, como PostgreSQL, MongoDB e Cassandra.
  • Desejável conhecimento em Apache Kafka.
  • Desejável conhecimento em dbt.

Responsabilidades

  • Construção e manutenção de pipelines de dados escaláveis e confiáveis, utilizando tecnologias modernas de processamento distribuído para garantir a ingestão, transformação e disponibilização de dados com qualidade e performance.
  • Organização das tabelas em Delta Lake e Unity Catalog;
  • Implementação de uma esteira automatizada de MLOps nativa em Databricks on GCP, cobrindo o ciclo de vida completo dos modelos;
  • Preparação de dados, geração de features, treinamento, validação, registro, deploy, serving, monitoramento e retreino automático;
  • Atuação desde o discovery técnico com inventário dos modelos existentes, até a construção de um template padrão de pipeline validado em um piloto e migração progressiva dos modelos em ondas organizadas por criticidade.
  • Atuação no modelo ágil, com sprints, rituais de refinamento, review e retrospectiva;

Ferramentas

Databricks
PySpark
Apache Spark
Apache Airflow
BigQuery
MLflow
AWS Glue
SQL
PostgreSQL
MongoDB
Cassandra
Kafka
dbt

Descrição da oferta de emprego

Descrição da vaga
  • Construção e manutenção de pipelines de dados escaláveis e confiáveis, utilizando tecnologias modernas de processamento distribuído para garantir a ingestão, transformação e disponibilização de dados com qualidade e performance.
  • Organização das tabelas em Delta Lake e Unity Catalog;
  • Implementação de uma esteira automatizada de MLOps nativa em Databricks on GCP, cobrindo o ciclo de vida completo dos modelos;
  • Preparação de dados, geração de features, treinamento, validação, registro, deploy, serving, monitoramento e retreino automático;
  • Atuação desde o discovery técnico com inventário dos modelos existentes, até a construção de um template padrão de pipeline validado em um piloto e migração progressiva dos modelos em ondas organizadas por criticidade.
  • Atuação no modelo ágil, com sprints, rituais de refinamento, review e retrospectiva;
Responsabilidades e atribuições
  • Construção e manutenção de pipelines de dados escaláveis e confiáveis, utilizando tecnologias modernas de processamento distribuído para garantir a ingestão, transformação e disponibilização de dados com qualidade e performance.
  • Organização das tabelas em Delta Lake e Unity Catalog;
  • Implementação de uma esteira automatizada de MLOps nativa em Databricks on GCP, cobrindo o ciclo de vida completo dos modelos;
  • Preparação de dados, geração de features, treinamento, validação, registro, deploy, serving, monitoramento e retreino automático;
  • Atuação desde o discovery técnico com inventário dos modelos existentes, até a construção de um template padrão de pipeline validado em um piloto e migração progressiva dos modelos em ondas organizadas por criticidade.
  • Atuação no modelo ágil, com sprints, rituais de refinamento, review e retrospectiva;
Requisitos e qualificações
  • Experiência com Databricks;
  • Experiência com PySpark e Apache Spark;
  • Experiência com Apache Airflow;
  • Experiência com BigQuery;
  • Experiência com integração e utilização do MLflow;
  • Conhecimento em AWS Glue;
  • Experiência com bancos de dados SQL e NoSQL, como PostgreSQL, MongoDB e Cassandra;
Requisitos Desejáveis
  • Desejável conhecimento em Apache Kafka;
  • Desejável conhecimento em dbt.

Become a Compasser, be part of AI/R.

Compass UOL is a global firm and part of the AI Revolution Company, together transforming organizations using Artificial Intelligence, Generative AI, and other of today’s most advanced technologies.

We equip our team with proprietary and external AI-driven tools to design and build digital-native platforms, integrating cutting-edge technologies and enabling companies to innovate, transform their businesses, and drive success in their markets.

To achieve this, we attract and develop the best talent, creating opportunities that enhance people’s lives and highlight the positive impact of disruptive technologies.

We empower borderless talent and promote knowledge and opportunities in the latest market trends, driving significant personal and professional growth.

Join us and be part of the AI-driven revolution.
Obtém a tua avaliação gratuita e confidencial do currículo.
ou arrasta e larga o ficheiro aqui.
Similar jobs

Ofertas semelhantes que vale a pena comparar

Databricks Data Engineer | Senior (Remote)
Databricks Data Engineer | Senior (Remote)

AI/R • Brasil

Presencial
BRL 120 000 - 190 000
Databricks Data Engineer| Senior | (Remote)
Databricks Data Engineer| Senior | (Remote)

AI/R • Brasil

Presencial
BRL 180 000 - 280 000
AWS Data Science | Specialist (Remote)
AWS Data Science | Specialist (Remote)

AI/R • Brasil

Presencial
BRL 360 000 - 520 000
Data Science Specialist | Feature Store & ML Platform| Especialista (Remote)
Data Science Specialist | Feature Store & ML Platform| Especialista (Remote)

AI/R • Brasil

Presencial
BRL 180 000 - 320 000
Databricks Lakehouse Analytics Engineer | Sênior (Remote)
Databricks Lakehouse Analytics Engineer | Sênior (Remote)

AI/R • Brasil

Presencial
BRL 140 000 - 190 000
Sr Data Platform Engineer | Azure | Databricks | Python Remote Work Full-time employee
Sr Data Platform Engineer | Azure | Databricks | Python Remote Work Full-time employee

Smarthis • Brasil

Híbrido
BRL 180 000 - 240 000
Data Governance Analyst | Senior (Remote)
Data Governance Analyst | Senior (Remote)

AI/R • Brasil

Presencial
BRL 120 000 - 180 000
Data Engineer
Data Engineer

Chubb • São Paulo

Híbrido
BRL 180 000 - 240 000
Data Science (Machine Learning - ML) | PL (Remote)
Data Science (Machine Learning - ML) | PL (Remote)

AI/R • Brasil

Presencial
BRL 150 000 - 270 000
Engenheiro de Dados Sr (Databricks)
Engenheiro de Dados Sr (Databricks)

TO Brasil • São Paulo

Híbrido
BRL 180 000 - 240 000
Trabalho híbrido próximo a Marginal Pi
Ambiente colaborativo