Data Engineer (GCP + Databricks)

GRUPO MED4U

Curitiba

Presencial

BRL 133 920 - 167 400

Tempo integral

14 dias+
Gerador de candidaturas

Destaca-te para esta função — gera um currículo e uma carta de apresentação personalizados em cerca de um minuto.

Ultrapassa os filtros ATS

Vantagens oferecidas por esta oferta de emprego

Oportunidade de inovação em projetos de saúde
Ambiente colaborativo

Resumo da oferta

A GRUPO MED4U busca um(a) Data Engineer (GCP + Databricks) para atuar na evolução da plataforma de dados em saúde.

Se você é apaixonado por dados e deseja participar da construção de soluções inovadoras em IA, essa é a chance ideal. Você trabalhará em um ambiente híbrido e fará parte de uma equipe dedicada a transformar dados clínicos em ferramentas que impactam a jornada de cuidado dos pacientes.

Qualificações

  • Formação em Ciência da Computação, Engenharia de Computação, Sistemas de Informação ou áreas correlatas.
  • Experiência na construção e sustentação de pipelines de dados em produção.
  • Domínio de SQL e experiência com Python para engenharia de dados.

Responsabilidades

  • Projetar e implementar arquiteturas de dados utilizando GCP e Databricks.
  • Manter pipelines de ingestão e transformação de dados com foco em escalabilidade.
  • Trabalhar em parceria com equipes de Ciência de Dados e clínicas.

Conhecimentos

SQL
Python
Databricks
Apache Spark
Google Cloud Platform (GCP)

Formação académica

Ciência da Computação ou áreas correlatas

Ferramentas

BigQuery
Terraform
Delta Lake

Descrição da oferta de emprego

Que tal trazer seu talento para a Spesia?

A Spesia é a healthtech do Grupo Med4U dedicada ao desenvolvimento de soluções de Inteligência Artificial aplicadas à saúde. Trabalhamos na transformação de dados clínicos em ferramentas reais de apoio à decisão médica, desenvolvendo aplicações inovadoras capazes de impactar diretamente a jornada de cuidado dos pacientes.

Estamos em busca de um(a) Data Engineer (GCP + Databricks) para atuar na evolução da nossa plataforma de dados em saúde. Se você é apaixonado por dados, arquitetura, engenharia de dados em larga escala e quer participar da construção de soluções inovadoras em IA para a saúde, essa oportunidade é para você!

Vaga: Data Engineer (GCP + Databricks)
Modelo de trabalho: Híbrido (3 dias presenciais e 2 remotos)
Local: Unidade Corporativa - Alameda Dom Pedro II, 574 - Batel

Missão do Cargo

Atuar na estruturação, evolução e sustentação da plataforma de dados da Spesia, garantindo a disponibilidade, qualidade, segurança e governança das informações utilizadas em produtos de dados e soluções de Inteligência Artificial aplicadas à saúde.

Principais Responsabilidades
  • Projetar, implementar e evoluir arquiteturas de dados utilizando Google Cloud Platform (GCP) e Databricks;
  • Estruturar e manter pipelines de ingestão, transformação e disponibilização de dados com foco em escalabilidade, rastreabilidade e qualidade;
  • Integrar dados provenientes de prontuários eletrônicos, sistemas hospitalares, bancos de dados relacionais e demais fontes clínicas e administrativas;
  • Organizar dados estruturados, semiestruturados e não estruturados para utilização em análises avançadas e aplicações de IA;
  • Definir padrões de modelagem, documentação, governança, qualidade e linhagem dos dados;
  • Construir datasets, tabelas analíticas e produtos de dados que apoiem modelos preditivos, soluções de IA, dashboards e estudos clínicos;
  • Administrar e evoluir o ambiente Databricks, incluindo gestão de permissões, catálogos, monitoramento e otimização de performance;
  • Implementar controles de segurança, privacidade e governança de dados em conformidade com a LGPD;
  • Trabalhar em parceria com equipes de Ciência de Dados, AI Engineering, Produto, TI e especialistas clínicos;
  • Monitorar pipelines e infraestrutura de dados, identificando oportunidades de melhoria contínua;
  • Manter documentação técnica atualizada e contribuir para iniciativas de inovação, pesquisa e desenvolvimento.
Requisitos
  • Formação em Ciência da Computação, Engenharia da Computação, Sistemas de Informação, Engenharia de Software, Engenharia de Dados ou áreas correlatas;
  • Experiência na construção e sustentação de pipelines de dados em produção;
  • Domínio de SQL e experiência com Python para engenharia de dados;
  • Experiência com Apache Spark e processamento distribuído;
  • Vivência prática com Databricks, incluindo Delta Lake, notebooks e workflows;
  • Experiência com Google Cloud Platform (GCP), especialmente BigQuery, Cloud Storage e IAM;
  • Conhecimento de modelagem de dados, Data Lake, Data Warehouse e/ou Lakehouse;
  • Experiência com bancos de dados relacionais, preferencialmente Oracle ou PostgreSQL;
  • Conhecimento em governança, qualidade, segurança e observabilidade de dados;
  • Experiência com ferramentas de orquestração de pipelines.
Diferenciais
  • Experiência com dados de saúde, prontuários eletrônicos ou sistemas hospitalares, especialmente Tasy;
  • Conhecimento em padrões de interoperabilidade em saúde, como HL7 FHIR;
  • Familiaridade com terminologias clínicas como CID-10, SNOMED CT, LOINC e mCODE;
  • Experiência com Unity Catalog, Delta Live Tables, dbt, Terraform e infraestrutura como código;
  • Vivência com NLP, dados clínicos não estruturados e preparação de dados para aplicações de IA e LLMs;
  • Conhecimento em anonimização, pseudonimização e proteção de dados sensíveis;
  • Experiência com ferramentas de observabilidade como Datadog, Prometheus, Grafana ou ELK;
  • Certificações em GCP ou Databricks;
  • Participação em projetos de saúde digital, pesquisa clínica ou Inteligência Artificial aplicada à saúde.

Na Spesia, você terá a oportunidade de atuar diretamente na construção da base de dados que impulsiona soluções inovadoras de Inteligência Artificial para a saúde, contribuindo para produtos que geram impacto real para médicos, equipes clínicas e pacientes.

Quer fazer parte?

Venha construir o futuro da saúde com a gente! ?

Obtém a tua avaliação gratuita e confidencial do currículo.
ou arrasta e larga o ficheiro aqui.
Similar jobs

Ofertas semelhantes que vale a pena comparar

Applied AI Engineer – Machine Learning & NLP
Applied AI Engineer – Machine Learning & NLP

GRUPO MED4U • Curitiba

Presencial
Software Engineer/Dev Fullstack
Software Engineer/Dev Fullstack

GRUPO MED4U • Curitiba

Presencial
BRL 180 000 - 260 000
Claude Code license
Ferramentas de IA
Remuneração competitiva
+1
[Job-31033] Engenheiro de Dados (Azure/Databrics) Sênior , Brazil
[Job-31033] Engenheiro de Dados (Azure/Databrics) Sênior , Brazil

Ciandt • Brasil

Presencial
BRL 201 000 - 268 000
Plano de saúde
Vale alimentação
Auxílio-creche
+4
[Job-31663] Engenheiro de Dados (Azure/Databricks) Sênior , Brazil
[Job-31663] Engenheiro de Dados (Azure/Databricks) Sênior , Brazil

Ciandt • Brasil

Presencial
BRL 150 000 - 230 000
Plano de saúde
Vale alimentação
Auxílio-creche
+5
[Job-31663] Engenheiro de Dados (Azure/Databrics) Sênior , Brazil
[Job-31663] Engenheiro de Dados (Azure/Databrics) Sênior , Brazil

CI&T • Brasil

Presencial
BRL 120 000 - 180 000
Plano de saúde e odontológico
Vale alimentação e refeição
Auxílio-creche
+4
Engenheiro de Dados Databricks
Engenheiro de Dados Databricks

Selbetti • São Paulo

Híbrido
BRL 180 000 - 240 000
Engenheiro de Dados | Databricks
Engenheiro de Dados | Databricks

1507 Avanade Brasil Company • São Paulo

Presencial
BRL 180 000 - 280 000
Vale refeição/alimentação
Convênio médico
Seguro de vida
+3
Data Developer (Azure/Databricks) Sênior , Brazil
Data Developer (Azure/Databricks) Sênior , Brazil

CI&T • Brasil

Presencial
BRL 180 000 - 300 000
Plano de saúde
Vale alimentação e refeição
PLR
+1
1014 - Data Engineer SR - Databricks
1014 - Data Engineer SR - Databricks

Cooperflora • São Paulo

Presencial
Vale Refeição
Assistência Médica
Assistência Odontológica
+12
Engenheiro(a) de Dados Sênior Databricks
Engenheiro(a) de Dados Sênior Databricks

Extractta • Brasil

Presencial
BRL 220 000 - 360 000
Vale alimentação ou refeição
Convênio SESI/Sesc