Data Engineer

ASTEK Polska

Kraków

Hybrid

PLN 180,000 - 260,000

Full time

2 days ago
Be an early applicant

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

ASTEK Polska poszukuje specjalisty ds. data engineering na Kraków. Do zadań należy projektowanie, rozwijanie i utrzymywanie skalowalnych potoków danych z wykorzystaniem PySpark i Pythona oraz budowa procesów ETL/ELT do obsługi dużych wolumenów danych.

Wymagane doświadczenie: 6–10 lat w IT, 4–5 lat z PySpark i Pythonem, silna znajomość Azure Data Factory, SQL i modelowania danych; dobra znajomość architektur data lake/lakehouse oraz praktyki DevOps.

Qualifications

  • 6–10 lat doświadczenia w IT
  • 4–5 lat praktycznego doświadczenia w pracy z PySpark i Python
  • Bardzo dobra znajomość zasad data engineeringu oraz nowoczesnych architektur przetwarzania danych
  • Udokumentowane doświadczenie w zakresie PySpark (Spark SQL, DataFrames, optymalizacja wydajności)
  • Udokumentowane doświadczenie w programowaniu i tworzeniu aplikacji w Pythonie
  • Udokumentowane doświadczenie w budowie i orkiestracji procesów w Azure Data Factory (ADF)
  • Dobra znajomość technik optymalizacji danych: partycjonowanie, cache'owanie, optymalizacja joinów, optymalizacja zapytań
  • Doświadczenie w pracy z rozproszonymi systemami przetwarzania dużych wolumenów danych
  • Dobra znajomość SQL, baz danych oraz modelowania danych
  • Bardzo dobre umiejętności analityczne i rozwiązywania problemów

Responsibilities

  • Projektowanie, rozwijanie i utrzymywanie skalowalnych potoków danych z wykorzystaniem PySpark i Python
  • Budowanie i optymalizacja procesów ETL/ELT do przetwarzania dużych wolumenów danych
  • Tworzenie wydajnego, wielokrotnego użytku kodu z naciskiem na optymalizację
  • Przetwarzanie i zarządzanie danymi strukturalnymi oraz niestrukturalnymi pochodzącymi z różnych źródeł
  • Wdrażanie najlepszych praktyk związanych z data engineeringiem, optymalizacją wydajności i jakością kodu
  • Tworzenie, orkiestracja i monitorowanie procesów danych przy użyciu Azure Data Factory (ADF)
  • Współpraca z Data Scientistami, Data Analystami, Architektami Rozwiązań oraz innymi interesariuszami
  • Zapewnienie jakości, niezawodności i integralności danych na wszystkich platformach danych
  • Identyfikowanie i rozwiązywanie problemów wydajnościowych w potokach przetwarzania danych
  • Udział w dyskusjach dotyczących architektury danych oraz inicjatywach związanych z ciągłym doskonaleniem

Skills

PySpark
Python
Azure Data Factory
SQL
Data engineering
Data processing architectures
Cloud technologies
DevOps practices
Data governance

Tools

Azure Databricks

Job description

Nasze wymagania:
  • 6-10 lat doświadczenia w IT
  • 4-5 lat praktycznego doświadczenia w pracy z PySpark i Python
  • Bardzo dobra znajomość zasad data engineeringu oraz nowoczesnych architektur przetwarzania danych
  • Udokumentowane doświadczenie w zakresie PySpark (Spark SQL, DataFrames, optymalizacja wydajności)
  • Udokumentowane doświadczenie w programowaniu i tworzeniu aplikacji w Pythonie
  • Udokumentowane doświadczenie w budowie i orkiestracji procesów w Azure Data Factory (ADF)
  • Dobra znajomość technik optymalizacji danych: partycjonowanie, cache'owanie, optymalizacja joinów, optymalizacja zapytań
  • Doświadczenie w pracy z rozproszonymi systemami przetwarzania dużych zbiorów danych
  • Dobra znajomość SQL, baz danych oraz modelowania danych
  • Bardzo dobre umiejętności analityczne i rozwiązywania problemów
Mile widziane:
  • Praktyczne doświadczenie z Azure Databricks (ADB)
  • Znajomość technologii chmurowych, preferencyjnie Microsoft Azure
  • Doświadczenie z procesami CI/CD oraz praktykami DevOps w obszarze data engineering
  • Znajomość architektur Data Lake oraz Lakehouse
  • Wiedza z zakresu nowoczesnego zarządzania danymi (Data Governance) i monitoringu danych
Zakres obowiązków:
  • Praca z biura 3 razy w tygodniu
  • Projektowanie, rozwijanie i utrzymywanie skalowalnych potoków danych z wykorzystaniem PySpark i Python
  • Budowanie i optymalizacja procesów ETL/ELT do przetwarzania dużych wolumenów danych
  • Tworzenie wydajnego, wielokrotnego użytku kodu z naciskiem na optymalizację
  • Przetwarzanie i zarządzanie danymi strukturalnymi oraz niestrukturalnymi pochodzącymi z różnych źródeł
  • Wdrażanie najlepszych praktyk związanych z data engineeringiem, optymalizacją wydajności i jakością kodu
  • Tworzenie, orkiestracja i monitorowanie procesów danych przy użyciu Azure Data Factory (ADF)
  • Współpraca z Data Scientistami, Data Analystami, Architektami Rozwiązań oraz innymi interesariuszami
  • Zapewnienie jakości, niezawodności i integralności danych na wszystkich platformach danych
  • Identyfikowanie i rozwiązywanie problemów wydajnościowych w potokach przetwarzania danych
  • Udział w dyskusjach dotyczących architektury danych oraz inicjatywach związanych z ciągłym doskonaleniem
Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Azure Data Engineer / ETL Consultant
Azure Data Engineer / ETL Consultant

Diverse CG Sp. z o.o. Sp.k. • Warszawa

On-site
PLN 140,000 - 200,000
Prywatna opieka medyczna
Dofinansowanie karty sportowej
Stałe wsparcie konsultanta
+1
Data Engineer
Data Engineer

Link Group • Warszawa

On-site
PLN 180,000 - 240,000
Senior Data Engineer
Senior Data Engineer

HeadHR • Wrocław

On-site
PLN 179,088 - 199,752
Senior Data Engineer (Azure)
Senior Data Engineer (Azure)

Michael Page • Wrocław

On-site
PLN 180,000 - 240,000
Senior Data Engineer - Spark / Data Lakehouse
Senior Data Engineer - Spark / Data Lakehouse

Clurgo Ltd. • Wrocławki

Hybrid
PLN 180,000 - 260,000
Senior Data Engineer - Spark / Data Lakehouse
Senior Data Engineer - Spark / Data Lakehouse

Clurgo Ltd. • Wrocław

Hybrid
PLN 180,000 - 280,000
Spark / Data Lakehouse Developer
Spark / Data Lakehouse Developer

HIBERUS POLAND SPÓŁKA Z OGRANICZONĄ ODPOWIEDZIALNOŚCIĄ • Wrocław

On-site
PLN 180,000 - 260,000
Karta Multisport
Prywatna opieka medyczna
Senior Data Engineer (Azure | Databricks)
Senior Data Engineer (Azure | Databricks)

HeadHR • Wrocław

Hybrid
PLN 120,000 - 160,000
Data Engineer
Data Engineer

HeadHR • Poland

On-site
PLN 180,000 - 260,000
Technical Lead Platformy Danych
Technical Lead Platformy Danych

PKO Bank Polski • Warszawa

On-site
PLN 720,000 - 1,440,000