Data Engineer - Python & PySpark (On-Prem Hadoop/Hive)

Wolsome

Île-de-France

Sur place

EUR 55 000 - 85 000

Plein temps

Il y a 4 jours
Soyez parmi les premiers à postuler
Générateur de candidature

Une candidature complète en une minute — CV personnalisé et lettre de motivation, prêts à envoyer.

Passez les filtres ATS

Résumé du poste

Wolsome recherche un Data Engineer Python / PySpark pour intervenir sur des projets de traitement et de valorisation des données dans un environnement on-premise basé sur Hadoop et Hive. Vous participerez à la conception, au développement et à l’optimisation de pipelines robustes et performants.

Vous maîtrisez Python et PySpark avec une expérience sur Hadoop, Hive et SQL, en environnement Linux et avec Git. Poste en collaboration avec les équipes Data, BI et infrastructure.

Qualifications

  • Maîtrise du développement Python et PySpark pour des traitements Data.
  • Compétence en PySpark et traitement distribué.
  • Bonne connaissance de l’écosystème Hadoop et de Hive.
  • Maîtrise du SQL et manipulation de données en grande volumétrie.
  • Environnement Linux et outils en ligne de commande.
  • Bonnes pratiques Git et développement logiciel.

Responsabilités

  • Concevoir et développer des pipelines de traitement de données avec Python et PySpark.
  • Développer et optimiser des traitements distribués sur Hadoop.
  • Manipuler et exploiter les données dans Hive et SQL.
  • Participer à l’alimentation et transformation des flux de données.
  • Optimiser les performances PySpark et requêtes Hive.
  • Assurer qualité, fiabilité et disponibilité des données.
  • Collaborer avec les équipes Data, BI et infra.
  • Contribuer à la documentation technique et à l’industrialisation.

Connaissances

Python
PySpark
Hadoop
Hive
SQL
Linux
Git
On-premise

Outils

Hadoop ecosystem

Description du poste

Wolsome recherche un Data Engineer Python / PySpark pour intervenir sur des projets de traitement et de valorisation des données dans un environnement on-premise basé sur Hadoop et Hive. Vous participerez à la conception, au développement et à l’optimisation de pipelines robustes et performants.

Vous maîtrisez Python et PySpark avec une expérience sur Hadoop, Hive et SQL, en environnement Linux et avec Git. Poste en collaboration avec les équipes Data, BI et infrastructure.

Obtenez votre examen gratuit et confidentiel de votre CV.

ou faites glisser et déposez votre fichier ici.

Similar jobs

Postes similaires à comparer

Data Engineer Python / PySpark
Data Engineer Python / PySpark

Wolsome • Île-de-France

Sur place
EUR 55 000 - 85 000
Data Engineer: Hadoop & PySpark for Datalake Ops
Data Engineer: Hadoop & PySpark for Datalake Ops

Free-Work • Paris

Sur place
EUR 55 000 - 90 000
Data Platform Engineer - Hadoop & PySpark Trailblazer
Data Platform Engineer - Hadoop & PySpark Trailblazer

Onyx-Conseil • Paris

Sur place
EUR 52 000 - 78 000
Data engineer Hadoop-
Data engineer Hadoop-

Onyx-Conseil • Paris

Sur place
EUR 50 000 - 70 000
Hadoop & PySpark Data Engineer – Data Lake & Pipelines
Hadoop & PySpark Data Engineer – Data Lake & Pipelines

Onyx-Conseil • Paris

Sur place
EUR 50 000 - 70 000
Data Engineer Spark & Big Data – ETL/ELT Specialist
Data Engineer Spark & Big Data – ETL/ELT Specialist

SII Group • Le Mans

Hybride
EUR 55 000 - 75 000
Formation technique
Évolution de carrière
Déjeuners techniques
+2
Data Engineer PySpark/Python — Cloud & Pipelines
Data Engineer PySpark/Python — Cloud & Pipelines

Zenika • Paris

Hybride
EUR 70 000 - 95 000
Télétravail flexible
Rémunération transparente
Data Engineer Python Spark (H/F) (IT) / Freelance
Data Engineer Python Spark (H/F) (IT) / Freelance

Free-Work • Lyon

Hybride
EUR 65 000 - 90 000
Data Engineer: Hadoop + PySpark Pipelines Architect
Data Engineer: Hadoop + PySpark Pipelines Architect

Bénin Digital • Montfaucon

Sur place
EUR 55 000 - 75 000
Data Engineer Hadoop / PySpark - Plateforme Data (H/F)
Data Engineer Hadoop / PySpark - Plateforme Data (H/F)

Onyx-Conseil • Paris

Sur place
EUR 52 000 - 78 000