Développeur Big Data Hadoop/PySpark/Python

Free-Work

Paris

Sur place

EUR 65 000 - 90 000

Plein temps

Il y a 13 heures
Soyez parmi les premiers à postuler

Recevez plus de réponses des employeurs

Envoyez un CV adapté au poste en quelques minutes.

Résumé du poste

Free-Work recherche un profil Hadoop / PySpark pour piloter les évolutions d'un datalake sur une stack Hadoop, en lien avec l'équipe production et DevOps à Paris.

Vous serez autonome, analytique et capable de proposer des solutions techniques face à des problématiques data complexes, avec ingestion de données, data prep et maintenance des pipelines. Une exposition aux API est possible.

Qualifications

  • Maîtrise de Hadoop, PySpark et Hive; SQL et outils de versioning (Git).
  • Bonnes connaissances de Jenkins, Jira et shell scripting sous Unix/Linux.
  • Maîtrise de l’anglais à l’écrit et à l’oral.
  • Expérience agile, SCRUM, dans des environnements data.

Responsabilités

  • Mettre en œuvre nouvelles ingestions et data prep/transformation.
  • Maintenir et faire évoluer les pipelines de données (PySpark + shell).</br>Collaborer avec DevOps pour les évolutions plateforme.
  • Eventuellement mettre en œuvre une couche d’APIs pour exposer les données.
  • Travailler en autonomie et proposer des solutions techniques.

Connaissances

Python
PySpark
Hive
SQL
Git
Jenkins
Jira
Shell scripting
Unix/Linux

Outils

Hadoop
GCP/BigQuery
Alteryx
Indexima
Altair

Description du poste

Secteurs stratégiques : Banque d’investissement

PAS DE FULL REMOTE NI SOUS TRAITANCE MERCI

Démarrage : ASAP

Contexte /Objectifs :

Le département a lancé un programme stratégique, qui comporte plusieurs projets d'harmonisation des processus et outils. L'un de ces streams a pour vocation de constituer un datalake sur une stack Hadoop, afin de servir les besoins en data et reporting. Ce datalake a également pour vocation de devenir la brique centrale de l'architecture du SI .

Nous recherchons un profil Hadoop / PySpark qui sera en charge, en lien avec l'équipe de production applicative / devops, de mettre en œuvre techniquement les évolutions du datalake. Passionné par les données, capable de s’adapter à un environnement dynamique et en constante évolution, le prestataire doit faire preuve d'autonomie, d'initiative et d'une forte capacité d'analyse pour résoudre des problèmes complexes.

Principales missions :
  • Mettre en œuvre de nouvelles ingestions de données, data prep/transformation
  • Maintenir et faire évoluer nos outils de gestion des pipeline de données (Pyspark + shell scripting)
  • Adresser à l'équipe devops les demandes relatives aux évolutions de la plateforme
  • Eventuellement mettre en œuvre une couche d'APIs afin d'exposer nos données

Profil candidat:

Expertises spécifiques :
  • Excellente maîtrise de la plateforme Hadoop, ainsi que du développement en Python/PySpark et Hive. Une bonne connaissance de SQL, GIT, Jenkins, Jira, et du shell scripting sous Unix/Linux est également nécessaire.
  • Maîtrise de l'anglais, tant à l'écrit qu'à l'oral, pour faciliter les échanges avec nos interlocuteurs basés à Porto, qui représentent une part importante de notre équipe IT.
  • Expérience dans des environnements agiles, en particulier avec la méthodologie SCRUM.
  • Connaissances et expériences avec des outils et technologies tels que Indexima, Alteryx, Altair, GCP/Big Query, ainsi que des bibliothèques Python orientées API seraient des atouts appréciables.
  • Capacité à rédiger des spécifications techniques claires et précises.
  • Dynamisme, excellent relationnel et capacité à travailler en équipe.
  • Force de proposition et curiosité technique pour explorer de nouvelles solutions et technologies.
Obtenez votre examen gratuit et confidentiel de votre CV.
ou faites glisser et déposez votre fichier ici.
Similar jobs

Postes similaires à comparer

Data Engineer GCP / Hadoop / PySpark (H/F)
Data Engineer GCP / Hadoop / PySpark (H/F)

ami Consulting • Neuilly-sur-Seine

Hybride
EUR 45 000 - 55 000
Télétravail hybride
Portage salarial
Projet CIO Office Data Lake
Développeur Big Data H/F
Développeur Big Data H/F

Groupe SII • France

Hybride
EUR 40 000 - 60 000
Formation technique
Évolution de carrière
Télétravail partiel (50 %)
[FBO] Data Engineering Spark Scala - 1773 (IT) / Freelance
[FBO] Data Engineering Spark Scala - 1773 (IT) / Freelance

Onyx-Conseil • Paris

Sur place
EUR 70 000 - 90 000
Data Engineer Hadoop (h/f) (IT) / Freelance
Data Engineer Hadoop (h/f) (IT) / Freelance

Onyx-Conseil • Créteil

Hybride
EUR 65 000 - 90 000
Télétravail 2 jours/semaine
Data Hub - Data Engineer
Data Hub - Data Engineer

Free-Work • Paris

Sur place
EUR 45 000 - 65 000
Expert Databricks / Lead Data Engineer
Expert Databricks / Lead Data Engineer

KAIZEN Solutions (KZS) • Lyon

Hybride
EUR 60 000 - 70 000
Télétravail 50%
Tickets restaurant 8,50 €
Forfait mobilité durable jusqu'à 600 €/an
+1
Data Engineer Databricks confirmé - H/F - CDI
Data Engineer Databricks confirmé - H/F - CDI

Talan - France • Paris

Sur place
EUR 45 000 - 60 000
Plan de formation
Locaux modernes
Télétravail
+5
Data Engineer
Data Engineer

INVIVOO • Île-de-France

Sur place
EUR 40 000 - 60 000
Data Engineer Senior Big Data / Spark – Cloudera (H/F)
Data Engineer Senior Big Data / Spark – Cloudera (H/F)

Onyx-Conseil • Vannes

Sur place
EUR 55 000 - 85 000
Data Engineer Databricks Senior - H/F - CDI
Data Engineer Databricks Senior - H/F - CDI

Talan Group • Paris

Hybride
EUR 55 000 - 75 000
Télétravail jusqu’à 5 jours
Prime d’équipement de 100€
Tickets restaurant
+3