Vous intégrez le vertical Services Publics de Sopra Steria en tant que Ingénieur(e) logiciel DATA / Data Engineering (stage). Le vertical Services Publics de Sopra Steria rassemble près de 1 700 collaborateurs en France, au sein d'équipes réparties sur tout le territoire. Il accompagne les acteurs de l'État, des collectivités et des opérateurs publics sur des projets structurants : modernisation des systèmes d'information, services numériques aux citoyens, data, cloud, cybersécurité et pilotage de politiques publiques. Les équipes interviennent sur des projets à fort impact sociétal, au coeur de la transformation de l'action publique.
Votre rôle et vos missions :
- Participez à l'analyse des besoins métier et à la compréhension des cas d'usage liés à la valorisation de la donnée.
- Contribuez aux travaux d'alimentation, de transformation et de contrôle de la qualité des données (Data Engineering, data pipelines, fiabilisation des flux).
- Développez des traitements de données et des indicateurs à l'aide de technologies telles que SQL, Python, Spark et des environnements Big Data.
- Réalisez des tests, validez les évolutions mises en oeuvre et contribuez à l'amélioration continue des solutions développées.
- Participez à la production de tableaux de bord et d'outils d'aide à la décision (Data Visualisation, indicateurs métiers, restitution des données aux utilisateurs).
- Contribuez aux réflexions autour de la gouvernance de la donnée, de la traçabilité et de la valorisation des informations au sein du secteur public.
Les apports du stage :
- Découvrir et comprendre l'ensemble de la chaîne de valeur de la donnée, depuis son acquisition jusqu'à sa restitution au service de la décision publique.
- Analyser et comprendre les besoins d'un système d'information, proposer des solutions et technologies adaptées et décliner les objectifs techniques associés.
- Appréhender les basiques et les bonnes pratiques du développement dans un contexte innovant Big Data / Cloud / Data Engineering.
- Acquérir et approfondir vos connaissances sur plusieurs domaines techniques (Data Engineering, Data Visualisation, gouvernance des données) et fonctionnels (services publics, transformation numérique).
- Évoluer dans un environnement favorisant le travail en équipe, l'apprentissage continu et la montée en compétences auprès d'expert(e)s data et secteur public.
Technologies utilisées :
- Data & Streaming : Kafka, NiFi, Spark, Iceberg
- Langages & Requêtes : Python, SQL, PySpark
- Architecture & Infra : API, Kubernetes, Conteneurs
- Outils de développement : Git et outils associés