CDIEnedis Lyon - 69003 Lyon, France

Développeur Big Data - Niveau 2 (Confirmé) - Lyon

Hybride
Ses missions tournent autour de 4 axes :
o Apporter une connaissance en Big Data pour faciliter la manipulation des données
o Définir les solutions techniques permettant le traitement massif de données
o Mettre en place les pipelines de données et solutions de stockage.
o Veiller la sécurisation et la clarté des pipelines de données pour faciliter l’analyse et la transformation

Il s’appuie si nécessaire sur les référents techniques des diverses briques si ces dernières sortent du cadre de sa mission.

Il met en avant ses qualités pour mener à bien ses missions :
o Autonomie, rigueur et force de proposition
o Capacités d'analyse et de synthèse.
o Esprit d’équipe

Activité principale

o Met en place des pipelines de données (développement, optimisation, etc.) au fil de l'eau ou à froid.
o Met en place les traitements / croisements de données en vue de leur mise en qualité ou de leur enrichissement métier
o Assure le développement, la maintenance, l'optimisation et la sécurité des solutions de stockage de données
o Garanti la qualité de la chaine data à travers les tests et l'observabilité
o Détecte, propose et suit les optimisations des requêtes SQL, PL/SQL afin de garantir les meilleures performances de nos applications métier
o Assure le support aux équipes de développement afin d’identifier et proposer des solutions performantes les mieux adaptées d’un point de vue métier
o Accompagne les équipes data (data science et/ou data analyse) dans leur exploitation des données à travers leurs études pour garantir la portabilité en industrialisation dans la suite du cycle de vie
o Enrichi la documentation technique

Activité secondaire

o Veille technologique sur les outils utilisés au sein du projet
o S'appuie sur ces connaissance cloud pour faciliter le move to cloud et garantir la portabilité de nos activités data.
o Partage et formation sur les guides de bonnes conduites
o Appui des équipes data (data science et/ou data analyse) dans la production de dashboards (BI) / études (IA)
o Participe au suivi de production

Stack technique de l'équipe

L'environnement technique du projet est le suivant :
• Python/Pyspark
• Java / Scala / Spark
• Postgre SQL
• Hadoop
• Jira / Confluence
• Git
• PowerBI
• Powerpoint / Excel
• Terraform
• Docker

Compétences attendues sur le profil

Connaissance des outils de gestion de code et de déploiement projet
Maitrise des bases de l’agilité
Connaissances cloud (AWS) -> S3 / Databricks / RDS notamment
Aide à la conception de solutions permettant le traitement de volumes importants de pipelines de données suffisamment sécurisés et lisibles pour les Data Analysts et Data Scientists.
Maitrise des langages structurés utilisés par le projet
Maitrise des solutions de stockage de données
Maîtrise des technologies du Big Data permettant le traitement et la manipulation de données
Maîtrise les principes data : data lineage, architecture médaillon
Capacité à monter sur divers langages de programmation (Python / pyspark / Java / Scala / Spark)

Une certification cloud Data AWS est un plus

Le profil pourra être amené à réaliser des activités en HHN lors de la reprise de l'exploitation coté projet (contexte move to cloud)

Informations de la mission :
  • Début de mission : 29/07/2026
  • Durée : 6 mois
  • Date de publication : 29/07/2026
  • Date limite de candidature : 04/08/2026

Compétences recherchées

Python (Indispensable)Pyspark (Indispensable)Java (Indispensable)Scala (Indispensable)Spark (Indispensable)PostgreSQL (Indispensable)Hadoop (Indispensable)SQL (Indispensable)PL/SQL (Indispensable)AWS (Indispensable)S3 (Indispensable)Databricks (Indispensable)RDS (Indispensable)Terraform (Indispensable)Docker (Indispensable)Git (Indispensable)Jira (Indispensable)Confluence (Indispensable)PowerBI (Indispensable)Powerpoint (Indispensable)Excel (Indispensable)data lineage (Indispensable)architecture médaillon (Indispensable)Modélisation analytique et travail avec data analysts/scientists (Indispensable)Architecture médaillon (Indispensable)Développement Data (pipelines (Apprécié)processing (Apprécié)modélisation (Apprécié)stockage (Apprécié)qualité (Apprécié)exposition) (Indispensable)Python/Pyspark (Indispensable)AWS (S3/Databricks/RDS) (Indispensable)Jira/Confluence (Indispensable)

Intéressé(e) ?

Rejoignez l'équipe et participez à nos projets ambitieux.