via Indeed · 18 septembre 2026 ·il y a 1 jour

Lead Data Engineer (H/F) (IT) / Freelance

lehibou
Colombes
Cette annonce provient de Indeed
Voir l'annonce originale ↗

Notre client dans le secteur Énergie et ressources naturelles recherche un/une Lead Data Engineer (H/F) H/F

Description de la mission :

Fiche de poste ? Lead Data Engineer (H/F)

Contexte et objectif de la mission

Dans le cadre d?un programme de replatforming B2C, une organisation internationale construit une Data Platform centralisée à l?échelle mondiale, aujourd?hui fragmentée. L?objectif est de mettre en place une plateforme cloud\-native, data\-centric et scalable, au service des équipes data de plusieurs géographies, notamment la France, la Belgique et l?Australie.

Le Core Model du programme repose sur un modèle de données unifié couvrant notamment les données clients, contrats et facturation. Le Lead Data Engineer intervient comme référent technique de la data platform, avec une responsabilité complète sur l?architecture, le delivery et la qualité des données.

Stack technique

? Data Platform : Databricks (lakehouse), Amazon S3, Amazon Managed Apache Flink

? Gouvernance des données : Unity Catalogue, Collibra

? Visualisation : Power BI

? Cloud : AWS

? Streaming : Confluent Kafka

? Langages : Python, SQL

? IA \& coding : GitHub Copilot, Claude Code, outils LLM

? Collaboration : Jira, Confluence, SonarQube

Missions principales

Stratégie \& Architecture Data

? Définir l?architecture de la data platform greenfield (lakehouse, zones bronze/silver/gold, data contracts)

? Co\-construire le Core Data Model commun aux différentes géographies tout en intégrant les spécificités locales

? Mettre en place la gouvernance des données, la qualité et l?observabilité

? Répondre aux besoins analytiques et fonctionnels des équipes métier via une approche de type catalogue as a service

Leadership \& Delivery

? Être le référent technique data du programme

? Choisir les partenaires et structurer une feature team de 5 à 6 personnes

? Assurer la responsabilité end\-to\-end des pipelines, de l?ingestion à la restitution

? Gérer le monitoring, la performance et l?optimisation FinOps des workloads data

? Mettre en place les pratiques DataOps : automatisation des tests, CI/CD data, infrastructure as code

IA \& Vélocité

? Exploiter GitHub Copilot, Claude Code ou équivalents pour accélérer le développement des pipelines et modèles

? Intégrer des cas d?usage IA/ML dans la data platform, incluant data science, feature store et jeux de données prêts pour les LLM

? Automatiser la génération de code, les tests de qualité des données et la documentation

? Conserver la maîtrise technique tout en augmentant la vélocité grâce à l?IA

Spécificités de l?équipe

Le périmètre comprend un chantier amont de migration de l?ensemble des données France vers l?écosystème Kaluza, dans le cadre d?un programme de replatforming B2C.

Cette migration implique deux modules en amont :

? Module d?éligibilité : définir les paramètres business pour les parcours clients/agents

? Module ETL : récupérer et transformer les données provenant de nombreux systèmes d?information avant injection dans Kaluza

Complexité forte de l?ETL :

? Orchestration multi\-sources

? Micro\-batch quotidien pendant plusieurs mois

? Gestion d?un service managé AWS (Glue, Step Functions, S3, Lambda?)

? Connexions API pour orchestrer les flux

Compétences appréciées

? Expérience Unity Catalogue et gouvernance des données à l?échelle

? Connaissance de Confluent Kafka et du streaming

? Familiarité avec Collibra ou équivalent

? Expérience en data modelling dans un contexte B2C

? Déploiements IA/ML en production, incluant MLflow, feature engineering et pipelines LLM

? Expérience de contextes multi\-pays ou de data platform cross\-entités

Compétences / Qualités indispensables :

Databricks et architecture lakehouse, AWS data managé (Glue, Step Functions, S3\), Python / PySpark / SQL, DataOps et CI/CD data, Leadership technique et delivery end\-to\-end, Usage d?outils IA de développement (GitHub Copilot)

Compétences / Qualités qui seraient un \+ :

Unity Catalogue et gouvernance des données à l?échelle, Confluent Kafka et streaming, Collibra, data modelling B2C, déploiements IA/ML en production, contextes multi\-pays ou cross\-entités

Informations concernant le télétravail :

Environ 3 jours par semaine, flexible selon l?autonomie

Profil candidat:

Databricks et architecture lakehouse

AWS data managé (Glue, Step Functions, S3\)

Python / PySpark / SQL

DataOps et CI/CD data

Leadership technique et delivery end\-to\-end

Usage d?outils IA de développement (GitHub Copilot)

Le marché pour ce type de poste

Offres similaires
56
postes Ingénierie à Colombes
Temps plein
83%
des offres Ingénierie en France
Télétravail possible
3%
des offres Ingénierie
lehibou

70 postes ouverts · Aubervilliers, Aulnay-Sous-Bois, Charenton-le-Pont, Chartres, Châteaufort +18

📊 Ingénierie · France
30 005
offres actives
3.3%
Remote
Ø 1d
Ø en ligne
Compétences les plus demandées
ExcelERPISOPythonAWSCI/CDSQLAzureAgileLean

Questions fréquentes

Combien d'offres Ingénierie sont disponibles à Colombes ?
Actuellement 56 postes en Ingénierie à Colombes sur AlmostHired, dans 18 entreprises différentes. Nos données sont mises à jour quotidiennement.
Est-ce que les postes Ingénierie offrent du télétravail ?
3% des offres Ingénierie en France permettent le télétravail, partiel ou total. Pour filtrer spécifiquement les postes en remote, utilisez AlmostHired.
Comment savoir si je corresponds à cette offre ?
Déposez votre CV — notre IA compare votre profil aux exigences du poste et vous donne un score de compatibilité précis, avec les compétences qui correspondent et celles qui manquent.