Offres d'emploi › Hauts-de-France › Lille
Data Engineer - AWS Databricks PySpark Sustainability - Freelance (H/F)
Collective.workPubliée il y a 1 min
- Entreprise
- Collective.work
- Lieu
- Lille 59000
- Contrat
- Profession libérale
- Expérience
- Débutant accepté
- Secteur
- Architecte systèmes et réseaux des territoires connectés
Description du poste
Taux journalier (TJM): 410
CONTEXTE
Mission longue basée à Lille (hybride). Organisation engagée dans une transformation visant à tracer, mesurer et optimiser l'impact environnemental des produits. L'équipe Planet est responsable de la construction et de la fiabilisation des données Sustainability, Circular Economy et Workshop.
MISSIONS
En tant que Data Engineer, vous travaillerez sur deux produits gérés par l'équipe :
* Service : prolonger la vie des produits en structurant les données de l'ensemble des flux circulaires.
* Sustainability : mesurer et réduire l'empreinte carbone de chaque produit depuis la conception jusqu'à l'impact en rayon.
Responsabilités :
* Implémenter des solutions, à partir des règles fonctionnelles établies par le Product Manager / Data Owner.
* Documenter les règles de qualité décrites dans Collibra au préalable pour valider les datasets.
* Partir des templates génériques pour construire des pipelines scalables de données structurées.
* Transformer la stack legacy vers la nouvelle stack recommandée par les équipes de la Data Platform.
* Répondre aux questions des utilisateurs ainsi que de l'équipe de datavisualisation sur les données mises à disposition.
* Intervenir sur l'ensemble des flux de l'équipe et documenter les flux implémentés.
* Contribuer à l'amélioration des bonnes pratiques de développement (Mob programming, Test Driven Development, ...) et à la communauté de data engineers.
OUTILS & ENVIRONNEMENT
* Environnement Big Data Amazon Web Services (AWS) : S3, CodeArtefact, ECR, etc.
* Pipelines de données : DBT, PySpark
* Ordonnancement : Airflow
* Plateforme : Databricks
* Langages : Python, SQL
* Outils de gouvernance des données : Collibra
CONDITIONS DE TRAVAIL
* Localisation : Lille (mode hybride)
* Durée : mission longue
----------------------------------------
Abonnez-vous à la page NaxoTech sur LinkedIn pour découvrir nos offres régulières :
https://www.linkedin.com/company/naxotech (https://www.linkedin.com/company/naxotech)
1. Expérience sur l'environnement Big Data d'Amazon Web Services (AWS) avec maîtrise de ses composants (S3, CodeArtefact, ECR) et optimisation de leurs performances
2. Expérience dans l'implémentation de pipelines de données (DBT, PySpark)
3. Expérience dans la mise en place de l'ordonnancement via Airflow
4. Connaissances sur Databricks
5. Développement en Python
6. Connaissances en modélisation de données
7. Niveau Avancé en Spark, AWS S3, Python, PySpark, Databricks
8. Niveau Confirmé en langage SQL
CONTEXTE
Mission longue basée à Lille (hybride). Organisation engagée dans une transformation visant à tracer, mesurer et optimiser l'impact environnemental des produits. L'équipe Planet est responsable de la construction et de la fiabilisation des données Sustainability, Circular Economy et Workshop.
MISSIONS
En tant que Data Engineer, vous travaillerez sur deux produits gérés par l'équipe :
* Service : prolonger la vie des produits en structurant les données de l'ensemble des flux circulaires.
* Sustainability : mesurer et réduire l'empreinte carbone de chaque produit depuis la conception jusqu'à l'impact en rayon.
Responsabilités :
* Implémenter des solutions, à partir des règles fonctionnelles établies par le Product Manager / Data Owner.
* Documenter les règles de qualité décrites dans Collibra au préalable pour valider les datasets.
* Partir des templates génériques pour construire des pipelines scalables de données structurées.
* Transformer la stack legacy vers la nouvelle stack recommandée par les équipes de la Data Platform.
* Répondre aux questions des utilisateurs ainsi que de l'équipe de datavisualisation sur les données mises à disposition.
* Intervenir sur l'ensemble des flux de l'équipe et documenter les flux implémentés.
* Contribuer à l'amélioration des bonnes pratiques de développement (Mob programming, Test Driven Development, ...) et à la communauté de data engineers.
OUTILS & ENVIRONNEMENT
* Environnement Big Data Amazon Web Services (AWS) : S3, CodeArtefact, ECR, etc.
* Pipelines de données : DBT, PySpark
* Ordonnancement : Airflow
* Plateforme : Databricks
* Langages : Python, SQL
* Outils de gouvernance des données : Collibra
CONDITIONS DE TRAVAIL
* Localisation : Lille (mode hybride)
* Durée : mission longue
----------------------------------------
Abonnez-vous à la page NaxoTech sur LinkedIn pour découvrir nos offres régulières :
https://www.linkedin.com/company/naxotech (https://www.linkedin.com/company/naxotech)
1. Expérience sur l'environnement Big Data d'Amazon Web Services (AWS) avec maîtrise de ses composants (S3, CodeArtefact, ECR) et optimisation de leurs performances
2. Expérience dans l'implémentation de pipelines de données (DBT, PySpark)
3. Expérience dans la mise en place de l'ordonnancement via Airflow
4. Connaissances sur Databricks
5. Développement en Python
6. Connaissances en modélisation de données
7. Niveau Avancé en Spark, AWS S3, Python, PySpark, Databricks
8. Niveau Confirmé en langage SQL
Source : France Travail. Publiée le 9 octobre 2026.
Offres similaires en Hauts-de-France
Dev Lead PLM Textile - Freelance (H/F)
Collective.work
Fullstack Software Engineer (React / Java) - Freelance (H/F)
Collective.work
Tech. Lead .NET - Freelance (H/F)
Collective.work
Toutes les offres d'emploi à Lille (336 offres, salaires et secteurs qui recrutent)
