Data Engineer
Il y a 1 jour
Lille, Nord-Pas-de-Calais, France
Collective.work
Temps plein
Gratuit avec email ou Google
Enregistrez cette offre et organisez votre recherche
Créez un compte gratuit pour enregistrer des offres d'emploi, créer des alertes et revenir à cette liste depuis votre tableau de bord.
Gratuit avec email ou Google
En continuant, vous acceptez nos Conditions d’utilisation & Politique de confidentialité.
Taux journalier (TJM): 550
VOTRE MISSION
* Concevoir, construire et maintenir des pipelines et infrastructures robustes et performants
* Garantir une architecture et une modélisation des flux optimisées et évolutives
* Faire évoluer la stack legacy vers les nouveaux standards de la Data Platform
* Assurer la qualité, la fiabilité et la gouvernance des données
* Apporter votre expertise et aider l'équipe dans ses choix techniques
* Promouvoir la qualité du code et les bonnes pratiques (revue de code, CI/CD)
* Respecter les engagements de sprint et contribuer à l'amélioration continue
* dbt (avancé) : industrialisation, documentation, tests des modèles
* SQL (avancé) : modélisation et interrogation
* Databricks (confirmé) : gestion des clusters, optimisation des performances, gouvernance
* PySpark (avancé)
* Apache Airflow (avancé) et Astronomer (confirmé) : création, monitoring et optimisation de DAGs complexes
* AWS (avancé)
* Python (confirmé)
* CI/CD et revue de code au quotidien (GitHub)
* Travail en environnement agile (Scrum / Kanban)
Experience:
Débutant accepté
* Concevoir, construire et maintenir des pipelines et infrastructures robustes et performants
* Garantir une architecture et une modélisation des flux optimisées et évolutives
* Faire évoluer la stack legacy vers les nouveaux standards de la Data Platform
* Assurer la qualité, la fiabilité et la gouvernance des données
* Apporter votre expertise et aider l'équipe dans ses choix techniques
* Promouvoir la qualité du code et les bonnes pratiques (revue de code, CI/CD)
* Respecter les engagements de sprint et contribuer à l'amélioration continue
* dbt (avancé) : industrialisation, documentation, tests des modèles
* SQL (avancé) : modélisation et interrogation
* Databricks (confirmé) : gestion des clusters, optimisation des performances, gouvernance
* PySpark (avancé)
* Apache Airflow (avancé) et Astronomer (confirmé) : création, monitoring et optimisation de DAGs complexes
* AWS (avancé)
* Python (confirmé)
* CI/CD et revue de code au quotidien (GitHub)
* Travail en environnement agile (Scrum / Kanban)
Experience:
Débutant accepté