ASTEK FRANCE

Data Engineer (h/f)

Posted 12 days ago

Experience
5+ years
Offer salary
Not specified
Location
Paris, France
Contract type
CDI, Freelance
Work arrangement
Hybride
Starting Date
ASAP
Stack required
Aws
Databricks
Spark
Sql
Delta Lake
Apache
Airflow
Github

Company Description

View more

Depuis 1988, Astek s'est affirmée comme un pilier incontesté des révolutions numériques à l'échelle mondiale. Nous sommes déterminés à être aux côtés de nos clients, où qu'ils soient, en leur offrant une expertise incomparable et un service de haute qualité.
Chaque jour, nous tirons parti d'un modèle d'entreprise hautement adaptable, renforcé par le savoir-faire technique de nos spécialistes et ingénieurs. Notre engagement indéfectible consiste à orchestrer une transformation numérique durable, en plaçant l'aspect humain au cœur de chacune de nos actions.
Astek guide ses clients à travers six secteurs d'activité mondiaux, en leur fournissant une expertise de pointe dans quatre domaines clés : Technologie, Opérations, Ingénierie Avancée et Conseil.

Job Description

Votre mission :


Concevoir et implémenter des pipelines de données scalables à partir de templates génériques dans un environnement Big Data.

Contribuer à la construction d’une vision 360° des utilisateurs et à l’enrichissement de la connaissance client via des partenaires data.

Transformer et moderniser des flux legacy vers une stack data lakehouse moderne (Databricks / Delta Lake / AWS).

Garantir la qualité, la fiabilité et la performance des datasets (data quality, optimisation Spark / SQL).

Documenter les flux et datasets et accompagner les utilisateurs dans la compréhension et l’usage des données.

Participer à l’amélioration continue des pratiques de développement : clean code, tests, CI/CD, data monitoring.

Contribuer à la communauté data via le partage de connaissances et les bonnes pratiques.


Votre quotidien sera rythmé par :


Développer et maintenir des pipelines de données dans un environnement AWS / Databricks / Spark.

Mettre en place et orchestrer des workflows de traitement de données avec Airflow.

Optimiser les traitements PySpark et SQL afin d’améliorer les performances des flux.

Appliquer et suivre les règles de qualité de données pour garantir la fiabilité des datasets.

Documenter les flux et datasets pour faciliter leur compréhension et leur usage.

Répondre aux questions des utilisateurs concernant les données mises à disposition.

Participer aux échanges techniques de l’équipe et contribuer aux bonnes pratiques de développement (tests, CI/CD, clean code).


Environnement technique :


AWS (S3, Lambda, Glue), Databricks

Apache Spark (PySpark), SQL

Data Lakehouse, Delta Lake

Apache Airflow

Collibra, Data Quality monitoring

Clean Code, CI/CD, tests unitaires et d’intégration

GitHub, Agile, Mob Programming

outils d’IA pour accélérer le développement (AI assistants)


Les petits plus du projet :


Un projet data stratégique autour de la connaissance client 360°.

Une stack data moderne (AWS, Databricks, Spark, Delta Lake).

Des volumes de données importants et des enjeux de performance et de qualité.

Une équipe data collaborative et orientée bonnes pratiques (clean code, CI/CD, partage de connaissances).


Votre profil :


Diplômé(e) d’un Bac+5 (école d’ingénieur ou université) en informatique, data ou domaine équivalent.

Vous justifiez d’au moins 5 ans d’expérience en Data Engineering sur des projets Big Data ou data platform.

Vous avez déjà évolué dans des environnements cloud et data modernes (AWS, Spark, Databricks…).

Vous êtes reconnu(e) pour votre rigueur technique, votre sens du service et votre capacité à travailler en équipe.

Vous êtes à l’aise dans un environnement agile et collaboratif et aimez partager vos connaissances.

Vous maitrisez le français à l'écrit et à l'oral.

https://astekjob.fr/rejoindre