
Data Engineer Senior (h/f)
Posted 4 days ago
Company Description
View more☁ PERFORMANCE, SÉCURITÉ, AGILITÉ ☁
💻 UN HÉBERGEUR À VOS CÔTÉS POUR RELEVER TOUS LES DÉFIS
cegedim.cloud propose une palette unique de services Cloud pour l’hébergement d’applications critiques et de données sensibles : infogérance (externalisation complète), plateformes « managées » ou PaaS (Platform as a Service), serveurs virtuels à la demande ou IaaS (Infrastructure as a Service), colocation (surface privative au sein des datacenters de Cegedim). Pôle IT du Groupe Cegedim -dixième du top 250 des éditeurs français et premier éditeur en santé, cegedim.cloud s’appuie sur cinq datacenters en France, regroupés en 2 campus régionaux, certifiés HDS, ISO/IEC 27001, ISO/IEC 20000-1, ISO 14 001 et ISO 50001, sur plus de 300 clouds privatifs et sur l’expertise informatique de 210 collaborateurs, pour assurer à ses clients la disponibilité de leurs applications critiques et la confidentialité de leurs données sensibles.
Job Description
Contexte :
Le poste, à Boulogne-Billancourt avec télétravail partiel, rejoint une équipe Data Engineering en pleine transformation vers une data platform cloud-native et des pipelines scalables.
Missions :
• conception, développement et maintenance de pipelines ETL/ELT scalables et robustes, reliant les sources que sont les logiciels d'officine (LGO) aux datamarts métier ;
• architecture et optimisation des entrepôts de données sous ClickHouse et SQL Server : performance des requêtes, indexation, partitionnement, modélisation ;
• orchestration des traitements sous Apache Airflow (alerting, monitoring, dépendances, DAGs) ;
• renforcement de la qualité des données par la détection d'anomalies, le scoring de fiabilité et la réconciliation des flux quotidiens ;
• participation à la stratégie d'évolution et de migration de la plateforme (Elasticsearch vers ClickHouse, SQL Server, cloud) ;
• traduction des besoins métier en solutions techniques, en lien avec les équipes d'analyse et les Product Managers ;
• animation de la culture d'ingénierie : mentorat des juniors, pair programming, documentation, revues de code.
Environnement technique :
SQL Server, ClickHouse, Elasticsearch, Apache Airflow, Python, SQL, TypeScript / Node.js, Docker, Kubernetes, GitLab CI/CD, Git, Jira, Confluence.
Profil recherché :
• formation Bac+5 (Master Big Data ou école d'ingénieur) et 5 ans minimum d'expérience en data engineering ;
• SQL de niveau avancé (procédures stockées, optimisation des requêtes complexes, tuning ClickHouse et/ou SQL Server) ;
• Python appliqué à la manipulation de données et aux pipelines (pandas, polars, SQLAlchemy) ;
• Airflow : DAGs, XComs, pools et connexions ;
• modélisation des entrepôts et des datamarts (schémas en étoile / flocon, historisation) ;
• CI/CD, Git et Docker ; des notions de Kubernetes sont appréciées ;
• curiosité, autonomie dans les choix techniques, rigueur et souci de la qualité de la donnée, aptitude à dialoguer avec des interlocuteurs non techniques.
Benefits
- Télétravail partiel
- mutuelle
- tickets restaurant
- intéressement
- prime de vacances
