
Alternance - Data Engineer (h/f)
Posted 7 days ago
Company Description
View moreChapsVision is a global player with European roots in the field of data intelligence and agent-based AI, enabling large enterprises and public institutions to collect, transform, secure, and analyze massive volumes of complex data in order to enhance decision-making and automate their operations through AI agents, with greater speed and confidence.
Founded in 2019 by Olivier Dellenbach, a renowned serial entrepreneur, the company now generates approximately €200 million in revenue, is profitable, and has raised over €350 million since its inception. With a primary presence in Western Europe and the United States, ChapsVision operates in more than 40 countries from seven offices.
Job Description
Missions
Maintenir et faire évoluer les pipelines de traitement de données orchestrés avec Apache Airflow.
Concevoir et développer de nouveaux DAGs afin d’intégrer de nouvelles sources et de nouveaux traitements de données.
Automatiser l’exécution de traitements dans le cloud en optimisant le provisioning des ressources de calcul.
Participer à l’intégration de modèles d’IA générative (LLM) pour le nettoyage, le filtrage, la structuration et l’enrichissement des données.
Contribuer au développement et à l'amélioration continue d'une plateforme interne d'évaluation et de visualisation des données.
Garantir la fiabilité et la qualité des traitements de données.
Optimiser les performances des pipelines et des traitements existants.
Réduire les temps d'exécution et optimiser les coûts liés aux ressources Cloud.
Documenter les pipelines, les traitements et les bonnes pratiques de développement.
Participer à la veille technologique autour du Data Engineering, du Cloud et de l'Intelligence Artificielle.
Environnement technique
Langages
Python
SQL
Data Engineering
Apache Airflow
DAGs
ETL / ELT
Traitement de données
Bases de données
Bases relationnelles (PostgreSQL, MySQL…)
Bases NoSQL
Cloud & Infrastructure
Amazon Web Services (AWS)
Amazon S3
Amazon EC2
Docker
Intelligence Artificielle
LLM (Large Language Models)
Traitement automatique de texte (Text Processing)
IA générative
Outils & Méthodes
Git
Linux
Documentation technique
Optimisation des performances
Profil recherché
Formation
Étudiant(e) en Bac+5 (école d'ingénieurs ou Master) spécialisé en informatique, Data Engineering, Data Science ou équivalent.
Expérience
Une première expérience (stage, alternance ou projet académique) en développement logiciel ou en traitement de données est appréciée.
Hard Skills
Bonne maîtrise de Python.
Solides bases en algorithmique.
Première expérience en traitement de données textuelles.
Bonne connaissance des bases de données relationnelles et NoSQL.
Compréhension des concepts de pipelines de données et des traitements distribués.
Intérêt pour les technologies Cloud et l'Intelligence Artificielle.
Compétences appréciées
Connaissances d'Apache Airflow.
Première expérience sur AWS (S3, EC2).
Maîtrise de Docker.
Connaissances des architectures Data modernes.
Sensibilité aux problématiques de performance et d'optimisation des coûts Cloud.
Soft Skills
Curiosité technique et envie d'apprendre.
Autonomie et sens de l'initiative.
Esprit d'analyse et capacité de résolution de problèmes.
Rigueur et sens de l'organisation.
Esprit d'équipe et goût pour le travail collaboratif.
Bonnes capacités de communication.
Intérêt pour l'innovation et les nouvelles technologies.
Langues
Français courant indispensable.
Anglais technique et professionnel (lecture de documentation et échanges avec des équipes internationales).
Benefits
- Forfait mobilité durable
- Carte Swile
