COLLECTIVE

Développeur Big Data (h/f)

Posted 4 days ago

Experience
5+ years
Offer salary
Not specified
Location
Lyon, France
Contract type
Freelance
Work arrangement
Sur Site
Starting Date
ASAP
Stack required
Python
Postgresql
Teradata
Hadoop
Jira
Confluence
Git
Bitbucket
Powerbi

Company Description

View more

AI Sourcing agent, built and used by 15K+ modern recruiters.
Search with AI from your core ATS to the deep web, create jobs in seconds with AI, get qualified applications scored with AI, find twins/lookalikes with AI...
Collective is reinventing the sourcing & recruitment thanks to AI, enabling amibitious recruiters to increase productivity and save time & money.

Job Description

CONTEXTE


Nous cherchons un candidat capable de s'adapter à l'environnement technique du département Service & Données et aux pratiques de l'équipe qu'il va rejoindre :

* Qui saura travailler de manière autonome
* Disposant d'un bon sens de l'organisation et de la rigueur
* Qui saura synthétiser ses travaux pour communiquer efficacement à ses commanditaires

5 années d'expérience, hors alternance, sont attendues sur un rôle de data scientist.


MISSIONS


Activité principale :

* Participation à des ateliers avec des experts métiers pour collecter le besoin et comprendre les données
* Conception et développement de traitements de données
* Réalisation d'études statistiques
* Présentation de résultats sous la forme de rapports d'étude ou de tableaux de bord
* Diffusion et vulgarisation des résultats d'études

Le consultant sera également attendu sur les compétences suivantes :

* Lien entre la partie métier et la partie data science
* Conception fonctionnelle du besoin métier au sein d'un SI
* Préparer et participer aux ateliers avec le métier et ses représentants utilisateurs

Activité secondaire :

* Veille technologique sur les outils utilisés au sein du projet
* Partage et formation sur les guides de bonnes conduites


STACK TECHNIQUE


L'environnement technique du projet est le suivant :

* Python
* PostgreSQL
* Teradata
* Hadoop
* Jira / Confluence
* Git / Bitbucket
* PowerBI
* PowerPoint / Excel


CONDITIONS DE TRAVAIL


* Référence de l'appel d'offres : RFP-267236-1
* Localisation : Lyon
* Expérience requise : +5 ans


COMPÉTENCES ATTENDUES


* Maîtrise de Python et de ses librairies pour le traitement, l'analyse de données et la modélisation statistique (pandas, polars, scikit-learn, matplotlib, xgboost, pandera, geopandas)
* Bonne connaissance des bases de données SQL, notamment PostgreSQL et Teradata
* Proactif et autonome, avec une capacité à prendre des initiatives et à résoudre des problèmes
* Expérience dans le recueil de besoins et l'animation d'ateliers métiers
* Capacités à communiquer efficacement et avec pédagogie
* Connaissance dans la rédaction de documents de cadrage du projet
* Familiarité avec Spark (PySpark ou Scala) pour le traitement de grandes volumétries de données


IMPÉRATIFS


* Expérience avérée (+5 ans) des méthodes de data science (modélisation statistique, machine learning, validation croisée, feature engineering)
* Maîtrise de Python dont packages : pandas, polars, numpy, matplotlib
* Proactif et autonome, capacité à communiquer efficacement avec les métiers


PROFIL:


1. 5 années d'expérience, hors alternance, sur un rôle de data scientist
2. Maîtrise de Python et de ses librairies pour le traitement, l'analyse de données et la modélisation statistique (pandas, polars, scikit-learn, matplotlib, xgboost, pandera, geopandas)
3. Bonne connaissance des bases de données SQL, notamment PostgreSQL et Teradata
4. Proactif et autonome, avec une capacité à prendre des initiatives et à résoudre des problèmes
5. Expérience dans le recueil de besoins et l'animation d'ateliers métiers
6. Capacités à communiquer efficacement et avec pédagogie
7. Connaissance dans la rédaction de documents de cadrage du projet
8. Familiarité avec Spark (PySpark ou Scala) pour le traitement de grandes volumétries de données
9. Expérience avérée (+5 ans) des méthodes de data science (modélisation statistique, machine learning, validation croisée, feature engineering)
10. Maîtrise de python dont packages : pandas, polars, numpy, matplotlib
11. Capacité à communiquer efficacement avec les métiers

https://www.collective.work