Consultante DATA ENGINEER (Freelance) at Allianz Technology France (2025-04 – Present)
- Ingestion et traitement de fichiers CSV générés par l'application NAI, normalisés avec un schéma de colonnes défini.
- Mise en place de flux de données sur Azure Synapse pour orchestrer le traitement des données.
- Conception et optimisation de procédures stockées SQL utilisées dans les pipelines Synapse.
- Migration et modernisation des traitements: transformation des procédures stockées en notebooks PySpark exécutés sur Synapse.
- Implémentation de traitements distribués et performants avec PySpark pour améliorer la scalabilité et la maintenabilité des pipelines.
- Stockage et organisation des données traitées dans un Delta Lake.
Consultante DATA ENGINEER (Freelance) at Neosys (2024-10 – 2025-03)
Client Direction Générale des impots:
- Création des pipelines CI/CD.
- Traitement et ingestion des données en utilisant Pyspark/Scala dans un environnement BIG Data (Hadoop/Spark) on premise.
- Elaboration d'un script scala de rapprochement des données pour identification des contribuables.
- Automation des flux d'ingestion et du rapprochement en utilisant Airflow.
Consultante DATA ENGINEER (Freelance) at Hexagone Digitale (France) (2023-03 – 2024-09)
Client Alliance Automotive Group (Paris):
- Conception d'un Datawarehouse sur SQL SERVER.
- Extraction et traitement des données en utilisant Azure DataFactory.
- Conception d'un datamart sur SQL SERVER.
- Traitement et calcul des KPI en utilisant Azure DataFactory.
- Ordonnancement et déclenchement de pipelines via azure DataFactory.
- Création de mesures et développement de dashboard sur power BI.
Consultante DATA ENGINEER at AKUMEN IA (Valyans & AIOX Labs JV) (2021-08 – 2023-03)
- Client secteur bancaire: Préparation et traitement des données pour des use case data science en pyspark/scala.
- Client secteur bancaire: Automatisation des pipelines DATA en utilisant DATA FACTORY.
- Client secteur bancaire: Développement de Dashboard power BI pour la visualisation des résultats du modèle.
- Client secteur de la grande distribution: Conception et implémentation d'un datalake sur Cloud Azure (Blob Storage/ Postgresql).
- Client secteur de la grande distribution: Extraction des données on premise et chiffrement des données sensibles (Pyspark/Scala).
- Client secteur de la grande distribution: Application des règles pour checker la qualité de la data (On premise) (Pyspark/Scala).
- Client secteur de la grande distribution: Envoie des données chiffrées on premise vers le service blob storage (Azure).
- Client secteur de la grande distribution: Orchestration des jobs Extraction, Anonymisation, envoie des données vers le cloud via airflow on premise.
- Client secteur de la grande distribution: Features Enginering pour des besoins en data science.
- Client secteur de la grande distribution: Industrialisation des pipelines DATA (Data Factory).
- Client secteur d'investissement: Conception d'un datawarehouse pour piloter les KPI d'une région.
- Client secteur d'investissement: Crawling de la data depuis le web (StormCrawler).
- Client secteur d'investissement: Scrapping de la data (Selenium).
- Client secteur d'investissement: Implémentation du Datawarehouse sur Azure SQL.
- Client secteur d'investissement: Création des Dashboard sur power BI.
- Client secteur tourisme: Développement d'une ontologie tourisme.
- Client secteur tourisme: Scraping de la data et dockerisation des scripts.
- Client secteur tourisme: Automatisation des valeurs input du scrapper via HELM.
- Client secteur tourisme: Exécution du pipeline sur un cluster Kubernetes.
- Client secteur tourisme: Industrialisation du pipeline sur Azure Devops.
- Client secteur tourisme: Transformation des données en format ontologique (Python/Pyspark).
- Client secteur tourisme: Visualisation des KPI sur power BI/Superset.
DATA ENGINEER / BI DEVELOPPER at Digital Factory Saham Assurance (2019-10 – 2021-07)
- DATA ENGINEER: Collecte des données à travers des systèmes de BD relationnels.
- DATA ENGINEER: Conception de bases de données.
- DATA ENGINEER: Création des schémas externe sur HIVE.
- DATA ENGINEER: Stockage des données sensibles sur HDFS.
- DATA ENGINEER: Stockage des données non sensibles sur S3 au niveau du cloud AWS.
- DATA ENGINEER: Traitement des BIG DATA en utilisant Python/Pyspark/Alteryx.
- DATA ENGINEER: Manipulation du cluster EMR et exécution des scripts dessus.
- DATA ENGINEER: Orchestration des jobs en utilisant Airflow.
- BI DEVELOPPER: Analyser les besoins métiers explicité à travers des ateliers.
- BI DEVELOPPER: Conception de l'architecture logicielle.
- BI DEVELOPPER: Conception des bases de données décisionnels (schéma en étoile, flocon, constellation).
- BI DEVELOPPER: Création des ETL et calcul des KPI en utilisant Alteryx/Python.
- BI DEVELOPPER: Stockage des données au niveau de AMAZON REDHSHIFT.
- BI DEVELOPPER: Visualisation des données et création de dashboard en utilisant tableau software.