Concevoir les flux
Ingestion batch et streaming, transformations distribuées, modélisation et stockage adaptés aux usages métier.
El Hadji Mboup · Data Engineer
Data Engineer diplômé de Paris-Saclay et ingénieur informatique, avec une expérience concrète en Data Engineering et en production bancaire. Je conçois, industrialise et rends observables des pipelines de données fiables.
Ce que j’apporte
Je réunis conception data, industrialisation et observabilité pour livrer des systèmes qui restent fiables une fois en production.
Ingestion batch et streaming, transformations distribuées, modélisation et stockage adaptés aux usages métier.
Orchestration, tests, CI/CD et déploiements multi-environnements pour réduire le risque opérationnel.
Contrôles qualité, traçabilité, métriques et observabilité pour détecter vite les dérives et anomalies.
Expérience professionnelle
Performance, sécurité, qualité et déploiement : mes expériences couvrent le cycle complet d’un produit data.
Projets sélectionnés
Ces projets prolongent mes expériences professionnelles par des implémentations concrètes autour du cloud, du streaming et de la qualité.
Zone raw partitionnée, catalogue Glue, ETL vers Parquet, requêtes Athena, contrôles Data Quality et quarantaine des données invalides.
Architecture Bronze/Silver/Gold pour ingérer, transformer, valider et superviser des données à grande échelle avec alerting et dashboards.
Flux de capteurs multi-régions, règles d’anomalie et états Normal/Alerte/Critique pour détecter les défaillances opérationnelles.
Injection de données prioritaires, simulation d’API, ciblage documentaire et comparaison d’approches RAG pour améliorer la pertinence des réponses.
Stack technique
Un socle Data Engineering solide, complété par le cloud, le DevOps et les pratiques GenAI utiles à la production.
Python · SQL / PL-SQL · Spark / PySpark · ETL / ELT · Kafka · Hive / HDFS · YARN · Databricks
Airflow · dbt · Great Expectations · ELK · Data Quality · Data Observability
AWS S3 / Glue / Athena · Docker · Kubernetes · Terraform · GitLab CI/CD · Ansible · Linux
Teradata · PostgreSQL · Oracle · Snowflake · BigQuery
RAG · LangChain · prompt engineering · ciblage documentaire · MLflow
Formation & certifications
Université Paris-Saclay · Big Data, NoSQL, Cloud Computing et gestion de données à grande échelle.
École Polytechnique de Thiès · Informatique & Télécommunications.
AWS Certified Cloud Practitioner · Apache Airflow Certification — Astronomer · Databricks Fundamentals Accreditation · Google Cloud Professional Data Engineer Learning Path
Prochaine étape
Je recherche un CDI Data Engineer en France et souhaite rejoindre une équipe qui traite la donnée comme un produit fiable, utile et durable.