Architecte Big Data & Cloud avec 8 ans d'expérience en environnement Data. Diplômé d'un Master Big Data et Fouille des données. Expertise en traitement de données avec Spark/Scala/Java/Python/R, maîtrise d'Apache Hadoop, Hive, Kafka, Spark et Cloudera. Expérience en Data Science (Machine Learning, Deep Learning) et outils comme Dataiku et PowerBI. Expérience en mode Agile Scrum.
Architecture technique, administration, intégration, support technique et décisionnel sur cluster Cloudera. Environnement: Hadoop Cloudera, Shell, Spark, Hue, Hive, Python, Scala.
Amélioration de la compréhension des données du DataLake et DataWarehouse, étude sur les indicateurs KPI et complétude des données. Environnement: DataGalaxy, Scala (sbt), Java, Spark.
Agrégation de données, structuration d'indicateurs, automatisation de pipelines, création et mise à jour de dataframes. Environnement: Python, Spark, Scala(Sbt), PowerBI, Minio, Agil, Jira.
Détection d'anomalies, maintenance prédictive des KPI, traitement du langage naturel. Mise en place d'algorithmes de classification, régression et apprentissage adaptatif. Environnement: Python, AWS, R, Agile Scrum.
Développement d'un algorithme de Deep Learning (RNN) pour un jeu de poker en ligne. Études, conception, mise en place d'architectures ML/DL et MLOps. Environnement: Python, R, AWS, Spark, Angular, Agil Scrum.
Cartographie des compétences des collaborateurs. Analyse et développement d'applications pour la gestion automatique des appels d'offres, automatisation de pipelines. Environnement: Python, R, Java, Scala (Sbt), Hadoop, Agile, PowerBI, Dataiku, AWS.
Recherche et développement en exploitation de données et déploiement d'IA. Analyses de sentiment sur tweets, réservations de vélos. Environnement: Scala, Spark, Hadoop Cloudera, Hive, MongoDb, MySQL, R, Knime, Kafka, PowerBI, Dataiku, AWS.