YM

Yatoute

Résumé

Elève Ingénieur Data scientist en dernière année à l’ENSAI, je m’oriente aujourd’hui vers l’IA, avec un intérêt particulier pour le NLP, les modèles de langage (LLMs) et les architectures Transformer.

Mon parcours mêle data engineering, cloud computing et machine learning, ce qui me permet d’aborder les modèles IA avec une vision à la fois théorique et opérationnelle :
• traitements et pipelines data à grande échelle (GCP, AWS),
• intégration et exploitation de modèles de machine learning en production,
• compréhension avancée des architectures neuronales modernes.

Récemment, j’ai approfondi la partie LLM engineering en développant un modèle GPT minimaliste en PyTorch et en expérimentant le fine-tuning supervisé sur des tâches de classification. Ce projet fait partie d’un apprentissage plus large sur les modèles génératifs et les systèmes IA modernes.

:direct_hit: Je recherche un stage de fin d’études (6 mois – 2026) dans les domaines :
• IA / Deep Learning,
• NLP / LLMs,
• systèmes intelligents (RAG, agents),
• ou R&D appliquée à l’IA.

Mon objectif : contribuer à des projets IA ambitieux en combinant rigueur d’ingénieur, créativité et compréhension des technologies de pointe.

Expériences professionnelles

Data engineer

opsci

De Juin 2025 à Septembre 2025

Développement de pipelines de collecte de données sur réseaux sociaux & Analyse d’opinion par NLP

- Conception et implémentation de scrapers sur mesure pour deux plateformes sociales majeures à l’aide de techniques de reverse engineering (interception et analyse de requêtes API REST/GraphQL).

- Développement de modules internes robustes permettant la collecte à large échelle via des Cloud Functions GCP orchestrées dynamiquement selon différents scénarios de collecte (par mots-clés, utilisateurs, connexions, etc.).

- Structuration, parsing et insertion des données dans notre Cloud SQL database via un pipeline distribué, exploitant notamment Cloud Tasks pour le traitement parallèle.

- Rédaction de documentations techniques complètes pour chaque collecteur.

- Proposition d'un schéma Big Query pour la migration de l'infra Cloud SQL vers Big Query (partitionnement, Clustering, index de recherche, etc)

- Cartographie thématique des discours sur la reconnaissance de L'État Palestinien : une analyse par NLP des prises de position partagées sur les réseaux sociaux.

Data analyst

Agence Nationale de la Statistique et de la Démographie - ANSD

De Août 2022 à Octobre 2022

- Analyse multidimensionnelle de la pauvreté au Sénégal

- Mise en place d'une plateforme web d'analyse de la vulnérabilité des ménages basée sur un modèle de machine learning.

Parcours officiels