Ingénieur Informatique dont l'intérêt se tourne vers les nouvelles technologies, l'innovation, la l'ingénierie de données et la data science (plus particulièrement le Deep Learning et l'IA en général).
En dehors du domaine Informatique, mes passions sont essentiellement la musique, les jeux vidéos, les arts martiaux, les voyages et l'E-Sport (compétiteur sur SSBU et SF6).
Mon objectif professionnel est de me consacrer intégralement à la data, avec pour finalité de me spécialiser en tant que Data Scientist.
Pipeline ETL d'intégration / migration de fichiers de données géospatiales QGIS vers une BDD PostgreSQL métier, assurant la transformation et le sourcing des données
Pipeline de synchronisation et d'intégration en batch processing (cron) et en streaming (event driven) pour des données documentaires (SI interne) et terrain (SI externe online et offline) :
Mise à jour simultanée en temps réel des données selon les règles métier avec des systèmes disparates (internes / externes et connectés / non connectés), avec gestion des conflits
Monitoring avec alertes e-mail, incluant du logging et reporting, assurant traçabilité et la conformité
Création des flux API
Pipeline de correction massive d'études Enedis
Outil d'automatisation des processus métiers :
Automatisation (Selenium) des opérations métiers complexes nécessitant des interactions web par plusieurs étapes et des processus longs.
Logging via API / triggers BDD de suivi et reprise en cas d'échec
Tests de régression et performance (web scraping + algorithme récursif)
En vrac :
Redmine (setup+ init + process + intégration API)
Git master
Flux BDD + backup / restore + migration de données
Migration SSO
POC tests Behave
Environnement général : Python (logiciel, graphique et web), Django, PostgreSQL (dénormalisé), Pandas / Numpy, QGIS