Dans le cadre du projet européen Europeana Newspapers qui vise à traiter et à agréger des contenus numériques de presse, en rendant accessibles plusieurs millions de pages sur le portail de la Bibliothèque Européenne (TEL).
Réalisations :
Mise en place des outils de suivi interne du projet et pilotage des plannings.
Suivi du flux opérationnel - processus techniques (workflow).
Organisation et animation des réunions internes (équipe projet-experts BnF).
Participation aux réunions du consortium en France et à l’étranger.
Coordination du déploiement du projet pour la BnF auprès des acteurs en Europe.
Identification, définition et expression des besoins/prérequis techniques. Conception et proposition des solutions adaptées à la BnF et aux livrables.
Transposition des livrables demandés en spécifications fonctionnelles détaillées, voire techniques auprès du Département des Systèmes d’Information.
Supervision des développements pour le projet, rédaction et validation des rapports d’activités et des livrables (domaine technique-informatique).
Participation au déroulement des tests techniques et fonctionnels et à l’évolution des applications/interfaces au sein du DSI (méthode agile-scrum).
Coordination pour l’exploitation des contenus numériques : analyse, mise à disposition pour traitements, valorisation et diffusion.
Le projet européen "Europeana Newspapers" a pour objectifs principaux:
L’agrégation de journaux européens libres de droits. Rendre visibles et accessibles plusieurs millions de pages numérisées issus des grands titres de la presse européenne.
La visibilité et l’accessibilité sur le portail Europeana et sur le portail de chacune des bibliothèques partenaires et l’amélioration des fonctionnalités de recherche pour ce contenu.
L’enrichissement sémantique des données et des métadonnées relatives aux corpus traités (en donnant en parallèle de nouvelles possibilités d’accès au web sémantique). Reconnaissance d'entités nommées (NER).
Il s’agit également d’optimiser les processus des projets de numérisation y compris l’OCR, les dispositifs de reconnaissance/segmentation des articles de presse (OLR) et d’enrichissement sémantique des données et des métadonnées relatives à ces contenus.