[appel à participation] Datathon Impresso@BnF : exploration des collections de médias historiques (du 28 au 30/10/26)
La BnF et les équipes du projet Impresso vous convient au Datathon Impresso@BnF qui se tiendra à la BnF, sur le site François Mitterrand du 28 au 30 octobre 2026.
À destination des chercheurs et chercheuses qui travaillent sur la presse, le projet Impresso fournit des outils, des données, des modèles ainsi que l’accompagnement d’experts pour fouiller les immenses collections de la presse patrimoniale européenne.
Les participants et participantes travailleront en petites équipes sur des questions de recherche qu’ils auront eux-mêmes définies, en s’appuyant sur les collections de la BnF et les ressources d’Impresso : un corpus multimédia multilingue et de données dérivées, des modèles de traitement du langage naturel (NLP) et de vision par ordinateur, ainsi que l’Impresso Datalab. L’équipe d’Impresso sera présente tout au long de l’événement pour guider, accompagner et collaborer avec les participants.
Le programme s’articule autour des cas d’usage des participants qui auront été indiqués lors de l’inscription, et qui feront l’objet d’une présentation en début de session. Il s’agit d’un événement pratique, et non d’un atelier passif.
Impresso DataLab
L’Impresso Datalab est un environnement de recherche dédié à l’analyse computationnelle de la presse historique numérisée, combinant une interface d’exploration et un espace de travail computationnel.
Les participants auront accès à :
- L’application web Impresso : une interface permettant d’explorer et d’interroger un corpus multilingue enrichi sémantiquement, composé de journaux et d’émissions de radio numérisés ;
- L’Impresso Datalab : un environnement informatique dédié à l’analyse basée sur les données, accompagné d’ensembles de données dérivés, de modèles de traitement du langage naturel (disponibles sur Hugging Face) et d’embeddings multimodaux permettant la recherche textuelle multilingue, la mise en relation image-texte et l’analyse sémantique à travers des collections d’archives hétérogènes ;
- Des supports de formation dédiés et des notebooks Jupyter d’études de cas pour accompagner les participants, quel que soit leur niveau technique ;
- Que vos sources soient en français, en allemand, en néerlandais ou dans une autre langue européenne, et que vous travailliez avec du texte, des images ou les deux, l’Impresso Datalab fournit des outils pour relier, annoter et interroger des collections historiques à grande échelle.
Présentation du programme
L’événement se déroule sur trois jours à la BnF :
Jour 1 (après-midi) : introduction à l’application web Impresso et à l’Impresso Datalab à travers des présentations et des démonstrations en direct ; constitution de groupes autour d’intérêts de recherche communs
Jours 2 et 3 : travaux de recherche pratiques, avec des sessions guidées sur les représentations et l’analyse basée sur les données, du temps consacré à des projets en équipe, ainsi qu’une séance de clôture comprenant des présentations de groupe et une réflexion collective
Les sessions sont conçues dans un esprit de flexibilité : les participants peuvent aborder des modules spécifiques en fonction de leur niveau d’expérience et de leur axe de recherche. Des « stands » dédiés aux échanges permettent d’engager une conversation directe et informelle avec les organisateurs à tout moment pendant l’événement.
À qui s’adresse cet événement ?
Ce datathon s’adresse tout particulièrement :
- aux historiens et chercheurs en sciences des médias travaillant sur des archives de presse numérisées
- aux chercheurs en humanités numériques intéressés par les méthodes computationnelles appliquées au patrimoine culturel
- aux spécialistes de l’information et les bibliothécaires explorant l’accès aux collections patrimoniales grâce à l’intelligence artificielle
- aux étudiants de niveau avancé et des chercheurs en début de carrière s’intéressant à l’analyse de données historiques
Une expérience préalable en programmation ou en analyse de données est un atout, mais n’est pas obligatoire. Des cahiers d’étude de cas prêts à l’emploi seront fournis afin de faciliter l’accès à l’événement, et l’équipe d’Impresso apportera un soutien pratique tout au long de la manifestation.
Détails pratiques
La participation est limitée à 15-30 personnes afin de garantir un environnement productif et propice aux discussions.
Lors de votre inscription, il vous sera demandé de décrire brièvement vos centres d’intérêt en matière de recherche. Ces réponses influenceront directement le programme de l’événement et le choix des études de cas ; nous vous encourageons donc à être précis.
👉 Inscrivez-vous ici : https://forms.gle/hQpNBrtMRVhKuMCp9
Nous nous réjouissons de vous accueillir à Paris pour ce qui, nous l’espérons, sera quelques journées productives et agréables.
Pour toute question, veuillez contacter info@impresso-project.ch
OpenEdition vous propose de citer ce billet de la manière suivante :
Bibliothèque nationale de France (7 juillet 2026). [appel à participation] Datathon Impresso@BnF : exploration des collections de médias historiques (du 28 au 30/10/26). Carnet de recherche. Consulté le 7 août 2026 à l’adresse https://doi.org/10.58079/16j3d
