Ariane Pinche, postdoctorante à l’École chargée du projet CREMMALAB, Jean-Baptiste Camps, maître de conférences, et Frédéric Duval, professeur de philologie romane, organisent un colloque intitulé « Documents anciens et reconnaissance automatique des écritures manuscrites ».
Évènement terminé
Jeudi 23 juin 2022 - Vendredi 24 juin 2022
- 65, rue de Richelieu, Paris 2e (salle Delisle)
- 9h-18h
Nombre de projets incluent aujourd’hui une étape d’acquisition automatique du texte dans leur chaîne de production ou d’exploitation des données. Plusieurs plateformes de transcription et différents moteurs HTR sont maintenant disponibles. L’intégration de cette technologie dans des chaînes de traitement de plus en plus efficaces a entraîné une automatisation des tâches qui remet en question la place du chercheur dans le processus d’établissement du texte. Cette nouvelle pratique, gourmande en données, rend pressant le besoin de rassembler, et donc d’harmoniser les corpus nécessaires à la constitution de corpus d’entraînement, mais aussi leur mise à disposition pour améliorer la qualité des résultats de l’HTR.
Ce colloque est organisé dans le cadre du projet CREMMALAB soutenu par le DIM MAP, l’École nationale des chartes - PSL (Centre-Jean Mabillon), en partenariat avec le LAMOP et le LabEX Hastec.
Il mêlera questions philologiques et techniques pour faire un état des lieux scientifique de l’HTR pour les documents anciens. Il sera l’occasion de faire le point sur l’HTR et ses outils, ses résultats, ses apports et les nouvelles pratiques qu’induit son utilisation dans les projets d’édition et d’exploitation des documents.
Cet événement permettra de rassembler une communauté internationale de chercheurs, aujourd’hui grandissante, pour échanger autour de l’usage de l’HTR dans leurs projets scientifiques.
Enfin, ce colloque repose sur la volonté de traiter la thématique de l’HTR tout en l’articulant à des problématiques scientifiques de constitution et/ou d’exploitation des corpus. Nous souhaitons également questionner les aspects pratiques de l’utilisation de cette technologie (développement de moteur HTR, d’interface de transcription, d'interface utilisateurs pour utiliser et entrainer des modèles, etc.), tout en soulevant ses enjeux méthodologiques et son impact sur les données de la Recherche.
Comité scientifique : Jean-Baptiste Camps, Alix Chagué, Thibault Clérice, Frédéric Duval, Vincent Jolivet, Benjamin Kiessling, Nicolas Perreaux, Ariane Pinche, Laurent Romary, Peter Stokes