La reconnaissance des entités nommées dans les bases numériques de chartes médiévales en latin : le cas du Corpus Burgundiae Medii Aevi (X-XIII siècle).

The availability of a vast amount of digitized medieval manuscripts requires to import effective methods for large-scale exploitation. But this work can only be done in structured databases where the textual properties are explicit and formalized. This type of handmade structuring is highly time-con...

Descripción completa

Detalles Bibliográficos
Publicado en:Médiévales Vol. 73; pp. 47 - 66
Autor principal: Aguilar, Sergio Torres
Formato: Artículo
Publicado: Presses Universitaires de Vincennes automne2017
Acceso en línea:Ver este registro en EBSCOhost
fields @attributes:
  recordID: 1
pdfLink:
plink: https://search.ebscohost.com/login.aspx?direct=true&db=hlh&AN=127531332&site=ehost-live
header:
  @attributes:
    shortDbName: hlh
    uiTerm: 127531332
    longDbName: Humanities International Complete
    uiTag: AN
  controlInfo:
    bkinfo:
    jinfo:
      jid:
        07512708
        KFB
      jtl: Médiévales
      issn: 07512708
      maglogo: N
    pubinfo:
      dt: automne2017
      vid: 73
      pid: 14283
      pub: Presses Universitaires de Vincennes
    artinfo:
      ui:
        127531332
        10.4000/medievales.8182
      ppf: 47
      ppct: 19
      formats:
        fmt:
          @attributes:
            type: P
            size: 5.9MB
      tig:
        atl: La reconnaissance des entités nommées dans les bases numériques de chartes médiévales en latin : le cas du Corpus Burgundiae Medii Aevi (X-XIII siècle).
      aug:
        au: Aguilar, Sergio Torres
        affil: DYPAC, Université de Versailles Saint-Quentin (Paris-Saclay)
      sug:
      keyword:
        Charters
        Digital Bases
        Digital Humanities
        Named Entities Recognition
        Bases de données
        Charters
        chartes
        Corpus Burgundiae Medii Aevi
        Digital Bases
        Digital Humanities
        humanités numériques
        latin
        Named Entities Recognition
        reconnaissance des entités nommées
      ab:
        The availability of a vast amount of digitized medieval manuscripts requires to import effective methods for large-scale exploitation. But this work can only be done in structured databases where the textual properties are explicit and formalized. This type of handmade structuring is highly time-consuming, which has led to the search for ways to it. We present an example of this: the creation of a named entities recognition model, which are a primary structuring agent, since it corresponds to all the subjects and objects adopting specific names. We detail the creation and implementation of the model formed from Burgundian charters (Corpus Burgundiae Medii Aevi), produced from the tenth to the thirteenth centuries; also, we describe various validation experiments in order to test its robustness on a wide range of sources and at the same time we submit all the results to a discussion that shows the various benefits and challenges of this type of technique on a medieval manuscripts' corpus.
        La disponibilité d'une quantité phénoménale de manuscrits médiévaux numérisés nous oblige à chercher des méthodes efficaces pour en réaliser une exploitation à grande échelle. Mais ce travail ne peut être réalisé que dans des bases de données structurées où les propriétés textuelles ont été explicitées et formalisées. Une telle structuration, lorsqu'elle est effectuée à la main, est coûteuse en termes de temps et d'effort, ce qui a conduit à chercher des manières de l'automatiser. Nous en présentons ici un exemple : la création d'un modèle de reconnaissance des entités nommées, qui sont un agent structurant primaire, puisque y sont identifiés tous les sujets et objets qui adoptent des noms spécifiques. Nous détaillons la création et la mise en oeuvre du modèle créé à partir des chartes de Bourgogne (Corpus Burgundiae Medii Aevi), produites entre le X et le XIII siècle ainsi que diverses expériences de validation pour en tester la robustesse sur un large éventail de sources, tout en soumettant les résultats à une discussion qui tente d'exposer les divers avantages et défis qu'offre un corpus de manuscrits médiévaux pour ce type de technique.
      pubtype: Academic Journal
      doctype: Article
      src: R
    language: French
    refInfo:
    copyright:
      @attributes:
        flag: Y
      custom: Copyright of Médiévales is the property of Presses Universitaires de Vincennes and its content may not be copied or emailed to multiple sites without the copyright holder's express written permission. Additionally, content may not be used with any artificial intelligence tools or machine learning technologies. However, users may print, download, or email articles for individual use.
      item: Médiévales
      holder: Presses Universitaires de Vincennes
      dt:
        @attributes:
          year: 2017
    holdings:
      @attributes:
        islocal: N