Bitext Generation Through Rich Markup.

This paper reports on a method for exploiting a bitext as the primary linguistic information source for the design of a generation environment for specialized bilingual documentation. The paper discusses such issues as Text Encoding Initiative (TEI), proposals for specialized corpus tagging, text se...

Full description

Bibliographic Details
Published in:Computers & the Humanities Vol. 38; no. 3; pp. 223 - 252
Main Authors: Casillas, Arantza, Martínez, Raquel
Format: Article
Published: Springer Nature Aug2004
Subjects:
Online Access:View this record in EBSCOhost
fields @attributes:
  recordID: 1
pdfLink:
plink: https://search.ebscohost.com/login.aspx?direct=true&db=hlh&AN=15825060&site=ehost-live
header:
  @attributes:
    shortDbName: hlh
    uiTerm: 15825060
    longDbName: Humanities International Complete
    uiTag: AN
  controlInfo:
    bkinfo:
    jinfo:
      jid:
        00104817
        CHM
      jtl: Computers & the Humanities
      issn: 00104817
      maglogo: N
    pubinfo:
      dt: Aug2004
      vid: 38
      iid: 3
      pid: 237
      pub: Springer Nature
    artinfo:
      ui:
        15825060
        10.1007/s10579-004-0233-2
      ppf: 223
      ppct: 29
      formats:
        fmt:
          @attributes:
            type: P
            size: 1.1MB
      tig:
        atl: Bitext Generation Through Rich Markup.
      aug:
        au:
          Casillas, Arantza
          Martínez, Raquel
        affil:
          Departamento Electridad y Electrónica, Facultad de Ciencia y TecnologIa, UPV-EHU, Madrid, Spain.
          Departamento Informática, EstadIstica y Telemática, Universidad Rey Juan Car/os, Spain.
      su:
        Linguistic informants
        Bilingualism & literature
        Documentation
        Translating & interpreting
        Encoding
        Books
      sug:
        subj:
          Linguistic informants
          Bilingualism & literature
          Documentation
          Translating & interpreting
          Encoding
          Books
      keyword:
        alignment
        bilingual document generation
        bitext
        parallel corpus
        segmentation
        SGML
        TEI
        translation memories
      ab: This paper reports on a method for exploiting a bitext as the primary linguistic information source for the design of a generation environment for specialized bilingual documentation. The paper discusses such issues as Text Encoding Initiative (TEI), proposals for specialized corpus tagging, text segmentation and alignment of translation units and their allocation into translation memories, Document Type Definition (DTD), abstraction from tagged texts, and DTD deployment for bilingual text generation. The parallel corpus used for experimentation has two main features:
      pubtype: Academic Journal
      doctype: Article
      src: R
    language: English
    refInfo:
    copyright:
      @attributes:
        flag: Y
      custom: Computers & the Humanities is a copyright of Springer, 2004. All Rights Reserved.
      item: Computers & the Humanities
      holder: Springer Nature
      dt:
        @attributes:
          year: 2004
    holdings:
      @attributes:
        islocal: N