Lexicon+TX: rapid construction of a multilingual lexicon with under-resourced languages.

Most efforts at automatically creating multilingual lexicons require input lexical resources with rich content (e.g. semantic networks, domain codes, semantic categories) or large corpora. Such material is often unavailable and difficult to construct for under-resourced languages. In some cases, par...

Descripción completa

Detalles Bibliográficos
Publicado en:Language Resources & Evaluation Vol. 48; no. 3; pp. 479 - 493
Autores principales: Lim, Lian, Soon, Lay-Ki, Lim, Tek, Tang, Enya, Ranaivo-Malançon, Bali
Formato: Artículo
Publicado: Springer Nature Sep2014
Materias:
Acceso en línea:Ver este registro en EBSCOhost
fields @attributes:
  recordID: 1
pdfLink:
plink: https://search.ebscohost.com/login.aspx?direct=true&db=hlh&AN=97523003&site=ehost-live
header:
  @attributes:
    shortDbName: hlh
    uiTerm: 97523003
    longDbName: Humanities International Complete
    uiTag: AN
  controlInfo:
    bkinfo:
    jinfo:
      jid:
        1574020X
        179V
      jtl: Language Resources & Evaluation
      issn: 1574020X
      maglogo: N
    pubinfo:
      dt: Sep2014
      vid: 48
      iid: 3
      pid: 237
      pub: Springer Nature
    artinfo:
      ui:
        97523003
        10.1007/s10579-013-9253-0
      ppf: 479
      ppct: 14
      formats:
        fmt:
          @attributes:
            type: P
            size: 448KB
      tig:
        atl: Lexicon+TX: rapid construction of a multilingual lexicon with under-resourced languages.
      aug:
        au:
          Lim, Lian
          Soon, Lay-Ki
          Lim, Tek
          Tang, Enya
          Ranaivo-Malançon, Bali
        affil:
          Faculty of Computing and Informatics, Multimedia University, Persiaran Multimedia, 63100 Cyberjaya, Selangor Malaysia
          Linton University College, Persiaran UTL, Bandar Universiti Teknologi Legenda, Batu 12 71700 Mantin, Negeri Sembilan Malaysia
          Faculty of Computer Science and Information Technology, Universiti Malaysia Sarawak, 94300 Kota Samarahan, Sarawak Malaysia
      su:
        Lexicon
        Multilingualism
        Iban language
        Malay language
        Computational linguistics
      sug:
        subj:
          Lexicon
          Multilingualism
          Iban language
          Malay language
          Computational linguistics
      keyword:
        Iban
        Malay
        Multilingual lexicon
        Under-resourced languages
      ab: Most efforts at automatically creating multilingual lexicons require input lexical resources with rich content (e.g. semantic networks, domain codes, semantic categories) or large corpora. Such material is often unavailable and difficult to construct for under-resourced languages. In some cases, particularly for some ethnic languages, even unannotated corpora are still in the process of collection. We show how multilingual lexicons with under-resourced languages can be constructed using simple bilingual translation lists, which are more readily available. The prototype multilingual lexicon developed comprise six member languages: English, Malay, Chinese, French, Thai and Iban, the last of which is an under-resourced language in Borneo. Quick evaluations showed that 91.2 % of 500 random multilingual entries in the generated lexicon require minimal or no human correction.
      pubtype: Academic Journal
      doctype: Article
      src: R
    language: English
    refInfo:
    copyright:
      @attributes:
        flag: Y
      custom: Language Resources & Evaluation is a copyright of Springer, 2014. All Rights Reserved.
      item: Language Resources & Evaluation
      holder: Springer Nature
      dt:
        @attributes:
          year: 2014
    holdings:
      @attributes:
        islocal: N