Lexicon+TX: rapid construction of a multilingual lexicon with under-resourced languages.
Most efforts at automatically creating multilingual lexicons require input lexical resources with rich content (e.g. semantic networks, domain codes, semantic categories) or large corpora. Such material is often unavailable and difficult to construct for under-resourced languages. In some cases, par...
| Publicado en: | Language Resources & Evaluation Vol. 48; no. 3; pp. 479 - 493 |
|---|---|
| Autores principales: | , , , , |
| Formato: | Artículo |
| Publicado: |
Springer Nature
Sep2014
|
| Materias: | |
| Acceso en línea: | Ver este registro en EBSCOhost |
| fields | @attributes: recordID: 1 pdfLink: plink: https://search.ebscohost.com/login.aspx?direct=true&db=hlh&AN=97523003&site=ehost-live header: @attributes: shortDbName: hlh uiTerm: 97523003 longDbName: Humanities International Complete uiTag: AN controlInfo: bkinfo: jinfo: jid: 1574020X 179V jtl: Language Resources & Evaluation issn: 1574020X maglogo: N pubinfo: dt: Sep2014 vid: 48 iid: 3 pid: 237 pub: Springer Nature artinfo: ui: 97523003 10.1007/s10579-013-9253-0 ppf: 479 ppct: 14 formats: fmt: @attributes: type: P size: 448KB tig: atl: Lexicon+TX: rapid construction of a multilingual lexicon with under-resourced languages. aug: au: Lim, Lian Soon, Lay-Ki Lim, Tek Tang, Enya Ranaivo-Malançon, Bali affil: Faculty of Computing and Informatics, Multimedia University, Persiaran Multimedia, 63100 Cyberjaya, Selangor Malaysia Linton University College, Persiaran UTL, Bandar Universiti Teknologi Legenda, Batu 12 71700 Mantin, Negeri Sembilan Malaysia Faculty of Computer Science and Information Technology, Universiti Malaysia Sarawak, 94300 Kota Samarahan, Sarawak Malaysia su: Lexicon Multilingualism Iban language Malay language Computational linguistics sug: subj: Lexicon Multilingualism Iban language Malay language Computational linguistics keyword: Iban Malay Multilingual lexicon Under-resourced languages ab: Most efforts at automatically creating multilingual lexicons require input lexical resources with rich content (e.g. semantic networks, domain codes, semantic categories) or large corpora. Such material is often unavailable and difficult to construct for under-resourced languages. In some cases, particularly for some ethnic languages, even unannotated corpora are still in the process of collection. We show how multilingual lexicons with under-resourced languages can be constructed using simple bilingual translation lists, which are more readily available. The prototype multilingual lexicon developed comprise six member languages: English, Malay, Chinese, French, Thai and Iban, the last of which is an under-resourced language in Borneo. Quick evaluations showed that 91.2 % of 500 random multilingual entries in the generated lexicon require minimal or no human correction. pubtype: Academic Journal doctype: Article src: R language: English refInfo: copyright: @attributes: flag: Y custom: Language Resources & Evaluation is a copyright of Springer, 2014. All Rights Reserved. item: Language Resources & Evaluation holder: Springer Nature dt: @attributes: year: 2014 holdings: @attributes: islocal: N |
|---|