Document dissimilarity within and across languages: A benchmarking study.

Quantifying the similarity or dissimilarity between documents is an important task in authorship attribution, information retrieval, plagiarism detection, text mining, and many other areas of linguistic computing. Numerous similarity indices have been devised and used, but relatively little attentio...

Descripción completa

Detalles Bibliográficos
Publicado en:Literary & Linguistic Computing Vol. 29; no. 1; pp. 6 - 23
Autores principales: Forsyth, Richard S., Sharoff, Serge
Formato: Artículo
Publicado: Oxford University Press / USA Apr2014
Materias:
Acceso en línea:Ver este registro en EBSCOhost