A Survey of MWE Identification Experiments: The Devil is in the Details
Rattachement africain : fr, gb, ie. Niveau de preuve : code pays fourni par la source.
Le résumé fourni par la source
Multiword expression (MWE) identification has been the focus of numerous research papers, especially in the context of the DiMSUM and PARSEME Shared Tasks (STs).This survey analyses 40 MWE identification papers with experiments on data from these STs.We look at corpus selection, pre-and post-processing, MWE encoding, evaluation metrics, statistical significance, and error analyses.We find that these aspects are usually considered minor and/or omitted in the literature.However, they may considerably impact the results and the conclusions drawn from them.Therefore, we advocate for more systematic descriptions of experimental conditions to reduce the risk of misleading conclusions drawn from poorly designed experimental setup.
Ce résumé expose les affirmations des auteurs. BNTIC ne l’interprète pas comme une validation indépendante des résultats.
Le contrôle bibliographique ouvert
DOI retrouvé dans Crossref DOI retrouvé ; titre concordant.
- Titre Crossref
- A Survey of MWE Identification Experiments: The Devil is in the Details
- Date Crossref
- 01/01/2023
- Éditeur
- Association for Computational Linguistics
- Type
- proceedings-article
Ce recoupement confirme des métadonnées liées au DOI. Il ne confirme ni la méthode ni les conclusions de l’étude, et il ne compte pas comme une seconde source scientifique indépendante.
Les institutions déclarées
Une affiliation ne permet pas de déduire la nationalité d’un auteur.