Aller au contenu principal
Accès ouvert déclaré 2023 conference-paper

TermoUD - a language-independent terminology extraction tool

1Citations signalées, ce qui n’est pas une note de qualité
2Institutions déclarées
1Pays d’affiliation déclarés

Rattachement africain : pl. Niveau de preuve : code pays fourni par la source.

Le résumé fourni par la source

The paper addresses TermoUD -a languageindependent terminology extraction tool.Its previous version, i.e.TermoPL (Marciniak et al., 2016;Rychlik et al., 2022), uses language dependent shallow grammar which selects candidate terms.The goal behind the development of TermoUD is to make the procedure as universal as possible, while taking care of the linguistic correctness of selected phrases.The tool is suitable for languages for which the Universal Dependencies (UD) parser exists.We describe a method of candidate term extraction based on UD POS tags and UD relations.The candidate ranking is performed by the C-value metric (contexts counting is adapted to the UD formalism), which doesn't need any additional language resources.The performance of the tool has been tested on texts in English, French, Dutch, and Slovenian.The results are evaluated on the manually annotated datasets: ACTER, RD-TEC 2.0, GENIA and RSDO5, and compared to those obtained by other tools.

Ce résumé expose les affirmations des auteurs. BNTIC ne l’interprète pas comme une validation indépendante des résultats.

Le contrôle bibliographique ouvert

DOI retrouvé dans Crossref DOI retrouvé ; titre concordant.

Titre Crossref
TermoUD - a language-independent terminology extraction tool
Date Crossref
01/01/2023
Éditeur
Association for Computational Linguistics
Type
proceedings-article

Ce recoupement confirme des métadonnées liées au DOI. Il ne confirme ni la méthode ni les conclusions de l’étude, et il ne compte pas comme une seconde source scientifique indépendante.

Où se fait cette recherche

  • Institute of Computer Science pays non établi dans la notice
    Structure de recherche
  • Polish Academy of Sciences pays non établi dans la notice
    Organisme public

Institute of Computer Science et Polish Academy of Sciences.

Une affiliation ne permet pas de déduire la nationalité d’un auteur.

Les sujets associés

Advanced Text Analysis TechniquesNatural Language Processing TechniquesBiomedical Text Mining and Ontologies

BNTIC News n’est pas le producteur de ces données. Les publications sont interrogées à la demande dans Crossref, OpenAIRE, DOAJ, Europe PMC, HAL, DataCite, AfricArXiv, ROR et la Banque mondiale, sans clé d’accès. OpenAlex reste optionnel. Aucun service payant n’est nécessaire et aucune donnée externe n’est enregistrée en base. Consulter les sources et leurs limites.