Measuring Idiomaticity in Text Embedding Models with epsilon-compositionality
Rattachement africain : no. Niveau de preuve : code pays fourni par la source.
Le résumé fourni par la source
The principle of compositionality, which concerns the construction of meaning from constituent parts, is a longstanding topic in various disciplines, most commonly associated with formal semantics.In NLP, recent studies have focused on the compositional properties of text embedding models, particularly regarding their sensitivity to idiomatic expression, as idioms have traditionally been seen as non-compositional.In this paper, we argue that it is unclear how previous work relates to formal definitions of the principle.To address this limitation, we take a theoretically motivated approach based on definitions in formal semantics.We present 𝜀-compositionality, a continuous relaxation of compositionality derived from these definitions.We measure 𝜀compositionality on a dataset containing both idiomatic and non-idiomatic sentences, providing a theoretically motivated assessment of sensitivity to idiomaticity.Our findings indicate that most text embedding models differentiate between idiomatic and non-idiomatic phrases, although to varying degrees.
Ce résumé expose les affirmations des auteurs. BNTIC ne l’interprète pas comme une validation indépendante des résultats.
Le contrôle bibliographique ouvert
DOI retrouvé dans Crossref DOI retrouvé ; titre concordant.
- Titre Crossref
- Measuring Idiomaticity in Text Embedding Models with epsilon-compositionality
- Date Crossref
- 01/01/2026
- Éditeur
- Association for Computational Linguistics
- Type
- proceedings-article
Ce recoupement confirme des métadonnées liées au DOI. Il ne confirme ni la méthode ni les conclusions de l’étude, et il ne compte pas comme une seconde source scientifique indépendante.
Les institutions déclarées
Une affiliation ne permet pas de déduire la nationalité d’un auteur.