Aller au contenu principal
2025 conference-paper

Enhancing Cosine Similarity: A Unified Approach to Reduce Common Entity Bias in Sentence Similarity

0Citations signalées, ce qui n’est pas une note de qualité
2Institutions déclarées
1Pays d’affiliation déclarés

Rattachement africain : in. Niveau de preuve : code pays fourni par la source.

Le résumé fourni par la source

Cosine similarity is widely used for measuring semantic similarity between sentences by calculating the cosine of the angle between their embedding vectors. Despite its widespread application, it often miscalculates, overestimates similarity when common Named Entities (NER) are present among text corpus, as these entities inflate the score without adequately reflecting real intents of the sentence. In this paper, first, the existing statistical and AI based approaches were evaluated for measuring semantic similarity between text corpora. Since the results were not acceptable, an enhanced cosine similarity framework was proposed, which addresses these challenges by using weighted scoring mechanism applied on Named Entity Recognition (NER), sentence intent analysis. Dataset is curated from FAQs of various products and user queries of initial deployment of LLMs. Logistic regression was used to learn optimal weights for these components using annotated data. Experimental results demonstrate improvement from 65% to 85% classification accuracy with proposed method.

Ce résumé expose les affirmations des auteurs. BNTIC ne l’interprète pas comme une validation indépendante des résultats.

Le contrôle bibliographique ouvert

DOI retrouvé dans Crossref DOI retrouvé ; titre concordant.

Titre Crossref
Enhancing Cosine Similarity: A Unified Approach to Reduce Common Entity Bias in Sentence Similarity
Date Crossref
25/07/2025
Éditeur
IEEE
Type
proceedings-article

Ce recoupement confirme des métadonnées liées au DOI. Il ne confirme ni la méthode ni les conclusions de l’étude, et il ne compte pas comme une seconde source scientifique indépendante.

Les institutions déclarées

Une affiliation ne permet pas de déduire la nationalité d’un auteur.

Les sujets associés

Topic ModelingNatural Language Processing TechniquesSentiment Analysis and Opinion Mining

BNTIC News n’est pas le producteur de ces données. Les publications sont interrogées à la demande dans Crossref, OpenAIRE, DOAJ, Europe PMC, HAL, DataCite, AfricArXiv, ROR et la Banque mondiale, sans clé d’accès. OpenAlex reste optionnel. Aucun service payant n’est nécessaire et aucune donnée externe n’est enregistrée en base. Consulter les sources et leurs limites.