Aller au contenu principal
2025 article

A Machine Learning Approach of Text Classification for High‐ and Low‐Resource Languages

0Citations signalées, ce qui n’est pas une note de qualité
3Institutions déclarées
3Pays d’affiliation déclarés

Rattachement africain : tr, pk, sa. Niveau de preuve : code pays fourni par la source.

Le résumé fourni par la source

ABSTRACT A large amount of data have been published online in textual format for the last decade because of the advancement of information and communication technologies. This is an open challenge to organize and classify large amounts of textual data automatically, especially for a language that has limited resources available online. In this study, two types of approaches are adopted for experiments. First one is a traditional strategy that uses six (06) classical state‐of‐the‐art classification models (1. decision tree (DT), 2. logistic regression (LR), 3. support vector machine (SVM), 4. k‐nearest neighbour (k‐NN), 5. Naive Bayes (NB), and 6. random forest (RF)) along with two (02) ensemble methods (1. Adaboost and 2. gradient boosting (GB)) and second modeling technique is our proposed voting based ensembling scheme. Models are trained on a 75‐25 split where 75% of data is used for training and 25% for testing. The evaluation of the classification models is carried out based on accuracy, precision, recall, and F1‐score indexes. The experimental outcomes witnessed that for the traditional approach, gradient boosting outperformed for the limited resource language with 98.08% F1‐score, while SVM performed better (97.34% F1‐score) for the resource‐rich language.

Ce résumé expose les affirmations des auteurs. BNTIC ne l’interprète pas comme une validation indépendante des résultats.

Le contrôle bibliographique ouvert

DOI retrouvé dans Crossref DOI retrouvé ; titre concordant.

Titre Crossref
A Machine Learning Approach of Text Classification for High‐ and Low‐Resource Languages
Date Crossref
01/08/2025
Éditeur
Wiley
Type
journal-article

Ce recoupement confirme des métadonnées liées au DOI. Il ne confirme ni la méthode ni les conclusions de l’étude, et il ne compte pas comme une seconde source scientifique indépendante.

Les institutions déclarées

Une affiliation ne permet pas de déduire la nationalité d’un auteur.

Les sujets associés

Text and Document Classification TechnologiesTopic ModelingSpam and Phishing Detection

BNTIC News n’est pas le producteur de ces données. Les publications sont interrogées à la demande dans Crossref, OpenAIRE, DOAJ, Europe PMC, HAL, DataCite, AfricArXiv, ROR et la Banque mondiale, sans clé d’accès. OpenAlex reste optionnel. Aucun service payant n’est nécessaire et aucune donnée externe n’est enregistrée en base. Consulter les sources et leurs limites.