Aller au contenu principal
2023 conference-paper

Rekhta: An Open-Source High-Quality Urdu Text-to-Speech Synthesis Dataset

1Citations signalées, ce qui n’est pas une note de qualité
1Institutions déclarées
1Pays d’affiliation déclarés

Rattachement africain : pk. Niveau de preuve : code pays fourni par la source.

Le résumé fourni par la source

A dataset is one of the most pivotal components in creating and developing Deep Learning and Machine Learning models. It is fundamental to the idea of training, refining, and evaluating AI models, serving as a metric for evaluating the model's results. As an outcome of advancements in innovation, research, and AI analysis, datasets in numerous languages and formats have emerged on the internet. However, the expanse of internet resources appears to contract when confronted with Machine Learning and Deep Learning tasks in Urdu. The sheer availability of resources and authenticated datasets in the Urdu language, juxtaposed with a multitude of subpar, incomplete, and unverified datasets, significantly hinders the advancement of AI in the Urdu language. This paper documents the exploration and refinement of the Common Voice Urdu Corpus dataset version 12.0 to create a clean and refined dataset suitable for training Urdu Text-to-Speech models. This task has been accomplished through primary research, preliminary analysis, techniques such as fuzzy string matching through Levenshtein Distance, and meticulous comparison among various models.

Ce résumé expose les affirmations des auteurs. BNTIC ne l’interprète pas comme une validation indépendante des résultats.

Le contrôle bibliographique ouvert

DOI retrouvé dans Crossref DOI retrouvé ; titre concordant.

Titre Crossref
Rekhta: An Open-Source High-Quality Urdu Text-to-Speech Synthesis Dataset
Date Crossref
06/11/2023
Éditeur
IEEE
Type
proceedings-article

Ce recoupement confirme des métadonnées liées au DOI. Il ne confirme ni la méthode ni les conclusions de l’étude, et il ne compte pas comme une seconde source scientifique indépendante.

Les institutions déclarées

Une affiliation ne permet pas de déduire la nationalité d’un auteur.

Les sujets associés

Speech Recognition and SynthesisNatural Language Processing TechniquesTopic Modeling

BNTIC News n’est pas le producteur de ces données. Les publications sont interrogées à la demande dans Crossref, OpenAIRE, DOAJ, Europe PMC, HAL, DataCite, AfricArXiv, ROR et la Banque mondiale, sans clé d’accès. OpenAlex reste optionnel. Aucun service payant n’est nécessaire et aucune donnée externe n’est enregistrée en base. Consulter les sources et leurs limites.