Aller au contenu principal
2006 article

Encodings in Legacy Khmer TrueType Fonts

1Citations signalées, ce qui n’est pas une note de qualité
0Institutions déclarées
0Pays d’affiliation déclarés

Le résumé fourni par la source

Malgre l’utilisation croissante des normes ISO pour le codage de la plupart des ecritures indiennes dans les pays d’Asie du Sud et du Sud-Est, les codages bricoles sont encore utilises pour eviter l’implementation de systemes de mise en page complexes pour les ecritures indiennes. Puisque ces codages ne sont pas bien definis et ont ete developpes ad hoc, il est tres difficile de les detecter par des methodes deductives. Il arrive alors que l’on publie le texte le plus souvent en tant qu’image. En guise d’exemple caracteristique nous avons choisi l’ecriture cambodgienne. Nous avons examine les differentes fontes cambodgiennes diffusees gratuitement sur le Web, les codages qu’elles declarent utiliser et ceux qu’elles utilisent. Nous arrivons a la conclusion que les codages declares ne sont pas fiables. En nous basant sur les codages etudies nous proposons un algorithme heuristique de detection de codage cambodgien. Cet algorithme nous permet egalement de transcoder des documents codes dans ces codages avec une precision plus elevee que celle des methodes cognitives.

Ce résumé expose les affirmations des auteurs. BNTIC ne l’interprète pas comme une validation indépendante des résultats.

Le contrôle bibliographique ouvert

Aucun DOI disponible pour le contrôle Crossref.

Les sujets associés

Natural Language Processing TechniquesHandwritten Text Recognition TechniquesMachine Learning and Algorithms

BNTIC News n’est pas le producteur de ces données. Les publications sont interrogées à la demande dans Crossref, OpenAIRE, DOAJ, Europe PMC, HAL, DataCite, AfricArXiv, ROR et la Banque mondiale, sans clé d’accès. OpenAlex reste optionnel. Aucun service payant n’est nécessaire et aucune donnée externe n’est enregistrée en base. Consulter les sources et leurs limites.