Accès ouvert déclaré
2026
dataset
The MultiplEYE Text Corpus Data and Materials
Ramunė Kasperẹ, Anna Bondar, Sergiu Nisioi, Maja Stegenwallner-Schütz, Hanne B. Søndergaard Knudsen, Ana Matić, Eva Pavlinušić Vilus, Dorota Klimek-Jankowska, Chiara Tschirner, Not Battesta Soliva, Deborah N. Jakobi, Cui Ding, Dima Abu Romi, Cengiz Acarturk, Matilda Agdler, Anton Marius Alexandru, Mohd Faizan Ansari, Annalisa Arcidiacono, Somayeh Bakhtiari, Elizabete Ausma Velta Barisa, Ana Bautista, Lisa Beinborn, Yevgeni Berzak, Nedeljka Bjelanović, Anna Isabelle Bothmann, Jan Brasser, Caterina Cacioli, Anila Çepani, Ilze Ceple, Adelina Çerpja, Dalí Chirino, Jan Chromý, Alessandro Corona Mendozza, Iria de-Dios-Flores, Nazik Dinçtopal Deniz, Ana Došen, Kristian Elersič, Inmaculada Fajardo, Zigmunds Freibergs, Angelina Ganebnaya, Shan Gao, Jéssica Gomes, Annjo Klungervik Greenall, Alba Haveriku, Miao He, Anamaria Hodivoianu, Yu-Yin Hsu, Amanda Isaksen, Andreia Janeiro, Kristine Jensen de López, Aleksandar Jevremovic, Vojislav Jovanović, Hanna Kędzierska, Nik Kharlamov, Sara Košutar, Nelda Kote, Vanja Ković, Izabela Krejtz, Thyra Krosness, Oleksandra Kuvshynova, Eilam Lavy, Ella Lion, Marta Łockiewicz, Kaidi Lõo, Paula Luegi, Mircea Mihai Marin, Clara Martin, Svitlana Matvieieva, Diane C. Mézière, Xavier Mínguez-López, Valeriia Modina, Jurgita Motiejūnienė, Marie-Luise Müller, Tolgonai Nasipbek Kyzy, Jamal Abdul Nasir, Johanne Nedergaard, Ayşegül Özkan, Patrizia Paggio, Marijan Palmović, Maria Panagiotopoulou, Alberto Parola, Helena Pérez, Klaudia Petersen, Anja Podlešek, Eva Pospíšilová, Marta Praulina, Mikuláš Preininger, Loredana Pungă, Diego Rossini, Špela Rot, Habib Sani Yahaya, Irina A. Sekerina, Anne Gabija Skadina, Jordi Solé-Casals, Lonneke van der Plas, Saara M. Varjopuro, Spyridoula Varlokosta, João Veríssimo, Oskari Juhapekka Virtanen, Nemanja Vračar, Mila Vulchanova, Ahmad Mustapha Wali, Peizheng Wu, Nilgün Yücel, Stefan Frank, Nora Hollenstein, Lena A. Jäger
0Citations signalées, ce qui n’est pas une note de qualité
0Institutions déclarées
0Pays d’affiliation déclarés
Le résumé fourni par la source
This repository contains data and materials for the 39 language versions of the MultiplEYE Text Corpus, as described in Kasperė, R., Bondar, A., Nisioi, S., Stegenwallner-Schütz, M., Knudsen, H. B. S., Matić, A., Vilus, E. P., Klimek-Jankowska, D., Tschirner, C., Soliva, N. B., Jakobi, D. N., Ding, C., Romi, D. A., Acarturk, C., Agdler, M., Alexandru, A. M., Ansari, M. F., Arcidiacono, A., Barisa, E. A. V., ... Jäger, L. (2026). The MultiplEYE Text Corpus: Towards a Diverse and Ever-Expanding Multilingual Text Corpus. In Proceedings of the Fifteenth Language Resources and Evaluation Conference (LREC 2026) (pp. 6706–6721). European Language Resources Association (ELRA). https://doi.org/10.63317/42gkpf6a6x2x. For each language version, the repository includes three file types: (1) a stimuli-experiment file containing the paginated stimulus texts, (2) a metadata file containing bibliographic and provenance information for each text, and (3) token-level linguistic annotation files. In addition, the repository provides (4) a pagination correspondence table documenting the alignment between each language version's pagination and the English reference pagination, and (5) a language coordinator list identifying the individuals coordinating the compilation of texts for each language version of the MultiplEYE Text Corpus.
Ce résumé expose les affirmations des auteurs. BNTIC ne l’interprète pas comme une validation indépendante des résultats.
Le contrôle bibliographique ouvert
La source scientifique ouverte est momentanément indisponible.
Les sujets associés
Natural Language Processing TechniquesAuthorship Attribution and ProfilingLinguistic research and analysis