Aller au contenu
BNTIC News Numérique · Innovation · Énergie
BNTIC ModelFinderAfrica · métadonnées ouvertes
Métadonnées publiques · Hugging Face Hub

nvidia/parakeet-tdt-0.6b-v3

nvidia/parakeet-tdt-0.6b-v3 : reconnaissance vocale, licence Creative Commons BY 4.0, 2,3 Gio de poids, 627 millions de paramètres. Mémoire nécessaire estimée

La source ne fournit pas de description structurée dans les métadonnées consultées.

Fiche factuelle

Propriétaire déclaré
nvidia
Tâche déclarée
Reconnaissance vocale automatic-speech-recognition
Langues déclarées
Anglais, es, Français, de, bg, hr, cs, da, nl, et, fi, el, hu, it, lv, lt, mt, pl, Portugais, ro, sk, sl, sv, ru, uk
Licence déclarée
Creative Commons BY 4.0
Qualification de licence
Licence ouverte avec conditions
Usage commercial
Possible d’après la licence déclarée, à confirmer dans son texte (vérification du texte intégral requise)
Accès public direct
Oui, d’après l’API
Format SafeTensors
Déclaré
Bibliothèque
transformers
Paramètres
627 millions de paramètres
Taille des poids connue
2,3 Gio
Fichiers référencés
12
Jeux de données déclarés
nvidia/Granary, nemo/asr-set-3.0
Résultats d’évaluation structurés
20 (comparables seulement à protocole identique)
Documentation structurée
Présente
Dernière mise à jour
2026-08-05T21:46:17.000Z
Téléchargements
601412 (indicateur de popularité uniquement)
Appréciations
1179 (indicateur de popularité uniquement)
Source
Hugging Face Hub
Dépôt de code explicitement lié
Non renseigné
Publication explicitement liée
Consulter la publication
Interrogé le
2026-10-08T19:45:50.737560+00:00

Évaluations déclarées

Ces valeurs sont reproduites depuis les métadonnées de la fiche. Ne comparez deux résultats que si la tâche, le jeu de données, sa version et le protocole sont identiques.
MétriqueValeur déclaréeTâcheJeu d’évaluation
Test WER11,31Automatic Speech RecognitionAMI (Meetings test)
Test WER11,42Automatic Speech RecognitionEarnings-22
Test WER9,59Automatic Speech RecognitionGigaSpeech
Test WER1,93Automatic Speech RecognitionLibriSpeech (clean)
Test WER3,59Automatic Speech RecognitionLibriSpeech (clean)
Test WER3,97automatic-speech-recognitionSPGI Speech
Test WER2,75automatic-speech-recognitiontedlium-v3
Test WER6,14Automatic Speech RecognitionVox Populi
Test WER (Bg)12,64automatic-speech-recognitionFLEURS
Test WER (Cs)11,01automatic-speech-recognitionFLEURS
Test WER (Da)18,41automatic-speech-recognitionFLEURS
Test WER (De)5,04automatic-speech-recognitionFLEURS
Test WER (El)20,7automatic-speech-recognitionFLEURS
Test WER (En)4,85automatic-speech-recognitionFLEURS
Test WER (Es)3,45automatic-speech-recognitionFLEURS
Test WER (Et)17,73automatic-speech-recognitionFLEURS
Test WER (Fi)13,21automatic-speech-recognitionFLEURS
Test WER (Fr)5,15automatic-speech-recognitionFLEURS
Test WER (Hr)12,46automatic-speech-recognitionFLEURS
Test WER (Hu)15,72automatic-speech-recognitionFLEURS

Fichiers déclarés par la source

NomFormatPrécision détectéeTaille
.eval_results/open_asr_leaderboard.yamlautreinconnue2,1 Kio
.gitattributesautreinconnue1,7 Kio
README.mdautreinconnue41,9 Kio
config.jsonautreinconnue1,1 Kio
generation_config.jsonautreinconnue289 octets
model.safetensorssafetensorsinconnue2,3 Gio
parakeet-tdt-0.6b-v3.nemoautreinconnue2,3 Gio
parakeet-tdt-0.6b-v3.q8_0.ggufgguf8-bit680,9 Mio
plots/asr.pngautreinconnue111,4 Kio
processor_config.jsonautreinconnue392 octets
tokenizer.jsonautreinconnue1,1 Mio
tokenizer_config.jsonautreinconnue290 octets