nvidia/parakeet-tdt-0.6b-v3
nvidia/parakeet-tdt-0.6b-v3 : reconnaissance vocale, licence Creative Commons BY 4.0, 2,3 Gio de poids, 627 millions de paramètres. Mémoire nécessaire estimée
La source ne fournit pas de description structurée dans les métadonnées consultées.
Fiche factuelle
- Propriétaire déclaré
- nvidia
- Tâche déclarée
- Reconnaissance vocale
automatic-speech-recognition - Langues déclarées
- Anglais, es, Français, de, bg, hr, cs, da, nl, et, fi, el, hu, it, lv, lt, mt, pl, Portugais, ro, sk, sl, sv, ru, uk
- Licence déclarée
- Creative Commons BY 4.0
- Qualification de licence
- Licence ouverte avec conditions
- Usage commercial
- Possible d’après la licence déclarée, à confirmer dans son texte (vérification du texte intégral requise)
- Accès public direct
- Oui, d’après l’API
- Format SafeTensors
- Déclaré
- Bibliothèque
- transformers
- Paramètres
- 627 millions de paramètres
- Taille des poids connue
- 2,3 Gio
- Fichiers référencés
- 12
- Jeux de données déclarés
- nvidia/Granary, nemo/asr-set-3.0
- Résultats d’évaluation structurés
- 20 (comparables seulement à protocole identique)
- Documentation structurée
- Présente
- Dernière mise à jour
- 2026-08-05T21:46:17.000Z
- Téléchargements
- 601412 (indicateur de popularité uniquement)
- Appréciations
- 1179 (indicateur de popularité uniquement)
- Source
- Hugging Face Hub
- Dépôt de code explicitement lié
- Non renseigné
- Publication explicitement liée
- Consulter la publication
- Interrogé le
- 2026-10-08T19:45:50.737560+00:00
Évaluations déclarées
Ces valeurs sont reproduites depuis les métadonnées de la fiche. Ne comparez deux résultats que si la tâche, le jeu de données, sa version et le protocole sont identiques.
| Métrique | Valeur déclarée | Tâche | Jeu d’évaluation |
|---|---|---|---|
| Test WER | 11,31 | Automatic Speech Recognition | AMI (Meetings test) |
| Test WER | 11,42 | Automatic Speech Recognition | Earnings-22 |
| Test WER | 9,59 | Automatic Speech Recognition | GigaSpeech |
| Test WER | 1,93 | Automatic Speech Recognition | LibriSpeech (clean) |
| Test WER | 3,59 | Automatic Speech Recognition | LibriSpeech (clean) |
| Test WER | 3,97 | automatic-speech-recognition | SPGI Speech |
| Test WER | 2,75 | automatic-speech-recognition | tedlium-v3 |
| Test WER | 6,14 | Automatic Speech Recognition | Vox Populi |
| Test WER (Bg) | 12,64 | automatic-speech-recognition | FLEURS |
| Test WER (Cs) | 11,01 | automatic-speech-recognition | FLEURS |
| Test WER (Da) | 18,41 | automatic-speech-recognition | FLEURS |
| Test WER (De) | 5,04 | automatic-speech-recognition | FLEURS |
| Test WER (El) | 20,7 | automatic-speech-recognition | FLEURS |
| Test WER (En) | 4,85 | automatic-speech-recognition | FLEURS |
| Test WER (Es) | 3,45 | automatic-speech-recognition | FLEURS |
| Test WER (Et) | 17,73 | automatic-speech-recognition | FLEURS |
| Test WER (Fi) | 13,21 | automatic-speech-recognition | FLEURS |
| Test WER (Fr) | 5,15 | automatic-speech-recognition | FLEURS |
| Test WER (Hr) | 12,46 | automatic-speech-recognition | FLEURS |
| Test WER (Hu) | 15,72 | automatic-speech-recognition | FLEURS |
Fichiers déclarés par la source
| Nom | Format | Précision détectée | Taille |
|---|---|---|---|
| .eval_results/open_asr_leaderboard.yaml | autre | inconnue | 2,1 Kio |
| .gitattributes | autre | inconnue | 1,7 Kio |
| README.md | autre | inconnue | 41,9 Kio |
| config.json | autre | inconnue | 1,1 Kio |
| generation_config.json | autre | inconnue | 289 octets |
| model.safetensors | safetensors | inconnue | 2,3 Gio |
| parakeet-tdt-0.6b-v3.nemo | autre | inconnue | 2,3 Gio |
| parakeet-tdt-0.6b-v3.q8_0.gguf | gguf | 8-bit | 680,9 Mio |
| plots/asr.png | autre | inconnue | 111,4 Kio |
| processor_config.json | autre | inconnue | 392 octets |
| tokenizer.json | autre | inconnue | 1,1 Mio |
| tokenizer_config.json | autre | inconnue | 290 octets |