Hearing from Silence: Reasoning Audio Descriptions from Silent Videos via Vision-Language Model
0Citations signalées, ce qui n’est pas une note de qualité
0Institutions déclarées
0Pays d’affiliation déclarés
Résumé indisponible. Les résultats de l’étude ne doivent pas être déduits de son seul titre.
Le contrôle bibliographique ouvert
DOI retrouvé dans Crossref DOI retrouvé ; titre concordant.
- Titre Crossref
- Hearing from Silence: Reasoning Audio Descriptions from Silent Videos via Vision-Language Model
- Date Crossref
- 17/08/2025
- Éditeur
- ISCA
- Type
- proceedings-article
Ce recoupement confirme des métadonnées liées au DOI. Il ne confirme ni la méthode ni les conclusions de l’étude, et il ne compte pas comme une seconde source scientifique indépendante.
Les sujets associés
Subtitles and Audiovisual MediaMusic and Audio Processing