ABMAMBA: Multimodal Large Language Model with Aligned Hierarchical Bidirectional Scan for Efficient Video Captioning
Rattachement africain : jp. Niveau de preuve : code pays fourni par la source.
Le contrôle bibliographique ouvert
DOI retrouvé dans Crossref DOI retrouvé ; titre concordant.
- Titre Crossref
- ABMAMBA: Multimodal Large Language Model with Aligned Hierarchical Bidirectional Scan for Efficient Video Captioning
- Date Crossref
- 04/08/2026
- Éditeur
- Springer Nature Switzerland
- Type
- book-chapter
Ce recoupement confirme des métadonnées liées au DOI. Il ne confirme ni la méthode ni les conclusions de l’étude, et il ne compte pas comme une seconde source scientifique indépendante.
Où se fait cette recherche
-
National Institute of Informatics pays non établi dans la noticeStructure de recherche
-
Keio University pays non établi dans la noticeUniversité ou école supérieure
National Institute of Informatics et Keio University.
Une affiliation ne permet pas de déduire la nationalité d’un auteur.