Aller au contenu principal
2024 conference-paper

Sonar Waveform Synthesis Based on Mel Generative Adversarial Networks with Self-Attention Mechanisms

0Citations signalées, ce qui n’est pas une note de qualité
1Institutions déclarées
1Pays d’affiliation déclarés

Rattachement africain : cn. Niveau de preuve : code pays fourni par la source.

Le résumé fourni par la source

Considering the complicated process of traditional sonar waveform synthesis method, in this study, we apply models from the speech domain to the underwater acoustic domain based on deep learning algorithms using a transfer learning approach. The core of this study lies in the development of a transfer learning framework based on the generative adversarial network (GAN) model, which effectively adapts to the special characteristics of sonar waveforms by fine-tuning the pretrained MelGAN model and the self-attention mechanism. Because sonar waveform cannot be accurately assessed by auditory assessments, we adopted Fréchet Audio Distance (FAD) as an objective audio assessment metric. Experiments based on the DeepShip dataset show that the proposed model effectively synthesizes a sonar waveform.

Ce résumé expose les affirmations des auteurs. BNTIC ne l’interprète pas comme une validation indépendante des résultats.

Le contrôle bibliographique ouvert

DOI retrouvé dans Crossref DOI retrouvé ; titre concordant.

Titre Crossref
Sonar Waveform Synthesis Based on Mel Generative Adversarial Networks with Self-Attention Mechanisms
Date Crossref
29/05/2024
Éditeur
IEEE
Type
proceedings-article

Ce recoupement confirme des métadonnées liées au DOI. Il ne confirme ni la méthode ni les conclusions de l’étude, et il ne compte pas comme une seconde source scientifique indépendante.

Où se fait cette recherche

  • Hangzhou Dianzi University HDU-ITMO Joint Institute pays non établi dans la notice
    Université ou école supérieure
  • College of Computer Science pays non établi dans la notice
    Université ou école supérieure

HDU-ITMO Joint Institute — Hangzhou Dianzi University et College of Computer Science.

Une affiliation ne permet pas de déduire la nationalité d’un auteur.

Les sujets associés

Underwater Acoustics ResearchSpeech and Audio ProcessingImage Processing and 3D Reconstruction

BNTIC News n’est pas le producteur de ces données. Les publications sont interrogées à la demande dans Crossref, OpenAIRE, DOAJ, Europe PMC, HAL, DataCite, AfricArXiv, ROR et la Banque mondiale, sans clé d’accès. OpenAlex reste optionnel. Aucun service payant n’est nécessaire et aucune donnée externe n’est enregistrée en base. Consulter les sources et leurs limites.