Aller au contenu principal
2025 conference-paper

A Communication Approach for Cooperation of Multi-Agent Reinforcement Learning Based on Value Decomposition

0Citations signalées, ce qui n’est pas une note de qualité
1Institutions déclarées
1Pays d’affiliation déclarés

Rattachement africain : cn. Niveau de preuve : code pays fourni par la source.

Le résumé fourni par la source

In cooperative multi-agent reinforcement learning, communication can improve coordination between agents and form effective cooperative strategies. However, the additional communication structure increases the learning cost for agents and brings challenges for many value decomposition methods. Excessive message transfer also leads to significant communication overhead, hindering its practicality in many real-world environments. In this paper, a value decomposition-based multi-agent communication method is proposed. Agents will consider the state of teammates when making decisions, decide the content of communication messages and the communication target according to the attention level. This method satisfies the Individual-Global-Max condition and evaluates the influence of communication messages on teammates' decision-making to quantify their contribution to the team reward, thereby achieving an efficient and reasonable value decomposition. To minimize communication overhead, agents decide whether to communicate with the target based on their level of attention to teammates and cut off low attention communication connections during the execution phase. The empirical results show that this framework helps to promote cooperation between agents while reducing a certain amount of communication overhead without sacrificing too much performance.

Ce résumé expose les affirmations des auteurs. BNTIC ne l’interprète pas comme une validation indépendante des résultats.

Le contrôle bibliographique ouvert

DOI retrouvé dans Crossref DOI retrouvé ; titre concordant.

Titre Crossref
A Communication Approach for Cooperation of Multi-Agent Reinforcement Learning Based on Value Decomposition
Date Crossref
28/07/2025
Éditeur
IEEE
Type
proceedings-article

Ce recoupement confirme des métadonnées liées au DOI. Il ne confirme ni la méthode ni les conclusions de l’étude, et il ne compte pas comme une seconde source scientifique indépendante.

Les institutions déclarées

Une affiliation ne permet pas de déduire la nationalité d’un auteur.

Les sujets associés

Advanced Research in Systems and Signal Processing

BNTIC News n’est pas le producteur de ces données. Les publications sont interrogées à la demande dans Crossref, OpenAIRE, DOAJ, Europe PMC, HAL, DataCite, AfricArXiv, ROR et la Banque mondiale, sans clé d’accès. OpenAlex reste optionnel. Aucun service payant n’est nécessaire et aucune donnée externe n’est enregistrée en base. Consulter les sources et leurs limites.