Aller au contenu principal
2025 conference-paper

Symplex: Learning Social Norm Hierarchies by Combining Autonomous Exploration and Expert Imitation

0Citations signalées, ce qui n’est pas une note de qualité
1Institutions déclarées
1Pays d’affiliation déclarés

Rattachement africain : gb. Niveau de preuve : code pays fourni par la source.

Le résumé fourni par la source

In this paper, we introduce SYMPLEX (Symbolic Policy Learning from Experts/Exploration), an interactive framework that learns complex hierarchies of behavioral norms as interpretable logical constraints through a combination of autonomous exploration and expert imitation. The approach ensures that learned constraints are interpretable for human oversight, generalizable for transfer to similar environments, and defeasible - enabling adaptation to novel behaviors and facilitating the learning of exceptions in dynamic domains. We demonstrate the utility of our approach in a traffic simulation environment using a neuro-symbolic implementation of SYMPLEX that interleaves a Deep Q-Learning (DQL) component for policy optimization through goal-directed domain exploration, with interactive Inductive Logic Programming (ILP) for example-based symbolic constraint generation. At each iteration, inferred constraints are imposed on the DQL via penalty terms appended to the reward function, allowing the system to form exceptions to previously-learned constraints. We illustrate SYMPLEX's ability to identify concise human-readable constraints in complex environments, and evidence the efficacy of learning norms as defeasible constraints. Additionally, we exemplify the benefits of using an interactive rule induction system in expediting convergence to accurate norms.

Ce résumé expose les affirmations des auteurs. BNTIC ne l’interprète pas comme une validation indépendante des résultats.

Le contrôle bibliographique ouvert

DOI retrouvé dans Crossref DOI retrouvé ; titre concordant.

Titre Crossref
Symplex: Learning Social Norm Hierarchies by Combining Autonomous Exploration and Expert Imitation
Date Crossref
28/05/2025
Éditeur
IEEE Computer Society
Type
proceedings-article

Ce recoupement confirme des métadonnées liées au DOI. Il ne confirme ni la méthode ni les conclusions de l’étude, et il ne compte pas comme une seconde source scientifique indépendante.

Où se fait cette recherche

  • University of Bristol pays non établi dans la notice
    Université ou école supérieure

University of Bristol.

Une affiliation ne permet pas de déduire la nationalité d’un auteur.

Les sujets associés

Logic, Reasoning, and KnowledgeMulti-Agent Systems and NegotiationReinforcement Learning in Robotics

BNTIC News n’est pas le producteur de ces données. Les publications sont interrogées à la demande dans Crossref, OpenAIRE, DOAJ, Europe PMC, HAL, DataCite, AfricArXiv, ROR et la Banque mondiale, sans clé d’accès. OpenAlex reste optionnel. Aucun service payant n’est nécessaire et aucune donnée externe n’est enregistrée en base. Consulter les sources et leurs limites.