Value Internalization: Learning and Generalizing from Social Reward
Fuente:
arXiv
Saved in:
| Main Authors: | Rong, Frieda, Kleiman-Weiner, Max |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Evaluating LLMs in Open-Source Games
by: Sistla, Swadesh, et al.
Published: (2025)
by: Sistla, Swadesh, et al.
Published: (2025)
Cross-environment Cooperation Enables Zero-shot Multi-agent Coordination
by: Jha, Kunal, et al.
Published: (2025)
by: Jha, Kunal, et al.
Published: (2025)
When Empowerment Disempowers
by: Yang, Claire, et al.
Published: (2025)
by: Yang, Claire, et al.
Published: (2025)
Improve Value Estimation of Q Function and Reshape Reward with Monte Carlo Tree Search
by: Li, Jiamian
Published: (2024)
by: Li, Jiamian
Published: (2024)
Learning Individual Intrinsic Reward in Multi-Agent Reinforcement Learning via Incorporating Generalized Human Expertise
by: Wu, Xuefei, et al.
Published: (2025)
by: Wu, Xuefei, et al.
Published: (2025)
When Is Diversity Rewarded in Cooperative Multi-Agent Learning?
by: Amir, Michael, et al.
Published: (2025)
by: Amir, Michael, et al.
Published: (2025)
Multi-Agent Reinforcement Learning with a Hierarchy of Reward Machines
by: Zheng, Xuejing, et al.
Published: (2024)
by: Zheng, Xuejing, et al.
Published: (2024)
Reward-Independent Messaging for Decentralized Multi-Agent Reinforcement Learning
by: Yoshida, Naoto, et al.
Published: (2025)
by: Yoshida, Naoto, et al.
Published: (2025)
Value-Based Rationales Improve Social Experience: A Multiagent Simulation Study
by: Tzeng, Sz-Ting, et al.
Published: (2024)
by: Tzeng, Sz-Ting, et al.
Published: (2024)
Achieving Optimal Tissue Repair Through MARL with Reward Shaping and Curriculum Learning
by: Khan, Muhammad Al-Zafar, et al.
Published: (2025)
by: Khan, Muhammad Al-Zafar, et al.
Published: (2025)
Mathematical Framework for Custom Reward Functions in Job Application Evaluation using Reinforcement Learning
by: Jain, Shreyansh, et al.
Published: (2025)
by: Jain, Shreyansh, et al.
Published: (2025)
LERO: LLM-driven Evolutionary framework with Hybrid Rewards and Enhanced Observation for Multi-Agent Reinforcement Learning
by: Wei, Yuan, et al.
Published: (2025)
by: Wei, Yuan, et al.
Published: (2025)
Large Language Model-Based Reward Design for Deep Reinforcement Learning-Driven Autonomous Cyber Defense
by: Mukherjee, Sayak, et al.
Published: (2025)
by: Mukherjee, Sayak, et al.
Published: (2025)
RiskQ: Risk-sensitive Multi-Agent Reinforcement Learning Value Factorization
by: Shen, Siqi, et al.
Published: (2023)
by: Shen, Siqi, et al.
Published: (2023)
Distributed Multi-Agent Reinforcement Learning Based on Graph-Induced Local Value Functions
by: Jing, Gangshan, et al.
Published: (2022)
by: Jing, Gangshan, et al.
Published: (2022)
SrSv: Integrating Sequential Rollouts with Sequential Value Estimation for Multi-agent Reinforcement Learning
by: Wan, Xu, et al.
Published: (2025)
by: Wan, Xu, et al.
Published: (2025)
Dynamic Sight Range Selection in Multi-Agent Reinforcement Learning
by: Liao, Wei-Chen, et al.
Published: (2025)
by: Liao, Wei-Chen, et al.
Published: (2025)
Balancing Act: Prioritization Strategies for LLM-Designed Restless Bandit Rewards
by: Verma, Shresth, et al.
Published: (2024)
by: Verma, Shresth, et al.
Published: (2024)
Incorporating Human Flexibility through Reward Preferences in Human-AI Teaming
by: Bhambri, Siddhant, et al.
Published: (2023)
by: Bhambri, Siddhant, et al.
Published: (2023)
Redistributing Rewards Across Time and Agents for Multi-Agent Reinforcement Learning
by: Kapoor, Aditya, et al.
Published: (2025)
by: Kapoor, Aditya, et al.
Published: (2025)
Learning to Cooperate with Humans using Generative Agents
by: Liang, Yancheng, et al.
Published: (2024)
by: Liang, Yancheng, et al.
Published: (2024)
VDFD: Multi-Agent Value Decomposition Framework with Disentangled World Model
by: Wang, Zhizun, et al.
Published: (2023)
by: Wang, Zhizun, et al.
Published: (2023)
Meritocratic Fairness in Budgeted Combinatorial Multi-armed Bandits via Shapley Values
by: Sharma, Shradha, et al.
Published: (2026)
by: Sharma, Shradha, et al.
Published: (2026)
PMAT: Optimizing Action Generation Order in Multi-Agent Reinforcement Learning
by: Hu, Kun, et al.
Published: (2025)
by: Hu, Kun, et al.
Published: (2025)
Innate-Values-driven Reinforcement Learning based Cooperative Multi-Agent Cognitive Modeling
by: Yang, Qin
Published: (2024)
by: Yang, Qin
Published: (2024)
Signaling and Social Learning in Swarms of Robots
by: Cazenille, Leo, et al.
Published: (2024)
by: Cazenille, Leo, et al.
Published: (2024)
SocialGrid: A Benchmark for Planning and Social Reasoning in Embodied Multi-Agent Systems
by: Shindo, Hikaru, et al.
Published: (2026)
by: Shindo, Hikaru, et al.
Published: (2026)
Beyond Shallow Behavior: Task-Efficient Value-Based Multi-Task Offline MARL via Skill Discovery
by: Wang, Xun, et al.
Published: (2025)
by: Wang, Xun, et al.
Published: (2025)
Assigning Credit with Partial Reward Decoupling in Multi-Agent Proximal Policy Optimization
by: Kapoor, Aditya, et al.
Published: (2024)
by: Kapoor, Aditya, et al.
Published: (2024)
Peer Learning: Learning Complex Policies in Groups from Scratch via Action Recommendations
by: Derstroff, Cedric, et al.
Published: (2023)
by: Derstroff, Cedric, et al.
Published: (2023)
Hierarchical Imitation Learning of Team Behavior from Heterogeneous Demonstrations
by: Seo, Sangwon, et al.
Published: (2025)
by: Seo, Sangwon, et al.
Published: (2025)
Discrete Diffusion for Complex and Congested Multi-Agent Path Finding with Sparse Social Attention
by: Wang, Yuanzhe, et al.
Published: (2026)
by: Wang, Yuanzhe, et al.
Published: (2026)
Learning the Preferences of a Learning Agent
by: Sadek, Karim Abdel, et al.
Published: (2026)
by: Sadek, Karim Abdel, et al.
Published: (2026)
Multi-Agent Deep Q-Network with Layer-based Communication Channel for Autonomous Internal Logistics Vehicle Scheduling in Smart Manufacturing
by: Feizabadi, Mohammad, et al.
Published: (2024)
by: Feizabadi, Mohammad, et al.
Published: (2024)
Scaling Clinician-Grade Feature Generation from Clinical Notes with Multi-Agent Language Models
by: Wang, Jiayi, et al.
Published: (2025)
by: Wang, Jiayi, et al.
Published: (2025)
Learning Strategy Representation for Imitation Learning in Multi-Agent Games
by: Lei, Shiqi, et al.
Published: (2024)
by: Lei, Shiqi, et al.
Published: (2024)
Representation Learning For Efficient Deep Multi-Agent Reinforcement Learning
by: Huh, Dom, et al.
Published: (2024)
by: Huh, Dom, et al.
Published: (2024)
Learning Generalizable Skills from Offline Multi-Task Data for Multi-Agent Cooperation
by: Liu, Sicong, et al.
Published: (2025)
by: Liu, Sicong, et al.
Published: (2025)
Expert-Free Online Transfer Learning in Multi-Agent Reinforcement Learning
by: Castagna, Alberto
Published: (2025)
by: Castagna, Alberto
Published: (2025)
Chain of Uncertain Rewards with Large Language Models for Reinforcement Learning
by: Mo, Shentong
Published: (2026)
by: Mo, Shentong
Published: (2026)
Similar Items
-
Evaluating LLMs in Open-Source Games
by: Sistla, Swadesh, et al.
Published: (2025) -
Cross-environment Cooperation Enables Zero-shot Multi-agent Coordination
by: Jha, Kunal, et al.
Published: (2025) -
When Empowerment Disempowers
by: Yang, Claire, et al.
Published: (2025) -
Improve Value Estimation of Q Function and Reshape Reward with Monte Carlo Tree Search
by: Li, Jiamian
Published: (2024) -
Learning Individual Intrinsic Reward in Multi-Agent Reinforcement Learning via Incorporating Generalized Human Expertise
by: Wu, Xuefei, et al.
Published: (2025)