Chasing Moving Targets with Online Self-Play Reinforcement Learning for Safer Language Models
Fuente:
arXiv
Saved in:
| Main Authors: | Liu, Mickel, Jiang, Liwei, Liang, Yancheng, Du, Simon Shaolei, Choi, Yejin, Althoff, Tim, Jaques, Natasha |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Learning to Cooperate with Humans using Generative Agents
by: Liang, Yancheng, et al.
Published: (2024)
by: Liang, Yancheng, et al.
Published: (2024)
Cross-environment Cooperation Enables Zero-shot Multi-agent Coordination
by: Jha, Kunal, et al.
Published: (2025)
by: Jha, Kunal, et al.
Published: (2025)
Multi Agent Reinforcement Learning for Sequential Satellite Assignment Problems
by: Holder, Joshua, et al.
Published: (2024)
by: Holder, Joshua, et al.
Published: (2024)
Multi-Agent Reinforcement Learning for Sample-Efficient Deep Neural Network Mapping
by: Krishnan, Srivatsan, et al.
Published: (2025)
by: Krishnan, Srivatsan, et al.
Published: (2025)
Differentially Private Reinforcement Learning with Self-Play
by: Qiao, Dan, et al.
Published: (2024)
by: Qiao, Dan, et al.
Published: (2024)
Near-Optimal Reinforcement Learning with Self-Play under Adaptivity Constraints
by: Qiao, Dan, et al.
Published: (2024)
by: Qiao, Dan, et al.
Published: (2024)
Outbidding and Outbluffing Elite Humans: Mastering Liar's Poker via Self-Play and Reinforcement Learning
by: Dewey, Richard, et al.
Published: (2025)
by: Dewey, Richard, et al.
Published: (2025)
Language Agents with Reinforcement Learning for Strategic Play in the Werewolf Game
by: Xu, Zelai, et al.
Published: (2023)
by: Xu, Zelai, et al.
Published: (2023)
MARLadona -- Towards Cooperative Team Play Using Multi-Agent Reinforcement Learning
by: Li, Zichong, et al.
Published: (2024)
by: Li, Zichong, et al.
Published: (2024)
ICRL: Learning to Internalize Self-Critique with Reinforcement Learning
by: Lin, Jianbo, et al.
Published: (2026)
by: Lin, Jianbo, et al.
Published: (2026)
Speaking the Language of Teamwork: LLM-Guided Credit Assignment in Multi-Agent Reinforcement Learning
by: Lin, Muhan, et al.
Published: (2025)
by: Lin, Muhan, et al.
Published: (2025)
InvestESG: A multi-agent reinforcement learning benchmark for studying climate investment as a social dilemma
by: Hou, Xiaoxuan, et al.
Published: (2024)
by: Hou, Xiaoxuan, et al.
Published: (2024)
Knowing What Not to Do: Leverage Language Model Insights for Action Space Pruning in Multi-agent Reinforcement Learning
by: Liu, Zhihao, et al.
Published: (2024)
by: Liu, Zhihao, et al.
Published: (2024)
MESA: Cooperative Meta-Exploration in Multi-Agent Learning through Exploiting State-Action Space Structure
by: Zhang, Zhicheng, et al.
Published: (2024)
by: Zhang, Zhicheng, et al.
Published: (2024)
Towards Natural Language Communication for Cooperative Autonomous Driving via Self-Play
by: Cui, Jiaxun, et al.
Published: (2025)
by: Cui, Jiaxun, et al.
Published: (2025)
Multi-Agent Training for Pommerman: Curriculum Learning and Population-based Self-Play Approach
by: Huynh, Nhat-Minh, et al.
Published: (2024)
by: Huynh, Nhat-Minh, et al.
Published: (2024)
Asynchronous Credit Assignment for Multi-Agent Reinforcement Learning
by: Liang, Yongheng, et al.
Published: (2024)
by: Liang, Yongheng, et al.
Published: (2024)
PufferLib: Making Reinforcement Learning Libraries and Environments Play Nice
by: Suarez, Joseph
Published: (2024)
by: Suarez, Joseph
Published: (2024)
Towards Language-Augmented Multi-Agent Deep Reinforcement Learning
by: Toquebiau, Maxime, et al.
Published: (2025)
by: Toquebiau, Maxime, et al.
Published: (2025)
Language Grounded Multi-agent Reinforcement Learning with Human-interpretable Communication
by: Li, Huao, et al.
Published: (2024)
by: Li, Huao, et al.
Published: (2024)
Multi-AUV Cooperative Underwater Multi-Target Tracking Based on Dynamic-Switching-enabled Multi-Agent Reinforcement Learning
by: Wang, Shengbo, et al.
Published: (2024)
by: Wang, Shengbo, et al.
Published: (2024)
Improving Human-AI Coordination through Online Adversarial Training and Generative Models
by: Chaudhary, Paresh, et al.
Published: (2025)
by: Chaudhary, Paresh, et al.
Published: (2025)
Safe Multi-agent Reinforcement Learning with Natural Language Constraints
by: Wang, Ziyan, et al.
Published: (2024)
by: Wang, Ziyan, et al.
Published: (2024)
Conversational Self-Play for Discovering and Understanding Psychotherapy Approaches
by: Kampman, Onno P, et al.
Published: (2025)
by: Kampman, Onno P, et al.
Published: (2025)
MA2RL: Masked Autoencoders for Generalizable Multi-Agent Reinforcement Learning
by: Feng, Jinyuan, et al.
Published: (2025)
by: Feng, Jinyuan, et al.
Published: (2025)
Hierarchical Multi-Agent Reinforcement Learning-based Coordinated Spatial Reuse for Next Generation WLANs
by: Yu, Jiaming, et al.
Published: (2025)
by: Yu, Jiaming, et al.
Published: (2025)
Tiny Moves: Game-based Hypothesis Refinement
by: Dobrowolska, Agnieszka, et al.
Published: (2026)
by: Dobrowolska, Agnieszka, et al.
Published: (2026)
Sample-Efficient Distributionally Robust Multi-Agent Reinforcement Learning via Online Interaction
by: Farhat, Zain Ulabedeen, et al.
Published: (2025)
by: Farhat, Zain Ulabedeen, et al.
Published: (2025)
Scalable Safe Multi-Agent Reinforcement Learning for Multi-Agent System
by: Du, Haikuo, et al.
Published: (2025)
by: Du, Haikuo, et al.
Published: (2025)
CandorMD: An AI-Assisted Audio Simulation and Feedback System for Training Clinicians for Medical Error Disclosure
by: Lin, Inna Wanyin, et al.
Published: (2026)
by: Lin, Inna Wanyin, et al.
Published: (2026)
Multi-agent Reinforcement Learning for Low-Carbon P2P Energy Trading among Self-Interested Microgrids
by: Ren, Junhao, et al.
Published: (2026)
by: Ren, Junhao, et al.
Published: (2026)
Expert-Free Online Transfer Learning in Multi-Agent Reinforcement Learning
by: Castagna, Alberto
Published: (2025)
by: Castagna, Alberto
Published: (2025)
Cooperative Integrated Estimation-Guidance for Simultaneous Interception of Moving Targets
by: Gopikannan, Lohitvel, et al.
Published: (2025)
by: Gopikannan, Lohitvel, et al.
Published: (2025)
A Black-box Approach for Non-stationary Multi-agent Reinforcement Learning
by: Jiang, Haozhe, et al.
Published: (2023)
by: Jiang, Haozhe, et al.
Published: (2023)
Scalable UAV Multi-Hop Networking via Multi-Agent Reinforcement Learning with Large Language Models
by: Xu, Yanggang, et al.
Published: (2025)
by: Xu, Yanggang, et al.
Published: (2025)
Selective Reincarnation: Offline-to-Online Multi-Agent Reinforcement Learning
by: Formanek, Claude, et al.
Published: (2023)
by: Formanek, Claude, et al.
Published: (2023)
Dynamic Leader-Follower Consensus with Adversaries: A Multi-Hop Relay Approach
by: Yuan, Liwei, et al.
Published: (2025)
by: Yuan, Liwei, et al.
Published: (2025)
Asynchronous Approximate Byzantine Consensus: A Multi-hop Relay Method and Tight Graph Conditions
by: Yuan, Liwei, et al.
Published: (2024)
by: Yuan, Liwei, et al.
Published: (2024)
Resilient Quantized Consensus in Multi-Hop Relay Networks
by: Yuan, Liwei, et al.
Published: (2025)
by: Yuan, Liwei, et al.
Published: (2025)
Reaching Resilient Leader-Follower Consensus in Time-Varying Networks via Multi-Hop Relays
by: Yuan, Liwei, et al.
Published: (2024)
by: Yuan, Liwei, et al.
Published: (2024)
Similar Items
-
Learning to Cooperate with Humans using Generative Agents
by: Liang, Yancheng, et al.
Published: (2024) -
Cross-environment Cooperation Enables Zero-shot Multi-agent Coordination
by: Jha, Kunal, et al.
Published: (2025) -
Multi Agent Reinforcement Learning for Sequential Satellite Assignment Problems
by: Holder, Joshua, et al.
Published: (2024) -
Multi-Agent Reinforcement Learning for Sample-Efficient Deep Neural Network Mapping
by: Krishnan, Srivatsan, et al.
Published: (2025) -
Differentially Private Reinforcement Learning with Self-Play
by: Qiao, Dan, et al.
Published: (2024)