Salvato in:
| Autori principali: | Zhang, Ruize, Xu, Zelai, Ma, Chengdong, Yu, Chao, Tu, Wei-Wei, Tang, Wenhao, Huang, Shiyu, Ye, Deheng, Ding, Wenbo, Yang, Yaodong, Wang, Yu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2408.01072 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Mastering Multi-Drone Volleyball through Hierarchical Co-Self-Play Reinforcement Learning
di: Zhang, Ruize, et al.
Pubblicazione: (2025)
di: Zhang, Ruize, et al.
Pubblicazione: (2025)
WideSeek-R1: Exploring Width Scaling for Broad Information Seeking via Multi-Agent Reinforcement Learning
di: Xu, Zelai, et al.
Pubblicazione: (2026)
di: Xu, Zelai, et al.
Pubblicazione: (2026)
VolleyBots: A Testbed for Multi-Drone Volleyball Game Combining Motion Control and Strategic Play
di: Xu, Zelai, et al.
Pubblicazione: (2025)
di: Xu, Zelai, et al.
Pubblicazione: (2025)
Goal Discovery with Causal Capacity for Efficient Reinforcement Learning
di: Yu, Yan, et al.
Pubblicazione: (2025)
di: Yu, Yan, et al.
Pubblicazione: (2025)
Towards Efficient Collaboration via Graph Modeling in Reinforcement Learning
di: Fan, Wenzhe, et al.
Pubblicazione: (2024)
di: Fan, Wenzhe, et al.
Pubblicazione: (2024)
Language Agents with Reinforcement Learning for Strategic Play in the Werewolf Game
di: Xu, Zelai, et al.
Pubblicazione: (2023)
di: Xu, Zelai, et al.
Pubblicazione: (2023)
AED: Automatic Discovery of Effective and Diverse Vulnerabilities for Autonomous Driving Policy with Large Language Models
di: Qiu, Le, et al.
Pubblicazione: (2025)
di: Qiu, Le, et al.
Pubblicazione: (2025)
Game-Theoretic Multiagent Reinforcement Learning
di: Yang, Yaodong, et al.
Pubblicazione: (2020)
di: Yang, Yaodong, et al.
Pubblicazione: (2020)
Accelerating Robotic Reinforcement Learning with Agent Guidance
di: Chen, Haojun, et al.
Pubblicazione: (2026)
di: Chen, Haojun, et al.
Pubblicazione: (2026)
Learning Strategic Language Agents in the Werewolf Game with Iterative Latent Space Policy Optimization
di: Xu, Zelai, et al.
Pubblicazione: (2025)
di: Xu, Zelai, et al.
Pubblicazione: (2025)
H$^2$R: Hierarchical Hindsight Reflection for Multi-Task LLM Agents
di: Ye, Shicheng, et al.
Pubblicazione: (2025)
di: Ye, Shicheng, et al.
Pubblicazione: (2025)
OmniDrones: An Efficient and Flexible Platform for Reinforcement Learning in Drone Control
di: Xu, Botian, et al.
Pubblicazione: (2023)
di: Xu, Botian, et al.
Pubblicazione: (2023)
Roadmap on Incentive Compatibility for AI Alignment and Governance in Sociotechnical Systems
di: Zhang, Zhaowei, et al.
Pubblicazione: (2024)
di: Zhang, Zhaowei, et al.
Pubblicazione: (2024)
EARL: Efficient Agentic Reinforcement Learning Systems for Large Language Models
di: Tan, Zheyue, et al.
Pubblicazione: (2025)
di: Tan, Zheyue, et al.
Pubblicazione: (2025)
MAGE: Meta-Reinforcement Learning for Language Agents toward Strategic Exploration and Exploitation
di: Yang, Lu, et al.
Pubblicazione: (2026)
di: Yang, Lu, et al.
Pubblicazione: (2026)
Finding Kissing Numbers with Game-theoretic Reinforcement Learning
di: Ma, Chengdong, et al.
Pubblicazione: (2025)
di: Ma, Chengdong, et al.
Pubblicazione: (2025)
JuggleRL: Mastering Ball Juggling with a Quadrotor via Deep Reinforcement Learning
di: Ji, Shilong, et al.
Pubblicazione: (2025)
di: Ji, Shilong, et al.
Pubblicazione: (2025)
Refining Few-Step Text-to-Multiview Diffusion via Reinforcement Learning
di: Zhang, Ziyi, et al.
Pubblicazione: (2025)
di: Zhang, Ziyi, et al.
Pubblicazione: (2025)
Sample-Efficient Regret-Minimizing Double Oracle in Extensive-Form Games
di: Tang, Xiaohang, et al.
Pubblicazione: (2024)
di: Tang, Xiaohang, et al.
Pubblicazione: (2024)
Bidirectional Soft Actor-Critic: Leveraging Forward and Reverse KL Divergence for Efficient Reinforcement Learning
di: Zhang, Yixian, et al.
Pubblicazione: (2025)
di: Zhang, Yixian, et al.
Pubblicazione: (2025)
Adaptive Coarse-to-Fine Subgoal Refinement for Long-Horizon Offline Goal-Conditioned Reinforcement Learning
di: Ke, Kaiqiang, et al.
Pubblicazione: (2026)
di: Ke, Kaiqiang, et al.
Pubblicazione: (2026)
A Comprehensive Survey on Self-Supervised Learning for Recommendation
di: Ren, Xubin, et al.
Pubblicazione: (2024)
di: Ren, Xubin, et al.
Pubblicazione: (2024)
Improving Sample Efficiency of Reinforcement Learning with Background Knowledge from Large Language Models
di: Zhang, Fuxiang, et al.
Pubblicazione: (2024)
di: Zhang, Fuxiang, et al.
Pubblicazione: (2024)
Scaling DRL for Decision Making: A Survey on Data, Network, and Training Budget Strategies
di: Ma, Yi, et al.
Pubblicazione: (2025)
di: Ma, Yi, et al.
Pubblicazione: (2025)
Vulnerable Agent Identification in Large-Scale Multi-Agent Reinforcement Learning
di: Li, Simin, et al.
Pubblicazione: (2025)
di: Li, Simin, et al.
Pubblicazione: (2025)
Reinforcement Learning with Knowledge Representation and Reasoning: A Brief Survey
di: Yu, Chao, et al.
Pubblicazione: (2023)
di: Yu, Chao, et al.
Pubblicazione: (2023)
GTR: Guided Thought Reinforcement Prevents Thought Collapse in RL-based VLM Agent Training
di: Wei, Tong, et al.
Pubblicazione: (2025)
di: Wei, Tong, et al.
Pubblicazione: (2025)
Absolute Zero: Reinforced Self-play Reasoning with Zero Data
di: Zhao, Andrew, et al.
Pubblicazione: (2025)
di: Zhao, Andrew, et al.
Pubblicazione: (2025)
Empirical Study on Robustness and Resilience in Cooperative Multi-Agent Reinforcement Learning
di: Li, Simin, et al.
Pubblicazione: (2025)
di: Li, Simin, et al.
Pubblicazione: (2025)
EvoMAS: Learning Execution-Time Workflows for Multi-Agent Systems
di: Xu, Chengdong, et al.
Pubblicazione: (2026)
di: Xu, Chengdong, et al.
Pubblicazione: (2026)
Online Planning for Multi-UAV Pursuit-Evasion in Unknown Environments Using Deep Reinforcement Learning
di: Chen, Jiayu, et al.
Pubblicazione: (2024)
di: Chen, Jiayu, et al.
Pubblicazione: (2024)
Enhance the Safety in Reinforcement Learning by ADRC Lagrangian Methods
di: Zhang, Mingxu, et al.
Pubblicazione: (2026)
di: Zhang, Mingxu, et al.
Pubblicazione: (2026)
Social World Model-Augmented Mechanism Design Policy Learning
di: Zhang, Xiaoyuan, et al.
Pubblicazione: (2025)
di: Zhang, Xiaoyuan, et al.
Pubblicazione: (2025)
Unlocking Reasoning Capabilities in LLMs via Reinforcement Learning Exploration
di: Deng, Wenhao, et al.
Pubblicazione: (2025)
di: Deng, Wenhao, et al.
Pubblicazione: (2025)
Context-Picker: Dynamic context selection using multi-stage reinforcement learning
di: Zhu, Siyuan, et al.
Pubblicazione: (2025)
di: Zhu, Siyuan, et al.
Pubblicazione: (2025)
HISR: Hindsight Information Modulated Segmental Process Rewards For Multi-turn Agentic Reinforcement Learning
di: Lu, Zhicong, et al.
Pubblicazione: (2026)
di: Lu, Zhicong, et al.
Pubblicazione: (2026)
Reaching Consensus in Cooperative Multi-Agent Reinforcement Learning with Goal Imagination
di: Wang, Liangzhou, et al.
Pubblicazione: (2024)
di: Wang, Liangzhou, et al.
Pubblicazione: (2024)
Evolving Diverse Red-team Language Models in Multi-round Multi-agent Games
di: Ma, Chengdong, et al.
Pubblicazione: (2023)
di: Ma, Chengdong, et al.
Pubblicazione: (2023)
Multi-UAV Formation Control with Static and Dynamic Obstacle Avoidance via Reinforcement Learning
di: Xie, Yuqing, et al.
Pubblicazione: (2024)
di: Xie, Yuqing, et al.
Pubblicazione: (2024)
AI Agents for Web Testing: A Case Study in the Wild
di: Ye, Naimeng, et al.
Pubblicazione: (2025)
di: Ye, Naimeng, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Mastering Multi-Drone Volleyball through Hierarchical Co-Self-Play Reinforcement Learning
di: Zhang, Ruize, et al.
Pubblicazione: (2025) -
WideSeek-R1: Exploring Width Scaling for Broad Information Seeking via Multi-Agent Reinforcement Learning
di: Xu, Zelai, et al.
Pubblicazione: (2026) -
VolleyBots: A Testbed for Multi-Drone Volleyball Game Combining Motion Control and Strategic Play
di: Xu, Zelai, et al.
Pubblicazione: (2025) -
Goal Discovery with Causal Capacity for Efficient Reinforcement Learning
di: Yu, Yan, et al.
Pubblicazione: (2025) -
Towards Efficient Collaboration via Graph Modeling in Reinforcement Learning
di: Fan, Wenzhe, et al.
Pubblicazione: (2024)