Saved in:
| Main Authors: | Qu, Yun, Wang, Boyuan, Jiang, Yuhang, Shao, Jianzhun, Mao, Yixiu, Zou, Heming, Liu, Chang, Wang, Cheems, Liu, Meiqin, Ji, Xiangyang |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | https://arxiv.org/abs/2410.02511 |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Latent Reward: LLM-Empowered Credit Assignment in Episodic Reinforcement Learning
by: Qu, Yun, et al.
Published: (2024)
by: Qu, Yun, et al.
Published: (2024)
Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments
by: Qu, Yun, et al.
Published: (2025)
by: Qu, Yun, et al.
Published: (2025)
Dynamics-Predictive Sampling for Active RL Finetuning of Large Reasoning Models
by: Mao, Yixiu, et al.
Published: (2026)
by: Mao, Yixiu, et al.
Published: (2026)
RLVR without Ineffective Samples: Group Prioritized Off-Policy Optimization for LLM Reasoning
by: Mao, Yixiu, et al.
Published: (2026)
by: Mao, Yixiu, et al.
Published: (2026)
Utility-Diversity Aware Online Batch Selection for LLM Supervised Fine-tuning
by: Zou, Heming, et al.
Published: (2025)
by: Zou, Heming, et al.
Published: (2025)
LLM-Empowered State Representation for Reinforcement Learning
by: Wang, Boyuan, et al.
Published: (2024)
by: Wang, Boyuan, et al.
Published: (2024)
Robust Fast Adaptation from Adversarially Explicit Task Distribution Generation
by: Wang, Cheems, et al.
Published: (2024)
by: Wang, Cheems, et al.
Published: (2024)
RMIO: A Model-Based MARL Framework for Scenarios with Observation Loss in Some Agents
by: Shi, Zifeng, et al.
Published: (2024)
by: Shi, Zifeng, et al.
Published: (2024)
Bi-Mem: Bidirectional Construction of Hierarchical Memory for Personalized LLMs via Inductive-Reflective Agents
by: Mao, Wenyu, et al.
Published: (2026)
by: Mao, Wenyu, et al.
Published: (2026)
GAWM: Global-Aware World Model for Multi-Agent Reinforcement Learning
by: Shi, Zifeng, et al.
Published: (2025)
by: Shi, Zifeng, et al.
Published: (2025)
Agent-Kernel: A MicroKernel Multi-Agent System Framework for Adaptive Social Simulation Powered by LLMs
by: Mao, Yuren, et al.
Published: (2025)
by: Mao, Yuren, et al.
Published: (2025)
Doubly Mild Generalization for Offline Reinforcement Learning
by: Mao, Yixiu, et al.
Published: (2024)
by: Mao, Yixiu, et al.
Published: (2024)
Dynamic Agent Grouping ECBS: Scaling Windowed Multi-Agent Path Finding with Completeness Guarantees
by: Zhang, Tiannan, et al.
Published: (2025)
by: Zhang, Tiannan, et al.
Published: (2025)
Stop Reducing Responsibility in LLM-Powered Multi-Agent Systems to Local Alignment
by: Hu, Jinwei, et al.
Published: (2025)
by: Hu, Jinwei, et al.
Published: (2025)
Learning to Communicate: Toward End-to-End Optimization of Multi-Agent Language Systems
by: Yu, Ye, et al.
Published: (2026)
by: Yu, Ye, et al.
Published: (2026)
WESE: Weak Exploration to Strong Exploitation for LLM Agents
by: Huang, Xu, et al.
Published: (2024)
by: Huang, Xu, et al.
Published: (2024)
MARLIN: Multi-Agent Reinforcement Learning with Murmuration Intelligence and LLM Guidance for Reservoir Management
by: Fu, Heming, et al.
Published: (2025)
by: Fu, Heming, et al.
Published: (2025)
Stop Wasting Your Tokens: Towards Efficient Runtime Multi-Agent Systems
by: Lin, Fulin, et al.
Published: (2025)
by: Lin, Fulin, et al.
Published: (2025)
An Agent-Based Model for Poverty and Discrimination Policy-Making
by: Montes, Nieves, et al.
Published: (2023)
by: Montes, Nieves, et al.
Published: (2023)
KAOS: Large Model Multi-Agent Operating System
by: Zhuo, Zhao, et al.
Published: (2024)
by: Zhuo, Zhao, et al.
Published: (2024)
Tree-based Credit Assignment for Multi-Agent Memory System
by: Mao, Marina, et al.
Published: (2026)
by: Mao, Marina, et al.
Published: (2026)
No Panacea in Planning: Algorithm Selection for Suboptimal Multi-Agent Path Finding
by: Chen, Weizhe, et al.
Published: (2024)
by: Chen, Weizhe, et al.
Published: (2024)
MGCBS: An Optimal and Efficient Algorithm for Solving Multi-Goal Multi-Agent Path Finding Problem
by: Tang, Mingkai, et al.
Published: (2024)
by: Tang, Mingkai, et al.
Published: (2024)
Anytime Multi-Agent Path Finding using Operation Parallelism in Large Neighborhood Search
by: Chan, Shao-Hung, et al.
Published: (2024)
by: Chan, Shao-Hung, et al.
Published: (2024)
Adaptive Neighborhood-Constrained Q Learning for Offline Reinforcement Learning
by: Mao, Yixiu, et al.
Published: (2025)
by: Mao, Yixiu, et al.
Published: (2025)
CREW-WILDFIRE: Benchmarking Agentic Multi-Agent Collaborations at Scale
by: Hyun, Jonathan, et al.
Published: (2025)
by: Hyun, Jonathan, et al.
Published: (2025)
Multi-Agent Path Finding Among Dynamic Uncontrollable Agents with Statistical Safety Guarantees
by: Strawn, Kegan J., et al.
Published: (2025)
by: Strawn, Kegan J., et al.
Published: (2025)
Joint Intrinsic Motivation for Coordinated Exploration in Multi-Agent Deep Reinforcement Learning
by: Toquebiau, Maxime, et al.
Published: (2024)
by: Toquebiau, Maxime, et al.
Published: (2024)
Cooperative Hybrid Multi-Agent Pathfinding Based on Shared Exploration Maps
by: Liu, Ning, et al.
Published: (2025)
by: Liu, Ning, et al.
Published: (2025)
Relaxing Constraints in Anonymous Multi Agent Path Finding for Large Agents
by: Dergachev, Stepan, et al.
Published: (2026)
by: Dergachev, Stepan, et al.
Published: (2026)
MasRouter: Learning to Route LLMs for Multi-Agent Systems
by: Yue, Yanwei, et al.
Published: (2025)
by: Yue, Yanwei, et al.
Published: (2025)
Streamlining the Action Dependency Graph Framework: Two Key Enhancements
by: Dunkel, Joachim
Published: (2024)
by: Dunkel, Joachim
Published: (2024)
CTS-CBS: A New Approach for Multi-Agent Collaborative Task Sequencing and Path Finding
by: Jiang, Junkai, et al.
Published: (2025)
by: Jiang, Junkai, et al.
Published: (2025)
MARPF: Multi-Agent and Multi-Rack Path Finding
by: Makino, Hiroya, et al.
Published: (2024)
by: Makino, Hiroya, et al.
Published: (2024)
Fairness Driven Multi-Agent Path Finding Problem
by: Anand, Aditi, et al.
Published: (2026)
by: Anand, Aditi, et al.
Published: (2026)
Constrained Multi-Agent Path Finding on Directed Graphs
by: Ardizzoni, Stefano, et al.
Published: (2022)
by: Ardizzoni, Stefano, et al.
Published: (2022)
Multi-agent Embodied AI: Advances and Future Directions
by: Feng, Zhaohan, et al.
Published: (2025)
by: Feng, Zhaohan, et al.
Published: (2025)
Agent-Based Exploration of Recommendation Systems in Misinformation Propagation
by: Jakobsen, Lise, et al.
Published: (2025)
by: Jakobsen, Lise, et al.
Published: (2025)
Introducing Delays in Multi-Agent Path Finding
by: Kottinger, Justin, et al.
Published: (2023)
by: Kottinger, Justin, et al.
Published: (2023)
Confidence-Based Curriculum Learning for Multi-Agent Path Finding
by: Phan, Thomy, et al.
Published: (2024)
by: Phan, Thomy, et al.
Published: (2024)
Similar Items
-
Latent Reward: LLM-Empowered Credit Assignment in Episodic Reinforcement Learning
by: Qu, Yun, et al.
Published: (2024) -
Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments
by: Qu, Yun, et al.
Published: (2025) -
Dynamics-Predictive Sampling for Active RL Finetuning of Large Reasoning Models
by: Mao, Yixiu, et al.
Published: (2026) -
RLVR without Ineffective Samples: Group Prioritized Off-Policy Optimization for LLM Reasoning
by: Mao, Yixiu, et al.
Published: (2026) -
Utility-Diversity Aware Online Batch Selection for LLM Supervised Fine-tuning
by: Zou, Heming, et al.
Published: (2025)