Stop Wandering, Find the Keys: LLMs Discriminate Key States for Efficient Multi-Agent Exploration
Fuente:
arXiv
Salvato in:
| Autori principali: | Qu, Yun, Wang, Boyuan, Jiang, Yuhang, Shao, Jianzhun, Mao, Yixiu, Zou, Heming, Liu, Chang, Wang, Cheems, Liu, Meiqin, Ji, Xiangyang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Latent Reward: LLM-Empowered Credit Assignment in Episodic Reinforcement Learning
di: Qu, Yun, et al.
Pubblicazione: (2024)
di: Qu, Yun, et al.
Pubblicazione: (2024)
Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments
di: Qu, Yun, et al.
Pubblicazione: (2025)
di: Qu, Yun, et al.
Pubblicazione: (2025)
Dynamics-Predictive Sampling for Active RL Finetuning of Large Reasoning Models
di: Mao, Yixiu, et al.
Pubblicazione: (2026)
di: Mao, Yixiu, et al.
Pubblicazione: (2026)
RLVR without Ineffective Samples: Group Prioritized Off-Policy Optimization for LLM Reasoning
di: Mao, Yixiu, et al.
Pubblicazione: (2026)
di: Mao, Yixiu, et al.
Pubblicazione: (2026)
Utility-Diversity Aware Online Batch Selection for LLM Supervised Fine-tuning
di: Zou, Heming, et al.
Pubblicazione: (2025)
di: Zou, Heming, et al.
Pubblicazione: (2025)
Bi-Mem: Bidirectional Construction of Hierarchical Memory for Personalized LLMs via Inductive-Reflective Agents
di: Mao, Wenyu, et al.
Pubblicazione: (2026)
di: Mao, Wenyu, et al.
Pubblicazione: (2026)
LLM-Empowered State Representation for Reinforcement Learning
di: Wang, Boyuan, et al.
Pubblicazione: (2024)
di: Wang, Boyuan, et al.
Pubblicazione: (2024)
RMIO: A Model-Based MARL Framework for Scenarios with Observation Loss in Some Agents
di: Shi, Zifeng, et al.
Pubblicazione: (2024)
di: Shi, Zifeng, et al.
Pubblicazione: (2024)
GAWM: Global-Aware World Model for Multi-Agent Reinforcement Learning
di: Shi, Zifeng, et al.
Pubblicazione: (2025)
di: Shi, Zifeng, et al.
Pubblicazione: (2025)
Robust Fast Adaptation from Adversarially Explicit Task Distribution Generation
di: Wang, Cheems, et al.
Pubblicazione: (2024)
di: Wang, Cheems, et al.
Pubblicazione: (2024)
Agent-Kernel: A MicroKernel Multi-Agent System Framework for Adaptive Social Simulation Powered by LLMs
di: Mao, Yuren, et al.
Pubblicazione: (2025)
di: Mao, Yuren, et al.
Pubblicazione: (2025)
Stop Reducing Responsibility in LLM-Powered Multi-Agent Systems to Local Alignment
di: Hu, Jinwei, et al.
Pubblicazione: (2025)
di: Hu, Jinwei, et al.
Pubblicazione: (2025)
Dynamic Agent Grouping ECBS: Scaling Windowed Multi-Agent Path Finding with Completeness Guarantees
di: Zhang, Tiannan, et al.
Pubblicazione: (2025)
di: Zhang, Tiannan, et al.
Pubblicazione: (2025)
WESE: Weak Exploration to Strong Exploitation for LLM Agents
di: Huang, Xu, et al.
Pubblicazione: (2024)
di: Huang, Xu, et al.
Pubblicazione: (2024)
Stop Wasting Your Tokens: Towards Efficient Runtime Multi-Agent Systems
di: Lin, Fulin, et al.
Pubblicazione: (2025)
di: Lin, Fulin, et al.
Pubblicazione: (2025)
An Agent-Based Model for Poverty and Discrimination Policy-Making
di: Montes, Nieves, et al.
Pubblicazione: (2023)
di: Montes, Nieves, et al.
Pubblicazione: (2023)
No Panacea in Planning: Algorithm Selection for Suboptimal Multi-Agent Path Finding
di: Chen, Weizhe, et al.
Pubblicazione: (2024)
di: Chen, Weizhe, et al.
Pubblicazione: (2024)
MARLIN: Multi-Agent Reinforcement Learning with Murmuration Intelligence and LLM Guidance for Reservoir Management
di: Fu, Heming, et al.
Pubblicazione: (2025)
di: Fu, Heming, et al.
Pubblicazione: (2025)
Learning to Communicate: Toward End-to-End Optimization of Multi-Agent Language Systems
di: Yu, Ye, et al.
Pubblicazione: (2026)
di: Yu, Ye, et al.
Pubblicazione: (2026)
Tree-based Credit Assignment for Multi-Agent Memory System
di: Mao, Marina, et al.
Pubblicazione: (2026)
di: Mao, Marina, et al.
Pubblicazione: (2026)
Anytime Multi-Agent Path Finding using Operation Parallelism in Large Neighborhood Search
di: Chan, Shao-Hung, et al.
Pubblicazione: (2024)
di: Chan, Shao-Hung, et al.
Pubblicazione: (2024)
KAOS: Large Model Multi-Agent Operating System
di: Zhuo, Zhao, et al.
Pubblicazione: (2024)
di: Zhuo, Zhao, et al.
Pubblicazione: (2024)
Doubly Mild Generalization for Offline Reinforcement Learning
di: Mao, Yixiu, et al.
Pubblicazione: (2024)
di: Mao, Yixiu, et al.
Pubblicazione: (2024)
MGCBS: An Optimal and Efficient Algorithm for Solving Multi-Goal Multi-Agent Path Finding Problem
di: Tang, Mingkai, et al.
Pubblicazione: (2024)
di: Tang, Mingkai, et al.
Pubblicazione: (2024)
Multi-Agent Path Finding Among Dynamic Uncontrollable Agents with Statistical Safety Guarantees
di: Strawn, Kegan J., et al.
Pubblicazione: (2025)
di: Strawn, Kegan J., et al.
Pubblicazione: (2025)
Cooperative Hybrid Multi-Agent Pathfinding Based on Shared Exploration Maps
di: Liu, Ning, et al.
Pubblicazione: (2025)
di: Liu, Ning, et al.
Pubblicazione: (2025)
Relaxing Constraints in Anonymous Multi Agent Path Finding for Large Agents
di: Dergachev, Stepan, et al.
Pubblicazione: (2026)
di: Dergachev, Stepan, et al.
Pubblicazione: (2026)
Joint Intrinsic Motivation for Coordinated Exploration in Multi-Agent Deep Reinforcement Learning
di: Toquebiau, Maxime, et al.
Pubblicazione: (2024)
di: Toquebiau, Maxime, et al.
Pubblicazione: (2024)
MARPF: Multi-Agent and Multi-Rack Path Finding
di: Makino, Hiroya, et al.
Pubblicazione: (2024)
di: Makino, Hiroya, et al.
Pubblicazione: (2024)
Fairness Driven Multi-Agent Path Finding Problem
di: Anand, Aditi, et al.
Pubblicazione: (2026)
di: Anand, Aditi, et al.
Pubblicazione: (2026)
Constrained Multi-Agent Path Finding on Directed Graphs
di: Ardizzoni, Stefano, et al.
Pubblicazione: (2022)
di: Ardizzoni, Stefano, et al.
Pubblicazione: (2022)
CREW-WILDFIRE: Benchmarking Agentic Multi-Agent Collaborations at Scale
di: Hyun, Jonathan, et al.
Pubblicazione: (2025)
di: Hyun, Jonathan, et al.
Pubblicazione: (2025)
Streamlining the Action Dependency Graph Framework: Two Key Enhancements
di: Dunkel, Joachim
Pubblicazione: (2024)
di: Dunkel, Joachim
Pubblicazione: (2024)
CTS-CBS: A New Approach for Multi-Agent Collaborative Task Sequencing and Path Finding
di: Jiang, Junkai, et al.
Pubblicazione: (2025)
di: Jiang, Junkai, et al.
Pubblicazione: (2025)
MasRouter: Learning to Route LLMs for Multi-Agent Systems
di: Yue, Yanwei, et al.
Pubblicazione: (2025)
di: Yue, Yanwei, et al.
Pubblicazione: (2025)
Agent-Based Exploration of Recommendation Systems in Misinformation Propagation
di: Jakobsen, Lise, et al.
Pubblicazione: (2025)
di: Jakobsen, Lise, et al.
Pubblicazione: (2025)
Confidence-Based Curriculum Learning for Multi-Agent Path Finding
di: Phan, Thomy, et al.
Pubblicazione: (2024)
di: Phan, Thomy, et al.
Pubblicazione: (2024)
Introducing Delays in Multi-Agent Path Finding
di: Kottinger, Justin, et al.
Pubblicazione: (2023)
di: Kottinger, Justin, et al.
Pubblicazione: (2023)
Exploration of LLM Multi-Agent Application Implementation Based on LangGraph+CrewAI
di: Duan, Zhihua, et al.
Pubblicazione: (2024)
di: Duan, Zhihua, et al.
Pubblicazione: (2024)
Augmented Runtime Collaboration for Self-Organizing Multi-Agent Systems: A Hybrid Bi-Criteria Routing Approach
di: Yang, Qingwen, et al.
Pubblicazione: (2025)
di: Yang, Qingwen, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Latent Reward: LLM-Empowered Credit Assignment in Episodic Reinforcement Learning
di: Qu, Yun, et al.
Pubblicazione: (2024) -
Fast and Robust: Task Sampling with Posterior and Diversity Synergies for Adaptive Decision-Makers in Randomized Environments
di: Qu, Yun, et al.
Pubblicazione: (2025) -
Dynamics-Predictive Sampling for Active RL Finetuning of Large Reasoning Models
di: Mao, Yixiu, et al.
Pubblicazione: (2026) -
RLVR without Ineffective Samples: Group Prioritized Off-Policy Optimization for LLM Reasoning
di: Mao, Yixiu, et al.
Pubblicazione: (2026) -
Utility-Diversity Aware Online Batch Selection for LLM Supervised Fine-tuning
di: Zou, Heming, et al.
Pubblicazione: (2025)