Salvato in:
| Autori principali: | Pan, Zhenyu, Zhang, Yiting, Zhang, Yutong, Zhang, Jianshu, Luo, Haozheng, Han, Yuwei, Wu, Dennis, Chen, Hong-Yu, Yu, Philip S., Li, Manling, Liu, Han |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2508.03864 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
AdvEvo-MARL: Shaping Internalized Safety through Adversarial Co-Evolution in Multi-Agent Reinforcement Learning
di: Pan, Zhenyu, et al.
Pubblicazione: (2025)
di: Pan, Zhenyu, et al.
Pubblicazione: (2025)
FairReason: Balancing Reasoning and Social Bias in MLLMs
di: Pan, Zhenyu, et al.
Pubblicazione: (2025)
di: Pan, Zhenyu, et al.
Pubblicazione: (2025)
Conv-CoA: Improving Open-domain Question Answering in Large Language Models via Conversational Chain-of-Action
di: Pan, Zhenyu, et al.
Pubblicazione: (2024)
di: Pan, Zhenyu, et al.
Pubblicazione: (2024)
Chain-of-Action: Faithful and Multimodal Question Answering through Large Language Models
di: Pan, Zhenyu, et al.
Pubblicazione: (2024)
di: Pan, Zhenyu, et al.
Pubblicazione: (2024)
EvoNash-MARL: A Closed-Loop Multi-Agent Reinforcement Learning Framework for Medium-Horizon Equity Allocation
di: Jia, Chongliu, et al.
Pubblicazione: (2026)
di: Jia, Chongliu, et al.
Pubblicazione: (2026)
EvoMAS: Evolutionary Generation of Multi-Agent Systems
di: Hu, Yuntong, et al.
Pubblicazione: (2026)
di: Hu, Yuntong, et al.
Pubblicazione: (2026)
CoEvoSkills: Self-Evolving Agent Skills via Co-Evolutionary Verification
di: Zhang, Hanrong, et al.
Pubblicazione: (2026)
di: Zhang, Hanrong, et al.
Pubblicazione: (2026)
Smart Interrupted Routing Based on Multi-head Attention Mask Mechanism-Driven MARL in Software-defined UASNs
di: Wang, Zhenyu, et al.
Pubblicazione: (2025)
di: Wang, Zhenyu, et al.
Pubblicazione: (2025)
CoT-Evo: Evolutionary Distillation of Chain-of-Thought for Scientific Reasoning
di: Feng, Kehua, et al.
Pubblicazione: (2025)
di: Feng, Kehua, et al.
Pubblicazione: (2025)
Topology Enhanced MARL for Multi-Vehicle Cooperative Decision-Making of CAVs
di: Han, Ye, et al.
Pubblicazione: (2025)
di: Han, Ye, et al.
Pubblicazione: (2025)
Network Topology and Information Efficiency of Multi-Agent Systems: Study based on MARL
di: Zhang, Xinren, et al.
Pubblicazione: (2025)
di: Zhang, Xinren, et al.
Pubblicazione: (2025)
YOLO-MARL: You Only LLM Once for Multi-Agent Reinforcement Learning
di: Zhuang, Yuan, et al.
Pubblicazione: (2024)
di: Zhuang, Yuan, et al.
Pubblicazione: (2024)
MARL-MambaContour: Unleashing Multi-Agent Deep Reinforcement Learning for Active Contour Optimization in Medical Image Segmentation
di: Zhang, Ruicheng, et al.
Pubblicazione: (2025)
di: Zhang, Ruicheng, et al.
Pubblicazione: (2025)
EvoGM: Learning to Merge LLMs via Evolutionary Generative Optimization
di: Jiang, Tao, et al.
Pubblicazione: (2026)
di: Jiang, Tao, et al.
Pubblicazione: (2026)
BenchMARL: Benchmarking Multi-Agent Reinforcement Learning
di: Bettini, Matteo, et al.
Pubblicazione: (2023)
di: Bettini, Matteo, et al.
Pubblicazione: (2023)
EvoAgent: Towards Automatic Multi-Agent Generation via Evolutionary Algorithms
di: Yuan, Siyu, et al.
Pubblicazione: (2024)
di: Yuan, Siyu, et al.
Pubblicazione: (2024)
SMUTF: Schema Matching Using Generative Tags and Hybrid Features
di: Zhang, Yu, et al.
Pubblicazione: (2024)
di: Zhang, Yu, et al.
Pubblicazione: (2024)
RefEvo: Agentic Design with Co-Evolutionary Verification for Agile Reference Model Generation
di: Zhang, Yifan, et al.
Pubblicazione: (2026)
di: Zhang, Yifan, et al.
Pubblicazione: (2026)
EvoCorps: An Evolutionary Multi-Agent Framework for Depolarizing Online Discourse
di: Lin, Ning, et al.
Pubblicazione: (2026)
di: Lin, Ning, et al.
Pubblicazione: (2026)
State-Novelty Guided Action Persistence in Deep Reinforcement Learning
di: Hu, Jianshu, et al.
Pubblicazione: (2024)
di: Hu, Jianshu, et al.
Pubblicazione: (2024)
MARL-GPT: Foundation Model for Multi-Agent Reinforcement Learning
di: Nesterova, Maria, et al.
Pubblicazione: (2026)
di: Nesterova, Maria, et al.
Pubblicazione: (2026)
LangMARL: Natural Language Multi-Agent Reinforcement Learning
di: Yao, Huaiyuan, et al.
Pubblicazione: (2026)
di: Yao, Huaiyuan, et al.
Pubblicazione: (2026)
EvoRepair: Enhancing Vulnerability Repair Agents Through Experience-Based Self-Evolution
di: Hu, Haichuan, et al.
Pubblicazione: (2026)
di: Hu, Haichuan, et al.
Pubblicazione: (2026)
MLLM-Protector: Ensuring MLLM's Safety without Hurting Performance
di: Pi, Renjie, et al.
Pubblicazione: (2024)
di: Pi, Renjie, et al.
Pubblicazione: (2024)
Compute Allocation in Evolutionary Search: From Depth-Breadth to Multi-Armed Bandits
di: Xing, Sixue, et al.
Pubblicazione: (2026)
di: Xing, Sixue, et al.
Pubblicazione: (2026)
Rewards-in-Context: Multi-objective Alignment of Foundation Models with Dynamic Preference Adjustment
di: Yang, Rui, et al.
Pubblicazione: (2024)
di: Yang, Rui, et al.
Pubblicazione: (2024)
EvoCoT: Overcoming the Exploration Bottleneck in Reinforcement Learning
di: Liu, Huanyu, et al.
Pubblicazione: (2025)
di: Liu, Huanyu, et al.
Pubblicazione: (2025)
Co-jump: Cooperative Jumping with Quadrupedal Robots via Multi-Agent Reinforcement Learning
di: Dong, Shihao, et al.
Pubblicazione: (2026)
di: Dong, Shihao, et al.
Pubblicazione: (2026)
MetaSpatial: Reinforcing 3D Spatial Reasoning in VLMs for the Metaverse
di: Pan, Zhenyu, et al.
Pubblicazione: (2025)
di: Pan, Zhenyu, et al.
Pubblicazione: (2025)
Hierarchical Consensus-Based Multi-Agent Reinforcement Learning for Multi-Robot Cooperation Tasks
di: Feng, Pu, et al.
Pubblicazione: (2024)
di: Feng, Pu, et al.
Pubblicazione: (2024)
Co-Evolution of Policy and Internal Reward for Language Agents
di: Wang, Xinyu, et al.
Pubblicazione: (2026)
di: Wang, Xinyu, et al.
Pubblicazione: (2026)
MARL-OT: Multi-Agent Reinforcement Learning Guided Online Fuzzing to Detect Safety Violation in Autonomous Driving Systems
di: Liang, Linfeng, et al.
Pubblicazione: (2025)
di: Liang, Linfeng, et al.
Pubblicazione: (2025)
IGN : Implicit Generative Networks
di: Luo, Haozheng, et al.
Pubblicazione: (2022)
di: Luo, Haozheng, et al.
Pubblicazione: (2022)
Contrastive Reasoning Alignment: Reinforcement Learning from Hidden Representations
di: Luo, Haozheng, et al.
Pubblicazione: (2026)
di: Luo, Haozheng, et al.
Pubblicazione: (2026)
Agent Q-Mix: Selecting the Right Action for LLM Multi-Agent Systems through Reinforcement Learning
di: Jiang, Eric Hanchen, et al.
Pubblicazione: (2026)
di: Jiang, Eric Hanchen, et al.
Pubblicazione: (2026)
Personalized Visual Instruction Tuning
di: Pi, Renjie, et al.
Pubblicazione: (2024)
di: Pi, Renjie, et al.
Pubblicazione: (2024)
3D printing single‐stroke path planning, local reinforcement and performance testing of MBB beams and cantilever beams
di: Jianshu Wang, et al.
Pubblicazione: (2024)
di: Jianshu Wang, et al.
Pubblicazione: (2024)
EvoRoute: Experience-Driven Self-Routing LLM Agent Systems
di: Zhang, Guibin, et al.
Pubblicazione: (2026)
di: Zhang, Guibin, et al.
Pubblicazione: (2026)
KD-MARL: Resource-Aware Knowledge Distillation in Multi-Agent Reinforcement Learning
di: Pavel, Monirul Islam, et al.
Pubblicazione: (2026)
di: Pavel, Monirul Islam, et al.
Pubblicazione: (2026)
Time Reversal Symmetry for Efficient Robotic Manipulations in Deep Reinforcement Learning
di: Jiang, Yunpeng, et al.
Pubblicazione: (2025)
di: Jiang, Yunpeng, et al.
Pubblicazione: (2025)
Documenti analoghi
-
AdvEvo-MARL: Shaping Internalized Safety through Adversarial Co-Evolution in Multi-Agent Reinforcement Learning
di: Pan, Zhenyu, et al.
Pubblicazione: (2025) -
FairReason: Balancing Reasoning and Social Bias in MLLMs
di: Pan, Zhenyu, et al.
Pubblicazione: (2025) -
Conv-CoA: Improving Open-domain Question Answering in Large Language Models via Conversational Chain-of-Action
di: Pan, Zhenyu, et al.
Pubblicazione: (2024) -
Chain-of-Action: Faithful and Multimodal Question Answering through Large Language Models
di: Pan, Zhenyu, et al.
Pubblicazione: (2024) -
EvoNash-MARL: A Closed-Loop Multi-Agent Reinforcement Learning Framework for Medium-Horizon Equity Allocation
di: Jia, Chongliu, et al.
Pubblicazione: (2026)