WideSeek-R1: Exploring Width Scaling for Broad Information Seeking via Multi-Agent Reinforcement Learning
Fuente:
arXiv
Guardado en:
| Autores principales: | Xu, Zelai, Xu, Zhexuan, Zhang, Ruize, Zhu, Chunyang, Yu, Shi, Liu, Weilin, Zhang, Quanlu, Ding, Wenbo, Yu, Chao, Wang, Yu |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
WideSeek: Advancing Wide Research via Multi-Agent Scaling
por: Huang, Ziyang, et al.
Publicado: (2026)
por: Huang, Ziyang, et al.
Publicado: (2026)
Language Agents with Reinforcement Learning for Strategic Play in the Werewolf Game
por: Xu, Zelai, et al.
Publicado: (2023)
por: Xu, Zelai, et al.
Publicado: (2023)
Learning Efficient Communication Protocols for Multi-Agent Reinforcement Learning
por: Zhang, Xinren, et al.
Publicado: (2025)
por: Zhang, Xinren, et al.
Publicado: (2025)
Multi-Agent Reinforcement Learning with a Hierarchy of Reward Machines
por: Zheng, Xuejing, et al.
Publicado: (2024)
por: Zheng, Xuejing, et al.
Publicado: (2024)
Vulnerable Agent Identification in Large-Scale Multi-Agent Reinforcement Learning
por: Li, Simin, et al.
Publicado: (2025)
por: Li, Simin, et al.
Publicado: (2025)
Subgoal-based Hierarchical Reinforcement Learning for Multi-Agent Collaboration
por: Xu, Cheng, et al.
Publicado: (2024)
por: Xu, Cheng, et al.
Publicado: (2024)
Hierarchical Multi-Agent Reinforcement Learning-based Coordinated Spatial Reuse for Next Generation WLANs
por: Yu, Jiaming, et al.
Publicado: (2025)
por: Yu, Jiaming, et al.
Publicado: (2025)
VIL2C: Value-of-Information Aware Low-Latency Communication for Multi-Agent Reinforcement Learning
por: Zhang, Qian, et al.
Publicado: (2025)
por: Zhang, Qian, et al.
Publicado: (2025)
Leveraging Partial Symmetry for Multi-Agent Reinforcement Learning
por: Yu, Xin, et al.
Publicado: (2023)
por: Yu, Xin, et al.
Publicado: (2023)
Distributed Multi-robot Source Seeking in Unknown Environments with Unknown Number of Sources
por: Chen, Lingpeng, et al.
Publicado: (2025)
por: Chen, Lingpeng, et al.
Publicado: (2025)
Adaptive Context Length Optimization with Low-Frequency Truncation for Multi-Agent Reinforcement Learning
por: Duan, Wenchang, et al.
Publicado: (2025)
por: Duan, Wenchang, et al.
Publicado: (2025)
A High-Throughput Compute-Efficient POMDP Hide-And-Seek-Engine (HASE) for Multi-Agent Operations
por: Flavin, Timothy, et al.
Publicado: (2026)
por: Flavin, Timothy, et al.
Publicado: (2026)
Belief-Driven Multi-Agent Collaboration via Approximate Perfect Bayesian Equilibrium for Social Simulation
por: Fang, Weiwei, et al.
Publicado: (2026)
por: Fang, Weiwei, et al.
Publicado: (2026)
Visual Reasoning over Time Series via Multi-Agent System
por: Ruan, Weilin, et al.
Publicado: (2026)
por: Ruan, Weilin, et al.
Publicado: (2026)
Attention-Guided Contrastive Role Representations for Multi-Agent Reinforcement Learning
por: Hu, Zican, et al.
Publicado: (2023)
por: Hu, Zican, et al.
Publicado: (2023)
Dynamic Deep Factor Graph for Multi-Agent Reinforcement Learning
por: Shi, Yuchen, et al.
Publicado: (2024)
por: Shi, Yuchen, et al.
Publicado: (2024)
SmartSnap: Proactive Evidence Seeking for Self-Verifying Agents
por: Cai, Shaofei, et al.
Publicado: (2025)
por: Cai, Shaofei, et al.
Publicado: (2025)
Heterogeneity in Multi-Agent Reinforcement Learning
por: Hu, Tianyi, et al.
Publicado: (2025)
por: Hu, Tianyi, et al.
Publicado: (2025)
Distributed Neural Policy Gradient Algorithm for Global Convergence of Networked Multi-Agent Reinforcement Learning
por: Dai, Pengcheng, et al.
Publicado: (2025)
por: Dai, Pengcheng, et al.
Publicado: (2025)
LLM Enabled Multi-Agent System for 6G Networks: Framework and Method of Dual-Loop Edge-Terminal Collaboration
por: Qu, Zheyan, et al.
Publicado: (2025)
por: Qu, Zheyan, et al.
Publicado: (2025)
GAWM: Global-Aware World Model for Multi-Agent Reinforcement Learning
por: Shi, Zifeng, et al.
Publicado: (2025)
por: Shi, Zifeng, et al.
Publicado: (2025)
Hierarchical Consensus-Based Multi-Agent Reinforcement Learning for Multi-Robot Cooperation Tasks
por: Feng, Pu, et al.
Publicado: (2024)
por: Feng, Pu, et al.
Publicado: (2024)
Voronoi-based Multi-Robot Formations for 3D Source Seeking via Cooperative Gradient Estimation
por: Briñón-Arranz, Lara, et al.
Publicado: (2024)
por: Briñón-Arranz, Lara, et al.
Publicado: (2024)
MARVEL: Multi-Agent Reinforcement-Learning for Large-Scale Variable Speed Limits
por: Zhang, Yuhang, et al.
Publicado: (2023)
por: Zhang, Yuhang, et al.
Publicado: (2023)
Decentralized Multi-Agent System with Trust-Aware Communication
por: Ding, Yepeng, et al.
Publicado: (2025)
por: Ding, Yepeng, et al.
Publicado: (2025)
Multi-Agent Reinforcement Learning-based Cooperative Autonomous Driving in Smart Intersections
por: Yu, Taoyuan, et al.
Publicado: (2025)
por: Yu, Taoyuan, et al.
Publicado: (2025)
Network Topology and Information Efficiency of Multi-Agent Systems: Study based on MARL
por: Zhang, Xinren, et al.
Publicado: (2025)
por: Zhang, Xinren, et al.
Publicado: (2025)
Intrinsic Action Tendency Consistency for Cooperative Multi-Agent Reinforcement Learning
por: Zhang, Junkai, et al.
Publicado: (2024)
por: Zhang, Junkai, et al.
Publicado: (2024)
HAWK: A Hierarchical Workflow Framework for Multi-Agent Collaboration
por: Cheng, Yuyang, et al.
Publicado: (2025)
por: Cheng, Yuyang, et al.
Publicado: (2025)
MasHost Builds It All: Autonomous Multi-Agent System Directed by Reinforcement Learning
por: Yang, Kuo, et al.
Publicado: (2025)
por: Yang, Kuo, et al.
Publicado: (2025)
DAO-Agent: Zero Knowledge-Verified Incentives for Decentralized Multi-Agent Coordination
por: Xia, Yihan, et al.
Publicado: (2025)
por: Xia, Yihan, et al.
Publicado: (2025)
AgentArk: Distilling Multi-Agent Intelligence into a Single LLM Agent
por: Luo, Yinyi, et al.
Publicado: (2026)
por: Luo, Yinyi, et al.
Publicado: (2026)
Nested Browser-Use Learning for Agentic Information Seeking
por: Li, Baixuan, et al.
Publicado: (2025)
por: Li, Baixuan, et al.
Publicado: (2025)
MA2RL: Masked Autoencoders for Generalizable Multi-Agent Reinforcement Learning
por: Feng, Jinyuan, et al.
Publicado: (2025)
por: Feng, Jinyuan, et al.
Publicado: (2025)
Causal-Inspired Multi-Agent Decision-Making via Graph Reinforcement Learning
por: Wang, Jing, et al.
Publicado: (2025)
por: Wang, Jing, et al.
Publicado: (2025)
Task Placement and Resource Allocation for Edge Machine Learning: A GNN-based Multi-Agent Reinforcement Learning Paradigm
por: Li, Yihong, et al.
Publicado: (2023)
por: Li, Yihong, et al.
Publicado: (2023)
Stronger-MAS: Multi-Agent Reinforcement Learning for Collaborative LLMs
por: Zhao, Yujie, et al.
Publicado: (2025)
por: Zhao, Yujie, et al.
Publicado: (2025)
ToMacVF : Temporal Macro-action Value Factorization for Asynchronous Multi-Agent Reinforcement Learning
por: Zhang, Wenjing, et al.
Publicado: (2025)
por: Zhang, Wenjing, et al.
Publicado: (2025)
ESP: Exploiting Symmetry Prior for Multi-Agent Reinforcement Learning
por: Yu, Xin, et al.
Publicado: (2023)
por: Yu, Xin, et al.
Publicado: (2023)
Multi-Agent Continuous Control with Generative Flow Networks
por: Luo, Shuang, et al.
Publicado: (2024)
por: Luo, Shuang, et al.
Publicado: (2024)
Ejemplares similares
-
WideSeek: Advancing Wide Research via Multi-Agent Scaling
por: Huang, Ziyang, et al.
Publicado: (2026) -
Language Agents with Reinforcement Learning for Strategic Play in the Werewolf Game
por: Xu, Zelai, et al.
Publicado: (2023) -
Learning Efficient Communication Protocols for Multi-Agent Reinforcement Learning
por: Zhang, Xinren, et al.
Publicado: (2025) -
Multi-Agent Reinforcement Learning with a Hierarchy of Reward Machines
por: Zheng, Xuejing, et al.
Publicado: (2024) -
Vulnerable Agent Identification in Large-Scale Multi-Agent Reinforcement Learning
por: Li, Simin, et al.
Publicado: (2025)