HyperEyes: Dual-Grained Efficiency-Aware Reinforcement Learning for Parallel Multimodal Search Agents
Fuente:
arXiv
Saved in:
| Main Authors: | Li, Guankai, Chen, Jiabin, Xu, Yi, Zhang, Xichen, Lu, Yuan |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Tree Search for LLM Agent Reinforcement Learning
by: Ji, Yuxiang, et al.
Published: (2025)
by: Ji, Yuxiang, et al.
Published: (2025)
Group-Aware Coordination Graph for Multi-Agent Reinforcement Learning
by: Duan, Wei, et al.
Published: (2024)
by: Duan, Wei, et al.
Published: (2024)
Heterogeneity-aware Personalized Federated Learning via Adaptive Dual-Agent Reinforcement Learning
by: Chen, Xi, et al.
Published: (2025)
by: Chen, Xi, et al.
Published: (2025)
A Dual-Agent Adversarial Framework for Robust Generalization in Deep Reinforcement Learning
by: Xie, Zhengpeng, et al.
Published: (2025)
by: Xie, Zhengpeng, et al.
Published: (2025)
Semi-Supervised Online Learning on the Edge by Transforming Knowledge from Teacher Models
by: Xue, Jiabin
Published: (2025)
by: Xue, Jiabin
Published: (2025)
Search-Based Adversarial Estimates for Improving Sample Efficiency in Off-Policy Reinforcement Learning
by: Malato, Federico, et al.
Published: (2025)
by: Malato, Federico, et al.
Published: (2025)
Large Language Model Agent for Hyper-Parameter Optimization
by: Liu, Siyi, et al.
Published: (2024)
by: Liu, Siyi, et al.
Published: (2024)
A Dual Large Language Models Architecture with Herald Guided Prompts for Parallel Fine Grained Traffic Signal Control
by: Guo, Qing, et al.
Published: (2025)
by: Guo, Qing, et al.
Published: (2025)
$Agent^2$: An Agent-Generates-Agent Framework for Reinforcement Learning Automation
by: Wei, Yuan, et al.
Published: (2025)
by: Wei, Yuan, et al.
Published: (2025)
A Curriculum Learning Approach to Reinforcement Learning: Leveraging RAG for Multimodal Question Answering
by: Zhang, Chenliang, et al.
Published: (2025)
by: Zhang, Chenliang, et al.
Published: (2025)
MARLIN: Multi-Agent Reinforcement Learning for Incremental DAG Discovery
by: Li, Dong, et al.
Published: (2026)
by: Li, Dong, et al.
Published: (2026)
Inverse Reinforcement Learning from Non-Stationary Learning Agents
by: Sivakumar, Kavinayan P., et al.
Published: (2024)
by: Sivakumar, Kavinayan P., et al.
Published: (2024)
FairAgent: Democratizing Fairness-Aware Machine Learning with LLM-Powered Agents
by: Dai, Yucong, et al.
Published: (2025)
by: Dai, Yucong, et al.
Published: (2025)
CARE-RL: Capability-Aware Reinforcement Learning for Mitigating Cross-Domain Conflicts
by: Zhang, Rui, et al.
Published: (2026)
by: Zhang, Rui, et al.
Published: (2026)
Bayes Adaptive Monte Carlo Tree Search for Offline Model-based Reinforcement Learning
by: Chen, Jiayu, et al.
Published: (2024)
by: Chen, Jiayu, et al.
Published: (2024)
RAMAC: Multimodal Risk-Aware Offline Reinforcement Learning and the Role of Behavior Regularization
by: Fukazawa, Kai, et al.
Published: (2025)
by: Fukazawa, Kai, et al.
Published: (2025)
DynaSearcher: Dynamic Knowledge Graph Augmented Search Agent via Multi-Reward Reinforcement Learning
by: Hao, Chuzhan, et al.
Published: (2025)
by: Hao, Chuzhan, et al.
Published: (2025)
GRPO-CARE: Consistency-Aware Reinforcement Learning for Multimodal Reasoning
by: Chen, Yi, et al.
Published: (2025)
by: Chen, Yi, et al.
Published: (2025)
Dynamic Adversarial Reinforcement Learning for Robust Multimodal Large Language Models
by: Bao, Yicheng, et al.
Published: (2026)
by: Bao, Yicheng, et al.
Published: (2026)
Stratified GRPO: Handling Structural Heterogeneity in Reinforcement Learning of LLM Search Agents
by: Zhu, Mingkang, et al.
Published: (2025)
by: Zhu, Mingkang, et al.
Published: (2025)
Towards Energy-Aware Federated Learning via MARL: A Dual-Selection Approach for Model and Client
by: Xia, Jun, et al.
Published: (2024)
by: Xia, Jun, et al.
Published: (2024)
Enhancing Robustness of Offline Reinforcement Learning Under Data Corruption via Sharpness-Aware Minimization
by: Xu, Le, et al.
Published: (2025)
by: Xu, Le, et al.
Published: (2025)
Discovering Temporally-Aware Reinforcement Learning Algorithms
by: Jackson, Matthew Thomas, et al.
Published: (2024)
by: Jackson, Matthew Thomas, et al.
Published: (2024)
Enhancing Talent Search Ranking with Role-Aware Expert Mixtures and LLM-based Fine-Grained Job Descriptions
by: Li, Jihang, et al.
Published: (2025)
by: Li, Jihang, et al.
Published: (2025)
Pearl: A Production-ready Reinforcement Learning Agent
by: Zhu, Zheqing, et al.
Published: (2023)
by: Zhu, Zheqing, et al.
Published: (2023)
A Discordance-Aware Multimodal Framework with Multi-Agent Clinical Reasoning
by: Ahadian, Pegah, et al.
Published: (2026)
by: Ahadian, Pegah, et al.
Published: (2026)
Momentum-Based Federated Reinforcement Learning with Interaction and Communication Efficiency
by: Yue, Sheng, et al.
Published: (2024)
by: Yue, Sheng, et al.
Published: (2024)
TimeMaster: Training Time-Series Multimodal LLMs to Reason via Reinforcement Learning
by: Zhang, Junru, et al.
Published: (2025)
by: Zhang, Junru, et al.
Published: (2025)
Scaling Multimodal Search and Recommendation with Small Language Models via Upside-Down Reinforcement Learning
by: Lin, Yu-Chen, et al.
Published: (2025)
by: Lin, Yu-Chen, et al.
Published: (2025)
Highly Parallelized Reinforcement Learning Training with Relaxed Assignment Dependencies
by: He, Zhouyu, et al.
Published: (2025)
by: He, Zhouyu, et al.
Published: (2025)
Pgx: Hardware-Accelerated Parallel Game Simulators for Reinforcement Learning
by: Koyamada, Sotetsu, et al.
Published: (2023)
by: Koyamada, Sotetsu, et al.
Published: (2023)
Language Agents with Reinforcement Learning for Strategic Play in the Werewolf Game
by: Xu, Zelai, et al.
Published: (2023)
by: Xu, Zelai, et al.
Published: (2023)
REAL: Regression-Aware Reinforcement Learning for LLM-as-a-Judge
by: Zhang, Yasi, et al.
Published: (2026)
by: Zhang, Yasi, et al.
Published: (2026)
Evaluation-Aware Reinforcement Learning
by: Deshmukh, Shripad Vilasrao, et al.
Published: (2025)
by: Deshmukh, Shripad Vilasrao, et al.
Published: (2025)
Towards Fault Tolerance in Multi-Agent Reinforcement Learning
by: Shi, Yuchen, et al.
Published: (2024)
by: Shi, Yuchen, et al.
Published: (2024)
Q-Star Meets Scalable Posterior Sampling: Bridging Theory and Practice via HyperAgent
by: Li, Yingru, et al.
Published: (2024)
by: Li, Yingru, et al.
Published: (2024)
ICA: Information-Aware Credit Assignment for Visually Grounded Long-Horizon Information-Seeking Agents
by: Pang, Cong, et al.
Published: (2026)
by: Pang, Cong, et al.
Published: (2026)
Fine-Grained Causal Dynamics Learning with Quantization for Improving Robustness in Reinforcement Learning
by: Hwang, Inwoo, et al.
Published: (2024)
by: Hwang, Inwoo, et al.
Published: (2024)
Continual Offline Reinforcement Learning via Diffusion-based Dual Generative Replay
by: Liu, Jinmei, et al.
Published: (2024)
by: Liu, Jinmei, et al.
Published: (2024)
Structure-Aware Fusion with Progressive Injection for Multimodal Molecular Representation Learning
by: Jing, Zihao, et al.
Published: (2025)
by: Jing, Zihao, et al.
Published: (2025)
Similar Items
-
Tree Search for LLM Agent Reinforcement Learning
by: Ji, Yuxiang, et al.
Published: (2025) -
Group-Aware Coordination Graph for Multi-Agent Reinforcement Learning
by: Duan, Wei, et al.
Published: (2024) -
Heterogeneity-aware Personalized Federated Learning via Adaptive Dual-Agent Reinforcement Learning
by: Chen, Xi, et al.
Published: (2025) -
A Dual-Agent Adversarial Framework for Robust Generalization in Deep Reinforcement Learning
by: Xie, Zhengpeng, et al.
Published: (2025) -
Semi-Supervised Online Learning on the Edge by Transforming Knowledge from Teacher Models
by: Xue, Jiabin
Published: (2025)