AI-SearchPlanner: Modular Agentic Search via Pareto-Optimal Multi-Objective Reinforcement Learning
Fuente:
arXiv
Saved in:
| Main Authors: | Mei, Lang, Yang, Zhihan, Yu, Xiaohan, Zhang, Huanyao, Chen, Chong |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
AutoSearch: Adaptive Search Depth for Efficient Agentic RAG via Reinforcement Learning
by: Sun, Jingbo, et al.
Published: (2026)
by: Sun, Jingbo, et al.
Published: (2026)
M$^3$Searcher: Modular Multimodal Information Seeking Agency with Retrieval-Oriented Reasoning
by: Yu, Xiaohan, et al.
Published: (2026)
by: Yu, Xiaohan, et al.
Published: (2026)
Agentic Transformers Provably Learn to Search via Reinforcement Learning
by: Yang, Tong, et al.
Published: (2026)
by: Yang, Tong, et al.
Published: (2026)
CogPlanner: Unveiling the Potential of Agentic Multimodal Retrieval Augmented Generation with Planning
by: Yu, Xiaohan, et al.
Published: (2025)
by: Yu, Xiaohan, et al.
Published: (2025)
Certifying Pareto-Optimality in Multi-Objective Maximum Satisfiability
by: Jabs, Christoph, et al.
Published: (2025)
by: Jabs, Christoph, et al.
Published: (2025)
In Search for Architectures and Loss Functions in Multi-Objective Reinforcement Learning
by: Terekhov, Mikhail, et al.
Published: (2024)
by: Terekhov, Mikhail, et al.
Published: (2024)
Generalizing Multi-Objective Search via Objective-Aggregation Functions
by: Peer, Hadar, et al.
Published: (2025)
by: Peer, Hadar, et al.
Published: (2025)
Pareto-NRPA: A Novel Monte-Carlo Search Algorithm for Multi-Objective Optimization
by: Lallouet, Noé, et al.
Published: (2025)
by: Lallouet, Noé, et al.
Published: (2025)
ReSearch: Learning to Reason with Search for LLMs via Reinforcement Learning
by: Chen, Mingyang, et al.
Published: (2025)
by: Chen, Mingyang, et al.
Published: (2025)
Pareto-Optimality, Smoothness, and Stochasticity in Learning-Augmented One-Max-Search
by: Benomar, Ziyad, et al.
Published: (2025)
by: Benomar, Ziyad, et al.
Published: (2025)
UC-MOA: Utility-Conditioned Multi-Objective Alignment for Distributional Pareto-Optimality
by: Cheng, Zelei, et al.
Published: (2025)
by: Cheng, Zelei, et al.
Published: (2025)
Heuristic Search for Multi-Objective Probabilistic Planning
by: Chen, Dillon, et al.
Published: (2023)
by: Chen, Dillon, et al.
Published: (2023)
Lean Refactor: Multi-Objective Controllable Proof Optimization via Agentic Strategy Search
by: Lu, Jialin, et al.
Published: (2026)
by: Lu, Jialin, et al.
Published: (2026)
Learning Pareto-Optimal Rewards from Noisy Preferences: A Framework for Multi-Objective Inverse Reinforcement Learning
by: Cherukuri, Kalyan, et al.
Published: (2025)
by: Cherukuri, Kalyan, et al.
Published: (2025)
Multi-Objective Neural Architecture Search by Learning Search Space Partitions
by: Zhao, Yiyang, et al.
Published: (2024)
by: Zhao, Yiyang, et al.
Published: (2024)
Beyond Monolithic Architectures: A Multi-Agent Search and Knowledge Optimization Framework for Agentic Search
by: Chen, Yiqun, et al.
Published: (2026)
by: Chen, Yiqun, et al.
Published: (2026)
A Survey of Multimodal Retrieval-Augmented Generation
by: Mei, Lang, et al.
Published: (2025)
by: Mei, Lang, et al.
Published: (2025)
CoSearch: Joint Training of Reasoning and Document Ranking via Reinforcement Learning for Agentic Search
by: Zeng, Hansi, et al.
Published: (2026)
by: Zeng, Hansi, et al.
Published: (2026)
One Search Fits All: Pareto-Optimal Eco-Friendly Model Selection
by: Betello, Filippo, et al.
Published: (2025)
by: Betello, Filippo, et al.
Published: (2025)
LocalSearchBench: Benchmarking Agentic Search in Real-World Local Life Services
by: He, Hang, et al.
Published: (2025)
by: He, Hang, et al.
Published: (2025)
Hindsight Planner: A Closed-Loop Few-Shot Planner for Embodied Instruction Following
by: Yang, Yuxiao, et al.
Published: (2024)
by: Yang, Yuxiao, et al.
Published: (2024)
Learning Pareto Set for Multi-Objective Continuous Robot Control
by: Shu, Tianye, et al.
Published: (2024)
by: Shu, Tianye, et al.
Published: (2024)
CuSearch: Curriculum Rollout Sampling via Search Depth for Agentic RAG
by: Shen, Jianghan, et al.
Published: (2026)
by: Shen, Jianghan, et al.
Published: (2026)
PiCA: Pivot-Based Credit Assignment for Search Agentic Reinforcement Learning
by: Liu, Dongyi, et al.
Published: (2026)
by: Liu, Dongyi, et al.
Published: (2026)
Robust Evolutionary Multi-Objective Network Architecture Search for Reinforcement Learning (EMNAS-RL)
by: Adde, Nihal Acharya, et al.
Published: (2025)
by: Adde, Nihal Acharya, et al.
Published: (2025)
Towards Agentic Self-Learning LLMs in Search Environment
by: Sun, Wangtao, et al.
Published: (2025)
by: Sun, Wangtao, et al.
Published: (2025)
AdaCoT: Pareto-Optimal Adaptive Chain-of-Thought Triggering via Reinforcement Learning
by: Lou, Chenwei, et al.
Published: (2025)
by: Lou, Chenwei, et al.
Published: (2025)
Multi-Objective Search: Algorithms, Applications, and Emerging Directions
by: Salzman, Oren, et al.
Published: (2025)
by: Salzman, Oren, et al.
Published: (2025)
RosettaSearch: Multi-Objective Inference-Time Search for Protein Sequence Design
by: Kshirsagar, Meghana, et al.
Published: (2026)
by: Kshirsagar, Meghana, et al.
Published: (2026)
PA2D-MORL: Pareto Ascent Directional Decomposition based Multi-Objective Reinforcement Learning
by: Hu, Tianmeng, et al.
Published: (2026)
by: Hu, Tianmeng, et al.
Published: (2026)
Search Wisely: Mitigating Sub-optimal Agentic Searches By Reducing Uncertainty
by: Wu, Peilin, et al.
Published: (2025)
by: Wu, Peilin, et al.
Published: (2025)
Explainable CTR Prediction via LLM Reasoning
by: Yu, Xiaohan, et al.
Published: (2024)
by: Yu, Xiaohan, et al.
Published: (2024)
Agentic Mixture-of-Workflows for Multi-Modal Chemical Search
by: Callahan, Tiffany J., et al.
Published: (2025)
by: Callahan, Tiffany J., et al.
Published: (2025)
CorrectionPlanner: Self-Correction Planner with Reinforcement Learning in Autonomous Driving
by: Guo, Yihong, et al.
Published: (2026)
by: Guo, Yihong, et al.
Published: (2026)
Bridging the Evaluation Gap: Standardized Benchmarks for Multi-Objective Search
by: Peer, Hadar, et al.
Published: (2026)
by: Peer, Hadar, et al.
Published: (2026)
ParetoFlow: Guided Flows in Multi-Objective Optimization
by: Yuan, Ye, et al.
Published: (2024)
by: Yuan, Ye, et al.
Published: (2024)
Beyond Trajectory Rewards: Step-level Credit Assignment for Agentic Search via Graph Modeling
by: Liu, Yuchen, et al.
Published: (2026)
by: Liu, Yuchen, et al.
Published: (2026)
Pareto-Optimal Offline Reinforcement Learning via Smooth Tchebysheff Scalarization
by: Bhatnagar, Aadyot, et al.
Published: (2026)
by: Bhatnagar, Aadyot, et al.
Published: (2026)
Can LLMs Time Travel? Enhancing Temporal Consistency in Legal Agentic Search through Reinforcement Learning
by: Fan, Wei, et al.
Published: (2026)
by: Fan, Wei, et al.
Published: (2026)
OASES: Outcome-Aligned Search-Evaluation Co-Training for Agentic Search
by: Zhang, Erhan, et al.
Published: (2026)
by: Zhang, Erhan, et al.
Published: (2026)
Similar Items
-
AutoSearch: Adaptive Search Depth for Efficient Agentic RAG via Reinforcement Learning
by: Sun, Jingbo, et al.
Published: (2026) -
M$^3$Searcher: Modular Multimodal Information Seeking Agency with Retrieval-Oriented Reasoning
by: Yu, Xiaohan, et al.
Published: (2026) -
Agentic Transformers Provably Learn to Search via Reinforcement Learning
by: Yang, Tong, et al.
Published: (2026) -
CogPlanner: Unveiling the Potential of Agentic Multimodal Retrieval Augmented Generation with Planning
by: Yu, Xiaohan, et al.
Published: (2025) -
Certifying Pareto-Optimality in Multi-Objective Maximum Satisfiability
by: Jabs, Christoph, et al.
Published: (2025)