AI-SearchPlanner: Modular Agentic Search via Pareto-Optimal Multi-Objective Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Mei, Lang, Yang, Zhihan, Yu, Xiaohan, Zhang, Huanyao, Chen, Chong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
AutoSearch: Adaptive Search Depth for Efficient Agentic RAG via Reinforcement Learning
di: Sun, Jingbo, et al.
Pubblicazione: (2026)
di: Sun, Jingbo, et al.
Pubblicazione: (2026)
M$^3$Searcher: Modular Multimodal Information Seeking Agency with Retrieval-Oriented Reasoning
di: Yu, Xiaohan, et al.
Pubblicazione: (2026)
di: Yu, Xiaohan, et al.
Pubblicazione: (2026)
Agentic Transformers Provably Learn to Search via Reinforcement Learning
di: Yang, Tong, et al.
Pubblicazione: (2026)
di: Yang, Tong, et al.
Pubblicazione: (2026)
CogPlanner: Unveiling the Potential of Agentic Multimodal Retrieval Augmented Generation with Planning
di: Yu, Xiaohan, et al.
Pubblicazione: (2025)
di: Yu, Xiaohan, et al.
Pubblicazione: (2025)
Certifying Pareto-Optimality in Multi-Objective Maximum Satisfiability
di: Jabs, Christoph, et al.
Pubblicazione: (2025)
di: Jabs, Christoph, et al.
Pubblicazione: (2025)
In Search for Architectures and Loss Functions in Multi-Objective Reinforcement Learning
di: Terekhov, Mikhail, et al.
Pubblicazione: (2024)
di: Terekhov, Mikhail, et al.
Pubblicazione: (2024)
Generalizing Multi-Objective Search via Objective-Aggregation Functions
di: Peer, Hadar, et al.
Pubblicazione: (2025)
di: Peer, Hadar, et al.
Pubblicazione: (2025)
Pareto-NRPA: A Novel Monte-Carlo Search Algorithm for Multi-Objective Optimization
di: Lallouet, Noé, et al.
Pubblicazione: (2025)
di: Lallouet, Noé, et al.
Pubblicazione: (2025)
ReSearch: Learning to Reason with Search for LLMs via Reinforcement Learning
di: Chen, Mingyang, et al.
Pubblicazione: (2025)
di: Chen, Mingyang, et al.
Pubblicazione: (2025)
Pareto-Optimality, Smoothness, and Stochasticity in Learning-Augmented One-Max-Search
di: Benomar, Ziyad, et al.
Pubblicazione: (2025)
di: Benomar, Ziyad, et al.
Pubblicazione: (2025)
UC-MOA: Utility-Conditioned Multi-Objective Alignment for Distributional Pareto-Optimality
di: Cheng, Zelei, et al.
Pubblicazione: (2025)
di: Cheng, Zelei, et al.
Pubblicazione: (2025)
Heuristic Search for Multi-Objective Probabilistic Planning
di: Chen, Dillon, et al.
Pubblicazione: (2023)
di: Chen, Dillon, et al.
Pubblicazione: (2023)
Lean Refactor: Multi-Objective Controllable Proof Optimization via Agentic Strategy Search
di: Lu, Jialin, et al.
Pubblicazione: (2026)
di: Lu, Jialin, et al.
Pubblicazione: (2026)
Learning Pareto-Optimal Rewards from Noisy Preferences: A Framework for Multi-Objective Inverse Reinforcement Learning
di: Cherukuri, Kalyan, et al.
Pubblicazione: (2025)
di: Cherukuri, Kalyan, et al.
Pubblicazione: (2025)
Multi-Objective Neural Architecture Search by Learning Search Space Partitions
di: Zhao, Yiyang, et al.
Pubblicazione: (2024)
di: Zhao, Yiyang, et al.
Pubblicazione: (2024)
Beyond Monolithic Architectures: A Multi-Agent Search and Knowledge Optimization Framework for Agentic Search
di: Chen, Yiqun, et al.
Pubblicazione: (2026)
di: Chen, Yiqun, et al.
Pubblicazione: (2026)
A Survey of Multimodal Retrieval-Augmented Generation
di: Mei, Lang, et al.
Pubblicazione: (2025)
di: Mei, Lang, et al.
Pubblicazione: (2025)
CoSearch: Joint Training of Reasoning and Document Ranking via Reinforcement Learning for Agentic Search
di: Zeng, Hansi, et al.
Pubblicazione: (2026)
di: Zeng, Hansi, et al.
Pubblicazione: (2026)
One Search Fits All: Pareto-Optimal Eco-Friendly Model Selection
di: Betello, Filippo, et al.
Pubblicazione: (2025)
di: Betello, Filippo, et al.
Pubblicazione: (2025)
LocalSearchBench: Benchmarking Agentic Search in Real-World Local Life Services
di: He, Hang, et al.
Pubblicazione: (2025)
di: He, Hang, et al.
Pubblicazione: (2025)
Hindsight Planner: A Closed-Loop Few-Shot Planner for Embodied Instruction Following
di: Yang, Yuxiao, et al.
Pubblicazione: (2024)
di: Yang, Yuxiao, et al.
Pubblicazione: (2024)
Learning Pareto Set for Multi-Objective Continuous Robot Control
di: Shu, Tianye, et al.
Pubblicazione: (2024)
di: Shu, Tianye, et al.
Pubblicazione: (2024)
CuSearch: Curriculum Rollout Sampling via Search Depth for Agentic RAG
di: Shen, Jianghan, et al.
Pubblicazione: (2026)
di: Shen, Jianghan, et al.
Pubblicazione: (2026)
PiCA: Pivot-Based Credit Assignment for Search Agentic Reinforcement Learning
di: Liu, Dongyi, et al.
Pubblicazione: (2026)
di: Liu, Dongyi, et al.
Pubblicazione: (2026)
Robust Evolutionary Multi-Objective Network Architecture Search for Reinforcement Learning (EMNAS-RL)
di: Adde, Nihal Acharya, et al.
Pubblicazione: (2025)
di: Adde, Nihal Acharya, et al.
Pubblicazione: (2025)
Towards Agentic Self-Learning LLMs in Search Environment
di: Sun, Wangtao, et al.
Pubblicazione: (2025)
di: Sun, Wangtao, et al.
Pubblicazione: (2025)
AdaCoT: Pareto-Optimal Adaptive Chain-of-Thought Triggering via Reinforcement Learning
di: Lou, Chenwei, et al.
Pubblicazione: (2025)
di: Lou, Chenwei, et al.
Pubblicazione: (2025)
Multi-Objective Search: Algorithms, Applications, and Emerging Directions
di: Salzman, Oren, et al.
Pubblicazione: (2025)
di: Salzman, Oren, et al.
Pubblicazione: (2025)
RosettaSearch: Multi-Objective Inference-Time Search for Protein Sequence Design
di: Kshirsagar, Meghana, et al.
Pubblicazione: (2026)
di: Kshirsagar, Meghana, et al.
Pubblicazione: (2026)
PA2D-MORL: Pareto Ascent Directional Decomposition based Multi-Objective Reinforcement Learning
di: Hu, Tianmeng, et al.
Pubblicazione: (2026)
di: Hu, Tianmeng, et al.
Pubblicazione: (2026)
Search Wisely: Mitigating Sub-optimal Agentic Searches By Reducing Uncertainty
di: Wu, Peilin, et al.
Pubblicazione: (2025)
di: Wu, Peilin, et al.
Pubblicazione: (2025)
Explainable CTR Prediction via LLM Reasoning
di: Yu, Xiaohan, et al.
Pubblicazione: (2024)
di: Yu, Xiaohan, et al.
Pubblicazione: (2024)
Agentic Mixture-of-Workflows for Multi-Modal Chemical Search
di: Callahan, Tiffany J., et al.
Pubblicazione: (2025)
di: Callahan, Tiffany J., et al.
Pubblicazione: (2025)
CorrectionPlanner: Self-Correction Planner with Reinforcement Learning in Autonomous Driving
di: Guo, Yihong, et al.
Pubblicazione: (2026)
di: Guo, Yihong, et al.
Pubblicazione: (2026)
Bridging the Evaluation Gap: Standardized Benchmarks for Multi-Objective Search
di: Peer, Hadar, et al.
Pubblicazione: (2026)
di: Peer, Hadar, et al.
Pubblicazione: (2026)
ParetoFlow: Guided Flows in Multi-Objective Optimization
di: Yuan, Ye, et al.
Pubblicazione: (2024)
di: Yuan, Ye, et al.
Pubblicazione: (2024)
Beyond Trajectory Rewards: Step-level Credit Assignment for Agentic Search via Graph Modeling
di: Liu, Yuchen, et al.
Pubblicazione: (2026)
di: Liu, Yuchen, et al.
Pubblicazione: (2026)
Pareto-Optimal Offline Reinforcement Learning via Smooth Tchebysheff Scalarization
di: Bhatnagar, Aadyot, et al.
Pubblicazione: (2026)
di: Bhatnagar, Aadyot, et al.
Pubblicazione: (2026)
Can LLMs Time Travel? Enhancing Temporal Consistency in Legal Agentic Search through Reinforcement Learning
di: Fan, Wei, et al.
Pubblicazione: (2026)
di: Fan, Wei, et al.
Pubblicazione: (2026)
OASES: Outcome-Aligned Search-Evaluation Co-Training for Agentic Search
di: Zhang, Erhan, et al.
Pubblicazione: (2026)
di: Zhang, Erhan, et al.
Pubblicazione: (2026)
Documenti analoghi
-
AutoSearch: Adaptive Search Depth for Efficient Agentic RAG via Reinforcement Learning
di: Sun, Jingbo, et al.
Pubblicazione: (2026) -
M$^3$Searcher: Modular Multimodal Information Seeking Agency with Retrieval-Oriented Reasoning
di: Yu, Xiaohan, et al.
Pubblicazione: (2026) -
Agentic Transformers Provably Learn to Search via Reinforcement Learning
di: Yang, Tong, et al.
Pubblicazione: (2026) -
CogPlanner: Unveiling the Potential of Agentic Multimodal Retrieval Augmented Generation with Planning
di: Yu, Xiaohan, et al.
Pubblicazione: (2025) -
Certifying Pareto-Optimality in Multi-Objective Maximum Satisfiability
di: Jabs, Christoph, et al.
Pubblicazione: (2025)