Saved in:
| Main Authors: | Yu, Xiaohan, Feng, Chao, Mei, Lang, Chen, Chong |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | https://arxiv.org/abs/2601.09278 |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
AI-SearchPlanner: Modular Agentic Search via Pareto-Optimal Multi-Objective Reinforcement Learning
by: Mei, Lang, et al.
Published: (2025)
by: Mei, Lang, et al.
Published: (2025)
A Survey of Multimodal Retrieval-Augmented Generation
by: Mei, Lang, et al.
Published: (2025)
by: Mei, Lang, et al.
Published: (2025)
SimpleDeepSearcher: Deep Information Seeking via Web-Powered Reasoning Trajectory Synthesis
by: Sun, Shuang, et al.
Published: (2025)
by: Sun, Shuang, et al.
Published: (2025)
Explainable CTR Prediction via LLM Reasoning
by: Yu, Xiaohan, et al.
Published: (2024)
by: Yu, Xiaohan, et al.
Published: (2024)
Hybrid Deep Searcher: Scalable Parallel and Sequential Search Reasoning
by: Ko, Dayoon, et al.
Published: (2025)
by: Ko, Dayoon, et al.
Published: (2025)
PanguIR Technical Report for NTCIR-18 AEOLLM Task
by: Mei, Lang, et al.
Published: (2025)
by: Mei, Lang, et al.
Published: (2025)
APEX-Searcher: Refining Credit Assignment with Subgoaling for Agentic Retrieval-Augmented Generation
by: Chen, Kun, et al.
Published: (2026)
by: Chen, Kun, et al.
Published: (2026)
MindSearch: Mimicking Human Minds Elicits Deep AI Searcher
by: Chen, Zehui, et al.
Published: (2024)
by: Chen, Zehui, et al.
Published: (2024)
LightSearcher: Efficient DeepSearch via Experiential Memory
by: Lan, Hengzhi, et al.
Published: (2025)
by: Lan, Hengzhi, et al.
Published: (2025)
CARV: A Diagnostic Benchmark for Compositional Analogical Reasoning in Multimodal LLMs
by: Du, Yongkang, et al.
Published: (2026)
by: Du, Yongkang, et al.
Published: (2026)
Aligning Large Language Models with Searcher Preferences
by: Wu, Wei, et al.
Published: (2026)
by: Wu, Wei, et al.
Published: (2026)
AceSearcher: Bootstrapping Reasoning and Search for LLMs via Reinforced Self-Play
by: Xu, Ran, et al.
Published: (2025)
by: Xu, Ran, et al.
Published: (2025)
MemSearcher: Training LLMs to Reason, Search and Manage Memory via End-to-End Reinforcement Learning
by: Yuan, Qianhao, et al.
Published: (2025)
by: Yuan, Qianhao, et al.
Published: (2025)
M3Retrieve: Benchmarking Multimodal Retrieval for Medicine
by: Acharya, Arkadeep, et al.
Published: (2025)
by: Acharya, Arkadeep, et al.
Published: (2025)
AnomSeer: Reinforcing Multimodal LLMs to Reason for Time-Series Anomaly Detection
by: Zhang, Junru, et al.
Published: (2026)
by: Zhang, Junru, et al.
Published: (2026)
Seeking to Collide: Online Safety-Critical Scenario Generation for Autonomous Driving with Retrieval Augmented Large Language Models
by: Mei, Yuewen, et al.
Published: (2025)
by: Mei, Yuewen, et al.
Published: (2025)
O$^2$-Searcher: A Searching-based Agent Model for Open-Domain Open-Ended Question Answering
by: Mei, Jianbiao, et al.
Published: (2025)
by: Mei, Jianbiao, et al.
Published: (2025)
BrowseComp-$V^3$: A Visual, Vertical, and Verifiable Benchmark for Multimodal Browsing Agents
by: Zhang, Huanyao, et al.
Published: (2026)
by: Zhang, Huanyao, et al.
Published: (2026)
Reason to Contrast: A Cascaded Multimodal Retrieval Framework
by: Cui, Xuanming, et al.
Published: (2025)
by: Cui, Xuanming, et al.
Published: (2025)
Modularizing Educational LLM-Agency for Fostering Responsible Learning Assistance
by: Gabelmann, Julius, et al.
Published: (2026)
by: Gabelmann, Julius, et al.
Published: (2026)
StarBench: A Turn-Based RPG Benchmark for Agentic Multimodal Decision-Making and Information Seeking
by: Zhang, Haoran, et al.
Published: (2025)
by: Zhang, Haoran, et al.
Published: (2025)
SciVideoBench: Benchmarking Scientific Video Reasoning in Large Multimodal Models
by: Deng, Andong, et al.
Published: (2025)
by: Deng, Andong, et al.
Published: (2025)
OPERA: A Reinforcement Learning--Enhanced Orchestrated Planner-Executor Architecture for Reasoning-Oriented Multi-Hop Retrieval
by: Liu, Yu, et al.
Published: (2025)
by: Liu, Yu, et al.
Published: (2025)
Deliberative Searcher: Improving LLM Reliability via Reinforcement Learning with constraints
by: Yin, Zhenyun, et al.
Published: (2025)
by: Yin, Zhenyun, et al.
Published: (2025)
WideSeek-R1: Exploring Width Scaling for Broad Information Seeking via Multi-Agent Reinforcement Learning
by: Xu, Zelai, et al.
Published: (2026)
by: Xu, Zelai, et al.
Published: (2026)
Prompt-Driven Low-Altitude Edge Intelligence: Modular Agents and Generative Reasoning
by: You, Jiahao, et al.
Published: (2026)
by: You, Jiahao, et al.
Published: (2026)
MIRAGE: A Benchmark for Multimodal Information-Seeking and Reasoning in Agricultural Expert-Guided Conversations
by: Dongre, Vardhan, et al.
Published: (2025)
by: Dongre, Vardhan, et al.
Published: (2025)
TimeMaster: Training Time-Series Multimodal LLMs to Reason via Reinforcement Learning
by: Zhang, Junru, et al.
Published: (2025)
by: Zhang, Junru, et al.
Published: (2025)
DynaSearcher: Dynamic Knowledge Graph Augmented Search Agent via Multi-Reward Reinforcement Learning
by: Hao, Chuzhan, et al.
Published: (2025)
by: Hao, Chuzhan, et al.
Published: (2025)
Redefining Proactivity for Information Seeking Dialogue
by: Lee, Jing Yang, et al.
Published: (2024)
by: Lee, Jing Yang, et al.
Published: (2024)
CREMA: Generalizable and Efficient Video-Language Reasoning via Multimodal Modular Fusion
by: Yu, Shoubin, et al.
Published: (2024)
by: Yu, Shoubin, et al.
Published: (2024)
Context Training with Active Information Seeking
by: Huang, Zeyu, et al.
Published: (2026)
by: Huang, Zeyu, et al.
Published: (2026)
Retrieval-Augmented Dynamic Prompt Tuning for Incomplete Multimodal Learning
by: Lang, Jian, et al.
Published: (2025)
by: Lang, Jian, et al.
Published: (2025)
InfoAgent: Advancing Autonomous Information-Seeking Agents
by: Zhang, Gongrui, et al.
Published: (2025)
by: Zhang, Gongrui, et al.
Published: (2025)
Beyond Chemical QA: Evaluating LLM's Chemical Reasoning with Modular Chemical Operations
by: Li, Hao, et al.
Published: (2025)
by: Li, Hao, et al.
Published: (2025)
GraphReason: Enhancing Reasoning Capabilities of Large Language Models through A Graph-Based Verification Approach
by: Cao, Lang
Published: (2023)
by: Cao, Lang
Published: (2023)
A Survey on Knowledge-Oriented Retrieval-Augmented Generation
by: Cheng, Mingyue, et al.
Published: (2025)
by: Cheng, Mingyue, et al.
Published: (2025)
Seeking the Sufficiency and Necessity Causal Features in Multimodal Representation Learning
by: Chen, Boyu, et al.
Published: (2024)
by: Chen, Boyu, et al.
Published: (2024)
R1-Searcher: Incentivizing the Search Capability in LLMs via Reinforcement Learning
by: Song, Huatong, et al.
Published: (2025)
by: Song, Huatong, et al.
Published: (2025)
DLLM-Searcher: Adapting Diffusion Large Language Model for Search Agents
by: Zhao, Jiahao, et al.
Published: (2026)
by: Zhao, Jiahao, et al.
Published: (2026)
Similar Items
-
AI-SearchPlanner: Modular Agentic Search via Pareto-Optimal Multi-Objective Reinforcement Learning
by: Mei, Lang, et al.
Published: (2025) -
A Survey of Multimodal Retrieval-Augmented Generation
by: Mei, Lang, et al.
Published: (2025) -
SimpleDeepSearcher: Deep Information Seeking via Web-Powered Reasoning Trajectory Synthesis
by: Sun, Shuang, et al.
Published: (2025) -
Explainable CTR Prediction via LLM Reasoning
by: Yu, Xiaohan, et al.
Published: (2024) -
Hybrid Deep Searcher: Scalable Parallel and Sequential Search Reasoning
by: Ko, Dayoon, et al.
Published: (2025)