Guardado en:
| Autores principales: | Yu, Xiaohan, Feng, Chao, Mei, Lang, Chen, Chong |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2601.09278 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
AI-SearchPlanner: Modular Agentic Search via Pareto-Optimal Multi-Objective Reinforcement Learning
por: Mei, Lang, et al.
Publicado: (2025)
por: Mei, Lang, et al.
Publicado: (2025)
A Survey of Multimodal Retrieval-Augmented Generation
por: Mei, Lang, et al.
Publicado: (2025)
por: Mei, Lang, et al.
Publicado: (2025)
SimpleDeepSearcher: Deep Information Seeking via Web-Powered Reasoning Trajectory Synthesis
por: Sun, Shuang, et al.
Publicado: (2025)
por: Sun, Shuang, et al.
Publicado: (2025)
Explainable CTR Prediction via LLM Reasoning
por: Yu, Xiaohan, et al.
Publicado: (2024)
por: Yu, Xiaohan, et al.
Publicado: (2024)
Hybrid Deep Searcher: Scalable Parallel and Sequential Search Reasoning
por: Ko, Dayoon, et al.
Publicado: (2025)
por: Ko, Dayoon, et al.
Publicado: (2025)
PanguIR Technical Report for NTCIR-18 AEOLLM Task
por: Mei, Lang, et al.
Publicado: (2025)
por: Mei, Lang, et al.
Publicado: (2025)
APEX-Searcher: Refining Credit Assignment with Subgoaling for Agentic Retrieval-Augmented Generation
por: Chen, Kun, et al.
Publicado: (2026)
por: Chen, Kun, et al.
Publicado: (2026)
MindSearch: Mimicking Human Minds Elicits Deep AI Searcher
por: Chen, Zehui, et al.
Publicado: (2024)
por: Chen, Zehui, et al.
Publicado: (2024)
LightSearcher: Efficient DeepSearch via Experiential Memory
por: Lan, Hengzhi, et al.
Publicado: (2025)
por: Lan, Hengzhi, et al.
Publicado: (2025)
CARV: A Diagnostic Benchmark for Compositional Analogical Reasoning in Multimodal LLMs
por: Du, Yongkang, et al.
Publicado: (2026)
por: Du, Yongkang, et al.
Publicado: (2026)
Aligning Large Language Models with Searcher Preferences
por: Wu, Wei, et al.
Publicado: (2026)
por: Wu, Wei, et al.
Publicado: (2026)
AceSearcher: Bootstrapping Reasoning and Search for LLMs via Reinforced Self-Play
por: Xu, Ran, et al.
Publicado: (2025)
por: Xu, Ran, et al.
Publicado: (2025)
MemSearcher: Training LLMs to Reason, Search and Manage Memory via End-to-End Reinforcement Learning
por: Yuan, Qianhao, et al.
Publicado: (2025)
por: Yuan, Qianhao, et al.
Publicado: (2025)
M3Retrieve: Benchmarking Multimodal Retrieval for Medicine
por: Acharya, Arkadeep, et al.
Publicado: (2025)
por: Acharya, Arkadeep, et al.
Publicado: (2025)
AnomSeer: Reinforcing Multimodal LLMs to Reason for Time-Series Anomaly Detection
por: Zhang, Junru, et al.
Publicado: (2026)
por: Zhang, Junru, et al.
Publicado: (2026)
Seeking to Collide: Online Safety-Critical Scenario Generation for Autonomous Driving with Retrieval Augmented Large Language Models
por: Mei, Yuewen, et al.
Publicado: (2025)
por: Mei, Yuewen, et al.
Publicado: (2025)
O$^2$-Searcher: A Searching-based Agent Model for Open-Domain Open-Ended Question Answering
por: Mei, Jianbiao, et al.
Publicado: (2025)
por: Mei, Jianbiao, et al.
Publicado: (2025)
BrowseComp-$V^3$: A Visual, Vertical, and Verifiable Benchmark for Multimodal Browsing Agents
por: Zhang, Huanyao, et al.
Publicado: (2026)
por: Zhang, Huanyao, et al.
Publicado: (2026)
Reason to Contrast: A Cascaded Multimodal Retrieval Framework
por: Cui, Xuanming, et al.
Publicado: (2025)
por: Cui, Xuanming, et al.
Publicado: (2025)
Modularizing Educational LLM-Agency for Fostering Responsible Learning Assistance
por: Gabelmann, Julius, et al.
Publicado: (2026)
por: Gabelmann, Julius, et al.
Publicado: (2026)
StarBench: A Turn-Based RPG Benchmark for Agentic Multimodal Decision-Making and Information Seeking
por: Zhang, Haoran, et al.
Publicado: (2025)
por: Zhang, Haoran, et al.
Publicado: (2025)
SciVideoBench: Benchmarking Scientific Video Reasoning in Large Multimodal Models
por: Deng, Andong, et al.
Publicado: (2025)
por: Deng, Andong, et al.
Publicado: (2025)
OPERA: A Reinforcement Learning--Enhanced Orchestrated Planner-Executor Architecture for Reasoning-Oriented Multi-Hop Retrieval
por: Liu, Yu, et al.
Publicado: (2025)
por: Liu, Yu, et al.
Publicado: (2025)
Deliberative Searcher: Improving LLM Reliability via Reinforcement Learning with constraints
por: Yin, Zhenyun, et al.
Publicado: (2025)
por: Yin, Zhenyun, et al.
Publicado: (2025)
WideSeek-R1: Exploring Width Scaling for Broad Information Seeking via Multi-Agent Reinforcement Learning
por: Xu, Zelai, et al.
Publicado: (2026)
por: Xu, Zelai, et al.
Publicado: (2026)
Prompt-Driven Low-Altitude Edge Intelligence: Modular Agents and Generative Reasoning
por: You, Jiahao, et al.
Publicado: (2026)
por: You, Jiahao, et al.
Publicado: (2026)
MIRAGE: A Benchmark for Multimodal Information-Seeking and Reasoning in Agricultural Expert-Guided Conversations
por: Dongre, Vardhan, et al.
Publicado: (2025)
por: Dongre, Vardhan, et al.
Publicado: (2025)
TimeMaster: Training Time-Series Multimodal LLMs to Reason via Reinforcement Learning
por: Zhang, Junru, et al.
Publicado: (2025)
por: Zhang, Junru, et al.
Publicado: (2025)
DynaSearcher: Dynamic Knowledge Graph Augmented Search Agent via Multi-Reward Reinforcement Learning
por: Hao, Chuzhan, et al.
Publicado: (2025)
por: Hao, Chuzhan, et al.
Publicado: (2025)
Redefining Proactivity for Information Seeking Dialogue
por: Lee, Jing Yang, et al.
Publicado: (2024)
por: Lee, Jing Yang, et al.
Publicado: (2024)
CREMA: Generalizable and Efficient Video-Language Reasoning via Multimodal Modular Fusion
por: Yu, Shoubin, et al.
Publicado: (2024)
por: Yu, Shoubin, et al.
Publicado: (2024)
Context Training with Active Information Seeking
por: Huang, Zeyu, et al.
Publicado: (2026)
por: Huang, Zeyu, et al.
Publicado: (2026)
Retrieval-Augmented Dynamic Prompt Tuning for Incomplete Multimodal Learning
por: Lang, Jian, et al.
Publicado: (2025)
por: Lang, Jian, et al.
Publicado: (2025)
InfoAgent: Advancing Autonomous Information-Seeking Agents
por: Zhang, Gongrui, et al.
Publicado: (2025)
por: Zhang, Gongrui, et al.
Publicado: (2025)
Beyond Chemical QA: Evaluating LLM's Chemical Reasoning with Modular Chemical Operations
por: Li, Hao, et al.
Publicado: (2025)
por: Li, Hao, et al.
Publicado: (2025)
GraphReason: Enhancing Reasoning Capabilities of Large Language Models through A Graph-Based Verification Approach
por: Cao, Lang
Publicado: (2023)
por: Cao, Lang
Publicado: (2023)
A Survey on Knowledge-Oriented Retrieval-Augmented Generation
por: Cheng, Mingyue, et al.
Publicado: (2025)
por: Cheng, Mingyue, et al.
Publicado: (2025)
Seeking the Sufficiency and Necessity Causal Features in Multimodal Representation Learning
por: Chen, Boyu, et al.
Publicado: (2024)
por: Chen, Boyu, et al.
Publicado: (2024)
R1-Searcher: Incentivizing the Search Capability in LLMs via Reinforcement Learning
por: Song, Huatong, et al.
Publicado: (2025)
por: Song, Huatong, et al.
Publicado: (2025)
DLLM-Searcher: Adapting Diffusion Large Language Model for Search Agents
por: Zhao, Jiahao, et al.
Publicado: (2026)
por: Zhao, Jiahao, et al.
Publicado: (2026)
Ejemplares similares
-
AI-SearchPlanner: Modular Agentic Search via Pareto-Optimal Multi-Objective Reinforcement Learning
por: Mei, Lang, et al.
Publicado: (2025) -
A Survey of Multimodal Retrieval-Augmented Generation
por: Mei, Lang, et al.
Publicado: (2025) -
SimpleDeepSearcher: Deep Information Seeking via Web-Powered Reasoning Trajectory Synthesis
por: Sun, Shuang, et al.
Publicado: (2025) -
Explainable CTR Prediction via LLM Reasoning
por: Yu, Xiaohan, et al.
Publicado: (2024) -
Hybrid Deep Searcher: Scalable Parallel and Sequential Search Reasoning
por: Ko, Dayoon, et al.
Publicado: (2025)