R1-Searcher: Incentivizing the Search Capability in LLMs via Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Song, Huatong, Jiang, Jinhao, Min, Yingqian, Chen, Jie, Chen, Zhipeng, Zhao, Wayne Xin, Fang, Lei, Wen, Ji-Rong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
R1-Searcher++: Incentivizing the Dynamic Knowledge Acquisition of LLMs via Reinforcement Learning
di: Song, Huatong, et al.
Pubblicazione: (2025)
di: Song, Huatong, et al.
Pubblicazione: (2025)
SimpleDeepSearcher: Deep Information Seeking via Web-Powered Reasoning Trajectory Synthesis
di: Sun, Shuang, et al.
Pubblicazione: (2025)
di: Sun, Shuang, et al.
Pubblicazione: (2025)
RAG-R1: Incentivizing the Search and Reasoning Capabilities of LLMs through Multi-query Parallelism
di: Tan, Zhiwen, et al.
Pubblicazione: (2025)
di: Tan, Zhiwen, et al.
Pubblicazione: (2025)
AceSearcher: Bootstrapping Reasoning and Search for LLMs via Reinforced Self-Play
di: Xu, Ran, et al.
Pubblicazione: (2025)
di: Xu, Ran, et al.
Pubblicazione: (2025)
Bridging Textual-Collaborative Gap through Semantic Codes for Sequential Recommendation
di: Liu, Enze, et al.
Pubblicazione: (2025)
di: Liu, Enze, et al.
Pubblicazione: (2025)
Universal Item Tokenization for Transferable Generative Recommendation
di: Zheng, Bowen, et al.
Pubblicazione: (2025)
di: Zheng, Bowen, et al.
Pubblicazione: (2025)
Search-Based Interaction For Conversation Recommendation via Generative Reward Model Based Simulated User
di: Wang, Xiaolei, et al.
Pubblicazione: (2025)
di: Wang, Xiaolei, et al.
Pubblicazione: (2025)
Holistically Guided Monte Carlo Tree Search for Intricate Information Seeking
di: Ren, Ruiyang, et al.
Pubblicazione: (2025)
di: Ren, Ruiyang, et al.
Pubblicazione: (2025)
Enhancing Graph Contrastive Learning with Reliable and Informative Augmentation for Recommendation
di: Zheng, Bowen, et al.
Pubblicazione: (2024)
di: Zheng, Bowen, et al.
Pubblicazione: (2024)
Adapting Large Language Models by Integrating Collaborative Semantics for Recommendation
di: Zheng, Bowen, et al.
Pubblicazione: (2023)
di: Zheng, Bowen, et al.
Pubblicazione: (2023)
Data-CUBE: Data Curriculum for Instruction-based Sentence Representation Learning
di: Min, Yingqian, et al.
Pubblicazione: (2024)
di: Min, Yingqian, et al.
Pubblicazione: (2024)
GenCI: Generative Modeling of User Interest Shift via Cohort-based Intent Learning for CTR Prediction
di: Ou, Kesha, et al.
Pubblicazione: (2026)
di: Ou, Kesha, et al.
Pubblicazione: (2026)
Tapping the Potential of Large Language Models as Recommender Systems: A Comprehensive Framework and Empirical Analysis
di: Xu, Lanling, et al.
Pubblicazione: (2024)
di: Xu, Lanling, et al.
Pubblicazione: (2024)
LARES: Latent Reasoning for Sequential Recommendation
di: Liu, Enze, et al.
Pubblicazione: (2025)
di: Liu, Enze, et al.
Pubblicazione: (2025)
Enhancing LLMs' Reasoning-Intensive Multimedia Search Capabilities through Fine-Tuning and Reinforcement Learning
di: Li, Jinzheng, et al.
Pubblicazione: (2025)
di: Li, Jinzheng, et al.
Pubblicazione: (2025)
EulerFormer: Sequential User Behavior Modeling with Complex Vector Attention
di: Tian, Zhen, et al.
Pubblicazione: (2024)
di: Tian, Zhen, et al.
Pubblicazione: (2024)
BASES: Large-scale Web Search User Simulation with Large Language Model based Agents
di: Ren, Ruiyang, et al.
Pubblicazione: (2024)
di: Ren, Ruiyang, et al.
Pubblicazione: (2024)
Curriculum-scheduled Knowledge Distillation from Multiple Pre-trained Teachers for Multi-domain Sequential Recommendation
di: Sun, Wenqi, et al.
Pubblicazione: (2024)
di: Sun, Wenqi, et al.
Pubblicazione: (2024)
Rethinking the Evaluation for Conversational Recommendation in the Era of Large Language Models
di: Wang, Xiaolei, et al.
Pubblicazione: (2023)
di: Wang, Xiaolei, et al.
Pubblicazione: (2023)
Query-oriented Data Augmentation for Session Search
di: Chen, Haonan, et al.
Pubblicazione: (2024)
di: Chen, Haonan, et al.
Pubblicazione: (2024)
MLLMRec-R1: Incentivizing Reasoning Capability in Large Language Models for Multimodal Sequential Recommendation
di: Wang, Yu, et al.
Pubblicazione: (2026)
di: Wang, Yu, et al.
Pubblicazione: (2026)
Blockchain-based Federated Recommendation with Incentive Mechanism
di: Chen, Jianhai, et al.
Pubblicazione: (2024)
di: Chen, Jianhai, et al.
Pubblicazione: (2024)
DeepRec: Towards a Deep Dive Into the Item Space with Large Language Model Based Recommendation
di: Zheng, Bowen, et al.
Pubblicazione: (2025)
di: Zheng, Bowen, et al.
Pubblicazione: (2025)
Pre-training Generative Recommender with Multi-Identifier Item Tokenization
di: Zheng, Bowen, et al.
Pubblicazione: (2025)
di: Zheng, Bowen, et al.
Pubblicazione: (2025)
Slow Thinking for Sequential Recommendation
di: Zhang, Junjie, et al.
Pubblicazione: (2025)
di: Zhang, Junjie, et al.
Pubblicazione: (2025)
Sticker-TTS: Learn to Utilize Historical Experience with a Sticker-driven Test-Time Scaling Framework
di: Chen, Jie, et al.
Pubblicazione: (2025)
di: Chen, Jie, et al.
Pubblicazione: (2025)
Challenging the Boundaries of Reasoning: An Olympiad-Level Math Benchmark for Large Language Models
di: Sun, Haoxiang, et al.
Pubblicazione: (2025)
di: Sun, Haoxiang, et al.
Pubblicazione: (2025)
Deep Research for Recommender Systems
di: Ou, Kesha, et al.
Pubblicazione: (2026)
di: Ou, Kesha, et al.
Pubblicazione: (2026)
REAR: A Relevance-Aware Retrieval-Augmented Framework for Open-Domain Question Answering
di: Wang, Yuhao, et al.
Pubblicazione: (2024)
di: Wang, Yuhao, et al.
Pubblicazione: (2024)
Imitate, Explore, and Self-Improve: A Reproduction Report on Slow-thinking Reasoning Systems
di: Min, Yingqian, et al.
Pubblicazione: (2024)
di: Min, Yingqian, et al.
Pubblicazione: (2024)
An Empirical Study on Eliciting and Improving R1-like Reasoning Models
di: Chen, Zhipeng, et al.
Pubblicazione: (2025)
di: Chen, Zhipeng, et al.
Pubblicazione: (2025)
Enhancing Sequential Recommender with Large Language Models for Joint Video and Comment Recommendation
di: Zheng, Bowen, et al.
Pubblicazione: (2024)
di: Zheng, Bowen, et al.
Pubblicazione: (2024)
Improving Conversational Recommendation Systems via Counterfactual Data Simulation
di: Wang, Xiaolei, et al.
Pubblicazione: (2023)
di: Wang, Xiaolei, et al.
Pubblicazione: (2023)
Search-R1: Training LLMs to Reason and Leverage Search Engines with Reinforcement Learning
di: Jin, Bowen, et al.
Pubblicazione: (2025)
di: Jin, Bowen, et al.
Pubblicazione: (2025)
Introducing Semantic Capability in LinkedIn's Content Search Engine
di: Yang, Xin, et al.
Pubblicazione: (2024)
di: Yang, Xin, et al.
Pubblicazione: (2024)
User Behavior Simulation with Large Language Model based Agents
di: Wang, Lei, et al.
Pubblicazione: (2023)
di: Wang, Lei, et al.
Pubblicazione: (2023)
LevelRAG: Enhancing Retrieval-Augmented Generation with Multi-hop Logic Planning over Rewriting Augmented Searchers
di: Zhang, Zhuocheng, et al.
Pubblicazione: (2025)
di: Zhang, Zhuocheng, et al.
Pubblicazione: (2025)
ConvSearch-R1: Enhancing Query Reformulation for Conversational Search with Reasoning via Reinforcement Learning
di: Zhu, Changtai, et al.
Pubblicazione: (2025)
di: Zhu, Changtai, et al.
Pubblicazione: (2025)
From Web Search towards Agentic Deep Research: Incentivizing Search with Reasoning Agents
di: Zhang, Weizhi, et al.
Pubblicazione: (2025)
di: Zhang, Weizhi, et al.
Pubblicazione: (2025)
MERIT: A Merchant Incentive Ranking Model for Hotel Search & Ranking
di: Quan, Shigang, et al.
Pubblicazione: (2025)
di: Quan, Shigang, et al.
Pubblicazione: (2025)
Documenti analoghi
-
R1-Searcher++: Incentivizing the Dynamic Knowledge Acquisition of LLMs via Reinforcement Learning
di: Song, Huatong, et al.
Pubblicazione: (2025) -
SimpleDeepSearcher: Deep Information Seeking via Web-Powered Reasoning Trajectory Synthesis
di: Sun, Shuang, et al.
Pubblicazione: (2025) -
RAG-R1: Incentivizing the Search and Reasoning Capabilities of LLMs through Multi-query Parallelism
di: Tan, Zhiwen, et al.
Pubblicazione: (2025) -
AceSearcher: Bootstrapping Reasoning and Search for LLMs via Reinforced Self-Play
di: Xu, Ran, et al.
Pubblicazione: (2025) -
Bridging Textual-Collaborative Gap through Semantic Codes for Sequential Recommendation
di: Liu, Enze, et al.
Pubblicazione: (2025)