R1-Searcher++: Incentivizing the Dynamic Knowledge Acquisition of LLMs via Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Song, Huatong, Jiang, Jinhao, Tian, Wenqing, Chen, Zhipeng, Wu, Yuhuan, Zhao, Jiahao, Min, Yingqian, Zhao, Wayne Xin, Fang, Lei, Wen, Ji-Rong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
R1-Searcher: Incentivizing the Search Capability in LLMs via Reinforcement Learning
di: Song, Huatong, et al.
Pubblicazione: (2025)
di: Song, Huatong, et al.
Pubblicazione: (2025)
SimpleDeepSearcher: Deep Information Seeking via Web-Powered Reasoning Trajectory Synthesis
di: Sun, Shuang, et al.
Pubblicazione: (2025)
di: Sun, Shuang, et al.
Pubblicazione: (2025)
GenCI: Generative Modeling of User Interest Shift via Cohort-based Intent Learning for CTR Prediction
di: Ou, Kesha, et al.
Pubblicazione: (2026)
di: Ou, Kesha, et al.
Pubblicazione: (2026)
EulerFormer: Sequential User Behavior Modeling with Complex Vector Attention
di: Tian, Zhen, et al.
Pubblicazione: (2024)
di: Tian, Zhen, et al.
Pubblicazione: (2024)
Curriculum-scheduled Knowledge Distillation from Multiple Pre-trained Teachers for Multi-domain Sequential Recommendation
di: Sun, Wenqi, et al.
Pubblicazione: (2024)
di: Sun, Wenqi, et al.
Pubblicazione: (2024)
Bridging Textual-Collaborative Gap through Semantic Codes for Sequential Recommendation
di: Liu, Enze, et al.
Pubblicazione: (2025)
di: Liu, Enze, et al.
Pubblicazione: (2025)
Data-CUBE: Data Curriculum for Instruction-based Sentence Representation Learning
di: Min, Yingqian, et al.
Pubblicazione: (2024)
di: Min, Yingqian, et al.
Pubblicazione: (2024)
Investigating the Factual Knowledge Boundary of Large Language Models with Retrieval Augmentation
di: Ren, Ruiyang, et al.
Pubblicazione: (2023)
di: Ren, Ruiyang, et al.
Pubblicazione: (2023)
Rethinking the Evaluation for Conversational Recommendation in the Era of Large Language Models
di: Wang, Xiaolei, et al.
Pubblicazione: (2023)
di: Wang, Xiaolei, et al.
Pubblicazione: (2023)
Universal Item Tokenization for Transferable Generative Recommendation
di: Zheng, Bowen, et al.
Pubblicazione: (2025)
di: Zheng, Bowen, et al.
Pubblicazione: (2025)
Tapping the Potential of Large Language Models as Recommender Systems: A Comprehensive Framework and Empirical Analysis
di: Xu, Lanling, et al.
Pubblicazione: (2024)
di: Xu, Lanling, et al.
Pubblicazione: (2024)
LARES: Latent Reasoning for Sequential Recommendation
di: Liu, Enze, et al.
Pubblicazione: (2025)
di: Liu, Enze, et al.
Pubblicazione: (2025)
Enhancing Graph Contrastive Learning with Reliable and Informative Augmentation for Recommendation
di: Zheng, Bowen, et al.
Pubblicazione: (2024)
di: Zheng, Bowen, et al.
Pubblicazione: (2024)
Adapting Large Language Models by Integrating Collaborative Semantics for Recommendation
di: Zheng, Bowen, et al.
Pubblicazione: (2023)
di: Zheng, Bowen, et al.
Pubblicazione: (2023)
Improving Conversational Recommendation Systems via Counterfactual Data Simulation
di: Wang, Xiaolei, et al.
Pubblicazione: (2023)
di: Wang, Xiaolei, et al.
Pubblicazione: (2023)
AceSearcher: Bootstrapping Reasoning and Search for LLMs via Reinforced Self-Play
di: Xu, Ran, et al.
Pubblicazione: (2025)
di: Xu, Ran, et al.
Pubblicazione: (2025)
REAR: A Relevance-Aware Retrieval-Augmented Framework for Open-Domain Question Answering
di: Wang, Yuhao, et al.
Pubblicazione: (2024)
di: Wang, Yuhao, et al.
Pubblicazione: (2024)
Search-Based Interaction For Conversation Recommendation via Generative Reward Model Based Simulated User
di: Wang, Xiaolei, et al.
Pubblicazione: (2025)
di: Wang, Xiaolei, et al.
Pubblicazione: (2025)
DeepRec: Towards a Deep Dive Into the Item Space with Large Language Model Based Recommendation
di: Zheng, Bowen, et al.
Pubblicazione: (2025)
di: Zheng, Bowen, et al.
Pubblicazione: (2025)
Pre-training Generative Recommender with Multi-Identifier Item Tokenization
di: Zheng, Bowen, et al.
Pubblicazione: (2025)
di: Zheng, Bowen, et al.
Pubblicazione: (2025)
Slow Thinking for Sequential Recommendation
di: Zhang, Junjie, et al.
Pubblicazione: (2025)
di: Zhang, Junjie, et al.
Pubblicazione: (2025)
Challenging the Boundaries of Reasoning: An Olympiad-Level Math Benchmark for Large Language Models
di: Sun, Haoxiang, et al.
Pubblicazione: (2025)
di: Sun, Haoxiang, et al.
Pubblicazione: (2025)
Deep Research for Recommender Systems
di: Ou, Kesha, et al.
Pubblicazione: (2026)
di: Ou, Kesha, et al.
Pubblicazione: (2026)
BASES: Large-scale Web Search User Simulation with Large Language Model based Agents
di: Ren, Ruiyang, et al.
Pubblicazione: (2024)
di: Ren, Ruiyang, et al.
Pubblicazione: (2024)
Enhancing Sequential Recommender with Large Language Models for Joint Video and Comment Recommendation
di: Zheng, Bowen, et al.
Pubblicazione: (2024)
di: Zheng, Bowen, et al.
Pubblicazione: (2024)
Holistically Guided Monte Carlo Tree Search for Intricate Information Seeking
di: Ren, Ruiyang, et al.
Pubblicazione: (2025)
di: Ren, Ruiyang, et al.
Pubblicazione: (2025)
Self-Calibrated Listwise Reranking with Large Language Models
di: Ren, Ruiyang, et al.
Pubblicazione: (2024)
di: Ren, Ruiyang, et al.
Pubblicazione: (2024)
DLRREC: Denoising Latent Representations via Multi-Modal Knowledge Fusion in Deep Recommender Systems
di: Tian, Jiahao, et al.
Pubblicazione: (2025)
di: Tian, Jiahao, et al.
Pubblicazione: (2025)
When a Paper Has 1000 Authors: Rethinking Citation Metrics in the Era of LLMs
di: Guo, Weihang, et al.
Pubblicazione: (2025)
di: Guo, Weihang, et al.
Pubblicazione: (2025)
LevelRAG: Enhancing Retrieval-Augmented Generation with Multi-hop Logic Planning over Rewriting Augmented Searchers
di: Zhang, Zhuocheng, et al.
Pubblicazione: (2025)
di: Zhang, Zhuocheng, et al.
Pubblicazione: (2025)
HtmlRAG: HTML is Better Than Plain Text for Modeling Retrieved Knowledge in RAG Systems
di: Tan, Jiejun, et al.
Pubblicazione: (2024)
di: Tan, Jiejun, et al.
Pubblicazione: (2024)
ArbGraph: Conflict-Aware Evidence Arbitration for Reliable Long-Form Retrieval-Augmented Generation
di: Niu, Qingying, et al.
Pubblicazione: (2026)
di: Niu, Qingying, et al.
Pubblicazione: (2026)
Collaborative Knowledge Fusion: A Novel Approach for Multi-task Recommender Systems via LLMs
di: Zhao, Chuang, et al.
Pubblicazione: (2024)
di: Zhao, Chuang, et al.
Pubblicazione: (2024)
Blockchain-based Federated Recommendation with Incentive Mechanism
di: Chen, Jianhai, et al.
Pubblicazione: (2024)
di: Chen, Jianhai, et al.
Pubblicazione: (2024)
Sequence-level Semantic Representation Fusion for Recommender Systems
di: Xu, Lanling, et al.
Pubblicazione: (2024)
di: Xu, Lanling, et al.
Pubblicazione: (2024)
ChatShopBuddy: Towards Reliable Conversational Shopping Agents via Reinforcement Learning
di: Cheng, Yiruo, et al.
Pubblicazione: (2026)
di: Cheng, Yiruo, et al.
Pubblicazione: (2026)
ICPC-Eval: Probing the Frontiers of LLM Reasoning with Competitive Programming Contests
di: Xu, Shiyi, et al.
Pubblicazione: (2025)
di: Xu, Shiyi, et al.
Pubblicazione: (2025)
Counteracting Duration Bias in Video Recommendation via Counterfactual Watch Time
di: Zhao, Haiyuan, et al.
Pubblicazione: (2024)
di: Zhao, Haiyuan, et al.
Pubblicazione: (2024)
Unbiased Top-k Learning to Rank with Causal Likelihood Decomposition
di: Zhao, Haiyuan, et al.
Pubblicazione: (2022)
di: Zhao, Haiyuan, et al.
Pubblicazione: (2022)
RAG-R1: Incentivizing the Search and Reasoning Capabilities of LLMs through Multi-query Parallelism
di: Tan, Zhiwen, et al.
Pubblicazione: (2025)
di: Tan, Zhiwen, et al.
Pubblicazione: (2025)
Documenti analoghi
-
R1-Searcher: Incentivizing the Search Capability in LLMs via Reinforcement Learning
di: Song, Huatong, et al.
Pubblicazione: (2025) -
SimpleDeepSearcher: Deep Information Seeking via Web-Powered Reasoning Trajectory Synthesis
di: Sun, Shuang, et al.
Pubblicazione: (2025) -
GenCI: Generative Modeling of User Interest Shift via Cohort-based Intent Learning for CTR Prediction
di: Ou, Kesha, et al.
Pubblicazione: (2026) -
EulerFormer: Sequential User Behavior Modeling with Complex Vector Attention
di: Tian, Zhen, et al.
Pubblicazione: (2024) -
Curriculum-scheduled Knowledge Distillation from Multiple Pre-trained Teachers for Multi-domain Sequential Recommendation
di: Sun, Wenqi, et al.
Pubblicazione: (2024)