Search-R2: Enhancing Search-Integrated Reasoning via Actor-Refiner Collaboration
Fuente:
arXiv
Salvato in:
| Autori principali: | He, Bowei, Hu, Minda, Xu, Zenan, Wang, Hongru, Zong, Licheng, Chen, Yankai, Ma, Chen, Liu, Xue, Zhou, Pluto, King, Irwin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SeRTS: Self-Rewarding Tree Search for Biomedical Retrieval-Augmented Generation
di: Hu, Minda, et al.
Pubblicazione: (2024)
di: Hu, Minda, et al.
Pubblicazione: (2024)
ConMax: Confidence-Maximizing Compression for Efficient Chain-of-Thought Reasoning
di: Hu, Minda, et al.
Pubblicazione: (2026)
di: Hu, Minda, et al.
Pubblicazione: (2026)
Mitigating Large Language Model Hallucination with Faithful Finetuning
di: Hu, Minda, et al.
Pubblicazione: (2024)
di: Hu, Minda, et al.
Pubblicazione: (2024)
NILE: Internal Consistency Alignment in Large Language Models
di: Hu, Minda, et al.
Pubblicazione: (2024)
di: Hu, Minda, et al.
Pubblicazione: (2024)
Towards Effective Top-N Hamming Search via Bipartite Graph Contrastive Hashing
di: Chen, Yankai, et al.
Pubblicazione: (2024)
di: Chen, Yankai, et al.
Pubblicazione: (2024)
Learning Binarized Representations with Pseudo-positive Sample Enhancement for Efficient Graph Collaborative Filtering
di: Chen, Yankai, et al.
Pubblicazione: (2025)
di: Chen, Yankai, et al.
Pubblicazione: (2025)
The Integration of Semantic and Structural Knowledge in Knowledge Graph Entity Typing
di: Li, Muzhi, et al.
Pubblicazione: (2024)
di: Li, Muzhi, et al.
Pubblicazione: (2024)
SRR-Judge: Step-Level Rating and Refinement for Enhancing Search-Integrated Reasoning in Search Agents
di: Zhang, Chen, et al.
Pubblicazione: (2026)
di: Zhang, Chen, et al.
Pubblicazione: (2026)
ReSearch: Learning to Reason with Search for LLMs via Reinforcement Learning
di: Chen, Mingyang, et al.
Pubblicazione: (2025)
di: Chen, Mingyang, et al.
Pubblicazione: (2025)
Saliency-R1: Enforcing Interpretable and Faithful Vision-language Reasoning via Saliency-map Alignment Reward
di: Gong, Shizhan, et al.
Pubblicazione: (2026)
di: Gong, Shizhan, et al.
Pubblicazione: (2026)
Rethinking Machine Ethics -- Can LLMs Perform Moral Reasoning through the Lens of Moral Theories?
di: Zhou, Jingyan, et al.
Pubblicazione: (2023)
di: Zhou, Jingyan, et al.
Pubblicazione: (2023)
WebCoT: Enhancing Web Agent Reasoning by Reconstructing Chain-of-Thought in Reflection, Branching, and Rollback
di: Hu, Minda, et al.
Pubblicazione: (2025)
di: Hu, Minda, et al.
Pubblicazione: (2025)
Result Diversification in Search and Recommendation: A Survey
di: Wu, Haolun, et al.
Pubblicazione: (2022)
di: Wu, Haolun, et al.
Pubblicazione: (2022)
HiHPQ: Hierarchical Hyperbolic Product Quantization for Unsupervised Image Retrieval
di: Qiu, Zexuan, et al.
Pubblicazione: (2024)
di: Qiu, Zexuan, et al.
Pubblicazione: (2024)
Dynamic Mixture of Latent Memories for Self-Evolving Agents
di: Yu, Dianzhi, et al.
Pubblicazione: (2026)
di: Yu, Dianzhi, et al.
Pubblicazione: (2026)
Distributionally Robust Set Representation Learning Under Inference-Time Element Corruption
di: Chen, Yankai, et al.
Pubblicazione: (2026)
di: Chen, Yankai, et al.
Pubblicazione: (2026)
Spatial CAPTCHA: Generatively Benchmarking Spatial Reasoning for Human-Machine Differentiation
di: Kharlamova, Arina, et al.
Pubblicazione: (2025)
di: Kharlamova, Arina, et al.
Pubblicazione: (2025)
From Web Search towards Agentic Deep Research: Incentivizing Search with Reasoning Agents
di: Zhang, Weizhi, et al.
Pubblicazione: (2025)
di: Zhang, Weizhi, et al.
Pubblicazione: (2025)
Pedagogically-Inspired Data Synthesis for Language Model Knowledge Distillation
di: He, Bowei, et al.
Pubblicazione: (2026)
di: He, Bowei, et al.
Pubblicazione: (2026)
Deep Structural Knowledge Exploitation and Synergy for Estimating Node Importance Value on Heterogeneous Information Networks
di: Chen, Yankai, et al.
Pubblicazione: (2024)
di: Chen, Yankai, et al.
Pubblicazione: (2024)
ActorMind: Emulating Human Actor Reasoning for Speech Role-Playing
di: Chen, Xi, et al.
Pubblicazione: (2026)
di: Chen, Xi, et al.
Pubblicazione: (2026)
ConvSearch-R1: Enhancing Query Reformulation for Conversational Search with Reasoning via Reinforcement Learning
di: Zhu, Changtai, et al.
Pubblicazione: (2025)
di: Zhu, Changtai, et al.
Pubblicazione: (2025)
UTCS: Effective Unsupervised Temporal Community Search with Pre-training of Temporal Dynamics and Subgraph Knowledge
di: Zhang, Yue, et al.
Pubblicazione: (2025)
di: Zhang, Yue, et al.
Pubblicazione: (2025)
Chiron-o1: Igniting Multimodal Large Language Models towards Generalizable Medical Reasoning via Mentor-Intern Collaborative Search
di: Sun, Haoran, et al.
Pubblicazione: (2025)
di: Sun, Haoran, et al.
Pubblicazione: (2025)
PSDiff: Diffusion Model for Person Search with Iterative and Collaborative Refinement
di: Jia, Chengyou, et al.
Pubblicazione: (2023)
di: Jia, Chengyou, et al.
Pubblicazione: (2023)
Interpretable Triplet Importance for Personalized Ranking
di: He, Bowei, et al.
Pubblicazione: (2024)
di: He, Bowei, et al.
Pubblicazione: (2024)
Beyond One-Size-Fits-All Pruning via Evolutionary Metric Search for Large Language Models
di: Liu, Shuqi, et al.
Pubblicazione: (2025)
di: Liu, Shuqi, et al.
Pubblicazione: (2025)
R-Search: Empowering LLM Reasoning with Search via Multi-Reward Reinforcement Learning
di: Zhao, Qingfei, et al.
Pubblicazione: (2025)
di: Zhao, Qingfei, et al.
Pubblicazione: (2025)
Search-o1: Agentic Search-Enhanced Large Reasoning Models
di: Li, Xiaoxi, et al.
Pubblicazione: (2025)
di: Li, Xiaoxi, et al.
Pubblicazione: (2025)
Reasoning in Action: MCTS-Driven Knowledge Retrieval for Large Language Models
di: Liu, Shuqi, et al.
Pubblicazione: (2025)
di: Liu, Shuqi, et al.
Pubblicazione: (2025)
From General to Targeted Rewards: Surpassing GPT-4 in Open-Ended Long-Context Generation
di: Guo, Zhihan, et al.
Pubblicazione: (2025)
di: Guo, Zhihan, et al.
Pubblicazione: (2025)
Coordinating Search-Informed Reasoning and Reasoning-Guided Search in Claim Verification
di: Hu, Qisheng, et al.
Pubblicazione: (2025)
di: Hu, Qisheng, et al.
Pubblicazione: (2025)
Have We Really Understood Collaborative Information? An Empirical Investigation
di: Zhang, Xiaokun, et al.
Pubblicazione: (2025)
di: Zhang, Xiaokun, et al.
Pubblicazione: (2025)
SWE-Search: Enhancing Software Agents with Monte Carlo Tree Search and Iterative Refinement
di: Antoniades, Antonis, et al.
Pubblicazione: (2024)
di: Antoniades, Antonis, et al.
Pubblicazione: (2024)
Open Deep Search: Democratizing Search with Open-source Reasoning Agents
di: Alzubi, Salaheddin, et al.
Pubblicazione: (2025)
di: Alzubi, Salaheddin, et al.
Pubblicazione: (2025)
Partial Reasoning in Language Models: Search and Refinement Guided by Uncertainty
di: da Luz, Murilo, et al.
Pubblicazione: (2026)
di: da Luz, Murilo, et al.
Pubblicazione: (2026)
Learning Quantised Structure-Preserving Motion Representations for Dance Fingerprinting
di: Kharlamova, Arina, et al.
Pubblicazione: (2026)
di: Kharlamova, Arina, et al.
Pubblicazione: (2026)
OneSearch-V2: The Latent Reasoning Enhanced Self-distillation Generative Search Framework
di: Chen, Ben, et al.
Pubblicazione: (2026)
di: Chen, Ben, et al.
Pubblicazione: (2026)
Triple Path Enhanced Neural Architecture Search for Multimodal Fake News Detection
di: Xu, Bo, et al.
Pubblicazione: (2025)
di: Xu, Bo, et al.
Pubblicazione: (2025)
Search and Refine During Think: Facilitating Knowledge Refinement for Improved Retrieval-Augmented Reasoning
di: Shi, Yaorui, et al.
Pubblicazione: (2025)
di: Shi, Yaorui, et al.
Pubblicazione: (2025)
Documenti analoghi
-
SeRTS: Self-Rewarding Tree Search for Biomedical Retrieval-Augmented Generation
di: Hu, Minda, et al.
Pubblicazione: (2024) -
ConMax: Confidence-Maximizing Compression for Efficient Chain-of-Thought Reasoning
di: Hu, Minda, et al.
Pubblicazione: (2026) -
Mitigating Large Language Model Hallucination with Faithful Finetuning
di: Hu, Minda, et al.
Pubblicazione: (2024) -
NILE: Internal Consistency Alignment in Large Language Models
di: Hu, Minda, et al.
Pubblicazione: (2024) -
Towards Effective Top-N Hamming Search via Bipartite Graph Contrastive Hashing
di: Chen, Yankai, et al.
Pubblicazione: (2024)