Iterative Self-Incentivization Empowers Large Language Models as Agentic Searchers
Fuente:
arXiv
Guardado en:
| Autores principales: | Shi, Zhengliang, Yan, Lingyong, Yin, Dawei, Verberne, Suzan, de Rijke, Maarten, Ren, Zhaochun |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Tool Learning in the Wild: Empowering Language Models as Automatic Tool Agents
por: Shi, Zhengliang, et al.
Publicado: (2024)
por: Shi, Zhengliang, et al.
Publicado: (2024)
Learning to Use Tools via Cooperative and Interactive Agents
por: Shi, Zhengliang, et al.
Publicado: (2024)
por: Shi, Zhengliang, et al.
Publicado: (2024)
Retrieval Models Aren't Tool-Savvy: Benchmarking Tool Retrieval for Large Language Models
por: Shi, Zhengliang, et al.
Publicado: (2025)
por: Shi, Zhengliang, et al.
Publicado: (2025)
KnowTuning: Knowledge-aware Fine-tuning for Large Language Models
por: Lyu, Yougang, et al.
Publicado: (2024)
por: Lyu, Yougang, et al.
Publicado: (2024)
CAUSE: Counterfactual Assessment of User Satisfaction Estimation in Task-Oriented Dialogue Systems
por: Abolghasemi, Amin, et al.
Publicado: (2024)
por: Abolghasemi, Amin, et al.
Publicado: (2024)
OpenReward: Learning to Reward Long-form Agentic Tasks via Reinforcement Learning
por: Hu, Ziyou, et al.
Publicado: (2025)
por: Hu, Ziyou, et al.
Publicado: (2025)
MACPO: Weak-to-Strong Alignment via Multi-Agent Contrastive Preference Optimization
por: Lyu, Yougang, et al.
Publicado: (2024)
por: Lyu, Yougang, et al.
Publicado: (2024)
Evaluation of Attribution Bias in Generator-Aware Retrieval-Augmented Large Language Models
por: Abolghasemi, Amin, et al.
Publicado: (2024)
por: Abolghasemi, Amin, et al.
Publicado: (2024)
Information Discovery in e-Commerce
por: Ren, Zhaochun, et al.
Publicado: (2024)
por: Ren, Zhaochun, et al.
Publicado: (2024)
Divide-Then-Aggregate: An Efficient Tool Learning Method via Parallel Tool Invocation
por: Zhu, Dongsheng, et al.
Publicado: (2025)
por: Zhu, Dongsheng, et al.
Publicado: (2025)
Cognitive Biases in Large Language Models for News Recommendation
por: Lyu, Yougang, et al.
Publicado: (2024)
por: Lyu, Yougang, et al.
Publicado: (2024)
Self-Adaptive Cognitive Debiasing for Large Language Models in Decision-Making
por: Lyu, Yougang, et al.
Publicado: (2025)
por: Lyu, Yougang, et al.
Publicado: (2025)
Measuring Bias in a Ranked List using Term-based Representations
por: Abolghasemi, Amin, et al.
Publicado: (2024)
por: Abolghasemi, Amin, et al.
Publicado: (2024)
Is ChatGPT Good at Search? Investigating Large Language Models as Re-Ranking Agents
por: Sun, Weiwei, et al.
Publicado: (2023)
por: Sun, Weiwei, et al.
Publicado: (2023)
The Real, the Better: Aligning Large Language Models with Online Human Behaviors
por: Jiang, Guanying, et al.
Publicado: (2024)
por: Jiang, Guanying, et al.
Publicado: (2024)
Improving the Robustness of Large Language Models via Consistency Alignment
por: Zhao, Yukun, et al.
Publicado: (2024)
por: Zhao, Yukun, et al.
Publicado: (2024)
Undesirable Memorization in Large Language Models: A Survey
por: Satvaty, Ali, et al.
Publicado: (2024)
por: Satvaty, Ali, et al.
Publicado: (2024)
Mitigating Hallucinations in Large Vision-Language Models via Entity-Centric Multimodal Preference Optimization
por: Wu, Jiulong, et al.
Publicado: (2025)
por: Wu, Jiulong, et al.
Publicado: (2025)
A Multi-Agent Conversational Recommender System
por: Fang, Jiabao, et al.
Publicado: (2024)
por: Fang, Jiabao, et al.
Publicado: (2024)
SPILL: Domain-Adaptive Intent Clustering based on Selection and Pooling with Large Language Models
por: Lin, I-Fan, et al.
Publicado: (2025)
por: Lin, I-Fan, et al.
Publicado: (2025)
Direct Retrieval-augmented Optimization: Synergizing Knowledge Selection and Language Models
por: Shi, Zhengliang, et al.
Publicado: (2025)
por: Shi, Zhengliang, et al.
Publicado: (2025)
Evolution without Large Models: Training Language Model with Task Principles
por: Zhu, Minghang, et al.
Publicado: (2025)
por: Zhu, Minghang, et al.
Publicado: (2025)
Reasoning-to-Defend: Safety-Aware Reasoning Can Defend Large Language Models from Jailbreaking
por: Zhu, Junda, et al.
Publicado: (2025)
por: Zhu, Junda, et al.
Publicado: (2025)
Joint Flashback Adaptation for Forgetting-Resistant Instruction Tuning
por: Zhao, Yukun, et al.
Publicado: (2025)
por: Zhao, Yukun, et al.
Publicado: (2025)
Knowing What LLMs DO NOT Know: A Simple Yet Effective Self-Detection Method
por: Zhao, Yukun, et al.
Publicado: (2023)
por: Zhao, Yukun, et al.
Publicado: (2023)
ReportLogic: Evaluating Logical Quality in Deep Research Reports
por: Zhao, Jujia, et al.
Publicado: (2026)
por: Zhao, Jujia, et al.
Publicado: (2026)
Investigating the Robustness of Modelling Decisions for Few-Shot Cross-Topic Stance Detection: A Preregistered Study
por: Reuver, Myrthe, et al.
Publicado: (2024)
por: Reuver, Myrthe, et al.
Publicado: (2024)
Generative Retrieval with Few-shot Indexing
por: Askari, Arian, et al.
Publicado: (2024)
por: Askari, Arian, et al.
Publicado: (2024)
Biomedical Entity Linking for Dutch: Fine-tuning a Self-alignment BERT Model on an Automatically Generated Wikipedia Corpus
por: Hartendorp, Fons, et al.
Publicado: (2024)
por: Hartendorp, Fons, et al.
Publicado: (2024)
Dataset Creation for Visual Entailment using Generative AI
por: Reijtenbach, Rob, et al.
Publicado: (2025)
por: Reijtenbach, Rob, et al.
Publicado: (2025)
A Cooperative Multi-Agent Framework for Zero-Shot Named Entity Recognition
por: Wang, Zihan, et al.
Publicado: (2025)
por: Wang, Zihan, et al.
Publicado: (2025)
ATM: Adversarial Tuning Multi-agent System Makes a Robust Retrieval-Augmented Generator
por: Zhu, Junda, et al.
Publicado: (2024)
por: Zhu, Junda, et al.
Publicado: (2024)
Aligning Large Language Models with Searcher Preferences
por: Wu, Wei, et al.
Publicado: (2026)
por: Wu, Wei, et al.
Publicado: (2026)
RE-Searcher: Robust Agentic Search with Goal-oriented Planning and Self-reflection
por: Fu, Daocheng, et al.
Publicado: (2025)
por: Fu, Daocheng, et al.
Publicado: (2025)
What are the limits of cross-lingual dense passage retrieval for low-resource languages?
por: Wu, Jie, et al.
Publicado: (2024)
por: Wu, Jie, et al.
Publicado: (2024)
Generate-then-Ground in Retrieval-Augmented Generation for Multi-hop Question Answering
por: Shi, Zhengliang, et al.
Publicado: (2024)
por: Shi, Zhengliang, et al.
Publicado: (2024)
Generate then Refine: Data Augmentation for Zero-shot Intent Detection
por: Lin, I-Fan, et al.
Publicado: (2024)
por: Lin, I-Fan, et al.
Publicado: (2024)
Multi-Step Reasoning with Large Language Models, a Survey
por: Plaat, Aske, et al.
Publicado: (2024)
por: Plaat, Aske, et al.
Publicado: (2024)
MELoRA: Mini-Ensemble Low-Rank Adapters for Parameter-Efficient Fine-Tuning
por: Ren, Pengjie, et al.
Publicado: (2024)
por: Ren, Pengjie, et al.
Publicado: (2024)
Improving RAG for Personalization with Author Features and Contrastive Examples
por: Yazan, Mert, et al.
Publicado: (2025)
por: Yazan, Mert, et al.
Publicado: (2025)
Ejemplares similares
-
Tool Learning in the Wild: Empowering Language Models as Automatic Tool Agents
por: Shi, Zhengliang, et al.
Publicado: (2024) -
Learning to Use Tools via Cooperative and Interactive Agents
por: Shi, Zhengliang, et al.
Publicado: (2024) -
Retrieval Models Aren't Tool-Savvy: Benchmarking Tool Retrieval for Large Language Models
por: Shi, Zhengliang, et al.
Publicado: (2025) -
KnowTuning: Knowledge-aware Fine-tuning for Large Language Models
por: Lyu, Yougang, et al.
Publicado: (2024) -
CAUSE: Counterfactual Assessment of User Satisfaction Estimation in Task-Oriented Dialogue Systems
por: Abolghasemi, Amin, et al.
Publicado: (2024)