Search, Do not Guess: Teaching Small Language Models to Be Effective Search Agents
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Liu, Yizhou, Sun, Qi, Chen, Yulin, Zhang, Siyue, Zhao, Chen |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
From "Weak" Signals to Strong Models: Preference Delta Aggregation with LoRA Merging
von: Sun, Qi, et al.
Veröffentlicht: (2026)
von: Sun, Qi, et al.
Veröffentlicht: (2026)
SearchSkill: Teaching LLMs to Use Search Tools with Evolving Skill Banks
von: Hu, Jinchao, et al.
Veröffentlicht: (2026)
von: Hu, Jinchao, et al.
Veröffentlicht: (2026)
QLASS: Boosting Language Agent Inference via Q-Guided Stepwise Search
von: Lin, Zongyu, et al.
Veröffentlicht: (2025)
von: Lin, Zongyu, et al.
Veröffentlicht: (2025)
Plan Before Search: Search Agents Need Plan
von: Qian, Zhipeng, et al.
Veröffentlicht: (2026)
von: Qian, Zhipeng, et al.
Veröffentlicht: (2026)
Weak-to-Strong Search: Align Large Language Models via Searching over Small Language Models
von: Zhou, Zhanhui, et al.
Veröffentlicht: (2024)
von: Zhou, Zhanhui, et al.
Veröffentlicht: (2024)
DLLM-Searcher: Adapting Diffusion Large Language Model for Search Agents
von: Zhao, Jiahao, et al.
Veröffentlicht: (2026)
von: Zhao, Jiahao, et al.
Veröffentlicht: (2026)
Learning to Be A Doctor: Searching for Effective Medical Agent Architectures
von: Zhuang, Yangyang, et al.
Veröffentlicht: (2025)
von: Zhuang, Yangyang, et al.
Veröffentlicht: (2025)
Beyond Monolithic Architectures: A Multi-Agent Search and Knowledge Optimization Framework for Agentic Search
von: Chen, Yiqun, et al.
Veröffentlicht: (2026)
von: Chen, Yiqun, et al.
Veröffentlicht: (2026)
Empirical-MCTS: Continuous Agent Evolution via Dual-Experience Monte Carlo Tree Search
von: Lu, Hao, et al.
Veröffentlicht: (2026)
von: Lu, Hao, et al.
Veröffentlicht: (2026)
LLM-DSE: Searching Accelerator Parameters with LLM Agents
von: Wang, Hanyu, et al.
Veröffentlicht: (2025)
von: Wang, Hanyu, et al.
Veröffentlicht: (2025)
Second Guess: Detecting Uncertainty Through Abstention and Answer Stability in Small Language Models
von: Aravindan, Ashwath Vaithinathan, et al.
Veröffentlicht: (2026)
von: Aravindan, Ashwath Vaithinathan, et al.
Veröffentlicht: (2026)
A First Guess is Rarely the Final Answer: Learning to Search in the Traveling Salesperson Problem
von: Garmendia, Andoni Irazusta
Veröffentlicht: (2026)
von: Garmendia, Andoni Irazusta
Veröffentlicht: (2026)
Over-Searching in Search-Augmented Large Language Models
von: Xie, Roy, et al.
Veröffentlicht: (2026)
von: Xie, Roy, et al.
Veröffentlicht: (2026)
Tree Search for Language Model Agents
von: Koh, Jing Yu, et al.
Veröffentlicht: (2024)
von: Koh, Jing Yu, et al.
Veröffentlicht: (2024)
CoSearchAgent: A Lightweight Collaborative Search Agent with Large Language Models
von: Gong, Peiyuan, et al.
Veröffentlicht: (2024)
von: Gong, Peiyuan, et al.
Veröffentlicht: (2024)
USimAgent: Large Language Models for Simulating Search Users
von: Zhang, Erhan, et al.
Veröffentlicht: (2024)
von: Zhang, Erhan, et al.
Veröffentlicht: (2024)
Evaluating the Search Agent in a Parallel World
von: Chen, Jiawei, et al.
Veröffentlicht: (2026)
von: Chen, Jiawei, et al.
Veröffentlicht: (2026)
Learnware of Language Models: Specialized Small Language Models Can Do Big
von: Tan, Zhi-Hao, et al.
Veröffentlicht: (2025)
von: Tan, Zhi-Hao, et al.
Veröffentlicht: (2025)
Small Language Model Makes an Effective Long Text Extractor
von: Chen, Yelin, et al.
Veröffentlicht: (2025)
von: Chen, Yelin, et al.
Veröffentlicht: (2025)
THOUGHTSCULPT: Reasoning with Intermediate Revision and Search
von: Chi, Yizhou, et al.
Veröffentlicht: (2024)
von: Chi, Yizhou, et al.
Veröffentlicht: (2024)
SearchGym: Bootstrapping Real-World Search Agents via Cost-Effective and High-Fidelity Environment Simulation
von: Zhang, Xichen, et al.
Veröffentlicht: (2026)
von: Zhang, Xichen, et al.
Veröffentlicht: (2026)
Instructing the Architecture Search for Spatial-temporal Sequence Forecasting with LLM
von: Xue, Xin, et al.
Veröffentlicht: (2025)
von: Xue, Xin, et al.
Veröffentlicht: (2025)
CO-Bench: Benchmarking Language Model Agents in Algorithm Search for Combinatorial Optimization
von: Sun, Weiwei, et al.
Veröffentlicht: (2025)
von: Sun, Weiwei, et al.
Veröffentlicht: (2025)
Search for Efficient Large Language Models
von: Shen, Xuan, et al.
Veröffentlicht: (2024)
von: Shen, Xuan, et al.
Veröffentlicht: (2024)
CAPF: Guiding Search-Agent Rollouts with Credit-Attenuated Privileged Feedback
von: Chen, Bin, et al.
Veröffentlicht: (2026)
von: Chen, Bin, et al.
Veröffentlicht: (2026)
SafeSearch: Automated Red-Teaming of LLM-Based Search Agents
von: Dong, Jianshuo, et al.
Veröffentlicht: (2025)
von: Dong, Jianshuo, et al.
Veröffentlicht: (2025)
Enhancing Reasoning Capabilities of Small Language Models with Blueprints and Prompt Template Search
von: Han, Dongge, et al.
Veröffentlicht: (2025)
von: Han, Dongge, et al.
Veröffentlicht: (2025)
Fine-tuning Small Language Models as Efficient Enterprise Search Relevance Labelers
von: Kang, Yue, et al.
Veröffentlicht: (2026)
von: Kang, Yue, et al.
Veröffentlicht: (2026)
AutoSCORE: Enhancing Automated Scoring with Multi-Agent Large Language Models via Structured Component Recognition
von: Wang, Yun, et al.
Veröffentlicht: (2025)
von: Wang, Yun, et al.
Veröffentlicht: (2025)
InfiR : Crafting Effective Small Language Models and Multimodal Small Language Models in Reasoning
von: Xie, Congkai, et al.
Veröffentlicht: (2025)
von: Xie, Congkai, et al.
Veröffentlicht: (2025)
QuarkMedSearch: A Long-Horizon Deep Search Agent for Exploring Medical Intelligence
von: Lin, Zhichao, et al.
Veröffentlicht: (2026)
von: Lin, Zhichao, et al.
Veröffentlicht: (2026)
Wild Guesses and Mild Guesses in Active Concept Learning
von: Chari, Anirudh, et al.
Veröffentlicht: (2026)
von: Chari, Anirudh, et al.
Veröffentlicht: (2026)
LightReasoner: Can Small Language Models Teach Large Language Models Reasoning?
von: Wang, Jingyuan, et al.
Veröffentlicht: (2025)
von: Wang, Jingyuan, et al.
Veröffentlicht: (2025)
Lightweight LLM Agent Memory with Small Language Models
von: Zhang, Jiaquan, et al.
Veröffentlicht: (2026)
von: Zhang, Jiaquan, et al.
Veröffentlicht: (2026)
An Agent Framework for Real-Time Financial Information Searching with Large Language Models
von: Li, Jinzheng, et al.
Veröffentlicht: (2024)
von: Li, Jinzheng, et al.
Veröffentlicht: (2024)
Answer, Refuse, or Guess? Investigating Risk-Aware Decision Making in Language Models
von: Wu, Cheng-Kuang, et al.
Veröffentlicht: (2025)
von: Wu, Cheng-Kuang, et al.
Veröffentlicht: (2025)
ReSearch: Learning to Reason with Search for LLMs via Reinforcement Learning
von: Chen, Mingyang, et al.
Veröffentlicht: (2025)
von: Chen, Mingyang, et al.
Veröffentlicht: (2025)
LongSeeker: Elastic Context Orchestration for Long-Horizon Search Agents
von: Lu, Yijun, et al.
Veröffentlicht: (2026)
von: Lu, Yijun, et al.
Veröffentlicht: (2026)
Agent Alpha: Tree Search Unifying Generation, Exploration and Evaluation for Computer-Use Agents
von: Tang, Sizhe, et al.
Veröffentlicht: (2026)
von: Tang, Sizhe, et al.
Veröffentlicht: (2026)
Optimizing Instruction Synthesis: Effective Exploration of Evolutionary Space with Tree Search
von: Li, Chenglin, et al.
Veröffentlicht: (2024)
von: Li, Chenglin, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
From "Weak" Signals to Strong Models: Preference Delta Aggregation with LoRA Merging
von: Sun, Qi, et al.
Veröffentlicht: (2026) -
SearchSkill: Teaching LLMs to Use Search Tools with Evolving Skill Banks
von: Hu, Jinchao, et al.
Veröffentlicht: (2026) -
QLASS: Boosting Language Agent Inference via Q-Guided Stepwise Search
von: Lin, Zongyu, et al.
Veröffentlicht: (2025) -
Plan Before Search: Search Agents Need Plan
von: Qian, Zhipeng, et al.
Veröffentlicht: (2026) -
Weak-to-Strong Search: Align Large Language Models via Searching over Small Language Models
von: Zhou, Zhanhui, et al.
Veröffentlicht: (2024)