AdaSearch: Balancing Parametric Knowledge and Search in Large Language Models via Reinforcement Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lin, Tzu-Han, Chen, Wei-Lin, Li, Chen-An, Lee, Hung-yi, Chen, Yun-Nung, Meng, Yu |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
DogeRM: Equipping Reward Models with Domain Knowledge through Model Merging
par: Lin, Tzu-Han, et autres
Publié: (2024)
par: Lin, Tzu-Han, et autres
Publié: (2024)
Transferring Textual Preferences to Vision-Language Understanding through Model Merging
par: Li, Chen-An, et autres
Publié: (2025)
par: Li, Chen-An, et autres
Publié: (2025)
When Silence Matters: The Impact of Irrelevant Audio on Text Reasoning in Large Audio-Language Models
par: Li, Chen-An, et autres
Publié: (2025)
par: Li, Chen-An, et autres
Publié: (2025)
Editing the Mind of Giants: An In-Depth Exploration of Pitfalls of Knowledge Editing in Large Language Models
par: Hsueh, Cheng-Hsun, et autres
Publié: (2024)
par: Hsueh, Cheng-Hsun, et autres
Publié: (2024)
On Calibration of Large Language Models: From Response To Capability
par: Yang, Sin-Han, et autres
Publié: (2026)
par: Yang, Sin-Han, et autres
Publié: (2026)
Let Me Speak Freely? A Study on the Impact of Format Restrictions on Performance of Large Language Models
par: Tam, Zhi Rui, et autres
Publié: (2024)
par: Tam, Zhi Rui, et autres
Publié: (2024)
Language Matters: How Do Multilingual Input and Reasoning Paths Affect Large Reasoning Models?
par: Tam, Zhi Rui, et autres
Publié: (2025)
par: Tam, Zhi Rui, et autres
Publié: (2025)
Synthesizing Programmatic Reinforcement Learning Policies with Large Language Model Guided Search
par: Liu, Max, et autres
Publié: (2024)
par: Liu, Max, et autres
Publié: (2024)
How Contrastive Decoding Enhances Large Audio Language Models?
par: Lin, Tzu-Quan, et autres
Publié: (2026)
par: Lin, Tzu-Quan, et autres
Publié: (2026)
Answer, Refuse, or Guess? Investigating Risk-Aware Decision Making in Language Models
par: Wu, Cheng-Kuang, et autres
Publié: (2025)
par: Wu, Cheng-Kuang, et autres
Publié: (2025)
StreamBench: Towards Benchmarking Continuous Improvement of Language Agents
par: Wu, Cheng-Kuang, et autres
Publié: (2024)
par: Wu, Cheng-Kuang, et autres
Publié: (2024)
Spoken Stereoset: On Evaluating Social Bias Toward Speaker in Speech Large Language Models
par: Lin, Yi-Cheng, et autres
Publié: (2024)
par: Lin, Yi-Cheng, et autres
Publié: (2024)
SAKE: Towards Editing Auditory Attribute Knowledge of Large Audio-Language Models
par: Yang, Chih-Kai, et autres
Publié: (2025)
par: Yang, Chih-Kai, et autres
Publié: (2025)
Balancing Knowledge Delivery and Emotional Comfort in Healthcare Conversational Systems
par: Tsai, Shang-Chi, et autres
Publié: (2025)
par: Tsai, Shang-Chi, et autres
Publié: (2025)
Pseudo2Real: Task Arithmetic for Pseudo-Label Correction in Automatic Speech Recognition
par: Lin, Yi-Cheng, et autres
Publié: (2025)
par: Lin, Yi-Cheng, et autres
Publié: (2025)
FactAlign: Long-form Factuality Alignment of Large Language Models
par: Huang, Chao-Wei, et autres
Publié: (2024)
par: Huang, Chao-Wei, et autres
Publié: (2024)
InstUPR : Instruction-based Unsupervised Passage Reranking with Large Language Models
par: Huang, Chao-Wei, et autres
Publié: (2024)
par: Huang, Chao-Wei, et autres
Publié: (2024)
Mitigating Forgetting in LLM Fine-Tuning via Low-Perplexity Token Learning
par: Wu, Chao-Chung, et autres
Publié: (2025)
par: Wu, Chao-Chung, et autres
Publié: (2025)
Reducing Object Hallucination in Large Audio-Language Models via Audio-Aware Decoding
par: Hsu, Tzu-wen, et autres
Publié: (2025)
par: Hsu, Tzu-wen, et autres
Publié: (2025)
Injecting Salesperson's Dialogue Strategies in Large Language Models with Chain-of-Thought Reasoning
par: Chang, Wen-Yu, et autres
Publié: (2024)
par: Chang, Wen-Yu, et autres
Publié: (2024)
Creativity in LLM-based Multi-Agent Systems: A Survey
par: Lin, Yi-Cheng, et autres
Publié: (2025)
par: Lin, Yi-Cheng, et autres
Publié: (2025)
Hearing the Order: Investigating Position Bias in Large Audio-Language Models
par: Lin, Yu-Xiang, et autres
Publié: (2025)
par: Lin, Yu-Xiang, et autres
Publié: (2025)
From Simulation to Strategy: Automating Personalized Interaction Planning for Conversational Agents
par: Chang, Wen-Yu, et autres
Publié: (2025)
par: Chang, Wen-Yu, et autres
Publié: (2025)
Over-Reasoning and Redundant Calculation of Large Language Models
par: Chiang, Cheng-Han, et autres
Publié: (2024)
par: Chiang, Cheng-Han, et autres
Publié: (2024)
InstructionCP: A fast approach to transfer Large Language Models into target language
par: Chen, Kuang-Ming, et autres
Publié: (2024)
par: Chen, Kuang-Ming, et autres
Publié: (2024)
Causal Tracing of Audio-Text Fusion in Large Audio Language Models
par: Chen, Wei-Chih, et autres
Publié: (2026)
par: Chen, Wei-Chih, et autres
Publié: (2026)
Visualizing Dialogues: Enhancing Image Selection through Dialogue Understanding with Large Language Models
par: Kao, Chang-Sheng, et autres
Publié: (2024)
par: Kao, Chang-Sheng, et autres
Publié: (2024)
AdaCAD: Adaptively Decoding to Balance Conflicts between Contextual and Parametric Knowledge
par: Wang, Han, et autres
Publié: (2024)
par: Wang, Han, et autres
Publié: (2024)
Listen and Speak Fairly: A Study on Semantic Gender Bias in Speech Integrated Large Language Models
par: Lin, Yi-Cheng, et autres
Publié: (2024)
par: Lin, Yi-Cheng, et autres
Publié: (2024)
Advancing Large Language Models to Capture Varied Speaking Styles and Respond Properly in Spoken Conversations
par: Lin, Guan-Ting, et autres
Publié: (2024)
par: Lin, Guan-Ting, et autres
Publié: (2024)
The Role of Exploration Modules in Small Language Models for Knowledge Graph Question Answering
par: Cheng, Yi-Jie, et autres
Publié: (2025)
par: Cheng, Yi-Jie, et autres
Publié: (2025)
Style Amnesia: Investigating Speaking Style Degradation and Mitigation in Multi-Turn Spoken Language Models
par: Lin, Yu-Xiang, et autres
Publié: (2025)
par: Lin, Yu-Xiang, et autres
Publié: (2025)
Measuring Taiwanese Mandarin Language Understanding
par: Chen, Po-Heng, et autres
Publié: (2024)
par: Chen, Po-Heng, et autres
Publié: (2024)
Scaling Multimodal Search and Recommendation with Small Language Models via Upside-Down Reinforcement Learning
par: Lin, Yu-Chen, et autres
Publié: (2025)
par: Lin, Yu-Chen, et autres
Publié: (2025)
AdaDecode: Accelerating LLM Decoding with Adaptive Layer Parallelism
par: Wei, Zhepei, et autres
Publié: (2025)
par: Wei, Zhepei, et autres
Publié: (2025)
Speech-FT: Merging Pre-trained And Fine-Tuned Speech Representation Models For Cross-Task Generalization
par: Lin, Tzu-Quan, et autres
Publié: (2025)
par: Lin, Tzu-Quan, et autres
Publié: (2025)
A Survey of Generative Information Retrieval
par: Kuo, Tzu-Lin, et autres
Publié: (2024)
par: Kuo, Tzu-Lin, et autres
Publié: (2024)
Large Language Model as an Assignment Evaluator: Insights, Feedback, and Challenges in a 1000+ Student Course
par: Chiang, Cheng-Han, et autres
Publié: (2024)
par: Chiang, Cheng-Han, et autres
Publié: (2024)
MelHuBERT: A simplified HuBERT on Mel spectrograms
par: Lin, Tzu-Quan, et autres
Publié: (2022)
par: Lin, Tzu-Quan, et autres
Publié: (2022)
ReSearch: Learning to Reason with Search for LLMs via Reinforcement Learning
par: Chen, Mingyang, et autres
Publié: (2025)
par: Chen, Mingyang, et autres
Publié: (2025)
Documents similaires
-
DogeRM: Equipping Reward Models with Domain Knowledge through Model Merging
par: Lin, Tzu-Han, et autres
Publié: (2024) -
Transferring Textual Preferences to Vision-Language Understanding through Model Merging
par: Li, Chen-An, et autres
Publié: (2025) -
When Silence Matters: The Impact of Irrelevant Audio on Text Reasoning in Large Audio-Language Models
par: Li, Chen-An, et autres
Publié: (2025) -
Editing the Mind of Giants: An In-Depth Exploration of Pitfalls of Knowledge Editing in Large Language Models
par: Hsueh, Cheng-Hsun, et autres
Publié: (2024) -
On Calibration of Large Language Models: From Response To Capability
par: Yang, Sin-Han, et autres
Publié: (2026)