Beyond Query Memorization: Large Language Model Routing with Query Decomposition and Historical Matching
Fuente:
arXiv
Salvato in:
| Autori principali: | Lv, Bo, Sun, Jingbo |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Guarded Query Routing for Large Language Models
di: Šléher, Richard, et al.
Pubblicazione: (2025)
di: Šléher, Richard, et al.
Pubblicazione: (2025)
ConsRoute:Consistency-Aware Adaptive Query Routing for Cloud-Edge-Device Large Language Models
di: Qiao, Haoyu, et al.
Pubblicazione: (2026)
di: Qiao, Haoyu, et al.
Pubblicazione: (2026)
Skewed Memorization in Large Language Models: Quantification and Decomposition
di: Li, Hao, et al.
Pubblicazione: (2025)
di: Li, Hao, et al.
Pubblicazione: (2025)
Robust Batch-Level Query Routing for Large Language Models under Cost and Capacity Constraints
di: Markovic-Voronov, Jelena, et al.
Pubblicazione: (2026)
di: Markovic-Voronov, Jelena, et al.
Pubblicazione: (2026)
Learning to Route Queries to Heads for Attention-based Re-ranking with Large Language Models
di: Tian, Yuxing, et al.
Pubblicazione: (2026)
di: Tian, Yuxing, et al.
Pubblicazione: (2026)
Unsupervised Memorability Modeling from Tip-of-the-Tongue Retrieval Queries
di: Bhattacharyya, Sree, et al.
Pubblicazione: (2025)
di: Bhattacharyya, Sree, et al.
Pubblicazione: (2025)
Query Decomposition for RAG: Balancing Exploration-Exploitation
di: Petcu, Roxana, et al.
Pubblicazione: (2025)
di: Petcu, Roxana, et al.
Pubblicazione: (2025)
Beyond Frequency: The Role of Redundancy in Large Language Model Memorization
di: Zhang, Jie, et al.
Pubblicazione: (2025)
di: Zhang, Jie, et al.
Pubblicazione: (2025)
Query Routing for Homogeneous Tools: An Instantiation in the RAG Scenario
di: Mu, Feiteng, et al.
Pubblicazione: (2024)
di: Mu, Feiteng, et al.
Pubblicazione: (2024)
Logic Query of Thoughts: Guiding Large Language Models to Answer Complex Logic Queries with Knowledge Graphs
di: Liu, Lihui, et al.
Pubblicazione: (2024)
di: Liu, Lihui, et al.
Pubblicazione: (2024)
QueryAttack: Jailbreaking Aligned Large Language Models Using Structured Non-natural Query Language
di: Zou, Qingsong, et al.
Pubblicazione: (2025)
di: Zou, Qingsong, et al.
Pubblicazione: (2025)
Jailbreaking Black Box Large Language Models in Twenty Queries
di: Chao, Patrick, et al.
Pubblicazione: (2023)
di: Chao, Patrick, et al.
Pubblicazione: (2023)
QAVA: Query-Agnostic Visual Attack to Large Vision-Language Models
di: Zhang, Yudong, et al.
Pubblicazione: (2025)
di: Zhang, Yudong, et al.
Pubblicazione: (2025)
Query-Efficient Planning with Language Models
di: Gonzalez-Pumariega, Gonzalo, et al.
Pubblicazione: (2024)
di: Gonzalez-Pumariega, Gonzalo, et al.
Pubblicazione: (2024)
RealRoute: Dynamic Query Routing System via Retrieve-then-Verify Paradigm
di: Liu, Jiahe, et al.
Pubblicazione: (2026)
di: Liu, Jiahe, et al.
Pubblicazione: (2026)
MedHalu: Hallucinations in Responses to Healthcare Queries by Large Language Models
di: Agarwal, Vibhor, et al.
Pubblicazione: (2024)
di: Agarwal, Vibhor, et al.
Pubblicazione: (2024)
Cequel: Cost-Effective Querying of Large Language Models for Text Clustering
di: Wang, Hongtao, et al.
Pubblicazione: (2025)
di: Wang, Hongtao, et al.
Pubblicazione: (2025)
Training Table Question Answering via SQL Query Decomposition
di: Mouravieff, Raphaël, et al.
Pubblicazione: (2024)
di: Mouravieff, Raphaël, et al.
Pubblicazione: (2024)
Beyond Memorization: Assessing Semantic Generalization in Large Language Models Using Phrasal Constructions
di: Scivetti, Wesley, et al.
Pubblicazione: (2025)
di: Scivetti, Wesley, et al.
Pubblicazione: (2025)
Beyond Memorization: Violating Privacy Via Inference with Large Language Models
di: Staab, Robin, et al.
Pubblicazione: (2023)
di: Staab, Robin, et al.
Pubblicazione: (2023)
SPARQL Query Generation with LLMs: Measuring the Impact of Training Data Memorization and Knowledge Injection
di: Gashkov, Aleksandr, et al.
Pubblicazione: (2025)
di: Gashkov, Aleksandr, et al.
Pubblicazione: (2025)
Querying Triadic Concepts through Partial or Complete Matching of Triples
di: Ruas, Pedro Henrique B., et al.
Pubblicazione: (2024)
di: Ruas, Pedro Henrique B., et al.
Pubblicazione: (2024)
Beyond Memorization: The Challenge of Random Memory Access in Language Models
di: Zhu, Tongyao, et al.
Pubblicazione: (2024)
di: Zhu, Tongyao, et al.
Pubblicazione: (2024)
Query Languages for Machine-Learning Models
di: Grohe, Martin
Pubblicazione: (2026)
di: Grohe, Martin
Pubblicazione: (2026)
Memorization in Fine-Tuned Large Language Models
di: Savine, Danil
Pubblicazione: (2025)
di: Savine, Danil
Pubblicazione: (2025)
Memorizing Documents with Guidance in Large Language Models
di: Park, Bumjin, et al.
Pubblicazione: (2024)
di: Park, Bumjin, et al.
Pubblicazione: (2024)
Query2Triple: Unified Query Encoding for Answering Diverse Complex Queries over Knowledge Graphs
di: Xu, Yao, et al.
Pubblicazione: (2023)
di: Xu, Yao, et al.
Pubblicazione: (2023)
Query-Conditioned Test-Time Self-Training for Large Language Models
di: Song, Chaehee, et al.
Pubblicazione: (2026)
di: Song, Chaehee, et al.
Pubblicazione: (2026)
Susceptibility of Large Language Models to User-Driven Factors in Medical Queries
di: Lim, Kyung Ho, et al.
Pubblicazione: (2025)
di: Lim, Kyung Ho, et al.
Pubblicazione: (2025)
Synthetic Query Generation using Large Language Models for Virtual Assistants
di: Sannigrahi, Sonal, et al.
Pubblicazione: (2024)
di: Sannigrahi, Sonal, et al.
Pubblicazione: (2024)
Improving Tool Retrieval by Leveraging Large Language Models for Query Generation
di: Kachuee, Mohammad, et al.
Pubblicazione: (2024)
di: Kachuee, Mohammad, et al.
Pubblicazione: (2024)
Detecting Memorization in Large Language Models
di: Slonski, Eduardo
Pubblicazione: (2024)
di: Slonski, Eduardo
Pubblicazione: (2024)
QUEEN: Query Unlearning against Model Extraction
di: Chen, Huajie, et al.
Pubblicazione: (2024)
di: Chen, Huajie, et al.
Pubblicazione: (2024)
Quantifying Cross-Query Contradictions in Multi-Query LLM Reasoning
di: Salla, Rohit Kumar, et al.
Pubblicazione: (2026)
di: Salla, Rohit Kumar, et al.
Pubblicazione: (2026)
Beyond Linearity in Attention Projections: The Case for Nonlinear Queries
di: Karbevski, Marko
Pubblicazione: (2026)
di: Karbevski, Marko
Pubblicazione: (2026)
VALUE: Value-Aware Large Language Model for Query Rewriting via Weighted Trie in Sponsored Search
di: Zhang, Xiao, et al.
Pubblicazione: (2025)
di: Zhang, Xiao, et al.
Pubblicazione: (2025)
Darth Vecdor: An Open-Source System for Generating Knowledge Graphs Through Large Language Model Queries
di: Handler, Jonathan A.
Pubblicazione: (2025)
di: Handler, Jonathan A.
Pubblicazione: (2025)
GQLA: Group-Query Latent Attention for Hardware-Adaptive Large Language Model Decoding
di: Meng, Fanxu
Pubblicazione: (2026)
di: Meng, Fanxu
Pubblicazione: (2026)
IDEAL: Leveraging Infinite and Dynamic Characterizations of Large Language Models for Query-focused Summarization
di: Cao, Jie, et al.
Pubblicazione: (2024)
di: Cao, Jie, et al.
Pubblicazione: (2024)
LLM4Hint: Leveraging Large Language Models for Hint Recommendation in Offline Query Optimization
di: Liu, Suchen, et al.
Pubblicazione: (2025)
di: Liu, Suchen, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Guarded Query Routing for Large Language Models
di: Šléher, Richard, et al.
Pubblicazione: (2025) -
ConsRoute:Consistency-Aware Adaptive Query Routing for Cloud-Edge-Device Large Language Models
di: Qiao, Haoyu, et al.
Pubblicazione: (2026) -
Skewed Memorization in Large Language Models: Quantification and Decomposition
di: Li, Hao, et al.
Pubblicazione: (2025) -
Robust Batch-Level Query Routing for Large Language Models under Cost and Capacity Constraints
di: Markovic-Voronov, Jelena, et al.
Pubblicazione: (2026) -
Learning to Route Queries to Heads for Attention-based Re-ranking with Large Language Models
di: Tian, Yuxing, et al.
Pubblicazione: (2026)