Parallel Context-of-Experts Decoding for Retrieval Augmented Generation
Fuente:
arXiv
Salvato in:
| Autori principali: | Corallo, Giulio, Papotti, Paolo |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Finch: Prompt-guided Key-Value Cache Compression
di: Corallo, Giulio, et al.
Pubblicazione: (2024)
di: Corallo, Giulio, et al.
Pubblicazione: (2024)
Beyond RAG: Task-Aware KV Cache Compression for Comprehensive Knowledge Reasoning
di: Corallo, Giulio, et al.
Pubblicazione: (2025)
di: Corallo, Giulio, et al.
Pubblicazione: (2025)
Dehallucinating Parallel Context Extension for Retrieval-Augmented Generation
di: Ma, Zexiong, et al.
Pubblicazione: (2024)
di: Ma, Zexiong, et al.
Pubblicazione: (2024)
RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models
di: Satriani, Dario, et al.
Pubblicazione: (2025)
di: Satriani, Dario, et al.
Pubblicazione: (2025)
RASD: Retrieval-Augmented Speculative Decoding
di: Quan, Guofeng, et al.
Pubblicazione: (2025)
di: Quan, Guofeng, et al.
Pubblicazione: (2025)
On the Consistency of Multilingual Context Utilization in Retrieval-Augmented Generation
di: Qi, Jirui, et al.
Pubblicazione: (2025)
di: Qi, Jirui, et al.
Pubblicazione: (2025)
RAVEN: In-Context Learning with Retrieval-Augmented Encoder-Decoder Language Models
di: Huang, Jie, et al.
Pubblicazione: (2023)
di: Huang, Jie, et al.
Pubblicazione: (2023)
A Reality Check on Context Utilisation for Retrieval-Augmented Generation
di: Hagström, Lovisa, et al.
Pubblicazione: (2024)
di: Hagström, Lovisa, et al.
Pubblicazione: (2024)
Influence Guided Context Selection for Effective Retrieval-Augmented Generation
di: Deng, Jiale, et al.
Pubblicazione: (2025)
di: Deng, Jiale, et al.
Pubblicazione: (2025)
LFD: Layer Fused Decoding to Exploit External Knowledge in Retrieval-Augmented Generation
di: Sun, Yang, et al.
Pubblicazione: (2025)
di: Sun, Yang, et al.
Pubblicazione: (2025)
SPARC-RAG: Adaptive Sequential-Parallel Scaling with Context Management for Retrieval-Augmented Generation
di: Yang, Yuxin, et al.
Pubblicazione: (2026)
di: Yang, Yuxin, et al.
Pubblicazione: (2026)
AttentionRAG: Attention-Guided Context Pruning in Retrieval-Augmented Generation
di: Fang, Yixiong, et al.
Pubblicazione: (2025)
di: Fang, Yixiong, et al.
Pubblicazione: (2025)
On the Influence of Context Size and Model Choice in Retrieval-Augmented Generation Systems
di: Vladika, Juraj, et al.
Pubblicazione: (2025)
di: Vladika, Juraj, et al.
Pubblicazione: (2025)
An LLM-Based Approach for Insight Generation in Data Analysis
di: Pérez, Alberto Sánchez, et al.
Pubblicazione: (2025)
di: Pérez, Alberto Sánchez, et al.
Pubblicazione: (2025)
RACER: Retrieval-Augmented Contextual Rapid Speculative Decoding
di: Zhang, Zihong, et al.
Pubblicazione: (2026)
di: Zhang, Zihong, et al.
Pubblicazione: (2026)
Expert-Guided Prompting and Retrieval-Augmented Generation for Emergency Medical Service Question Answering
di: Ge, Xueren, et al.
Pubblicazione: (2025)
di: Ge, Xueren, et al.
Pubblicazione: (2025)
ContextRAG: Extraction-Free Hierarchical Graph Construction for Retrieval-Augmented Generation
di: Prosvirnin, Roman, et al.
Pubblicazione: (2026)
di: Prosvirnin, Roman, et al.
Pubblicazione: (2026)
Breaking the Static Graph: Context-Aware Traversal for Robust Retrieval-Augmented Generation
di: Lau, Kwun Hang, et al.
Pubblicazione: (2026)
di: Lau, Kwun Hang, et al.
Pubblicazione: (2026)
Parallel Decoder Transformer: Planner-Seeded Latent Coordination for Synchronized Parallel Decoding
di: Robbins, Logan
Pubblicazione: (2025)
di: Robbins, Logan
Pubblicazione: (2025)
EcoSafeRAG: Efficient Security through Context Analysis in Retrieval-Augmented Generation
di: Yao, Ruobing, et al.
Pubblicazione: (2025)
di: Yao, Ruobing, et al.
Pubblicazione: (2025)
RAT: Retrieval Augmented Thoughts Elicit Context-Aware Reasoning in Long-Horizon Generation
di: Wang, Zihao, et al.
Pubblicazione: (2024)
di: Wang, Zihao, et al.
Pubblicazione: (2024)
RARe: Retrieval Augmented Retrieval with In-Context Examples
di: Tejaswi, Atula, et al.
Pubblicazione: (2024)
di: Tejaswi, Atula, et al.
Pubblicazione: (2024)
MMRAG: Multi-Mode Retrieval-Augmented Generation with Large Language Models for Biomedical In-Context Learning
di: Zhan, Zaifu, et al.
Pubblicazione: (2025)
di: Zhan, Zaifu, et al.
Pubblicazione: (2025)
Evaluating Retrieval-Augmented Generation vs. Long-Context Input for Clinical Reasoning over EHRs
di: Myers, Skatje, et al.
Pubblicazione: (2025)
di: Myers, Skatje, et al.
Pubblicazione: (2025)
Making Retrieval-Augmented Language Models Robust to Irrelevant Context
di: Yoran, Ori, et al.
Pubblicazione: (2023)
di: Yoran, Ori, et al.
Pubblicazione: (2023)
Improving Context Fidelity via Native Retrieval-Augmented Reasoning
di: Wang, Suyuchen, et al.
Pubblicazione: (2025)
di: Wang, Suyuchen, et al.
Pubblicazione: (2025)
Enhancing Robustness of Retrieval-Augmented Language Models with In-Context Learning
di: Park, Seong-Il, et al.
Pubblicazione: (2024)
di: Park, Seong-Il, et al.
Pubblicazione: (2024)
MME-RAG: Multi-Manager-Expert Retrieval-Augmented Generation for Fine-Grained Entity Recognition in Task-Oriented Dialogues
di: Xue, Liang, et al.
Pubblicazione: (2025)
di: Xue, Liang, et al.
Pubblicazione: (2025)
Reconstructing Context: Evaluating Advanced Chunking Strategies for Retrieval-Augmented Generation
di: Merola, Carlo, et al.
Pubblicazione: (2025)
di: Merola, Carlo, et al.
Pubblicazione: (2025)
EXIT: Context-Aware Extractive Compression for Enhancing Retrieval-Augmented Generation
di: Hwang, Taeho, et al.
Pubblicazione: (2024)
di: Hwang, Taeho, et al.
Pubblicazione: (2024)
Boosting the Capabilities of Compact Models in Low-Data Contexts with Large Language Models and Retrieval-Augmented Generation
di: Shandilya, Bhargav, et al.
Pubblicazione: (2024)
di: Shandilya, Bhargav, et al.
Pubblicazione: (2024)
Predictive Prefetching for Retrieval-Augmented Generation
di: Zhang, Wuyang, et al.
Pubblicazione: (2026)
di: Zhang, Wuyang, et al.
Pubblicazione: (2026)
Latent Abstraction for Retrieval-Augmented Generation
di: T, Ha Lan N., et al.
Pubblicazione: (2026)
di: T, Ha Lan N., et al.
Pubblicazione: (2026)
Semantic Tokens in Retrieval Augmented Generation
di: Suro, Joel
Pubblicazione: (2024)
di: Suro, Joel
Pubblicazione: (2024)
Clustered Retrieved Augmented Generation (CRAG)
di: Akesson, Simon, et al.
Pubblicazione: (2024)
di: Akesson, Simon, et al.
Pubblicazione: (2024)
Retrieval-Augmented Generation with Hierarchical Knowledge
di: Huang, Haoyu, et al.
Pubblicazione: (2025)
di: Huang, Haoyu, et al.
Pubblicazione: (2025)
Exploring Retrieval Augmented Generation in Arabic
di: El-Beltagy, Samhaa R., et al.
Pubblicazione: (2024)
di: El-Beltagy, Samhaa R., et al.
Pubblicazione: (2024)
Retrieval-Augmented Generation with Conflicting Evidence
di: Wang, Han, et al.
Pubblicazione: (2025)
di: Wang, Han, et al.
Pubblicazione: (2025)
Benchmarking Retrieval-Augmented Generation for Medicine
di: Xiong, Guangzhi, et al.
Pubblicazione: (2024)
di: Xiong, Guangzhi, et al.
Pubblicazione: (2024)
No-Worse Context-Aware Decoding: Preventing Neutral Regression in Context-Conditioned Generation
di: Tao, Yufei, et al.
Pubblicazione: (2026)
di: Tao, Yufei, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Finch: Prompt-guided Key-Value Cache Compression
di: Corallo, Giulio, et al.
Pubblicazione: (2024) -
Beyond RAG: Task-Aware KV Cache Compression for Comprehensive Knowledge Reasoning
di: Corallo, Giulio, et al.
Pubblicazione: (2025) -
Dehallucinating Parallel Context Extension for Retrieval-Augmented Generation
di: Ma, Zexiong, et al.
Pubblicazione: (2024) -
RelationalFactQA: A Benchmark for Evaluating Tabular Fact Retrieval from Large Language Models
di: Satriani, Dario, et al.
Pubblicazione: (2025) -
RASD: Retrieval-Augmented Speculative Decoding
di: Quan, Guofeng, et al.
Pubblicazione: (2025)