Retrieval-Augmented Generation for Natural Language Processing: A Survey
Fuente:
arXiv
Saved in:
| Main Authors: | Wu, Shangyu, Xiong, Ying, Cui, Yufei, Wu, Haolun, Chen, Can, Yuan, Ye, Huang, Lianming, Liu, Xue, Kuo, Tei-Wei, Guan, Nan, Xue, Chun Jason |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
RAEE: A Robust Retrieval-Augmented Early Exit Framework for Efficient Inference
by: Huang, Lianming, et al.
Published: (2024)
by: Huang, Lianming, et al.
Published: (2024)
ReFusion: Improving Natural Language Understanding with Computation-Efficient Retrieval Representation Fusion
by: Wu, Shangyu, et al.
Published: (2024)
by: Wu, Shangyu, et al.
Published: (2024)
Beyond Semantic Similarity: Reducing Unnecessary API Calls via Behavior-Aligned Retriever
by: Chen, Yixin, et al.
Published: (2025)
by: Chen, Yixin, et al.
Published: (2025)
ReFilter: Improving Robustness of Retrieval-Augmented Generation via Gated Filter
by: Chen, Yixin, et al.
Published: (2026)
by: Chen, Yixin, et al.
Published: (2026)
AD-EE: Early Exiting for Fast and Reliable Vision-Language Models in Autonomous Driving
by: Huang, Lianming, et al.
Published: (2025)
by: Huang, Lianming, et al.
Published: (2025)
Nav-EE: Navigation-Guided Early Exiting for Efficient Vision-Language Models in Autonomous Driving
by: Hu, Haibo, et al.
Published: (2025)
by: Hu, Haibo, et al.
Published: (2025)
EvoP: Robust LLM Inference via Evolutionary Pruning
by: Wu, Shangyu, et al.
Published: (2025)
by: Wu, Shangyu, et al.
Published: (2025)
GeneQuery: A General QA-based Framework for Spatial Gene Expression Predictions from Histology Images
by: Xiong, Ying, et al.
Published: (2024)
by: Xiong, Ying, et al.
Published: (2024)
DeeAD: Dynamic Early Exit of Vision-Language Action for Efficient Autonomous Driving
by: HU, Haibo, et al.
Published: (2025)
by: HU, Haibo, et al.
Published: (2025)
FlexInfer: Breaking Memory Constraint via Flexible and Efficient Offloading for On-Device LLM Inference
by: Du, Hongchao, et al.
Published: (2025)
by: Du, Hongchao, et al.
Published: (2025)
On-Demand Multi-Task Sparsity for Efficient Large-Model Deployment on Edge Devices
by: Huang, Lianming, et al.
Published: (2025)
by: Huang, Lianming, et al.
Published: (2025)
GM-Skip: Metric-Guided Transformer Block Skipping for Efficient Vision-Language Models
by: Huang, Lianming, et al.
Published: (2025)
by: Huang, Lianming, et al.
Published: (2025)
RALAD: Bridging the Real-to-Sim Domain Gap in Autonomous Driving with Retrieval-Augmented Learning
by: Zuo, Jiacheng, et al.
Published: (2025)
by: Zuo, Jiacheng, et al.
Published: (2025)
BAHOP: Similarity-based Basin Hopping for A fast hyper-parameter search in WSI classification
by: Wang, Jun, et al.
Published: (2024)
by: Wang, Jun, et al.
Published: (2024)
IHC Matters: Incorporating IHC analysis to H&E Whole Slide Image Analysis for Improved Cancer Grading via Two-stage Multimodal Bilinear Pooling Fusion
by: Wang, Jun, et al.
Published: (2024)
by: Wang, Jun, et al.
Published: (2024)
Large Language Model (LLM) for Telecommunications: A Comprehensive Survey on Principles, Key Techniques, and Opportunities
by: Zhou, Hao, et al.
Published: (2024)
by: Zhou, Hao, et al.
Published: (2024)
Easz: An Agile Transformer-based Image Compression Framework for Resource-constrained IoTs
by: Mao, Yu, et al.
Published: (2025)
by: Mao, Yu, et al.
Published: (2025)
Efficient Distributed Retrieval-Augmented Generation for Enhancing Language Model Performance
by: Liu, Shangyu, et al.
Published: (2025)
by: Liu, Shangyu, et al.
Published: (2025)
Training Diffusion Language Models for Black-Box Optimization
by: Sun, Zipeng, et al.
Published: (2026)
by: Sun, Zipeng, et al.
Published: (2026)
Support-Proximity Augmented Diffusion Estimation for Offline Black-Box Optimization
by: Yang, Yonghan, et al.
Published: (2026)
by: Yang, Yonghan, et al.
Published: (2026)
CHESS: Optimizing LLM Inference via Channel-Wise Thresholding and Selective Sparsification
by: He, Junhui, et al.
Published: (2024)
by: He, Junhui, et al.
Published: (2024)
ContiguousKV: Accelerating LLM Prefill with Granularity-Aligned KV Cache Management
by: Zou, Jing, et al.
Published: (2026)
by: Zou, Jing, et al.
Published: (2026)
A$^2$ATS: Retrieval-Based KV Cache Reduction via Windowed Rotary Position Embedding and Query-Aware Vector Quantization
by: He, Junhui, et al.
Published: (2025)
by: He, Junhui, et al.
Published: (2025)
Grade Like a Human: Rethinking Automated Assessment with Large Language Models
by: Xie, Wenjing, et al.
Published: (2024)
by: Xie, Wenjing, et al.
Published: (2024)
Optimizing User Profiles via Contextual Bandits for Retrieval-Augmented LLM Personalization
by: Du, Linfeng, et al.
Published: (2026)
by: Du, Linfeng, et al.
Published: (2026)
Density-based User Representation using Gaussian Process Regression for Multi-interest Personalized Retrieval
by: Wu, Haolun, et al.
Published: (2023)
by: Wu, Haolun, et al.
Published: (2023)
Learning to Extract Structured Entities Using Language Models
by: Wu, Haolun, et al.
Published: (2024)
by: Wu, Haolun, et al.
Published: (2024)
On the Compressibility of Quantized Large Language Models
by: Mao, Yu, et al.
Published: (2024)
by: Mao, Yu, et al.
Published: (2024)
RAG and RAU: A Survey on Retrieval-Augmented Language Model in Natural Language Processing
by: Hu, Yucheng, et al.
Published: (2024)
by: Hu, Yucheng, et al.
Published: (2024)
Understanding 6G through Language Models: A Case Study on LLM-aided Structured Entity Extraction in Telecom Domain
by: Yuan, Ye, et al.
Published: (2025)
by: Yuan, Ye, et al.
Published: (2025)
Enhancing Large Language Models (LLMs) for Telecommunications using Knowledge Graphs and Retrieval-Augmented Generation
by: Yuan, Dun, et al.
Published: (2025)
by: Yuan, Dun, et al.
Published: (2025)
WISE: A Framework for Gigapixel Whole-Slide-Image Lossless Compression
by: Mao, Yu, et al.
Published: (2025)
by: Mao, Yu, et al.
Published: (2025)
Advances in Multiple Instance Learning for Whole Slide Image Analysis: Techniques, Challenges, and Future Directions
by: Wang, Jun, et al.
Published: (2024)
by: Wang, Jun, et al.
Published: (2024)
SHAP-CAT: A interpretable multi-modal framework enhancing WSI classification via virtual staining and shapley-value-based multimodal fusion
by: Wang, Jun, et al.
Published: (2024)
by: Wang, Jun, et al.
Published: (2024)
VLM-C4L: Continual Core Dataset Learning with Corner Case Optimization via Vision-Language Models for Autonomous Driving
by: Hu, Haibo, et al.
Published: (2025)
by: Hu, Haibo, et al.
Published: (2025)
Design Editing for Offline Model-based Optimization
by: Yuan, Ye, et al.
Published: (2024)
by: Yuan, Ye, et al.
Published: (2024)
Examining the Role of Peer Acknowledgements on Social Annotations: Unraveling the Psychological Underpinnings
by: Huang, Xiaoshan, et al.
Published: (2024)
by: Huang, Xiaoshan, et al.
Published: (2024)
ClawMobile: Rethinking Smartphone-Native Agentic Systems
by: Du, Hongchao, et al.
Published: (2026)
by: Du, Hongchao, et al.
Published: (2026)
Retrieval-Augmented Generation for Large Language Models: A Survey
by: Gao, Yunfan, et al.
Published: (2023)
by: Gao, Yunfan, et al.
Published: (2023)
Result Diversification in Search and Recommendation: A Survey
by: Wu, Haolun, et al.
Published: (2022)
by: Wu, Haolun, et al.
Published: (2022)
Similar Items
-
RAEE: A Robust Retrieval-Augmented Early Exit Framework for Efficient Inference
by: Huang, Lianming, et al.
Published: (2024) -
ReFusion: Improving Natural Language Understanding with Computation-Efficient Retrieval Representation Fusion
by: Wu, Shangyu, et al.
Published: (2024) -
Beyond Semantic Similarity: Reducing Unnecessary API Calls via Behavior-Aligned Retriever
by: Chen, Yixin, et al.
Published: (2025) -
ReFilter: Improving Robustness of Retrieval-Augmented Generation via Gated Filter
by: Chen, Yixin, et al.
Published: (2026) -
AD-EE: Early Exiting for Fast and Reliable Vision-Language Models in Autonomous Driving
by: Huang, Lianming, et al.
Published: (2025)