Efficient RAG with Intent-Aware Retrieval and Semantics-Preserving Chunking
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Puspitasari, Fachrina Dewi, Zhang, Chaoning, Zhang, Jiaquan, Wang, Zhicheng, Awan, Hafiz Shakeel Ahmad, Qureshi, Rizwan, Lee, Jewon, Kim, Tae-Ho, Yang, Yang |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Small Language Model Helps Resolve Semantic Ambiguity of LLM Prompt
par: Huang, Zhenzhen, et autres
Publié: (2026)
par: Huang, Zhenzhen, et autres
Publié: (2026)
Fast SAM2 with Text-Driven Token Pruning
par: Mandal, Avilasha, et autres
Publié: (2025)
par: Mandal, Avilasha, et autres
Publié: (2025)
Geometric Neural Operators via Lie Group-Constrained Latent Dynamics
par: Zhang, Jiaquan, et autres
Publié: (2026)
par: Zhang, Jiaquan, et autres
Publié: (2026)
Exploring Kernel Transformations for Implicit Neural Representations
par: Zheng, Sheng, et autres
Publié: (2025)
par: Zheng, Sheng, et autres
Publié: (2025)
Agent-GWO: Collaborative Agents for Dynamic Prompt Optimization in Large Language Models
par: Wang, Xudong, et autres
Publié: (2026)
par: Wang, Xudong, et autres
Publié: (2026)
Text summarization via global structure awareness
par: Zhang, Jiaquan, et autres
Publié: (2026)
par: Zhang, Jiaquan, et autres
Publié: (2026)
SmartChunk Retrieval: Query-Aware Chunk Compression with Planning for Efficient Document RAG
par: Zhang, Xuechen, et autres
Publié: (2025)
par: Zhang, Xuechen, et autres
Publié: (2025)
Topology-Aware Layer Pruning for Large Vision-Language Models
par: Zheng, Pengcheng, et autres
Publié: (2026)
par: Zheng, Pengcheng, et autres
Publié: (2026)
Sora as a World Model? A Complete Survey on Text-to-Video Generation
par: Puspitasari, Fachrina Dewi, et autres
Publié: (2024)
par: Puspitasari, Fachrina Dewi, et autres
Publié: (2024)
The Chronicles of RAG: The Retriever, the Chunk and the Generator
par: Finardi, Paulo, et autres
Publié: (2024)
par: Finardi, Paulo, et autres
Publié: (2024)
A Survey on Segment Anything Model (SAM): Vision Foundation Model Meets Prompt Engineering
par: Zhang, Chaoning, et autres
Publié: (2023)
par: Zhang, Chaoning, et autres
Publié: (2023)
Weak-Link Optimization for Multi-Agent Reasoning and Collaboration
par: Bian, Haoyu, et autres
Publié: (2026)
par: Bian, Haoyu, et autres
Publié: (2026)
Beyond Chunking: Discourse-Aware Hierarchical Retrieval for Long Document Question Answering
par: Chen, Huiyao, et autres
Publié: (2025)
par: Chen, Huiyao, et autres
Publié: (2025)
Transforming External Knowledge into Triplets for Enhanced Retrieval in RAG of LLMs
par: Wang, Xudong, et autres
Publié: (2026)
par: Wang, Xudong, et autres
Publié: (2026)
Voxel-Aggregated Feature Synthesis: Efficient Dense Mapping for Simulated 3D Reasoning
par: Burns, Owen, et autres
Publié: (2024)
par: Burns, Owen, et autres
Publié: (2024)
FlashRAG: A Modular Toolkit for Efficient Retrieval-Augmented Generation Research
par: Jin, Jiajie, et autres
Publié: (2024)
par: Jin, Jiajie, et autres
Publié: (2024)
Efficient and Interpretable Multi-Agent LLM Routing via Ant Colony Optimization
par: Wang, Xudong, et autres
Publié: (2026)
par: Wang, Xudong, et autres
Publié: (2026)
EHRAG: Bridging Semantic Gaps in Lightweight GraphRAG via Hybrid Hypergraph Construction and Retrieval
par: Song, Yifan, et autres
Publié: (2026)
par: Song, Yifan, et autres
Publié: (2026)
vGamba: Attentive State Space Bottleneck for efficient Long-range Dependencies in Visual Recognition
par: Haruna, Yunusa, et autres
Publié: (2025)
par: Haruna, Yunusa, et autres
Publié: (2025)
ChunkRAG: Novel LLM-Chunk Filtering Method for RAG Systems
par: Singh, Ishneet Sukhvinder, et autres
Publié: (2024)
par: Singh, Ishneet Sukhvinder, et autres
Publié: (2024)
Lightweight LLM Agent Memory with Small Language Models
par: Zhang, Jiaquan, et autres
Publié: (2026)
par: Zhang, Jiaquan, et autres
Publié: (2026)
Beyond Chunk-Local Extraction: Cross-Chunk Graph Augmentation for GraphRAG
par: Zhang, Jiaming, et autres
Publié: (2026)
par: Zhang, Jiaming, et autres
Publié: (2026)
AgriLens: Semantic Retrieval in Agricultural Texts Using Topic Modeling and Language Models
par: Shakeel, Heba, et autres
Publié: (2026)
par: Shakeel, Heba, et autres
Publié: (2026)
Grounding Language Model with Chunking-Free In-Context Retrieval
par: Qian, Hongjin, et autres
Publié: (2024)
par: Qian, Hongjin, et autres
Publié: (2024)
From Similarity to Structure: Training-free LLM Context Compression with Hybrid Graph Priors
par: Zhou, Yitian, et autres
Publié: (2026)
par: Zhou, Yitian, et autres
Publié: (2026)
Adaptive Chunking: Optimizing Chunking-Method Selection for RAG
par: Júnior, Paulo Roberto de Moura, et autres
Publié: (2026)
par: Júnior, Paulo Roberto de Moura, et autres
Publié: (2026)
P$^2$RAG: Efficient Privacy-Preserving RAG Service Supporting Arbitrary Top-$k$ Retrieval
par: Ming, Yulong, et autres
Publié: (2026)
par: Ming, Yulong, et autres
Publié: (2026)
Adaptive Semantic Chunking for Enhanced Contextual Fidelity in Long-Document RAG
par: Revista, Zen, et autres
Publié: (2025)
par: Revista, Zen, et autres
Publié: (2025)
EfficientRAG: Efficient Retriever for Multi-Hop Question Answering
par: Zhuang, Ziyuan, et autres
Publié: (2024)
par: Zhuang, Ziyuan, et autres
Publié: (2024)
ChunkKV: Semantic-Preserving KV Cache Compression for Efficient Long-Context LLM Inference
par: Liu, Xiang, et autres
Publié: (2025)
par: Liu, Xiang, et autres
Publié: (2025)
Understanding Chain-of-Thought in Large Language Models via Topological Data Analysis
par: Li, Chenghao, et autres
Publié: (2025)
par: Li, Chenghao, et autres
Publié: (2025)
Rethinking Input Domains in Physics-Informed Neural Networks via Geometric Compactification Mappings
par: Huang, Zhenzhen, et autres
Publié: (2026)
par: Huang, Zhenzhen, et autres
Publié: (2026)
Web Retrieval-Aware Chunking (W-RAC) for Efficient and Cost-Effective Retrieval-Augmented Generation Systems
par: Allu, Uday, et autres
Publié: (2026)
par: Allu, Uday, et autres
Publié: (2026)
PACE: Phase-Aware Chunk Execution for Robot Policies with Action Chunking
par: Nie, Junnan, et autres
Publié: (2026)
par: Nie, Junnan, et autres
Publié: (2026)
REIC: RAG-Enhanced Intent Classification at Scale
par: Zhang, Ziji, et autres
Publié: (2025)
par: Zhang, Ziji, et autres
Publié: (2025)
Visual Late Chunking: An Empirical Study of Contextual Chunking for Efficient Visual Document Retrieval
par: Yan, Yibo, et autres
Publié: (2026)
par: Yan, Yibo, et autres
Publié: (2026)
Privacy-Aware RAG: Secure and Isolated Knowledge Retrieval
par: Zhou, Pengcheng, et autres
Publié: (2025)
par: Zhou, Pengcheng, et autres
Publié: (2025)
TurboRAG: Accelerating Retrieval-Augmented Generation with Precomputed KV Caches for Chunked Text
par: Lu, Songshuo, et autres
Publié: (2024)
par: Lu, Songshuo, et autres
Publié: (2024)
Breaking Semantic-Aware Watermarks via LLM-Guided Coherence-Preserving Semantic Injection
par: Gao, Zheng, et autres
Publié: (2026)
par: Gao, Zheng, et autres
Publié: (2026)
LiteSemRAG: Lightweight LLM-Free Semantic-Aware Graph Retrieval for Robust RAG
par: Yue, Xiao, et autres
Publié: (2026)
par: Yue, Xiao, et autres
Publié: (2026)
Documents similaires
-
Small Language Model Helps Resolve Semantic Ambiguity of LLM Prompt
par: Huang, Zhenzhen, et autres
Publié: (2026) -
Fast SAM2 with Text-Driven Token Pruning
par: Mandal, Avilasha, et autres
Publié: (2025) -
Geometric Neural Operators via Lie Group-Constrained Latent Dynamics
par: Zhang, Jiaquan, et autres
Publié: (2026) -
Exploring Kernel Transformations for Implicit Neural Representations
par: Zheng, Sheng, et autres
Publié: (2025) -
Agent-GWO: Collaborative Agents for Dynamic Prompt Optimization in Large Language Models
par: Wang, Xudong, et autres
Publié: (2026)