Enregistré dans:
| Auteurs principaux: | Ye, Xiaoju, Wang, Zhichun, Wang, Jingyuan |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2502.12962 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
DERA: Dense Entity Retrieval for Entity Alignment in Knowledge Graphs
par: Wang, Zhichun, et autres
Publié: (2024)
par: Wang, Zhichun, et autres
Publié: (2024)
InfiniPot: Infinite Context Processing on Memory-Constrained LLMs
par: Kim, Minsoo, et autres
Publié: (2024)
par: Kim, Minsoo, et autres
Publié: (2024)
MoBA: Mixture of Block Attention for Long-Context LLMs
par: Lu, Enzhe, et autres
Publié: (2025)
par: Lu, Enzhe, et autres
Publié: (2025)
S$^3$-Attention:Attention-Aligned Endogenous Retrieval for Memory-Bounded Long-Context Inference
par: Ma, Qingsen, et autres
Publié: (2026)
par: Ma, Qingsen, et autres
Publié: (2026)
Emulating Retrieval Augmented Generation via Prompt Engineering for Enhanced Long Context Comprehension in LLMs
par: Park, Joon, et autres
Publié: (2025)
par: Park, Joon, et autres
Publié: (2025)
Dynamic Uncertainty Ranking: Enhancing Retrieval-Augmented In-Context Learning for Long-Tail Knowledge in LLMs
par: Yu, Shuyang, et autres
Publié: (2024)
par: Yu, Shuyang, et autres
Publié: (2024)
Mixture of In-Context Experts Enhance LLMs' Long Context Awareness
par: Lin, Hongzhan, et autres
Publié: (2024)
par: Lin, Hongzhan, et autres
Publié: (2024)
RetrievalAttention: Accelerating Long-Context LLM Inference via Vector Retrieval
par: Liu, Di, et autres
Publié: (2024)
par: Liu, Di, et autres
Publié: (2024)
LongSafety: Enhance Safety for Long-Context LLMs
par: Huang, Mianqiu, et autres
Publié: (2024)
par: Huang, Mianqiu, et autres
Publié: (2024)
SEAL: Scaling to Emphasize Attention for Long-Context Retrieval
par: Lee, Changhun, et autres
Publié: (2025)
par: Lee, Changhun, et autres
Publié: (2025)
MemoRAG: Boosting Long Context Processing with Global Memory-Enhanced Retrieval Augmentation
par: Qian, Hongjin, et autres
Publié: (2024)
par: Qian, Hongjin, et autres
Publié: (2024)
Route Before Retrieve: Activating Latent Routing Abilities of LLMs for RAG vs. Long-Context Selection
par: Chen, Yiwen, et autres
Publié: (2026)
par: Chen, Yiwen, et autres
Publié: (2026)
Periodic RoPE for Infinite Context LLMs
par: Huo, Simin
Publié: (2026)
par: Huo, Simin
Publié: (2026)
Understanding the RoPE Extensions of Long-Context LLMs: An Attention Perspective
par: Zhong, Meizhi, et autres
Publié: (2024)
par: Zhong, Meizhi, et autres
Publié: (2024)
ReAttention: Training-Free Infinite Context with Finite Attention Scope
par: Liu, Xiaoran, et autres
Publié: (2024)
par: Liu, Xiaoran, et autres
Publié: (2024)
ZigzagAttention: Efficient Long-Context Inference with Exclusive Retrieval and Streaming Heads
par: Liu, Zhuorui, et autres
Publié: (2025)
par: Liu, Zhuorui, et autres
Publié: (2025)
DuoAttention: Efficient Long-Context LLM Inference with Retrieval and Streaming Heads
par: Xiao, Guangxuan, et autres
Publié: (2024)
par: Xiao, Guangxuan, et autres
Publié: (2024)
Attention Reveals More Than Tokens: Training-Free Long-Context Reasoning with Attention-guided Retrieval
par: Zhang, Yuwei, et autres
Publié: (2025)
par: Zhang, Yuwei, et autres
Publié: (2025)
Activation-aware Probe-Query: Effective Key-Value Retrieval for Long-Context LLMs Inference
par: Xiao, Qingfa, et autres
Publié: (2025)
par: Xiao, Qingfa, et autres
Publié: (2025)
SWAA: Sliding Window Attention Adaptation for Efficient and Quality Preserving Long Context Processing
par: Yu, Yijiong, et autres
Publié: (2025)
par: Yu, Yijiong, et autres
Publié: (2025)
Long-Short Alignment for Effective Long-Context Modeling in LLMs
par: Du, Tianqi, et autres
Publié: (2025)
par: Du, Tianqi, et autres
Publié: (2025)
Ltri-LLM: Streaming Long Context Inference for LLMs with Training-Free Dynamic Triangular Attention Pattern
par: Tang, Hongyin, et autres
Publié: (2024)
par: Tang, Hongyin, et autres
Publié: (2024)
Inference Scaling for Long-Context Retrieval Augmented Generation
par: Yue, Zhenrui, et autres
Publié: (2024)
par: Yue, Zhenrui, et autres
Publié: (2024)
ParisKV: Fast and Drift-Robust KV-Cache Retrieval for Long-Context LLMs
par: Qi, Yanlin, et autres
Publié: (2026)
par: Qi, Yanlin, et autres
Publié: (2026)
Human-inspired Episodic Memory for Infinite Context LLMs
par: Fountas, Zafeirios, et autres
Publié: (2024)
par: Fountas, Zafeirios, et autres
Publié: (2024)
Retrieval Head Mechanistically Explains Long-Context Factuality
par: Wu, Wenhao, et autres
Publié: (2024)
par: Wu, Wenhao, et autres
Publié: (2024)
LongFaith: Enhancing Long-Context Reasoning in LLMs with Faithful Synthetic Data
par: Yang, Cehao, et autres
Publié: (2025)
par: Yang, Cehao, et autres
Publié: (2025)
Training-free Context-adaptive Attention for Efficient Long Context Modeling
par: You, Zeng, et autres
Publié: (2025)
par: You, Zeng, et autres
Publié: (2025)
SPLA: Block Sparse Plus Linear Attention for Long Context Modeling
par: Wang, Bailin, et autres
Publié: (2026)
par: Wang, Bailin, et autres
Publié: (2026)
UncertaintyRAG: Span-Level Uncertainty Enhanced Long-Context Modeling for Retrieval-Augmented Generation
par: Li, Zixuan, et autres
Publié: (2024)
par: Li, Zixuan, et autres
Publié: (2024)
LongRAG: Enhancing Retrieval-Augmented Generation with Long-context LLMs
par: Jiang, Ziyan, et autres
Publié: (2024)
par: Jiang, Ziyan, et autres
Publié: (2024)
LIFT: A Novel Framework for Enhancing Long-Context Understanding of LLMs via Long Input Fine-Tuning
par: Mao, Yansheng, et autres
Publié: (2025)
par: Mao, Yansheng, et autres
Publié: (2025)
CTkvr: KV Cache Retrieval for Long-Context LLMs via Centroid then Token Indexing
par: Lu, Kuan, et autres
Publié: (2025)
par: Lu, Kuan, et autres
Publié: (2025)
Accelerating Prefilling for Long-Context LLMs via Sparse Pattern Sharing
par: Peng, Dan, et autres
Publié: (2025)
par: Peng, Dan, et autres
Publié: (2025)
You Only Use Reactive Attention Slice For Long Context Retrieval
par: Soh, Yun Joon, et autres
Publié: (2024)
par: Soh, Yun Joon, et autres
Publié: (2024)
LongEmbed: Extending Embedding Models for Long Context Retrieval
par: Zhu, Dawei, et autres
Publié: (2024)
par: Zhu, Dawei, et autres
Publié: (2024)
RAGViz: Diagnose and Visualize Retrieval-Augmented Generation
par: Wang, Tevin, et autres
Publié: (2024)
par: Wang, Tevin, et autres
Publié: (2024)
Query-Focused Retrieval Heads Improve Long-Context Reasoning and Re-ranking
par: Zhang, Wuwei, et autres
Publié: (2025)
par: Zhang, Wuwei, et autres
Publié: (2025)
Semantics-Adaptive Activation Intervention for LLMs via Dynamic Steering Vectors
par: Wang, Weixuan, et autres
Publié: (2024)
par: Wang, Weixuan, et autres
Publié: (2024)
DySCO: Dynamic Attention-Scaling Decoding for Long-Context Language Models
par: Ye, Xi, et autres
Publié: (2026)
par: Ye, Xi, et autres
Publié: (2026)
Documents similaires
-
DERA: Dense Entity Retrieval for Entity Alignment in Knowledge Graphs
par: Wang, Zhichun, et autres
Publié: (2024) -
InfiniPot: Infinite Context Processing on Memory-Constrained LLMs
par: Kim, Minsoo, et autres
Publié: (2024) -
MoBA: Mixture of Block Attention for Long-Context LLMs
par: Lu, Enzhe, et autres
Publié: (2025) -
S$^3$-Attention:Attention-Aligned Endogenous Retrieval for Memory-Bounded Long-Context Inference
par: Ma, Qingsen, et autres
Publié: (2026) -
Emulating Retrieval Augmented Generation via Prompt Engineering for Enhanced Long Context Comprehension in LLMs
par: Park, Joon, et autres
Publié: (2025)