Subtopic-aware View Sampling and Temporal Aggregation for Long-form Document Matching
Fuente:
arXiv
Saved in:
| Main Authors: | Zhou, Youchao, Huang, Heyan, Wu, Zhijing, Liu, Yuhang, Wang, Xinglin |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
DRAGIN: Dynamic Retrieval Augmented Generation based on the Information Needs of Large Language Models
by: Su, Weihang, et al.
Published: (2024)
by: Su, Weihang, et al.
Published: (2024)
Mitigating Entity-Level Hallucination in Large Language Models
by: Su, Weihang, et al.
Published: (2024)
by: Su, Weihang, et al.
Published: (2024)
Towards Storage-Efficient Visual Document Retrieval: An Empirical Study on Reducing Patch-Level Embeddings
by: Ma, Yubo, et al.
Published: (2025)
by: Ma, Yubo, et al.
Published: (2025)
MoLoRAG: Bootstrapping Document Understanding via Multi-modal Logic-aware Retrieval
by: Wu, Xixi, et al.
Published: (2025)
by: Wu, Xixi, et al.
Published: (2025)
SCARV: Structure-Constrained Aggregation for Stable Sample Ranking in Redundant NLP Datasets
by: Zheng, Xu, et al.
Published: (2026)
by: Zheng, Xu, et al.
Published: (2026)
Positional Bias in Long-Document Ranking: Impact, Assessment, and Mitigation
by: Boytsov, Leonid, et al.
Published: (2022)
by: Boytsov, Leonid, et al.
Published: (2022)
Fast and Faithful: Real-Time Verification for Long-Document Retrieval-Augmented Generation Systems
by: Liu, Xunzhuo, et al.
Published: (2026)
by: Liu, Xunzhuo, et al.
Published: (2026)
ASTRA-QA: A Benchmark for Abstract Question Answering over Documents
by: Wang, Shu, et al.
Published: (2026)
by: Wang, Shu, et al.
Published: (2026)
GDLLM: A Global Distance-aware Modeling Approach Based on Large Language Models for Event Temporal Relation Extraction
by: Zhao, Jie, et al.
Published: (2025)
by: Zhao, Jie, et al.
Published: (2025)
Toward General Semantic Chunking: A Discriminative Framework for Ultra-Long Documents
by: Wu, Kaifeng, et al.
Published: (2025)
by: Wu, Kaifeng, et al.
Published: (2025)
Generative Dense Retrieval: Memory Can Be a Burden
by: Yuan, Peiwen, et al.
Published: (2024)
by: Yuan, Peiwen, et al.
Published: (2024)
Recall Them All: Retrieval-Augmented Language Models for Long Object List Extraction from Long Documents
by: Singhania, Sneha, et al.
Published: (2024)
by: Singhania, Sneha, et al.
Published: (2024)
U-NIAH: Unified RAG and LLM Evaluation for Long Context Needle-In-A-Haystack
by: Gao, Yunfan, et al.
Published: (2025)
by: Gao, Yunfan, et al.
Published: (2025)
Decomposing Retrieval Failures in RAG for Long-Document Financial Question Answering
by: Kobeissi, Amine, et al.
Published: (2026)
by: Kobeissi, Amine, et al.
Published: (2026)
UniHGKR: Unified Instruction-aware Heterogeneous Knowledge Retrievers
by: Min, Dehai, et al.
Published: (2024)
by: Min, Dehai, et al.
Published: (2024)
Dwell in the Beginning: How Language Models Embed Long Documents for Dense Retrieval
by: Coelho, João, et al.
Published: (2024)
by: Coelho, João, et al.
Published: (2024)
LLM-ESR: Large Language Models Enhancement for Long-tailed Sequential Recommendation
by: Liu, Qidong, et al.
Published: (2024)
by: Liu, Qidong, et al.
Published: (2024)
A Comprehensive Evaluation of Large Language Models on Temporal Event Forecasting
by: Chang, He, et al.
Published: (2024)
by: Chang, He, et al.
Published: (2024)
Self-Manager: Parallel Agent Loop for Long-form Deep Research
by: Xu, Yilong, et al.
Published: (2026)
by: Xu, Yilong, et al.
Published: (2026)
CliniQ: A Multi-faceted Benchmark for Electronic Health Record Retrieval with Semantic Match Assessment
by: Zhao, Zhengyun, et al.
Published: (2025)
by: Zhao, Zhengyun, et al.
Published: (2025)
A Split-then-Join Approach to Abstractive Summarization for Very Long Documents in a Low Resource Setting
by: Fazry, Lhuqita
Published: (2025)
by: Fazry, Lhuqita
Published: (2025)
Retrieval of Temporal Event Sequences from Textual Descriptions
by: Liu, Zefang, et al.
Published: (2024)
by: Liu, Zefang, et al.
Published: (2024)
Cocktail: A Comprehensive Information Retrieval Benchmark with LLM-Generated Documents Integration
by: Dai, Sunhao, et al.
Published: (2024)
by: Dai, Sunhao, et al.
Published: (2024)
Doc-Researcher: A Unified System for Multimodal Document Parsing and Deep Research
by: Dong, Kuicai, et al.
Published: (2025)
by: Dong, Kuicai, et al.
Published: (2025)
Set-Aligning Framework for Auto-Regressive Event Temporal Graph Generation
by: Tan, Xingwei, et al.
Published: (2024)
by: Tan, Xingwei, et al.
Published: (2024)
How Does A Text Preprocessing Pipeline Affect Ontology Matching?
by: Qiang, Zhangcheng, et al.
Published: (2024)
by: Qiang, Zhangcheng, et al.
Published: (2024)
Unlocking the Power of Large Language Models for Multi-table Entity Matching
by: Tang, Yingkai, et al.
Published: (2026)
by: Tang, Yingkai, et al.
Published: (2026)
Text-to-Pipeline: Bridging Natural Language and Data Preparation Pipelines
by: Ge, Yuhang, et al.
Published: (2025)
by: Ge, Yuhang, et al.
Published: (2025)
OkraLong: A Flexible Retrieval-Augmented Framework for Long-Text Query Processing
by: Hui, Yulong, et al.
Published: (2025)
by: Hui, Yulong, et al.
Published: (2025)
Unlocking Multimodal Document Intelligence: From Current Triumphs to Future Frontiers of Visual Document Retrieval
by: Yan, Yibo, et al.
Published: (2026)
by: Yan, Yibo, et al.
Published: (2026)
SAKE: Self-aware Knowledge Exploitation-Exploration for Grounded Multimodal Named Entity Recognition
by: Tang, Jielong, et al.
Published: (2026)
by: Tang, Jielong, et al.
Published: (2026)
TA-Mem: Tool-Augmented Autonomous Memory Retrieval for LLM in Long-Term Conversational QA
by: Yuan, Mengwei, et al.
Published: (2026)
by: Yuan, Mengwei, et al.
Published: (2026)
Elaborative Subtopic Query Reformulation for Broad and Indirect Queries in Travel Destination Recommendation
by: Wen, Qianfeng, et al.
Published: (2024)
by: Wen, Qianfeng, et al.
Published: (2024)
Passage Segmentation of Documents for Extractive Question Answering
by: Liu, Zuhong, et al.
Published: (2025)
by: Liu, Zuhong, et al.
Published: (2025)
How Vital is the Jurisprudential Relevance: Law Article Intervened Legal Case Retrieval and Matching
by: Xu, Nuo, et al.
Published: (2025)
by: Xu, Nuo, et al.
Published: (2025)
Utilizing Contextual Clues and Role Correlations for Enhancing Document-level Event Argument Extraction
by: Liu, Wanlong, et al.
Published: (2023)
by: Liu, Wanlong, et al.
Published: (2023)
Enhancing Temporal Sensitivity of Large Language Model for Recommendation with Counterfactual Tuning
by: Liu, Yutian, et al.
Published: (2025)
by: Liu, Yutian, et al.
Published: (2025)
Beyond the Grid: Layout-Informed Multi-Vector Retrieval with Parsed Visual Document Representations
by: Yan, Yibo, et al.
Published: (2026)
by: Yan, Yibo, et al.
Published: (2026)
Optimizing RAG Rerankers with LLM Feedback via Reinforcement Learning
by: Wu, Yuhang, et al.
Published: (2026)
by: Wu, Yuhang, et al.
Published: (2026)
RaDeR: Reasoning-aware Dense Retrieval Models
by: Das, Debrup, et al.
Published: (2025)
by: Das, Debrup, et al.
Published: (2025)
Similar Items
-
DRAGIN: Dynamic Retrieval Augmented Generation based on the Information Needs of Large Language Models
by: Su, Weihang, et al.
Published: (2024) -
Mitigating Entity-Level Hallucination in Large Language Models
by: Su, Weihang, et al.
Published: (2024) -
Towards Storage-Efficient Visual Document Retrieval: An Empirical Study on Reducing Patch-Level Embeddings
by: Ma, Yubo, et al.
Published: (2025) -
MoLoRAG: Bootstrapping Document Understanding via Multi-modal Logic-aware Retrieval
by: Wu, Xixi, et al.
Published: (2025) -
SCARV: Structure-Constrained Aggregation for Stable Sample Ranking in Redundant NLP Datasets
by: Zheng, Xu, et al.
Published: (2026)