Hypothetical Documents or Knowledge Leakage? Rethinking LLM-based Query Expansion
Fuente:
arXiv
Saved in:
| Main Authors: | Yoon, Yejun, Jung, Jaeyoon, Yoon, Seunghyun, Park, Kunwoo |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Team HUMANE at AVeriTeC 2025: HerO 2 for Efficient Fact Verification
by: Yoon, Yejun, et al.
Published: (2025)
by: Yoon, Yejun, et al.
Published: (2025)
HerO at AVeriTeC: The Herd of Open Large Language Models for Verifying Real-World Claims
by: Yoon, Yejun, et al.
Published: (2024)
by: Yoon, Yejun, et al.
Published: (2024)
VILLAIN at AVerImaTeC: Verifying Image-Text Claims via Multi-Agent Collaboration
by: Jung, Jaeyoon, et al.
Published: (2026)
by: Jung, Jaeyoon, et al.
Published: (2026)
Is a Picture Worth a Thousand Words? Adaptive Multimodal Fact-Checking with Visual Evidence Necessity
by: Jung, Jaeyoon, et al.
Published: (2026)
by: Jung, Jaeyoon, et al.
Published: (2026)
Assessing News Thumbnail Representativeness: Counterfactual text can enhance the cross-modal matching ability
by: Yoon, Yejun, et al.
Published: (2024)
by: Yoon, Yejun, et al.
Published: (2024)
A New Query Expansion Approach via Agent-Mediated Dialogic Inquiry
by: Seo, Wonduk, et al.
Published: (2025)
by: Seo, Wonduk, et al.
Published: (2025)
Knowledge-Aware Query Expansion with Large Language Models for Textual and Relational Retrieval
by: Xia, Yu, et al.
Published: (2024)
by: Xia, Yu, et al.
Published: (2024)
Rethinking LLM-Based Recommendations: A Personalized Query-Driven Parallel Integration
by: Han, Donghee, et al.
Published: (2025)
by: Han, Donghee, et al.
Published: (2025)
Rethinking On-policy Optimization for Query Augmentation
by: Xu, Zhichao, et al.
Published: (2025)
by: Xu, Zhichao, et al.
Published: (2025)
Corpus-Steered Query Expansion with Large Language Models
by: Lei, Yibin, et al.
Published: (2024)
by: Lei, Yibin, et al.
Published: (2024)
LANGSAE EDITING: Improving Multilingual Information Retrieval via Post-hoc Language Identity Removal
by: Kim, Dongjun, et al.
Published: (2026)
by: Kim, Dongjun, et al.
Published: (2026)
ThinkQE: Query Expansion via an Evolving Thinking Process
by: Lei, Yibin, et al.
Published: (2025)
by: Lei, Yibin, et al.
Published: (2025)
Enhancing Time Awareness in Generative Recommendation
by: Lee, Sunkyung, et al.
Published: (2025)
by: Lee, Sunkyung, et al.
Published: (2025)
QueryGym: A Toolkit for Reproducible LLM-Based Query Reformulation
by: Bigdeli, Amin, et al.
Published: (2025)
by: Bigdeli, Amin, et al.
Published: (2025)
Beyond Relevant Documents: A Knowledge-Intensive Approach for Query-Focused Summarization using Large Language Models
by: Zhang, Weijia, et al.
Published: (2024)
by: Zhang, Weijia, et al.
Published: (2024)
GOLFer: Smaller LM-Generated Documents Hallucination Filter & Combiner for Query Expansion in Information Retrieval
by: Liu, Lingyuan, et al.
Published: (2025)
by: Liu, Lingyuan, et al.
Published: (2025)
Improving Document Retrieval Coherence for Semantically Equivalent Queries
by: Campese, Stefano, et al.
Published: (2025)
by: Campese, Stefano, et al.
Published: (2025)
The Effect of Document Selection on Query-focused Text Analysis
by: Rangreji, Sandesh S, et al.
Published: (2026)
by: Rangreji, Sandesh S, et al.
Published: (2026)
Query-Adaptive Semantic Chunking for Retrieval-Augmented Generation: A Dynamic Strategy with Contextual Window Expansion
by: Rastogi, Mudit
Published: (2026)
by: Rastogi, Mudit
Published: (2026)
QDER: Query-Specific Document and Entity Representations for Multi-Vector Document Re-Ranking
by: Chatterjee, Shubham, et al.
Published: (2025)
by: Chatterjee, Shubham, et al.
Published: (2025)
MODS: Moderating a Mixture of Document Speakers to Summarize Debatable Queries in Document Collections
by: Balepur, Nishant, et al.
Published: (2025)
by: Balepur, Nishant, et al.
Published: (2025)
A Reproducibility Study of LLM-Based Query Reformulation
by: Bigdeli, Amin, et al.
Published: (2026)
by: Bigdeli, Amin, et al.
Published: (2026)
When do Generative Query and Document Expansions Fail? A Comprehensive Study Across Methods, Retrievers, and Datasets
by: Weller, Orion, et al.
Published: (2023)
by: Weller, Orion, et al.
Published: (2023)
Query-Document Dense Vectors for LLM Relevance Judgment Bias Analysis
by: Mohtadi, Samaneh, et al.
Published: (2026)
by: Mohtadi, Samaneh, et al.
Published: (2026)
Ontology-Based Knowledge Graph Framework for Industrial Standard Documents via Hierarchical and Propositional Structuring
by: Park, Jiin, et al.
Published: (2025)
by: Park, Jiin, et al.
Published: (2025)
Verbal-R3: Verbal Reranker as the Missing Bridge between Retrieval and Reasoning
by: Park, Sangkwon, et al.
Published: (2026)
by: Park, Sangkwon, et al.
Published: (2026)
Survey of Query-based Text Summarization
by: Yu, Hang, et al.
Published: (2022)
by: Yu, Hang, et al.
Published: (2022)
Query Optimization for Parametric Knowledge Refinement in Retrieval-Augmented Large Language Models
by: Cong, Youan, et al.
Published: (2024)
by: Cong, Youan, et al.
Published: (2024)
Generative Query Expansion with Multilingual LLMs for Cross-Lingual Information Retrieval
by: Macmillan-Scott, Olivia, et al.
Published: (2025)
by: Macmillan-Scott, Olivia, et al.
Published: (2025)
QEQR: An Exploration of Query Expansion Methods for Question Retrieval in CQA Services
by: Ghafourian, Yasin, et al.
Published: (2024)
by: Ghafourian, Yasin, et al.
Published: (2024)
CardRewriter: Leveraging Knowledge Cards for Long-Tail Query Rewriting on Short-Video Platforms
by: Gong, Peiyuan, et al.
Published: (2025)
by: Gong, Peiyuan, et al.
Published: (2025)
Knowledge-Driven Cross-Document Relation Extraction
by: Jain, Monika, et al.
Published: (2024)
by: Jain, Monika, et al.
Published: (2024)
An Empirical Study on Reinforcement Learning for Reasoning-Search Interleaved LLM Agents
by: Jin, Bowen, et al.
Published: (2025)
by: Jin, Bowen, et al.
Published: (2025)
MILL: Mutual Verification with Large Language Models for Zero-Shot Query Expansion
by: Jia, Pengyue, et al.
Published: (2023)
by: Jia, Pengyue, et al.
Published: (2023)
Enhancing Short-Text Topic Modeling with LLM-Driven Context Expansion and Prefix-Tuned VAEs
by: Akash, Pritom Saha, et al.
Published: (2024)
by: Akash, Pritom Saha, et al.
Published: (2024)
Rank-R1: Enhancing Reasoning in LLM-based Document Rerankers via Reinforcement Learning
by: Zhuang, Shengyao, et al.
Published: (2025)
by: Zhuang, Shengyao, et al.
Published: (2025)
LegalMALR:Multi-Agent Query Understanding and LLM-Based Reranking for Chinese Statute Retrieval
by: Li, Yunhan, et al.
Published: (2026)
by: Li, Yunhan, et al.
Published: (2026)
Anveshana: A New Benchmark Dataset for Cross-Lingual Information Retrieval On English Queries and Sanskrit Documents
by: Jagadeeshan, Manoj Balaji, et al.
Published: (2025)
by: Jagadeeshan, Manoj Balaji, et al.
Published: (2025)
CWRCzech: 100M Query-Document Czech Click Dataset and Its Application to Web Relevance Ranking
by: Vonášek, Josef, et al.
Published: (2024)
by: Vonášek, Josef, et al.
Published: (2024)
Machine Reading Comprehension using Case-based Reasoning
by: Thai, Dung, et al.
Published: (2023)
by: Thai, Dung, et al.
Published: (2023)
Similar Items
-
Team HUMANE at AVeriTeC 2025: HerO 2 for Efficient Fact Verification
by: Yoon, Yejun, et al.
Published: (2025) -
HerO at AVeriTeC: The Herd of Open Large Language Models for Verifying Real-World Claims
by: Yoon, Yejun, et al.
Published: (2024) -
VILLAIN at AVerImaTeC: Verifying Image-Text Claims via Multi-Agent Collaboration
by: Jung, Jaeyoon, et al.
Published: (2026) -
Is a Picture Worth a Thousand Words? Adaptive Multimodal Fact-Checking with Visual Evidence Necessity
by: Jung, Jaeyoon, et al.
Published: (2026) -
Assessing News Thumbnail Representativeness: Counterfactual text can enhance the cross-modal matching ability
by: Yoon, Yejun, et al.
Published: (2024)