DocReLM: Mastering Document Retrieval with Language Model
Fuente:
arXiv
Guardado en:
| Autores principales: | Wei, Gengchen, Pang, Xinle, Zhang, Tianning, Sun, Yu, Qian, Xun, Lin, Chen, Zhong, Han-Sen, Ouyang, Wanli |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
DocGraphLM: Documental Graph Language Model for Information Extraction
por: Wang, Dongsheng, et al.
Publicado: (2024)
por: Wang, Dongsheng, et al.
Publicado: (2024)
DocMMIR: A Framework for Document Multi-modal Information Retrieval
por: Li, Zirui, et al.
Publicado: (2025)
por: Li, Zirui, et al.
Publicado: (2025)
Doc2Query++: Topic-Coverage based Document Expansion and its Application to Dense Retrieval via Dual-Index Fusion
por: Kuo, Tzu-Lin, et al.
Publicado: (2025)
por: Kuo, Tzu-Lin, et al.
Publicado: (2025)
LLM-Augmented Retrieval: Enhancing Retrieval Models Through Language Models and Doc-Level Embedding
por: Wu, Mingrui, et al.
Publicado: (2024)
por: Wu, Mingrui, et al.
Publicado: (2024)
ReAlign: Optimizing the Visual Document Retriever with Reasoning-Guided Fine-Grained Alignment
por: Yang, Hao, et al.
Publicado: (2026)
por: Yang, Hao, et al.
Publicado: (2026)
Contrastive Retrieval Heads Improve Attention-Based Re-Ranking
por: Tran, Linh, et al.
Publicado: (2025)
por: Tran, Linh, et al.
Publicado: (2025)
CPRet: A Dataset, Benchmark, and Model for Retrieval in Competitive Programming
por: Deng, Han, et al.
Publicado: (2025)
por: Deng, Han, et al.
Publicado: (2025)
Doc-Researcher: A Unified System for Multimodal Document Parsing and Deep Research
por: Dong, Kuicai, et al.
Publicado: (2025)
por: Dong, Kuicai, et al.
Publicado: (2025)
DocReRank: Single-Page Hard Negative Query Generation for Training Multi-Modal RAG Rerankers
por: Wasserman, Navve, et al.
Publicado: (2025)
por: Wasserman, Navve, et al.
Publicado: (2025)
Retrieval-in-the-Chain: Bootstrapping Large Language Models for Generative Retrieval
por: Zhang, Yingchen, et al.
Publicado: (2025)
por: Zhang, Yingchen, et al.
Publicado: (2025)
AnnoRetrieve: Efficient Structured Retrieval for Unstructured Document Analysis
por: Lin, Teng, et al.
Publicado: (2026)
por: Lin, Teng, et al.
Publicado: (2026)
Docs2KG: Unified Knowledge Graph Construction from Heterogeneous Documents Assisted by Large Language Models
por: Sun, Qiang, et al.
Publicado: (2024)
por: Sun, Qiang, et al.
Publicado: (2024)
XR: Cross-Modal Agents for Composed Image Retrieval
por: Yang, Zhongyu, et al.
Publicado: (2026)
por: Yang, Zhongyu, et al.
Publicado: (2026)
DeepRetrieval: Hacking Real Search Engines and Retrievers with Large Language Models via Reinforcement Learning
por: Jiang, Pengcheng, et al.
Publicado: (2025)
por: Jiang, Pengcheng, et al.
Publicado: (2025)
Evidence Units: Ontology-Grounded Document Organization for Parser-Independent Retrieval
por: Han, Yeonjee
Publicado: (2026)
por: Han, Yeonjee
Publicado: (2026)
RecLM: Recommendation Instruction Tuning
por: Jiang, Yangqin, et al.
Publicado: (2024)
por: Jiang, Yangqin, et al.
Publicado: (2024)
Tevatron 2.0: Unified Document Retrieval Toolkit across Scale, Language, and Modality
por: Ma, Xueguang, et al.
Publicado: (2025)
por: Ma, Xueguang, et al.
Publicado: (2025)
DocPruner: A Storage-Efficient Framework for Multi-Vector Visual Document Retrieval via Adaptive Patch-Level Embedding Pruning
por: Yan, Yibo, et al.
Publicado: (2025)
por: Yan, Yibo, et al.
Publicado: (2025)
Unifying Multimodal Retrieval via Document Screenshot Embedding
por: Ma, Xueguang, et al.
Publicado: (2024)
por: Ma, Xueguang, et al.
Publicado: (2024)
Learning Refined Document Representations for Dense Retrieval via Deliberate Thinking
por: Ji, Yifan, et al.
Publicado: (2025)
por: Ji, Yifan, et al.
Publicado: (2025)
TCDE: Topic-Centric Dual Expansion of Queries and Documents with Large Language Models for Information Retrieval
por: Yang, Yu, et al.
Publicado: (2025)
por: Yang, Yu, et al.
Publicado: (2025)
AskDoc -- Identifying Hidden Healthcare Disparities
por: Gupta, Shashank
Publicado: (2025)
por: Gupta, Shashank
Publicado: (2025)
DiffuGR: Generative Document Retrieval with Diffusion Language Models
por: Zhao, Xinpeng, et al.
Publicado: (2025)
por: Zhao, Xinpeng, et al.
Publicado: (2025)
Doc To The Future: Infomorphs for Interactive, Multimodal Document Transformation and Generation
por: Kumaravel, Balasaravanan Thoravi
Publicado: (2025)
por: Kumaravel, Balasaravanan Thoravi
Publicado: (2025)
ReFeed: Retrieval Feedback-Guided Dataset Construction for Style-Aware Query Rewriting
por: Myung, Jiyoon, et al.
Publicado: (2026)
por: Myung, Jiyoon, et al.
Publicado: (2026)
Re3: Learning to Balance Relevance & Recency for Temporal Information Retrieval
por: Cao, Jiawei, et al.
Publicado: (2025)
por: Cao, Jiawei, et al.
Publicado: (2025)
A Counterfactual Explanation Framework for Retrieval Models
por: Chandna, Bhavik, et al.
Publicado: (2024)
por: Chandna, Bhavik, et al.
Publicado: (2024)
Spiral of Silence: How is Large Language Model Killing Information Retrieval? -- A Case Study on Open Domain Question Answering
por: Chen, Xiaoyang, et al.
Publicado: (2024)
por: Chen, Xiaoyang, et al.
Publicado: (2024)
ReLLa: Retrieval-enhanced Large Language Models for Lifelong Sequential Behavior Comprehension in Recommendation
por: Lin, Jianghao, et al.
Publicado: (2023)
por: Lin, Jianghao, et al.
Publicado: (2023)
PairSem: LLM-Guided Pairwise Semantic Matching for Scientific Document Retrieval
por: Kweon, Wonbin, et al.
Publicado: (2025)
por: Kweon, Wonbin, et al.
Publicado: (2025)
PromptReps: Prompting Large Language Models to Generate Dense and Sparse Representations for Zero-Shot Document Retrieval
por: Zhuang, Shengyao, et al.
Publicado: (2024)
por: Zhuang, Shengyao, et al.
Publicado: (2024)
Document Screenshot Retrievers are Vulnerable to Pixel Poisoning Attacks
por: Zhuang, Shengyao, et al.
Publicado: (2025)
por: Zhuang, Shengyao, et al.
Publicado: (2025)
GOLFer: Smaller LM-Generated Documents Hallucination Filter & Combiner for Query Expansion in Information Retrieval
por: Liu, Lingyuan, et al.
Publicado: (2025)
por: Liu, Lingyuan, et al.
Publicado: (2025)
Harnessing the Power of Reinforcement Learning for Language-Model-Based Information Retriever via Query-Document Co-Augmentation
por: Liu, Jingming, et al.
Publicado: (2025)
por: Liu, Jingming, et al.
Publicado: (2025)
Non-parametric Graph Convolution for Re-ranking in Recommendation Systems
por: Ouyang, Zhongyu, et al.
Publicado: (2025)
por: Ouyang, Zhongyu, et al.
Publicado: (2025)
Spatial-RAG: Spatial Retrieval Augmented Generation for Real-World Geospatial Reasoning Questions
por: Yu, Dazhou, et al.
Publicado: (2025)
por: Yu, Dazhou, et al.
Publicado: (2025)
LegalSearchLM: Rethinking Legal Case Retrieval as Legal Elements Generation
por: Kim, Chaeeun, et al.
Publicado: (2025)
por: Kim, Chaeeun, et al.
Publicado: (2025)
KAP: MLLM-assisted OCR Text Enhancement for Hybrid Retrieval in Chinese Non-Narrative Documents
por: Hsu, Hsin-Ling, et al.
Publicado: (2025)
por: Hsu, Hsin-Ling, et al.
Publicado: (2025)
Multimodal Search in Chemical Documents and Reactions
por: Shah, Ayush Kumar, et al.
Publicado: (2025)
por: Shah, Ayush Kumar, et al.
Publicado: (2025)
I^3 Retriever: Incorporating Implicit Interaction in Pre-trained Language Models for Passage Retrieval
por: Dong, Qian, et al.
Publicado: (2023)
por: Dong, Qian, et al.
Publicado: (2023)
Ejemplares similares
-
DocGraphLM: Documental Graph Language Model for Information Extraction
por: Wang, Dongsheng, et al.
Publicado: (2024) -
DocMMIR: A Framework for Document Multi-modal Information Retrieval
por: Li, Zirui, et al.
Publicado: (2025) -
Doc2Query++: Topic-Coverage based Document Expansion and its Application to Dense Retrieval via Dual-Index Fusion
por: Kuo, Tzu-Lin, et al.
Publicado: (2025) -
LLM-Augmented Retrieval: Enhancing Retrieval Models Through Language Models and Doc-Level Embedding
por: Wu, Mingrui, et al.
Publicado: (2024) -
ReAlign: Optimizing the Visual Document Retriever with Reasoning-Guided Fine-Grained Alignment
por: Yang, Hao, et al.
Publicado: (2026)