Dense Retrievers Can Fail on Simple Queries: Revealing The Granularity Dilemma of Embeddings
Fuente:
arXiv
Salvato in:
| Autori principali: | Xu, Liyan, Su, Zhenlin, Yu, Mo, Li, Jiangnan, Meng, Fandong, Zhou, Jie |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Fine-Grained Modeling of Narrative Context: A Coherence Perspective via Retrospective Questions
di: Xu, Liyan, et al.
Pubblicazione: (2024)
di: Xu, Liyan, et al.
Pubblicazione: (2024)
SIG: Speaker Identification in Literature via Prompt-Based Generation
di: Su, Zhenlin, et al.
Pubblicazione: (2023)
di: Su, Zhenlin, et al.
Pubblicazione: (2023)
Identifying Factual Inconsistencies in Summaries: Grounding LLM Inference via Task Taxonomy
di: Xu, Liyan, et al.
Pubblicazione: (2024)
di: Xu, Liyan, et al.
Pubblicazione: (2024)
LLaVE: Large Language and Vision Embedding Models with Hardness-Weighted Contrastive Learning
di: Lan, Zhibin, et al.
Pubblicazione: (2025)
di: Lan, Zhibin, et al.
Pubblicazione: (2025)
Beyond Next Token Prediction: Patch-Level Training for Large Language Models
di: Shao, Chenze, et al.
Pubblicazione: (2024)
di: Shao, Chenze, et al.
Pubblicazione: (2024)
HGMEM: Hypergraph-based Working Memory to Improve Multi-step RAG for Long-Context Complex Relational Modeling
di: Zhou, Chulun, et al.
Pubblicazione: (2025)
di: Zhou, Chulun, et al.
Pubblicazione: (2025)
Language Generation with Strictly Proper Scoring Rules
di: Shao, Chenze, et al.
Pubblicazione: (2024)
di: Shao, Chenze, et al.
Pubblicazione: (2024)
Continuous Autoregressive Language Models
di: Shao, Chenze, et al.
Pubblicazione: (2025)
di: Shao, Chenze, et al.
Pubblicazione: (2025)
On Large Language Models' Hallucination with Regard to Known Facts
di: Jiang, Che, et al.
Pubblicazione: (2024)
di: Jiang, Che, et al.
Pubblicazione: (2024)
Beyond Imitation: Recovering Dense Rewards from Demonstrations
di: Li, Jiangnan, et al.
Pubblicazione: (2025)
di: Li, Jiangnan, et al.
Pubblicazione: (2025)
SitEmb-v1.5: Improved Context-Aware Dense Retrieval for Semantic Association and Long Story Comprehension
di: Wu, Junjie, et al.
Pubblicazione: (2025)
di: Wu, Junjie, et al.
Pubblicazione: (2025)
UME-R1: Exploring Reasoning-Driven Generative Multimodal Embeddings
di: Lan, Zhibin, et al.
Pubblicazione: (2025)
di: Lan, Zhibin, et al.
Pubblicazione: (2025)
ComoRAG: A Cognitive-Inspired Memory-Organized RAG for Stateful Long Narrative Reasoning
di: Wang, Juyuan, et al.
Pubblicazione: (2025)
di: Wang, Juyuan, et al.
Pubblicazione: (2025)
DailyDilemmas: Revealing Value Preferences of LLMs with Quandaries of Daily Life
di: Chiu, Yu Ying, et al.
Pubblicazione: (2024)
di: Chiu, Yu Ying, et al.
Pubblicazione: (2024)
Dissecting Long-Chain-of-Thought Reasoning Models: An Empirical Study
di: Mu, Yongyu, et al.
Pubblicazione: (2025)
di: Mu, Yongyu, et al.
Pubblicazione: (2025)
A Dual-Space Framework for General Knowledge Distillation of Large Language Models
di: Zhang, Xue, et al.
Pubblicazione: (2025)
di: Zhang, Xue, et al.
Pubblicazione: (2025)
Mix-of-Granularity: Optimize the Chunking Granularity for Retrieval-Augmented Generation
di: Zhong, Zijie, et al.
Pubblicazione: (2024)
di: Zhong, Zijie, et al.
Pubblicazione: (2024)
Zero-Shot Dense Retrieval with Embeddings from Relevance Feedback
di: Jedidi, Nour, et al.
Pubblicazione: (2024)
di: Jedidi, Nour, et al.
Pubblicazione: (2024)
STS: Efficient Sparse Attention with Speculative Token Sparsity
di: Xu, Ceyu, et al.
Pubblicazione: (2026)
di: Xu, Ceyu, et al.
Pubblicazione: (2026)
Structured Query Construction via Knowledge Graph Embedding
di: Wang, Ruijie, et al.
Pubblicazione: (2019)
di: Wang, Ruijie, et al.
Pubblicazione: (2019)
Luxical: High-Speed Lexical-Dense Text Embeddings
di: DatologyAI, et al.
Pubblicazione: (2025)
di: DatologyAI, et al.
Pubblicazione: (2025)
LongEmbed: Extending Embedding Models for Long Context Retrieval
di: Zhu, Dawei, et al.
Pubblicazione: (2024)
di: Zhu, Dawei, et al.
Pubblicazione: (2024)
Momentum Posterior Regularization for Multi-hop Dense Retrieval
di: Xia, Zehua, et al.
Pubblicazione: (2024)
di: Xia, Zehua, et al.
Pubblicazione: (2024)
Diffusion-Pretrained Dense and Contextual Embeddings
di: Eslami, Sedigheh, et al.
Pubblicazione: (2026)
di: Eslami, Sedigheh, et al.
Pubblicazione: (2026)
Offline Exploration-Aware Fine-Tuning for Long-Chain Mathematical Reasoning
di: Mu, Yongyu, et al.
Pubblicazione: (2026)
di: Mu, Yongyu, et al.
Pubblicazione: (2026)
Sparse and Dense Retrievers Learn Better Together: Joint Sparse-Dense Optimization for Text-Image Retrieval
di: Song, Jonghyun, et al.
Pubblicazione: (2025)
di: Song, Jonghyun, et al.
Pubblicazione: (2025)
On Prompt-Driven Safeguarding for Large Language Models
di: Zheng, Chujie, et al.
Pubblicazione: (2024)
di: Zheng, Chujie, et al.
Pubblicazione: (2024)
Efficient Covariance Estimation for Sparsified Functional Data
di: Zheng, Sijie, et al.
Pubblicazione: (2025)
di: Zheng, Sijie, et al.
Pubblicazione: (2025)
SimPO: Simple Preference Optimization with a Reference-Free Reward
di: Meng, Yu, et al.
Pubblicazione: (2024)
di: Meng, Yu, et al.
Pubblicazione: (2024)
QueryBuilder: Human-in-the-Loop Query Development for Information Retrieval
di: Kandula, Hemanth, et al.
Pubblicazione: (2024)
di: Kandula, Hemanth, et al.
Pubblicazione: (2024)
Transferable Embedding Inversion Attack: Uncovering Privacy Risks in Text Embeddings without Model Queries
di: Huang, Yu-Hsiang, et al.
Pubblicazione: (2024)
di: Huang, Yu-Hsiang, et al.
Pubblicazione: (2024)
The Missing Half: Unveiling Training-time Implicit Safety Risks Beyond Deployment
di: Zhang, Zhexin, et al.
Pubblicazione: (2026)
di: Zhang, Zhexin, et al.
Pubblicazione: (2026)
ZoomR: Memory Efficient Reasoning through Multi-Granularity Key Value Retrieval
di: Yang, David H., et al.
Pubblicazione: (2026)
di: Yang, David H., et al.
Pubblicazione: (2026)
Can LLMs Follow Simple Rules?
di: Mu, Norman, et al.
Pubblicazione: (2023)
di: Mu, Norman, et al.
Pubblicazione: (2023)
RewardAnything: Generalizable Principle-Following Reward Models
di: Yu, Zhuohao, et al.
Pubblicazione: (2025)
di: Yu, Zhuohao, et al.
Pubblicazione: (2025)
AVG-LLaVA: An Efficient Large Multimodal Model with Adaptive Visual Granularity
di: Lan, Zhibin, et al.
Pubblicazione: (2024)
di: Lan, Zhibin, et al.
Pubblicazione: (2024)
Self-Verification Dilemma: Experience-Driven Suppression of Overused Checking in LLM Reasoning
di: Long, Quanyu, et al.
Pubblicazione: (2026)
di: Long, Quanyu, et al.
Pubblicazione: (2026)
Recitation over Reasoning: How Cutting-Edge Language Models Can Fail on Elementary School-Level Reasoning Problems?
di: Yan, Kai, et al.
Pubblicazione: (2025)
di: Yan, Kai, et al.
Pubblicazione: (2025)
Hybrid Reinforcement: When Reward Is Sparse, It's Better to Be Dense
di: Tao, Leitian, et al.
Pubblicazione: (2025)
di: Tao, Leitian, et al.
Pubblicazione: (2025)
Can Large Language Models Play Text Games Well? Current State-of-the-Art and Open Questions
di: Tsai, Chen Feng, et al.
Pubblicazione: (2023)
di: Tsai, Chen Feng, et al.
Pubblicazione: (2023)
Documenti analoghi
-
Fine-Grained Modeling of Narrative Context: A Coherence Perspective via Retrospective Questions
di: Xu, Liyan, et al.
Pubblicazione: (2024) -
SIG: Speaker Identification in Literature via Prompt-Based Generation
di: Su, Zhenlin, et al.
Pubblicazione: (2023) -
Identifying Factual Inconsistencies in Summaries: Grounding LLM Inference via Task Taxonomy
di: Xu, Liyan, et al.
Pubblicazione: (2024) -
LLaVE: Large Language and Vision Embedding Models with Hardness-Weighted Contrastive Learning
di: Lan, Zhibin, et al.
Pubblicazione: (2025) -
Beyond Next Token Prediction: Patch-Level Training for Large Language Models
di: Shao, Chenze, et al.
Pubblicazione: (2024)