Quantifying Positional Biases in Text Embedding Models
Fuente:
arXiv
Saved in:
| Main Authors: | Lee, Reagan J., Goel, Samarth, Ramchandran, Kannan |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
SAGE: A Realistic Benchmark for Semantic Understanding
by: Goel, Samarth, et al.
Published: (2025)
by: Goel, Samarth, et al.
Published: (2025)
Position: Text Embeddings Should Capture Implicit Semantics, Not Just Surface Meaning
by: Sun, Yiqun, et al.
Published: (2025)
by: Sun, Yiqun, et al.
Published: (2025)
Arctic-Embed: Scalable, Efficient, and Accurate Text Embedding Models
by: Merrick, Luke, et al.
Published: (2024)
by: Merrick, Luke, et al.
Published: (2024)
Training Sparse Mixture Of Experts Text Embedding Models
by: Nussbaum, Zach, et al.
Published: (2025)
by: Nussbaum, Zach, et al.
Published: (2025)
Bagging-Based Model Merging for Robust General Text Embeddings
by: Zhang, Hengran, et al.
Published: (2026)
by: Zhang, Hengran, et al.
Published: (2026)
Interpretable Text Embeddings and Text Similarity Explanation: A Survey
by: Opitz, Juri, et al.
Published: (2025)
by: Opitz, Juri, et al.
Published: (2025)
MMTEB: Massive Multilingual Text Embedding Benchmark
by: Enevoldsen, Kenneth, et al.
Published: (2025)
by: Enevoldsen, Kenneth, et al.
Published: (2025)
When Text Embedding Meets Large Language Model: A Comprehensive Survey
by: Nie, Zhijie, et al.
Published: (2024)
by: Nie, Zhijie, et al.
Published: (2024)
Cognitive Biases in Large Language Models for News Recommendation
by: Lyu, Yougang, et al.
Published: (2024)
by: Lyu, Yougang, et al.
Published: (2024)
HIRO: Hierarchical Information Retrieval Optimization
by: Goel, Krish, et al.
Published: (2024)
by: Goel, Krish, et al.
Published: (2024)
Enhancing Multilingual Embeddings via Multi-Way Parallel Text Alignment
by: Fazili, Barah, et al.
Published: (2026)
by: Fazili, Barah, et al.
Published: (2026)
Tabular Embedding Model (TEM): Finetuning Embedding Models For Tabular RAG Applications
by: Khanna, Sujit, et al.
Published: (2024)
by: Khanna, Sujit, et al.
Published: (2024)
Don't Reinvent the Wheel: Efficient Instruction-Following Text Embedding based on Guided Space Transformation
by: Feng, Yingchaojie, et al.
Published: (2025)
by: Feng, Yingchaojie, et al.
Published: (2025)
E2Rank: Your Text Embedding can Also be an Effective and Efficient Listwise Reranker
by: Liu, Qi, et al.
Published: (2025)
by: Liu, Qi, et al.
Published: (2025)
HORIZON: A Benchmark for In-the-wild User Behaviour Modeling
by: Goel, Arnav, et al.
Published: (2026)
by: Goel, Arnav, et al.
Published: (2026)
Neural Retrievers are Biased Towards LLM-Generated Content
by: Dai, Sunhao, et al.
Published: (2023)
by: Dai, Sunhao, et al.
Published: (2023)
QUPID: Quantified Understanding for Enhanced Performance, Insights, and Decisions in Korean Search Engines
by: Kwon, Ohjoon, et al.
Published: (2025)
by: Kwon, Ohjoon, et al.
Published: (2025)
SymTax: Symbiotic Relationship and Taxonomy Fusion for Effective Citation Recommendation
by: Goyal, Karan, et al.
Published: (2024)
by: Goyal, Karan, et al.
Published: (2024)
Length-Induced Embedding Collapse in PLM-based Models
by: Zhou, Yuqi, et al.
Published: (2024)
by: Zhou, Yuqi, et al.
Published: (2024)
The Cross-Lingual Cost: Retrieval Biases in RAG over Arabic-English Corpora
by: Amiraz, Chen, et al.
Published: (2025)
by: Amiraz, Chen, et al.
Published: (2025)
LLM-Ensemble: Optimal Large Language Model Ensemble Method for E-commerce Product Attribute Value Extraction
by: Fang, Chenhao, et al.
Published: (2024)
by: Fang, Chenhao, et al.
Published: (2024)
Deep Learning Based Named Entity Recognition Models for Recipes
by: Goel, Mansi, et al.
Published: (2024)
by: Goel, Mansi, et al.
Published: (2024)
NV-Embed: Improved Techniques for Training LLMs as Generalist Embedding Models
by: Lee, Chankyu, et al.
Published: (2024)
by: Lee, Chankyu, et al.
Published: (2024)
An Open-Source Dual-Loss Embedding Model for Semantic Retrieval in Higher Education
by: Sajja, Ramteja, et al.
Published: (2025)
by: Sajja, Ramteja, et al.
Published: (2025)
Refine Thought: A Test-Time Inference Method for Embedding Model Reasoning
by: Wang, Guangzhi, et al.
Published: (2025)
by: Wang, Guangzhi, et al.
Published: (2025)
UniGLM: Training One Unified Language Model for Text-Attributed Graph Embedding
by: Fang, Yi, et al.
Published: (2024)
by: Fang, Yi, et al.
Published: (2024)
Quantifying Divergence in Inter-LLM Communication Through API Retrieval and Ranking
by: Al-Masri, Eyhab
Published: (2026)
by: Al-Masri, Eyhab
Published: (2026)
TnT-LLM: Text Mining at Scale with Large Language Models
by: Wan, Mengting, et al.
Published: (2024)
by: Wan, Mengting, et al.
Published: (2024)
LEMUR: A Corpus for Robust Fine-Tuning of Multilingual Law Embedding Models for Retrieval
by: Ahmadi, Narges Baba, et al.
Published: (2026)
by: Ahmadi, Narges Baba, et al.
Published: (2026)
One Model Is Enough: Native Retrieval Embeddings from LLM Agent Hidden States
by: Jiang, Bo
Published: (2026)
by: Jiang, Bo
Published: (2026)
ConceptFormer: Towards Efficient Use of Knowledge-Graph Embeddings in Large Language Models
by: Barmettler, Joel, et al.
Published: (2025)
by: Barmettler, Joel, et al.
Published: (2025)
Triple Modality Fusion: Aligning Visual, Textual, and Graph Data with Large Language Models for Multi-Behavior Recommendations
by: Ma, Luyi, et al.
Published: (2024)
by: Ma, Luyi, et al.
Published: (2024)
Memory-Based vs. Context-Only Conditioning Produces Distinct Behavioral Patterns in Stateful Personalization
by: Park, Junsoo, et al.
Published: (2026)
by: Park, Junsoo, et al.
Published: (2026)
Domain-Partitioned Hybrid RAG for Legal Reasoning: Toward Modular and Explainable Legal AI for India
by: Goel, Rakshita, et al.
Published: (2025)
by: Goel, Rakshita, et al.
Published: (2025)
A Survey on Retrieval-Augmented Text Generation for Large Language Models
by: Huang, Yizheng, et al.
Published: (2024)
by: Huang, Yizheng, et al.
Published: (2024)
Robustness Risk of Conversational Retrieval: Identifying and Mitigating Noise Sensitivity in Qwen3-Embedding Model
by: Chen, Weishu, et al.
Published: (2026)
by: Chen, Weishu, et al.
Published: (2026)
The Massive Legal Embedding Benchmark (MLEB)
by: Butler, Umar, et al.
Published: (2025)
by: Butler, Umar, et al.
Published: (2025)
Improving Embedding Accuracy for Document Retrieval Using Entity Relationship Maps and Model-Aware Contrastive Sampling
by: Aviss, Thea
Published: (2024)
by: Aviss, Thea
Published: (2024)
ConfReady: A RAG based Assistant and Dataset for Conference Checklist Responses
by: Galarnyk, Michael, et al.
Published: (2024)
by: Galarnyk, Michael, et al.
Published: (2024)
Predicting Oscar-Nominated Screenplays with Sentence Embeddings
by: Gross, Francis
Published: (2025)
by: Gross, Francis
Published: (2025)
Similar Items
-
SAGE: A Realistic Benchmark for Semantic Understanding
by: Goel, Samarth, et al.
Published: (2025) -
Position: Text Embeddings Should Capture Implicit Semantics, Not Just Surface Meaning
by: Sun, Yiqun, et al.
Published: (2025) -
Arctic-Embed: Scalable, Efficient, and Accurate Text Embedding Models
by: Merrick, Luke, et al.
Published: (2024) -
Training Sparse Mixture Of Experts Text Embedding Models
by: Nussbaum, Zach, et al.
Published: (2025) -
Bagging-Based Model Merging for Robust General Text Embeddings
by: Zhang, Hengran, et al.
Published: (2026)