Training Sparse Mixture Of Experts Text Embedding Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Nussbaum, Zach, Duderstadt, Brandon |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Nomic Embed: Training a Reproducible Long Context Text Embedder
di: Nussbaum, Zach, et al.
Pubblicazione: (2024)
di: Nussbaum, Zach, et al.
Pubblicazione: (2024)
CoRNStack: High-Quality Contrastive Data for Better Code Retrieval and Reranking
di: Suresh, Tarun, et al.
Pubblicazione: (2024)
di: Suresh, Tarun, et al.
Pubblicazione: (2024)
Arctic-Embed: Scalable, Efficient, and Accurate Text Embedding Models
di: Merrick, Luke, et al.
Pubblicazione: (2024)
di: Merrick, Luke, et al.
Pubblicazione: (2024)
Quantifying Positional Biases in Text Embedding Models
di: Lee, Reagan J., et al.
Pubblicazione: (2024)
di: Lee, Reagan J., et al.
Pubblicazione: (2024)
ExpertRAG: Efficient RAG with Mixture of Experts -- Optimizing Context Retrieval for Adaptive LLM Responses
di: Gumaan, Esmail
Pubblicazione: (2025)
di: Gumaan, Esmail
Pubblicazione: (2025)
Nomic Embed Vision: Expanding the Latent Space
di: Nussbaum, Zach, et al.
Pubblicazione: (2024)
di: Nussbaum, Zach, et al.
Pubblicazione: (2024)
Bagging-Based Model Merging for Robust General Text Embeddings
di: Zhang, Hengran, et al.
Pubblicazione: (2026)
di: Zhang, Hengran, et al.
Pubblicazione: (2026)
Dynamic Reasoning Chains through Depth-Specialized Mixture-of-Experts in Transformer Architectures
di: Roy, Sampurna, et al.
Pubblicazione: (2025)
di: Roy, Sampurna, et al.
Pubblicazione: (2025)
Multi-Type Context-Aware Conversational Recommender Systems via Mixture-of-Experts
di: Zou, Jie, et al.
Pubblicazione: (2025)
di: Zou, Jie, et al.
Pubblicazione: (2025)
Interpretable Text Embeddings and Text Similarity Explanation: A Survey
di: Opitz, Juri, et al.
Pubblicazione: (2025)
di: Opitz, Juri, et al.
Pubblicazione: (2025)
When Text Embedding Meets Large Language Model: A Comprehensive Survey
di: Nie, Zhijie, et al.
Pubblicazione: (2024)
di: Nie, Zhijie, et al.
Pubblicazione: (2024)
MMTEB: Massive Multilingual Text Embedding Benchmark
di: Enevoldsen, Kenneth, et al.
Pubblicazione: (2025)
di: Enevoldsen, Kenneth, et al.
Pubblicazione: (2025)
MoR: Better Handling Diverse Queries with a Mixture of Sparse, Dense, and Human Retrievers
di: Kalra, Jushaan Singh, et al.
Pubblicazione: (2025)
di: Kalra, Jushaan Singh, et al.
Pubblicazione: (2025)
UniGLM: Training One Unified Language Model for Text-Attributed Graph Embedding
di: Fang, Yi, et al.
Pubblicazione: (2024)
di: Fang, Yi, et al.
Pubblicazione: (2024)
Enhancing Multilingual Embeddings via Multi-Way Parallel Text Alignment
di: Fazili, Barah, et al.
Pubblicazione: (2026)
di: Fazili, Barah, et al.
Pubblicazione: (2026)
Position: Text Embeddings Should Capture Implicit Semantics, Not Just Surface Meaning
di: Sun, Yiqun, et al.
Pubblicazione: (2025)
di: Sun, Yiqun, et al.
Pubblicazione: (2025)
Tabular Embedding Model (TEM): Finetuning Embedding Models For Tabular RAG Applications
di: Khanna, Sujit, et al.
Pubblicazione: (2024)
di: Khanna, Sujit, et al.
Pubblicazione: (2024)
NV-Embed: Improved Techniques for Training LLMs as Generalist Embedding Models
di: Lee, Chankyu, et al.
Pubblicazione: (2024)
di: Lee, Chankyu, et al.
Pubblicazione: (2024)
Don't Reinvent the Wheel: Efficient Instruction-Following Text Embedding based on Guided Space Transformation
di: Feng, Yingchaojie, et al.
Pubblicazione: (2025)
di: Feng, Yingchaojie, et al.
Pubblicazione: (2025)
E2Rank: Your Text Embedding can Also be an Effective and Efficient Listwise Reranker
di: Liu, Qi, et al.
Pubblicazione: (2025)
di: Liu, Qi, et al.
Pubblicazione: (2025)
Reasoning-Enhanced Self-Training for Long-Form Personalized Text Generation
di: Salemi, Alireza, et al.
Pubblicazione: (2025)
di: Salemi, Alireza, et al.
Pubblicazione: (2025)
Length-Induced Embedding Collapse in PLM-based Models
di: Zhou, Yuqi, et al.
Pubblicazione: (2024)
di: Zhou, Yuqi, et al.
Pubblicazione: (2024)
RouterRetriever: Routing over a Mixture of Expert Embedding Models
di: Lee, Hyunji, et al.
Pubblicazione: (2024)
di: Lee, Hyunji, et al.
Pubblicazione: (2024)
An Open-Source Dual-Loss Embedding Model for Semantic Retrieval in Higher Education
di: Sajja, Ramteja, et al.
Pubblicazione: (2025)
di: Sajja, Ramteja, et al.
Pubblicazione: (2025)
Refine Thought: A Test-Time Inference Method for Embedding Model Reasoning
di: Wang, Guangzhi, et al.
Pubblicazione: (2025)
di: Wang, Guangzhi, et al.
Pubblicazione: (2025)
TnT-LLM: Text Mining at Scale with Large Language Models
di: Wan, Mengting, et al.
Pubblicazione: (2024)
di: Wan, Mengting, et al.
Pubblicazione: (2024)
ConceptFormer: Towards Efficient Use of Knowledge-Graph Embeddings in Large Language Models
di: Barmettler, Joel, et al.
Pubblicazione: (2025)
di: Barmettler, Joel, et al.
Pubblicazione: (2025)
LEMUR: A Corpus for Robust Fine-Tuning of Multilingual Law Embedding Models for Retrieval
di: Ahmadi, Narges Baba, et al.
Pubblicazione: (2026)
di: Ahmadi, Narges Baba, et al.
Pubblicazione: (2026)
One Model Is Enough: Native Retrieval Embeddings from LLM Agent Hidden States
di: Jiang, Bo
Pubblicazione: (2026)
di: Jiang, Bo
Pubblicazione: (2026)
Advancing AI Research Assistants with Expert-Involved Learning
di: Liu, Tianyu, et al.
Pubblicazione: (2025)
di: Liu, Tianyu, et al.
Pubblicazione: (2025)
MSA: Memory Sparse Attention for Efficient End-to-End Memory Model Scaling to 100M Tokens
di: Chen, Yu, et al.
Pubblicazione: (2026)
di: Chen, Yu, et al.
Pubblicazione: (2026)
A Survey on Retrieval-Augmented Text Generation for Large Language Models
di: Huang, Yizheng, et al.
Pubblicazione: (2024)
di: Huang, Yizheng, et al.
Pubblicazione: (2024)
Robustness Risk of Conversational Retrieval: Identifying and Mitigating Noise Sensitivity in Qwen3-Embedding Model
di: Chen, Weishu, et al.
Pubblicazione: (2026)
di: Chen, Weishu, et al.
Pubblicazione: (2026)
The Massive Legal Embedding Benchmark (MLEB)
di: Butler, Umar, et al.
Pubblicazione: (2025)
di: Butler, Umar, et al.
Pubblicazione: (2025)
Improving Embedding Accuracy for Document Retrieval Using Entity Relationship Maps and Model-Aware Contrastive Sampling
di: Aviss, Thea
Pubblicazione: (2024)
di: Aviss, Thea
Pubblicazione: (2024)
Robust Training for Conversational Question Answering Models with Reinforced Reformulation Generation
di: Kaiser, Magdalena, et al.
Pubblicazione: (2023)
di: Kaiser, Magdalena, et al.
Pubblicazione: (2023)
Predicting Oscar-Nominated Screenplays with Sentence Embeddings
di: Gross, Francis
Pubblicazione: (2025)
di: Gross, Francis
Pubblicazione: (2025)
A Diverse and Effective Retrieval-Based Debt Collection System with Expert Knowledge
di: Luo, Jiaming, et al.
Pubblicazione: (2025)
di: Luo, Jiaming, et al.
Pubblicazione: (2025)
Unsupervised Information Refinement Training of Large Language Models for Retrieval-Augmented Generation
di: Xu, Shicheng, et al.
Pubblicazione: (2024)
di: Xu, Shicheng, et al.
Pubblicazione: (2024)
Exp4Fuse: A Rank Fusion Framework for Enhanced Sparse Retrieval using Large Language Model-based Query Expansion
di: Liu, Lingyuan, et al.
Pubblicazione: (2025)
di: Liu, Lingyuan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Nomic Embed: Training a Reproducible Long Context Text Embedder
di: Nussbaum, Zach, et al.
Pubblicazione: (2024) -
CoRNStack: High-Quality Contrastive Data for Better Code Retrieval and Reranking
di: Suresh, Tarun, et al.
Pubblicazione: (2024) -
Arctic-Embed: Scalable, Efficient, and Accurate Text Embedding Models
di: Merrick, Luke, et al.
Pubblicazione: (2024) -
Quantifying Positional Biases in Text Embedding Models
di: Lee, Reagan J., et al.
Pubblicazione: (2024) -
ExpertRAG: Efficient RAG with Mixture of Experts -- Optimizing Context Retrieval for Adaptive LLM Responses
di: Gumaan, Esmail
Pubblicazione: (2025)