FaMTEB: Massive Text Embedding Benchmark in Persian Language
Fuente:
arXiv
Saved in:
| Main Authors: | Zinvandi, Erfan, Alikhani, Morteza, Sarmadi, Mehran, Pourbahman, Zahra, Arvin, Sepehr, Kazemi, Reza, Amini, Arash |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Hakim: Farsi Text Embedding Model
by: Sarmadi, Mehran, et al.
Published: (2025)
by: Sarmadi, Mehran, et al.
Published: (2025)
PerCoR: Evaluating Commonsense Reasoning in Persian via Multiple-Choice Sentence Completion
by: Alikhani, Morteza, et al.
Published: (2025)
by: Alikhani, Morteza, et al.
Published: (2025)
FinMTEB: Finance Massive Text Embedding Benchmark
by: Tang, Yixuan, et al.
Published: (2025)
by: Tang, Yixuan, et al.
Published: (2025)
MTEB-French: Resources for French Sentence Embedding Evaluation and Analysis
by: Ciancone, Mathieu, et al.
Published: (2024)
by: Ciancone, Mathieu, et al.
Published: (2024)
PersianRAG: A Retrieval-Augmented Generation System for Persian Language
by: Hosseini, Hossein, et al.
Published: (2024)
by: Hosseini, Hossein, et al.
Published: (2024)
MMTEB: Massive Multilingual Text Embedding Benchmark
by: Enevoldsen, Kenneth, et al.
Published: (2025)
by: Enevoldsen, Kenneth, et al.
Published: (2025)
ELAB: Extensive LLM Alignment Benchmark in Persian Language
by: Pourbahman, Zahra, et al.
Published: (2025)
by: Pourbahman, Zahra, et al.
Published: (2025)
Recent advances in text embedding: A Comprehensive Review of Top-Performing Methods on the MTEB Benchmark
by: Cao, Hongliu
Published: (2024)
by: Cao, Hongliu
Published: (2024)
The Massive Legal Embedding Benchmark (MLEB)
by: Butler, Umar, et al.
Published: (2025)
by: Butler, Umar, et al.
Published: (2025)
Exploring Contrastive Learning for Long-Tailed Multi-Label Text Classification
by: Audibert, Alexandre, et al.
Published: (2024)
by: Audibert, Alexandre, et al.
Published: (2024)
In-context Learning with Retrieved Demonstrations for Language Models: A Survey
by: Luo, Man, et al.
Published: (2024)
by: Luo, Man, et al.
Published: (2024)
JFinTEB: Japanese Financial Text Embedding Benchmark
by: Suzuki, Masahiro, et al.
Published: (2026)
by: Suzuki, Masahiro, et al.
Published: (2026)
MAIR: A Massive Benchmark for Evaluating Instructed Retrieval
by: Sun, Weiwei, et al.
Published: (2024)
by: Sun, Weiwei, et al.
Published: (2024)
Improving Text Embeddings with Large Language Models
by: Wang, Liang, et al.
Published: (2023)
by: Wang, Liang, et al.
Published: (2023)
Towards A Generalist Code Embedding Model Based On Massive Data Synthesis
by: Li, Chaofan, et al.
Published: (2025)
by: Li, Chaofan, et al.
Published: (2025)
DL based analysis of movie reviews
by: Paparimoghadamborazjani, Maryam, et al.
Published: (2022)
by: Paparimoghadamborazjani, Maryam, et al.
Published: (2022)
A Method for Multi-Hop Question Answering on Persian Knowledge Graph
by: Ghafouri, Arash, et al.
Published: (2025)
by: Ghafouri, Arash, et al.
Published: (2025)
Are ID Embeddings Necessary? Whitening Pre-trained Text Embeddings for Effective Sequential Recommendation
by: Zhang, Lingzi, et al.
Published: (2024)
by: Zhang, Lingzi, et al.
Published: (2024)
aedFaCT: Scientific Fact-Checking Made Easier via Semi-Automatic Discovery of Relevant Expert Opinions
by: Altuncu, Enes, et al.
Published: (2023)
by: Altuncu, Enes, et al.
Published: (2023)
Queries Are Not Alone: Clustering Text Embeddings for Video Search
by: Liu, Peyang, et al.
Published: (2025)
by: Liu, Peyang, et al.
Published: (2025)
Enhancing Lexicon-Based Text Embeddings with Large Language Models
by: Lei, Yibin, et al.
Published: (2025)
by: Lei, Yibin, et al.
Published: (2025)
PARSE: An Open-Domain Reasoning Question Answering Benchmark for Persian
by: Mozafari, Jamshid, et al.
Published: (2026)
by: Mozafari, Jamshid, et al.
Published: (2026)
Rethinking the Privacy of Text Embeddings: A Reproducibility Study of "Text Embeddings Reveal (Almost) As Much As Text"
by: Seputis, Dominykas, et al.
Published: (2025)
by: Seputis, Dominykas, et al.
Published: (2025)
Benchmarking Prompt Sensitivity in Large Language Models
by: Razavi, Amirhossein, et al.
Published: (2025)
by: Razavi, Amirhossein, et al.
Published: (2025)
Beyond Benchmarks: Evaluating Embedding Model Similarity for Retrieval Augmented Generation Systems
by: Caspari, Laura, et al.
Published: (2024)
by: Caspari, Laura, et al.
Published: (2024)
AlphaFuse: Learn ID Embeddings for Sequential Recommendation in Null Space of Language Embeddings
by: Hu, Guoqing, et al.
Published: (2025)
by: Hu, Guoqing, et al.
Published: (2025)
TabEmbed: Benchmarking and Learning Generalist Embeddings for Tabular Understanding
by: Qiang, Minjie, et al.
Published: (2026)
by: Qiang, Minjie, et al.
Published: (2026)
ReasonEmbed: Enhanced Text Embeddings for Reasoning-Intensive Document Retrieval
by: Chen, Jianlyu, et al.
Published: (2025)
by: Chen, Jianlyu, et al.
Published: (2025)
T$^2$-RAGBench: Text-and-Table Benchmark for Evaluating Retrieval-Augmented Generation
by: Strich, Jan, et al.
Published: (2025)
by: Strich, Jan, et al.
Published: (2025)
VIBE: Vector Index Benchmark for Embeddings
by: Jääsaari, Elias, et al.
Published: (2025)
by: Jääsaari, Elias, et al.
Published: (2025)
Empirical Evaluation of Embedding Models in the Context of Text Classification in Document Review in Construction Delay Disputes
by: Wei, Fusheng, et al.
Published: (2025)
by: Wei, Fusheng, et al.
Published: (2025)
ICLERB: In-Context Learning Embedding and Reranker Benchmark
by: Ghossein, Marie Al, et al.
Published: (2024)
by: Ghossein, Marie Al, et al.
Published: (2024)
A Study on Enhancing User Engagement by Employing Gamified Recommender Systems
by: Fallahi, Ali, et al.
Published: (2025)
by: Fallahi, Ali, et al.
Published: (2025)
Req-Rec: Enhancing Requirements Elicitation for Increasing Stakeholder's Satisfaction Using a Collaborative Filtering Based Recommender System
by: Fallahi, Ali, et al.
Published: (2025)
by: Fallahi, Ali, et al.
Published: (2025)
ChEmbed: Enhancing Chemical Literature Search Through Domain-Specific Text Embeddings
by: Kasmaee, Ali Shiraee, et al.
Published: (2025)
by: Kasmaee, Ali Shiraee, et al.
Published: (2025)
FloodSQL-Bench: A Retrieval-Augmented Benchmark for Geospatially-Grounded Text-to-SQL
by: Liu, Hanzhou, et al.
Published: (2025)
by: Liu, Hanzhou, et al.
Published: (2025)
Less is More: Adapting Text Embeddings for Low-Resource Languages with Small Scale Noisy Synthetic Data
by: Navasardyan, Zaruhi, et al.
Published: (2026)
by: Navasardyan, Zaruhi, et al.
Published: (2026)
Text Embeddings by Weakly-Supervised Contrastive Pre-training
by: Wang, Liang, et al.
Published: (2022)
by: Wang, Liang, et al.
Published: (2022)
CoLLM: Integrating Collaborative Embeddings into Large Language Models for Recommendation
by: Zhang, Yang, et al.
Published: (2023)
by: Zhang, Yang, et al.
Published: (2023)
Vela: Scalable Embeddings with Voice Large Language Models for Multimodal Retrieval
by: Hu, Ruofan, et al.
Published: (2025)
by: Hu, Ruofan, et al.
Published: (2025)
Similar Items
-
Hakim: Farsi Text Embedding Model
by: Sarmadi, Mehran, et al.
Published: (2025) -
PerCoR: Evaluating Commonsense Reasoning in Persian via Multiple-Choice Sentence Completion
by: Alikhani, Morteza, et al.
Published: (2025) -
FinMTEB: Finance Massive Text Embedding Benchmark
by: Tang, Yixuan, et al.
Published: (2025) -
MTEB-French: Resources for French Sentence Embedding Evaluation and Analysis
by: Ciancone, Mathieu, et al.
Published: (2024) -
PersianRAG: A Retrieval-Augmented Generation System for Persian Language
by: Hosseini, Hossein, et al.
Published: (2024)