Language Models are Universal Embedders
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Xin, Li, Zehan, Zhang, Yanzhao, Long, Dingkun, Xie, Pengjun, Zhang, Meishan, Zhang, Min |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Chinese Sequence Labeling with Semi-Supervised Boundary-Aware Language Model Pre-training
par: Zhang, Longhui, et autres
Publié: (2024)
par: Zhang, Longhui, et autres
Publié: (2024)
An End-to-End Model for Photo-Sharing Multi-modal Dialogue Generation
par: Guo, Peiming, et autres
Publié: (2024)
par: Guo, Peiming, et autres
Publié: (2024)
GME: Improving Universal Multimodal Retrieval by Multimodal LLMs
par: Zhang, Xin, et autres
Publié: (2024)
par: Zhang, Xin, et autres
Publié: (2024)
Supervised Fine-Tuning or Contrastive Learning? Towards Better Multimodal LLM Reranking
par: Dai, Ziqi, et autres
Publié: (2025)
par: Dai, Ziqi, et autres
Publié: (2025)
Improving General Text Embedding Model: Tackling Task Conflict and Data Imbalance through Model Merging
par: Li, Mingxin, et autres
Publié: (2024)
par: Li, Mingxin, et autres
Publié: (2024)
Towards Text-Image Interleaved Retrieval
par: Zhang, Xin, et autres
Publié: (2025)
par: Zhang, Xin, et autres
Publié: (2025)
A Two-Stage Adaptation of Large Language Models for Text Ranking
par: Zhang, Longhui, et autres
Publié: (2023)
par: Zhang, Longhui, et autres
Publié: (2023)
mGTE: Generalized Long-Context Text Representation and Reranking Models for Multilingual Text Retrieval
par: Zhang, Xin, et autres
Publié: (2024)
par: Zhang, Xin, et autres
Publié: (2024)
Towards Universal Video Retrieval: Generalizing Video Embedding via Synthesized Multimodal Pyramid Curriculum
par: Guo, Zhuoning, et autres
Publié: (2025)
par: Guo, Zhuoning, et autres
Publié: (2025)
ERank: Fusing Supervised Fine-Tuning and Reinforcement Learning for Effective and Efficient Text Reranking
par: Cai, Yuzheng, et autres
Publié: (2025)
par: Cai, Yuzheng, et autres
Publié: (2025)
E2Rank: Your Text Embedding can Also be an Effective and Efficient Listwise Reranker
par: Liu, Qi, et autres
Publié: (2025)
par: Liu, Qi, et autres
Publié: (2025)
LaSER: Internalizing Explicit Reasoning into Latent Space for Dense Retrieval
par: Jin, Jiajie, et autres
Publié: (2026)
par: Jin, Jiajie, et autres
Publié: (2026)
DiffuRank: Effective Document Reranking with Diffusion Language Models
par: Liu, Qi, et autres
Publié: (2026)
par: Liu, Qi, et autres
Publié: (2026)
Qwen3 Embedding: Advancing Text Embedding and Reranking Through Foundation Models
par: Zhang, Yanzhao, et autres
Publié: (2025)
par: Zhang, Yanzhao, et autres
Publié: (2025)
Rethinking Composed Image Retrieval Evaluation: A Fine-Grained Benchmark from Image Editing
par: Song, Tingyu, et autres
Publié: (2026)
par: Song, Tingyu, et autres
Publié: (2026)
When Text Embedding Meets Large Language Model: A Comprehensive Survey
par: Nie, Zhijie, et autres
Publié: (2024)
par: Nie, Zhijie, et autres
Publié: (2024)
Text2Token: Unsupervised Text Representation Learning with Token Target Prediction
par: An, Ruize, et autres
Publié: (2025)
par: An, Ruize, et autres
Publié: (2025)
On The Role of Pretrained Language Models in General-Purpose Text Embeddings: A Survey
par: Zhang, Meishan, et autres
Publié: (2025)
par: Zhang, Meishan, et autres
Publié: (2025)
XNLP: An Interactive Demonstration System for Universal Structured NLP
par: Fei, Hao, et autres
Publié: (2023)
par: Fei, Hao, et autres
Publié: (2023)
Qwen3-VL-Embedding and Qwen3-VL-Reranker: A Unified Framework for State-of-the-Art Multimodal Retrieval and Ranking
par: Li, Mingxin, et autres
Publié: (2026)
par: Li, Mingxin, et autres
Publié: (2026)
Contrastive Learning on LLM Back Generation Treebank for Cross-domain Constituency Parsing
par: Guo, Peiming, et autres
Publié: (2025)
par: Guo, Peiming, et autres
Publié: (2025)
A Systematic Survey of Semantic Role Labeling in the Era of Pretrained Language Models
par: Chen, Huiyao, et autres
Publié: (2025)
par: Chen, Huiyao, et autres
Publié: (2025)
LLMs Can Also Do Well! Breaking Barriers in Semantic Role Labeling via Large Language Models
par: Li, Xinxin, et autres
Publié: (2025)
par: Li, Xinxin, et autres
Publié: (2025)
ToolOmni: Enabling Open-World Tool Use via Agentic learning with Proactive Retrieval and Grounded Execution
par: Huang, Shouzheng, et autres
Publié: (2026)
par: Huang, Shouzheng, et autres
Publié: (2026)
In-Context Learning for Few-Shot Nested Named Entity Recognition
par: Zhang, Meishan, et autres
Publié: (2024)
par: Zhang, Meishan, et autres
Publié: (2024)
Less Languages, Less Tokens: An Efficient Unified Logic Cross-lingual Chain-of-Thought Reasoning Framework
par: Zhang, Chenyuan, et autres
Publié: (2026)
par: Zhang, Chenyuan, et autres
Publié: (2026)
Dynamic Long Context Reasoning over Compressed Memory via End-to-End Reinforcement Learning
par: Chen, Zhuoen, et autres
Publié: (2026)
par: Chen, Zhuoen, et autres
Publié: (2026)
RCEM: Embedder Equipped with Query Rewriting Skill for Robust Conversational Search in Distributional Shift
par: Son, Kilho, et autres
Publié: (2026)
par: Son, Kilho, et autres
Publié: (2026)
ChatIE: Zero-Shot Information Extraction via Chatting with ChatGPT
par: Wei, Xiang, et autres
Publié: (2023)
par: Wei, Xiang, et autres
Publié: (2023)
Enhancing Video-Language Representations with Structural Spatio-Temporal Alignment
par: Fei, Hao, et autres
Publié: (2024)
par: Fei, Hao, et autres
Publié: (2024)
Event Extraction in Large Language Model
par: Li, Bobo, et autres
Publié: (2025)
par: Li, Bobo, et autres
Publié: (2025)
AutoSurvey: Large Language Models Can Automatically Write Surveys
par: Wang, Yidong, et autres
Publié: (2024)
par: Wang, Yidong, et autres
Publié: (2024)
Retrieval-style In-Context Learning for Few-shot Hierarchical Text Classification
par: Chen, Huiyao, et autres
Publié: (2024)
par: Chen, Huiyao, et autres
Publié: (2024)
Understanding the Influence of Synthetic Data for Text Embedders
par: Springer, Jacob Mitchell, et autres
Publié: (2025)
par: Springer, Jacob Mitchell, et autres
Publié: (2025)
Making Text Embedders Few-Shot Learners
par: Li, Chaofan, et autres
Publié: (2024)
par: Li, Chaofan, et autres
Publié: (2024)
Mitigating Bias in RAG: Controlling the Embedder
par: Kim, Taeyoun, et autres
Publié: (2025)
par: Kim, Taeyoun, et autres
Publié: (2025)
Debiasing Sentence Embedders through Contrastive Word Pairs
par: Kenneweg, Philip, et autres
Publié: (2024)
par: Kenneweg, Philip, et autres
Publié: (2024)
Detecting Knowledge Boundary of Vision Large Language Models by Sampling-Based Inference
par: Chen, Zhuo, et autres
Publié: (2025)
par: Chen, Zhuo, et autres
Publié: (2025)
Supportiveness-based Knowledge Rewriting for Retrieval-augmented Language Modeling
par: Qiao, Zile, et autres
Publié: (2024)
par: Qiao, Zile, et autres
Publié: (2024)
Beyond Chunking: Discourse-Aware Hierarchical Retrieval for Long Document Question Answering
par: Chen, Huiyao, et autres
Publié: (2025)
par: Chen, Huiyao, et autres
Publié: (2025)
Documents similaires
-
Chinese Sequence Labeling with Semi-Supervised Boundary-Aware Language Model Pre-training
par: Zhang, Longhui, et autres
Publié: (2024) -
An End-to-End Model for Photo-Sharing Multi-modal Dialogue Generation
par: Guo, Peiming, et autres
Publié: (2024) -
GME: Improving Universal Multimodal Retrieval by Multimodal LLMs
par: Zhang, Xin, et autres
Publié: (2024) -
Supervised Fine-Tuning or Contrastive Learning? Towards Better Multimodal LLM Reranking
par: Dai, Ziqi, et autres
Publié: (2025) -
Improving General Text Embedding Model: Tackling Task Conflict and Data Imbalance through Model Merging
par: Li, Mingxin, et autres
Publié: (2024)