C-Pack: Packed Resources For General Chinese Embeddings
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Xiao, Shitao, Liu, Zheng, Zhang, Peitian, Muennighoff, Niklas, Lian, Defu, Nie, Jian-Yun |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2023
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Boosting Long-Context Management via Query-Guided Activation Refilling
von: Qian, Hongjin, et al.
Veröffentlicht: (2024)
von: Qian, Hongjin, et al.
Veröffentlicht: (2024)
A Multi-Task Embedder For Retrieval Augmented LLMs
von: Zhang, Peitian, et al.
Veröffentlicht: (2023)
von: Zhang, Peitian, et al.
Veröffentlicht: (2023)
From Matching to Generation: A Survey on Generative Information Retrieval
von: Li, Xiaoxi, et al.
Veröffentlicht: (2024)
von: Li, Xiaoxi, et al.
Veröffentlicht: (2024)
M3-Embedding: Multi-Linguality, Multi-Functionality, Multi-Granularity Text Embeddings Through Self-Knowledge Distillation
von: Chen, Jianlv, et al.
Veröffentlicht: (2024)
von: Chen, Jianlv, et al.
Veröffentlicht: (2024)
HawkBench: Investigating Resilience of RAG Methods on Stratified Information-Seeking Tasks
von: Qian, Hongjin, et al.
Veröffentlicht: (2025)
von: Qian, Hongjin, et al.
Veröffentlicht: (2025)
Retro*: Optimizing LLMs for Reasoning-Intensive Document Retrieval
von: Lan, Junwei, et al.
Veröffentlicht: (2025)
von: Lan, Junwei, et al.
Veröffentlicht: (2025)
Learning to Route Queries to Heads for Attention-based Re-ranking with Large Language Models
von: Tian, Yuxing, et al.
Veröffentlicht: (2026)
von: Tian, Yuxing, et al.
Veröffentlicht: (2026)
Search-o1: Agentic Search-Enhanced Large Reasoning Models
von: Li, Xiaoxi, et al.
Veröffentlicht: (2025)
von: Li, Xiaoxi, et al.
Veröffentlicht: (2025)
ReasonEmbed: Enhanced Text Embeddings for Reasoning-Intensive Document Retrieval
von: Chen, Jianlyu, et al.
Veröffentlicht: (2025)
von: Chen, Jianlyu, et al.
Veröffentlicht: (2025)
When Text Embedding Meets Large Language Model: A Comprehensive Survey
von: Nie, Zhijie, et al.
Veröffentlicht: (2024)
von: Nie, Zhijie, et al.
Veröffentlicht: (2024)
When Large Language Models Meet Personalization: Perspectives of Challenges and Opportunities
von: Chen, Jin, et al.
Veröffentlicht: (2023)
von: Chen, Jin, et al.
Veröffentlicht: (2023)
DEGAP: Dual Event-Guided Adaptive Prefixes for Templated-Based Event Argument Extraction with Slot Querying
von: Wang, Guanghui, et al.
Veröffentlicht: (2024)
von: Wang, Guanghui, et al.
Veröffentlicht: (2024)
MMTEB: Massive Multilingual Text Embedding Benchmark
von: Enevoldsen, Kenneth, et al.
Veröffentlicht: (2025)
von: Enevoldsen, Kenneth, et al.
Veröffentlicht: (2025)
JuDGE: Benchmarking Judgment Document Generation for Chinese Legal System
von: Su, Weihang, et al.
Veröffentlicht: (2025)
von: Su, Weihang, et al.
Veröffentlicht: (2025)
OpenDecoder: Open Large Language Model Decoding to Incorporate Document Quality in RAG
von: Mo, Fengran, et al.
Veröffentlicht: (2026)
von: Mo, Fengran, et al.
Veröffentlicht: (2026)
Bagging-Based Model Merging for Robust General Text Embeddings
von: Zhang, Hengran, et al.
Veröffentlicht: (2026)
von: Zhang, Hengran, et al.
Veröffentlicht: (2026)
Length-Induced Embedding Collapse in PLM-based Models
von: Zhou, Yuqi, et al.
Veröffentlicht: (2024)
von: Zhou, Yuqi, et al.
Veröffentlicht: (2024)
AIR-Bench: Automated Heterogeneous Information Retrieval Benchmark
von: Chen, Jianlyu, et al.
Veröffentlicht: (2024)
von: Chen, Jianlyu, et al.
Veröffentlicht: (2024)
Making Text Embedders Few-Shot Learners
von: Li, Chaofan, et al.
Veröffentlicht: (2024)
von: Li, Chaofan, et al.
Veröffentlicht: (2024)
BRIGHT: A Realistic and Challenging Benchmark for Reasoning-Intensive Retrieval
von: Su, Hongjin, et al.
Veröffentlicht: (2024)
von: Su, Hongjin, et al.
Veröffentlicht: (2024)
Distillation Enhanced Generative Retrieval
von: Li, Yongqi, et al.
Veröffentlicht: (2024)
von: Li, Yongqi, et al.
Veröffentlicht: (2024)
RecExplainer: Aligning Large Language Models for Explaining Recommendation Models
von: Lei, Yuxuan, et al.
Veröffentlicht: (2023)
von: Lei, Yuxuan, et al.
Veröffentlicht: (2023)
Recommender AI Agent: Integrating Large Language Models for Interactive Recommendations
von: Huang, Xu, et al.
Veröffentlicht: (2023)
von: Huang, Xu, et al.
Veröffentlicht: (2023)
Graph Retrieval-Augmented Generation: A Survey
von: Peng, Boci, et al.
Veröffentlicht: (2024)
von: Peng, Boci, et al.
Veröffentlicht: (2024)
Deep Bag-of-Words Model: An Efficient and Interpretable Relevance Architecture for Chinese E-Commerce
von: Lin, Zhe, et al.
Veröffentlicht: (2024)
von: Lin, Zhe, et al.
Veröffentlicht: (2024)
Rethinking Soft Compression in Retrieval-Augmented Generation: A Query-Conditioned Selector Perspective
von: Liu, Yunhao, et al.
Veröffentlicht: (2026)
von: Liu, Yunhao, et al.
Veröffentlicht: (2026)
Arctic-Embed: Scalable, Efficient, and Accurate Text Embedding Models
von: Merrick, Luke, et al.
Veröffentlicht: (2024)
von: Merrick, Luke, et al.
Veröffentlicht: (2024)
The Synergy of Automated Pipelines with Prompt Engineering and Generative AI in Web Crawling
von: Huang, Chau-Jian
Veröffentlicht: (2024)
von: Huang, Chau-Jian
Veröffentlicht: (2024)
BERT-Enhanced Retrieval Tool for Homework Plagiarism Detection System
von: Xian, Jiarong, et al.
Veröffentlicht: (2024)
von: Xian, Jiarong, et al.
Veröffentlicht: (2024)
E2Rank: Your Text Embedding can Also be an Effective and Efficient Listwise Reranker
von: Liu, Qi, et al.
Veröffentlicht: (2025)
von: Liu, Qi, et al.
Veröffentlicht: (2025)
A Survey of Graph Retrieval-Augmented Generation for Customized Large Language Models
von: Zhang, Qinggang, et al.
Veröffentlicht: (2025)
von: Zhang, Qinggang, et al.
Veröffentlicht: (2025)
Neural Retrievers are Biased Towards LLM-Generated Content
von: Dai, Sunhao, et al.
Veröffentlicht: (2023)
von: Dai, Sunhao, et al.
Veröffentlicht: (2023)
Tabular Embedding Model (TEM): Finetuning Embedding Models For Tabular RAG Applications
von: Khanna, Sujit, et al.
Veröffentlicht: (2024)
von: Khanna, Sujit, et al.
Veröffentlicht: (2024)
CoRe-MMRAG: Cross-Source Knowledge Reconciliation for Multimodal RAG
von: Tian, Yang, et al.
Veröffentlicht: (2025)
von: Tian, Yang, et al.
Veröffentlicht: (2025)
Level-Navi Agent: A Framework and benchmark for Chinese Web Search Agents
von: Hu, Chuanrui, et al.
Veröffentlicht: (2024)
von: Hu, Chuanrui, et al.
Veröffentlicht: (2024)
Refine Thought: A Test-Time Inference Method for Embedding Model Reasoning
von: Wang, Guangzhi, et al.
Veröffentlicht: (2025)
von: Wang, Guangzhi, et al.
Veröffentlicht: (2025)
PMG : Personalized Multimodal Generation with Large Language Models
von: Shen, Xiaoteng, et al.
Veröffentlicht: (2024)
von: Shen, Xiaoteng, et al.
Veröffentlicht: (2024)
C-SEO Bench: Does Conversational SEO Work?
von: Puerto, Haritz, et al.
Veröffentlicht: (2025)
von: Puerto, Haritz, et al.
Veröffentlicht: (2025)
Trustworthiness in Retrieval-Augmented Generation Systems: A Survey
von: Zhou, Yujia, et al.
Veröffentlicht: (2024)
von: Zhou, Yujia, et al.
Veröffentlicht: (2024)
The Massive Legal Embedding Benchmark (MLEB)
von: Butler, Umar, et al.
Veröffentlicht: (2025)
von: Butler, Umar, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Boosting Long-Context Management via Query-Guided Activation Refilling
von: Qian, Hongjin, et al.
Veröffentlicht: (2024) -
A Multi-Task Embedder For Retrieval Augmented LLMs
von: Zhang, Peitian, et al.
Veröffentlicht: (2023) -
From Matching to Generation: A Survey on Generative Information Retrieval
von: Li, Xiaoxi, et al.
Veröffentlicht: (2024) -
M3-Embedding: Multi-Linguality, Multi-Functionality, Multi-Granularity Text Embeddings Through Self-Knowledge Distillation
von: Chen, Jianlv, et al.
Veröffentlicht: (2024) -
HawkBench: Investigating Resilience of RAG Methods on Stratified Information-Seeking Tasks
von: Qian, Hongjin, et al.
Veröffentlicht: (2025)