Retrofitting Small Multilingual Models for Retrieval: Matching 7B Performance with 300M Parameters
Fuente:
arXiv
Saved in:
| Main Authors: | Tu, Lifu, Zhou, Yingbo, Yavuz, Semih |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Investigating Factuality in Long-Form Text Generation: The Roles of Self-Known and Self-Unknown
by: Tu, Lifu, et al.
Published: (2024)
by: Tu, Lifu, et al.
Published: (2024)
Traffic Light or Light Traffic? Investigating Phrasal Semantics in Large Language Models
by: Meng, Rui, et al.
Published: (2024)
by: Meng, Rui, et al.
Published: (2024)
Parameter-Efficient Detoxification with Contrastive Decoding
by: Niu, Tong, et al.
Published: (2024)
by: Niu, Tong, et al.
Published: (2024)
Unlocking Anticipatory Text Generation: A Constrained Approach for Large Language Models Decoding
by: Tu, Lifu, et al.
Published: (2023)
by: Tu, Lifu, et al.
Published: (2023)
Efficiently Aligned Cross-Lingual Transfer Learning for Conversational Tasks using Prompt-Tuning
by: Tu, Lifu, et al.
Published: (2023)
by: Tu, Lifu, et al.
Published: (2023)
AugTriever: Unsupervised Dense Retrieval and Domain Adaptation by Scalable Data Augmentation
by: Meng, Rui, et al.
Published: (2022)
by: Meng, Rui, et al.
Published: (2022)
JudgeRank: Leveraging Large Language Models for Reasoning-Intensive Reranking
by: Niu, Tong, et al.
Published: (2024)
by: Niu, Tong, et al.
Published: (2024)
VLM2Vec: Training Vision-Language Models for Massive Multimodal Embedding Tasks
by: Jiang, Ziyan, et al.
Published: (2024)
by: Jiang, Ziyan, et al.
Published: (2024)
HPE:Answering Complex Questions over Text by Hybrid Question Parsing and Execution
by: Liu, Ye, et al.
Published: (2023)
by: Liu, Ye, et al.
Published: (2023)
SSR: Socratic Self-Refine for Large Language Model Reasoning
by: Shi, Haizhou, et al.
Published: (2025)
by: Shi, Haizhou, et al.
Published: (2025)
MAS-ProVe: Understanding the Process Verification of Multi-Agent Systems
by: Venkataramani, Vishal, et al.
Published: (2026)
by: Venkataramani, Vishal, et al.
Published: (2026)
Retrofitting Large Language Models with Dynamic Tokenization
by: Feher, Darius, et al.
Published: (2024)
by: Feher, Darius, et al.
Published: (2024)
Debate as Optimization: Adaptive Conformal Prediction and Diverse Retrieval for Event Extraction
by: Wang, Sijia, et al.
Published: (2024)
by: Wang, Sijia, et al.
Published: (2024)
Reinforcement Learning-based Knowledge Distillation with LLM-as-a-Judge
by: Shen, Yiyang, et al.
Published: (2026)
by: Shen, Yiyang, et al.
Published: (2026)
Stage-wise Fine-tuning for Graph-to-Text Generation
by: Wang, Qingyun, et al.
Published: (2021)
by: Wang, Qingyun, et al.
Published: (2021)
Seed-X: Building Strong Multilingual Translation LLM with 7B Parameters
by: Cheng, Shanbo, et al.
Published: (2025)
by: Cheng, Shanbo, et al.
Published: (2025)
MINERS: Multilingual Language Models as Semantic Retrievers
by: Winata, Genta Indra, et al.
Published: (2024)
by: Winata, Genta Indra, et al.
Published: (2024)
Blessing of Multilinguality: A Systematic Analysis of Multilingual In-Context Learning
by: Tu, Yilei, et al.
Published: (2025)
by: Tu, Yilei, et al.
Published: (2025)
VLM2Vec-V2: Advancing Multimodal Embedding for Videos, Images, and Visual Documents
by: Meng, Rui, et al.
Published: (2025)
by: Meng, Rui, et al.
Published: (2025)
Does Context Matter? ContextualJudgeBench for Evaluating LLM-based Judges in Contextual Settings
by: Xu, Austin, et al.
Published: (2025)
by: Xu, Austin, et al.
Published: (2025)
Dynamic Memory Compression: Retrofitting LLMs for Accelerated Inference
by: Nawrot, Piotr, et al.
Published: (2024)
by: Nawrot, Piotr, et al.
Published: (2024)
Evaluating Multilingual Long-Context Models for Retrieval and Reasoning
by: Agrawal, Ameeta, et al.
Published: (2024)
by: Agrawal, Ameeta, et al.
Published: (2024)
Optimizing Multi-Hop Document Retrieval Through Intermediate Representations
by: Lin, Jiaen, et al.
Published: (2025)
by: Lin, Jiaen, et al.
Published: (2025)
RoRA-VLM: Robust Retrieval-Augmented Vision Language Models
by: Qi, Jingyuan, et al.
Published: (2024)
by: Qi, Jingyuan, et al.
Published: (2024)
Parameter Alignment Mitigates Catastrophic Forgetting in Multilingual Expert Language Models
by: Ahuja, Sanchit, et al.
Published: (2026)
by: Ahuja, Sanchit, et al.
Published: (2026)
MAPLE: Multilingual Evaluation of Parameter Efficient Finetuning of Large Language Models
by: Aggarwal, Divyanshu, et al.
Published: (2024)
by: Aggarwal, Divyanshu, et al.
Published: (2024)
UWBa at SemEval-2025 Task 7: Multilingual and Crosslingual Fact-Checked Claim Retrieval
by: Lenc, Ladislav, et al.
Published: (2025)
by: Lenc, Ladislav, et al.
Published: (2025)
Teaching Pretrained Language Models to Think Deeper with Retrofitted Recurrence
by: McLeish, Sean, et al.
Published: (2025)
by: McLeish, Sean, et al.
Published: (2025)
Flexing in 73 Languages: A Single Small Model for Multilingual Inflection
by: Sourada, Tomáš, et al.
Published: (2025)
by: Sourada, Tomáš, et al.
Published: (2025)
Command R7B Arabic: A Small, Enterprise Focused, Multilingual, and Culturally Aware Arabic LLM
by: Alnumay, Yazeed, et al.
Published: (2025)
by: Alnumay, Yazeed, et al.
Published: (2025)
Embedding Retrofitting: Data Engineering for better RAG
by: Sharma, Anantha
Published: (2026)
by: Sharma, Anantha
Published: (2026)
LLM Braces: Straightening Out LLM Predictions with Relevant Sub-Updates
by: Shen, Ying, et al.
Published: (2025)
by: Shen, Ying, et al.
Published: (2025)
Multilingual Entity Linking Using Dense Retrieval
by: Farhan, Dominik
Published: (2024)
by: Farhan, Dominik
Published: (2024)
Multilingual Previously Fact-Checked Claim Retrieval
by: Pikuliak, Matúš, et al.
Published: (2023)
by: Pikuliak, Matúš, et al.
Published: (2023)
Distillation for Multilingual Information Retrieval
by: Yang, Eugene, et al.
Published: (2024)
by: Yang, Eugene, et al.
Published: (2024)
P-FOLIO: Evaluating and Improving Logical Reasoning with Abundant Human-Written Reasoning Chains
by: Han, Simeng, et al.
Published: (2024)
by: Han, Simeng, et al.
Published: (2024)
UniHGKR: Unified Instruction-aware Heterogeneous Knowledge Retrievers
by: Min, Dehai, et al.
Published: (2024)
by: Min, Dehai, et al.
Published: (2024)
M-DaQ: Retrieving Samples with Multilingual Diversity and Quality for Instruction Fine-Tuning Datasets
by: Zhao, Chunguang, et al.
Published: (2025)
by: Zhao, Chunguang, et al.
Published: (2025)
In-context Learning vs. Instruction Tuning: The Case of Small and Multilingual Language Models
by: Ponce, David, et al.
Published: (2025)
by: Ponce, David, et al.
Published: (2025)
Merging by Matching Models in Task Parameter Subspaces
by: Tam, Derek, et al.
Published: (2023)
by: Tam, Derek, et al.
Published: (2023)
Similar Items
-
Investigating Factuality in Long-Form Text Generation: The Roles of Self-Known and Self-Unknown
by: Tu, Lifu, et al.
Published: (2024) -
Traffic Light or Light Traffic? Investigating Phrasal Semantics in Large Language Models
by: Meng, Rui, et al.
Published: (2024) -
Parameter-Efficient Detoxification with Contrastive Decoding
by: Niu, Tong, et al.
Published: (2024) -
Unlocking Anticipatory Text Generation: A Constrained Approach for Large Language Models Decoding
by: Tu, Lifu, et al.
Published: (2023) -
Efficiently Aligned Cross-Lingual Transfer Learning for Conversational Tasks using Prompt-Tuning
by: Tu, Lifu, et al.
Published: (2023)