Modular Sentence Encoders: Separating Language Specialization from Cross-Lingual Alignment
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Huang, Yongxin, Wang, Kexin, Glavaš, Goran, Gurevych, Iryna |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
IRCoder: Intermediate Representations Make Language Models Robust Multilingual Code Generators
par: Paul, Indraneil, et autres
Publié: (2024)
par: Paul, Indraneil, et autres
Publié: (2024)
The Devil Is in the Word Alignment Details: On Translation-Based Cross-Lingual Transfer for Token Classification Tasks
par: Ebing, Benedikt, et autres
Publié: (2025)
par: Ebing, Benedikt, et autres
Publié: (2025)
To Translate or Not to Translate: A Systematic Investigation of Translation-Based Cross-Lingual Transfer to Low-Resource Languages
par: Ebing, Benedikt, et autres
Publié: (2023)
par: Ebing, Benedikt, et autres
Publié: (2023)
Self-Distillation for Model Stacking Unlocks Cross-Lingual NLU in 200+ Languages
par: Schmidt, Fabian David, et autres
Publié: (2024)
par: Schmidt, Fabian David, et autres
Publié: (2024)
Enabling Natural Zero-Shot Prompting on Encoder Models via Statement-Tuning
par: Elshabrawy, Ahmed, et autres
Publié: (2024)
par: Elshabrawy, Ahmed, et autres
Publié: (2024)
ANHALTEN: Cross-Lingual Transfer for German Token-Level Reference-Free Hallucination Detection
par: Herrlein, Janek, et autres
Publié: (2024)
par: Herrlein, Janek, et autres
Publié: (2024)
One Script Instead of Hundreds? On Pretraining Romanized Encoder Language Models
par: Ebing, Benedikt, et autres
Publié: (2026)
par: Ebing, Benedikt, et autres
Publié: (2026)
ObscuraCoder: Powering Efficient Code LM Pre-Training Via Obfuscation Grounding
par: Paul, Indraneil, et autres
Publié: (2025)
par: Paul, Indraneil, et autres
Publié: (2025)
TransAlign: Machine Translation Encoders are Strong Word Aligners, Too
par: Ebing, Benedikt, et autres
Publié: (2025)
par: Ebing, Benedikt, et autres
Publié: (2025)
DAPR: A Benchmark on Document-Aware Passage Retrieval
par: Wang, Kexin, et autres
Publié: (2023)
par: Wang, Kexin, et autres
Publié: (2023)
Why Better Cross-Lingual Alignment Fails for Better Cross-Lingual Transfer: Case of Encoders
par: Veitsman, Yana, et autres
Publié: (2026)
par: Veitsman, Yana, et autres
Publié: (2026)
DARA: Decomposition-Alignment-Reasoning Autonomous Language Agent for Question Answering over Knowledge Graphs
par: Fang, Haishuo, et autres
Publié: (2024)
par: Fang, Haishuo, et autres
Publié: (2024)
Languages are Modalities: Cross-Lingual Alignment via Encoder Injection
par: Agarwal, Rajan, et autres
Publié: (2025)
par: Agarwal, Rajan, et autres
Publié: (2025)
SciCoQA: Quality Assurance for Scientific Paper--Code Alignment
par: Baumgärtner, Tim, et autres
Publié: (2026)
par: Baumgärtner, Tim, et autres
Publié: (2026)
News Without Borders: Domain Adaptation of Multilingual Sentence Embeddings for Cross-lingual News Recommendation
par: Iana, Andreea, et autres
Publié: (2024)
par: Iana, Andreea, et autres
Publié: (2024)
Themis: Training Robust Multilingual Code Reward Models for Flexible Multi-Criteria Scoring
par: Paul, Indraneil, et autres
Publié: (2026)
par: Paul, Indraneil, et autres
Publié: (2026)
Differentially Private Steering for Large Language Model Alignment
par: Goel, Anmol, et autres
Publié: (2025)
par: Goel, Anmol, et autres
Publié: (2025)
Linear Cross-Lingual Mapping of Sentence Embeddings
par: Vasilyev, Oleg, et autres
Publié: (2023)
par: Vasilyev, Oleg, et autres
Publié: (2023)
MVL-SIB: A Massively Multilingual Vision-Language Benchmark for Cross-Modal Topical Matching
par: Schmidt, Fabian David, et autres
Publié: (2025)
par: Schmidt, Fabian David, et autres
Publié: (2025)
Dive into the Chasm: Probing the Gap between In- and Cross-Topic Generalization
par: Waldis, Andreas, et autres
Publié: (2024)
par: Waldis, Andreas, et autres
Publié: (2024)
Babel-ImageNet: Massively Multilingual Evaluation of Vision-and-Language Representations
par: Geigle, Gregor, et autres
Publié: (2023)
par: Geigle, Gregor, et autres
Publié: (2023)
Does Object Grounding Really Reduce Hallucination of Large Vision-Language Models?
par: Geigle, Gregor, et autres
Publié: (2024)
par: Geigle, Gregor, et autres
Publié: (2024)
Triple-Encoders: Representations That Fire Together, Wire Together
par: Erker, Justus-Jonas, et autres
Publié: (2024)
par: Erker, Justus-Jonas, et autres
Publié: (2024)
Cross-Lingual Knowledge Distillation for Answer Sentence Selection in Low-Resource Languages
par: Gupta, Shivanshu, et autres
Publié: (2023)
par: Gupta, Shivanshu, et autres
Publié: (2023)
African or European Swallow? Benchmarking Large Vision-Language Models for Fine-Grained Object Classification
par: Geigle, Gregor, et autres
Publié: (2024)
par: Geigle, Gregor, et autres
Publié: (2024)
The Curious Case of Factual (Mis)Alignment between LLMs' Short- and Long-Form Answers
par: Islam, Saad Obaid ul, et autres
Publié: (2025)
par: Islam, Saad Obaid ul, et autres
Publié: (2025)
Token Weighting for Long-Range Language Modeling
par: Helm, Falko, et autres
Publié: (2025)
par: Helm, Falko, et autres
Publié: (2025)
Automatic Reviewers Fail to Detect Faulty Reasoning in Research Papers: A New Counterfactual Evaluation Framework
par: Dycke, Nils, et autres
Publié: (2025)
par: Dycke, Nils, et autres
Publié: (2025)
Like a Good Nearest Neighbor: Practical Content Moderation and Text Classification
par: Bates, Luke, et autres
Publié: (2023)
par: Bates, Luke, et autres
Publié: (2023)
Citation Failure: Definition, Analysis and Efficient Mitigation
par: Buchmann, Jan, et autres
Publié: (2025)
par: Buchmann, Jan, et autres
Publié: (2025)
Attribute or Abstain: Large Language Models as Long Document Assistants
par: Buchmann, Jan, et autres
Publié: (2024)
par: Buchmann, Jan, et autres
Publié: (2024)
SpeechTaxi: On Multilingual Semantic Speech Classification
par: Keller, Lennart, et autres
Publié: (2024)
par: Keller, Lennart, et autres
Publié: (2024)
Robust Utility-Preserving Text Anonymization Based on Large Language Models
par: Yang, Tianyu, et autres
Publié: (2024)
par: Yang, Tianyu, et autres
Publié: (2024)
MERLIN: Multi-Stage Curriculum Alignment for Multilingual Encoder-LLM Integration in Cross-Lingual Reasoning
par: Uemura, Kosei, et autres
Publié: (2025)
par: Uemura, Kosei, et autres
Publié: (2025)
RIRAG: Regulatory Information Retrieval and Answer Generation
par: Gokhan, Tuba, et autres
Publié: (2024)
par: Gokhan, Tuba, et autres
Publié: (2024)
Are Large Language Models Good Classifiers? A Study on Edit Intent Classification in Scientific Document Revisions
par: Ruan, Qian, et autres
Publié: (2024)
par: Ruan, Qian, et autres
Publié: (2024)
Cross-Lingual Word Alignment for ASEAN Languages with Contrastive Learning
par: Zhang, Jingshen, et autres
Publié: (2024)
par: Zhang, Jingshen, et autres
Publié: (2024)
Pralekha: Cross-Lingual Document Alignment for Indic Languages
par: Suryanarayanan, Sanjay, et autres
Publié: (2024)
par: Suryanarayanan, Sanjay, et autres
Publié: (2024)
Supervised In-Context Fine-Tuning for Generative Sequence Labeling
par: Dukić, David, et autres
Publié: (2025)
par: Dukić, David, et autres
Publié: (2025)
Investigating the Effect of Parallel Data in the Cross-Lingual Transfer for Vision-Language Encoders
par: Manea, Andrei-Alexandru, et autres
Publié: (2025)
par: Manea, Andrei-Alexandru, et autres
Publié: (2025)
Documents similaires
-
IRCoder: Intermediate Representations Make Language Models Robust Multilingual Code Generators
par: Paul, Indraneil, et autres
Publié: (2024) -
The Devil Is in the Word Alignment Details: On Translation-Based Cross-Lingual Transfer for Token Classification Tasks
par: Ebing, Benedikt, et autres
Publié: (2025) -
To Translate or Not to Translate: A Systematic Investigation of Translation-Based Cross-Lingual Transfer to Low-Resource Languages
par: Ebing, Benedikt, et autres
Publié: (2023) -
Self-Distillation for Model Stacking Unlocks Cross-Lingual NLU in 200+ Languages
par: Schmidt, Fabian David, et autres
Publié: (2024) -
Enabling Natural Zero-Shot Prompting on Encoder Models via Statement-Tuning
par: Elshabrawy, Ahmed, et autres
Publié: (2024)