Modular Sentence Encoders: Separating Language Specialization from Cross-Lingual Alignment
Fuente:
arXiv
Salvato in:
| Autori principali: | Huang, Yongxin, Wang, Kexin, Glavaš, Goran, Gurevych, Iryna |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
IRCoder: Intermediate Representations Make Language Models Robust Multilingual Code Generators
di: Paul, Indraneil, et al.
Pubblicazione: (2024)
di: Paul, Indraneil, et al.
Pubblicazione: (2024)
The Devil Is in the Word Alignment Details: On Translation-Based Cross-Lingual Transfer for Token Classification Tasks
di: Ebing, Benedikt, et al.
Pubblicazione: (2025)
di: Ebing, Benedikt, et al.
Pubblicazione: (2025)
To Translate or Not to Translate: A Systematic Investigation of Translation-Based Cross-Lingual Transfer to Low-Resource Languages
di: Ebing, Benedikt, et al.
Pubblicazione: (2023)
di: Ebing, Benedikt, et al.
Pubblicazione: (2023)
Self-Distillation for Model Stacking Unlocks Cross-Lingual NLU in 200+ Languages
di: Schmidt, Fabian David, et al.
Pubblicazione: (2024)
di: Schmidt, Fabian David, et al.
Pubblicazione: (2024)
Enabling Natural Zero-Shot Prompting on Encoder Models via Statement-Tuning
di: Elshabrawy, Ahmed, et al.
Pubblicazione: (2024)
di: Elshabrawy, Ahmed, et al.
Pubblicazione: (2024)
ANHALTEN: Cross-Lingual Transfer for German Token-Level Reference-Free Hallucination Detection
di: Herrlein, Janek, et al.
Pubblicazione: (2024)
di: Herrlein, Janek, et al.
Pubblicazione: (2024)
One Script Instead of Hundreds? On Pretraining Romanized Encoder Language Models
di: Ebing, Benedikt, et al.
Pubblicazione: (2026)
di: Ebing, Benedikt, et al.
Pubblicazione: (2026)
ObscuraCoder: Powering Efficient Code LM Pre-Training Via Obfuscation Grounding
di: Paul, Indraneil, et al.
Pubblicazione: (2025)
di: Paul, Indraneil, et al.
Pubblicazione: (2025)
TransAlign: Machine Translation Encoders are Strong Word Aligners, Too
di: Ebing, Benedikt, et al.
Pubblicazione: (2025)
di: Ebing, Benedikt, et al.
Pubblicazione: (2025)
DAPR: A Benchmark on Document-Aware Passage Retrieval
di: Wang, Kexin, et al.
Pubblicazione: (2023)
di: Wang, Kexin, et al.
Pubblicazione: (2023)
Why Better Cross-Lingual Alignment Fails for Better Cross-Lingual Transfer: Case of Encoders
di: Veitsman, Yana, et al.
Pubblicazione: (2026)
di: Veitsman, Yana, et al.
Pubblicazione: (2026)
DARA: Decomposition-Alignment-Reasoning Autonomous Language Agent for Question Answering over Knowledge Graphs
di: Fang, Haishuo, et al.
Pubblicazione: (2024)
di: Fang, Haishuo, et al.
Pubblicazione: (2024)
Languages are Modalities: Cross-Lingual Alignment via Encoder Injection
di: Agarwal, Rajan, et al.
Pubblicazione: (2025)
di: Agarwal, Rajan, et al.
Pubblicazione: (2025)
SciCoQA: Quality Assurance for Scientific Paper--Code Alignment
di: Baumgärtner, Tim, et al.
Pubblicazione: (2026)
di: Baumgärtner, Tim, et al.
Pubblicazione: (2026)
News Without Borders: Domain Adaptation of Multilingual Sentence Embeddings for Cross-lingual News Recommendation
di: Iana, Andreea, et al.
Pubblicazione: (2024)
di: Iana, Andreea, et al.
Pubblicazione: (2024)
Themis: Training Robust Multilingual Code Reward Models for Flexible Multi-Criteria Scoring
di: Paul, Indraneil, et al.
Pubblicazione: (2026)
di: Paul, Indraneil, et al.
Pubblicazione: (2026)
Differentially Private Steering for Large Language Model Alignment
di: Goel, Anmol, et al.
Pubblicazione: (2025)
di: Goel, Anmol, et al.
Pubblicazione: (2025)
Linear Cross-Lingual Mapping of Sentence Embeddings
di: Vasilyev, Oleg, et al.
Pubblicazione: (2023)
di: Vasilyev, Oleg, et al.
Pubblicazione: (2023)
MVL-SIB: A Massively Multilingual Vision-Language Benchmark for Cross-Modal Topical Matching
di: Schmidt, Fabian David, et al.
Pubblicazione: (2025)
di: Schmidt, Fabian David, et al.
Pubblicazione: (2025)
Dive into the Chasm: Probing the Gap between In- and Cross-Topic Generalization
di: Waldis, Andreas, et al.
Pubblicazione: (2024)
di: Waldis, Andreas, et al.
Pubblicazione: (2024)
Babel-ImageNet: Massively Multilingual Evaluation of Vision-and-Language Representations
di: Geigle, Gregor, et al.
Pubblicazione: (2023)
di: Geigle, Gregor, et al.
Pubblicazione: (2023)
Does Object Grounding Really Reduce Hallucination of Large Vision-Language Models?
di: Geigle, Gregor, et al.
Pubblicazione: (2024)
di: Geigle, Gregor, et al.
Pubblicazione: (2024)
Triple-Encoders: Representations That Fire Together, Wire Together
di: Erker, Justus-Jonas, et al.
Pubblicazione: (2024)
di: Erker, Justus-Jonas, et al.
Pubblicazione: (2024)
Cross-Lingual Knowledge Distillation for Answer Sentence Selection in Low-Resource Languages
di: Gupta, Shivanshu, et al.
Pubblicazione: (2023)
di: Gupta, Shivanshu, et al.
Pubblicazione: (2023)
African or European Swallow? Benchmarking Large Vision-Language Models for Fine-Grained Object Classification
di: Geigle, Gregor, et al.
Pubblicazione: (2024)
di: Geigle, Gregor, et al.
Pubblicazione: (2024)
The Curious Case of Factual (Mis)Alignment between LLMs' Short- and Long-Form Answers
di: Islam, Saad Obaid ul, et al.
Pubblicazione: (2025)
di: Islam, Saad Obaid ul, et al.
Pubblicazione: (2025)
Token Weighting for Long-Range Language Modeling
di: Helm, Falko, et al.
Pubblicazione: (2025)
di: Helm, Falko, et al.
Pubblicazione: (2025)
Automatic Reviewers Fail to Detect Faulty Reasoning in Research Papers: A New Counterfactual Evaluation Framework
di: Dycke, Nils, et al.
Pubblicazione: (2025)
di: Dycke, Nils, et al.
Pubblicazione: (2025)
Like a Good Nearest Neighbor: Practical Content Moderation and Text Classification
di: Bates, Luke, et al.
Pubblicazione: (2023)
di: Bates, Luke, et al.
Pubblicazione: (2023)
Citation Failure: Definition, Analysis and Efficient Mitigation
di: Buchmann, Jan, et al.
Pubblicazione: (2025)
di: Buchmann, Jan, et al.
Pubblicazione: (2025)
Attribute or Abstain: Large Language Models as Long Document Assistants
di: Buchmann, Jan, et al.
Pubblicazione: (2024)
di: Buchmann, Jan, et al.
Pubblicazione: (2024)
SpeechTaxi: On Multilingual Semantic Speech Classification
di: Keller, Lennart, et al.
Pubblicazione: (2024)
di: Keller, Lennart, et al.
Pubblicazione: (2024)
Robust Utility-Preserving Text Anonymization Based on Large Language Models
di: Yang, Tianyu, et al.
Pubblicazione: (2024)
di: Yang, Tianyu, et al.
Pubblicazione: (2024)
MERLIN: Multi-Stage Curriculum Alignment for Multilingual Encoder-LLM Integration in Cross-Lingual Reasoning
di: Uemura, Kosei, et al.
Pubblicazione: (2025)
di: Uemura, Kosei, et al.
Pubblicazione: (2025)
RIRAG: Regulatory Information Retrieval and Answer Generation
di: Gokhan, Tuba, et al.
Pubblicazione: (2024)
di: Gokhan, Tuba, et al.
Pubblicazione: (2024)
Are Large Language Models Good Classifiers? A Study on Edit Intent Classification in Scientific Document Revisions
di: Ruan, Qian, et al.
Pubblicazione: (2024)
di: Ruan, Qian, et al.
Pubblicazione: (2024)
Cross-Lingual Word Alignment for ASEAN Languages with Contrastive Learning
di: Zhang, Jingshen, et al.
Pubblicazione: (2024)
di: Zhang, Jingshen, et al.
Pubblicazione: (2024)
Pralekha: Cross-Lingual Document Alignment for Indic Languages
di: Suryanarayanan, Sanjay, et al.
Pubblicazione: (2024)
di: Suryanarayanan, Sanjay, et al.
Pubblicazione: (2024)
Supervised In-Context Fine-Tuning for Generative Sequence Labeling
di: Dukić, David, et al.
Pubblicazione: (2025)
di: Dukić, David, et al.
Pubblicazione: (2025)
Investigating the Effect of Parallel Data in the Cross-Lingual Transfer for Vision-Language Encoders
di: Manea, Andrei-Alexandru, et al.
Pubblicazione: (2025)
di: Manea, Andrei-Alexandru, et al.
Pubblicazione: (2025)
Documenti analoghi
-
IRCoder: Intermediate Representations Make Language Models Robust Multilingual Code Generators
di: Paul, Indraneil, et al.
Pubblicazione: (2024) -
The Devil Is in the Word Alignment Details: On Translation-Based Cross-Lingual Transfer for Token Classification Tasks
di: Ebing, Benedikt, et al.
Pubblicazione: (2025) -
To Translate or Not to Translate: A Systematic Investigation of Translation-Based Cross-Lingual Transfer to Low-Resource Languages
di: Ebing, Benedikt, et al.
Pubblicazione: (2023) -
Self-Distillation for Model Stacking Unlocks Cross-Lingual NLU in 200+ Languages
di: Schmidt, Fabian David, et al.
Pubblicazione: (2024) -
Enabling Natural Zero-Shot Prompting on Encoder Models via Statement-Tuning
di: Elshabrawy, Ahmed, et al.
Pubblicazione: (2024)