FOCUS: Effective Embedding Initialization for Monolingual Specialization of Multilingual Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Dobler, Konstantin, de Melo, Gerard |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2023
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Token Distillation: Attention-aware Input Embeddings For New Tokens
di: Dobler, Konstantin, et al.
Pubblicazione: (2025)
di: Dobler, Konstantin, et al.
Pubblicazione: (2025)
Language Adaptation on a Tight Academic Compute Budget: Tokenizer Swapping Works and Pure bfloat16 Is Enough
di: Dobler, Konstantin, et al.
Pubblicazione: (2024)
di: Dobler, Konstantin, et al.
Pubblicazione: (2024)
I Don't Know: Explicit Modeling of Uncertainty with an [IDK] Token
di: Cohen, Roi, et al.
Pubblicazione: (2024)
di: Cohen, Roi, et al.
Pubblicazione: (2024)
The Scandinavian Embedding Benchmarks: Comprehensive Assessment of Multilingual and Monolingual Text Embedding
di: Enevoldsen, Kenneth, et al.
Pubblicazione: (2024)
di: Enevoldsen, Kenneth, et al.
Pubblicazione: (2024)
Multilingual Reasoning Gym: Multilingual Scaling of Procedural Reasoning Environments
di: Dobler, Konstantin, et al.
Pubblicazione: (2026)
di: Dobler, Konstantin, et al.
Pubblicazione: (2026)
mAceReason-Math: A Dataset of High-Quality Multilingual Math Problems Ready For RLVR
di: Dobler, Konstantin, et al.
Pubblicazione: (2026)
di: Dobler, Konstantin, et al.
Pubblicazione: (2026)
When Does Monolingual Data Help Multilingual Translation: The Role of Domain and Model Scale
di: Baziotis, Christos, et al.
Pubblicazione: (2023)
di: Baziotis, Christos, et al.
Pubblicazione: (2023)
Comparing Explanation Faithfulness between Multilingual and Monolingual Fine-tuned Language Models
di: Zhao, Zhixue, et al.
Pubblicazione: (2024)
di: Zhao, Zhixue, et al.
Pubblicazione: (2024)
Multilingual Information Retrieval with a Monolingual Knowledge Base
di: Zhuang, Yingying, et al.
Pubblicazione: (2025)
di: Zhuang, Yingying, et al.
Pubblicazione: (2025)
Monolingual and Multilingual Misinformation Detection for Low-Resource Languages: A Comprehensive Survey
di: Wang, Xinyu, et al.
Pubblicazione: (2024)
di: Wang, Xinyu, et al.
Pubblicazione: (2024)
Monolingual or Multilingual Instruction Tuning: Which Makes a Better Alpaca
di: Chen, Pinzhen, et al.
Pubblicazione: (2023)
di: Chen, Pinzhen, et al.
Pubblicazione: (2023)
Evaluating Monolingual and Multilingual Large Language Models for Greek Question Answering: The DemosQA Benchmark
di: Mastrokostas, Charalampos, et al.
Pubblicazione: (2026)
di: Mastrokostas, Charalampos, et al.
Pubblicazione: (2026)
Synergistic Approach for Simultaneous Optimization of Monolingual, Cross-lingual, and Multilingual Information Retrieval
di: Elmahdy, Adel, et al.
Pubblicazione: (2024)
di: Elmahdy, Adel, et al.
Pubblicazione: (2024)
Claim Detection for Automated Fact-checking: A Survey on Monolingual, Multilingual and Cross-Lingual Research
di: Panchendrarajan, Rrubaa, et al.
Pubblicazione: (2024)
di: Panchendrarajan, Rrubaa, et al.
Pubblicazione: (2024)
Goldfish: Monolingual Language Models for 350 Languages
di: Chang, Tyler A., et al.
Pubblicazione: (2024)
di: Chang, Tyler A., et al.
Pubblicazione: (2024)
EMS: Efficient and Effective Massively Multilingual Sentence Embedding Learning
di: Mao, Zhuoyuan, et al.
Pubblicazione: (2022)
di: Mao, Zhuoyuan, et al.
Pubblicazione: (2022)
Bilingual Adaptation of Monolingual Foundation Models
di: Gosal, Gurpreet, et al.
Pubblicazione: (2024)
di: Gosal, Gurpreet, et al.
Pubblicazione: (2024)
Yankari: A Monolingual Yoruba Dataset
di: Akpobi, Maro
Pubblicazione: (2024)
di: Akpobi, Maro
Pubblicazione: (2024)
OFA: A Framework of Initializing Unseen Subword Embeddings for Efficient Large-scale Multilingual Continued Pretraining
di: Liu, Yihong, et al.
Pubblicazione: (2023)
di: Liu, Yihong, et al.
Pubblicazione: (2023)
Adapting Multilingual Embedding Models to Historical Luxembourgish
di: Michail, Andrianos, et al.
Pubblicazione: (2025)
di: Michail, Andrianos, et al.
Pubblicazione: (2025)
Efficient Parallelization Layouts for Large-Scale Distributed Model Training
di: Hagemann, Johannes, et al.
Pubblicazione: (2023)
di: Hagemann, Johannes, et al.
Pubblicazione: (2023)
Towards Better Monolingual Japanese Retrievers with Multi-Vector Models
di: Clavié, Benjamin
Pubblicazione: (2023)
di: Clavié, Benjamin
Pubblicazione: (2023)
Introducing cosmosGPT: Monolingual Training for Turkish Language Models
di: Kesgin, H. Toprak, et al.
Pubblicazione: (2024)
di: Kesgin, H. Toprak, et al.
Pubblicazione: (2024)
Exploring the Effectiveness of Methods for Persona Extraction
di: Zaitsev, Konstantin
Pubblicazione: (2024)
di: Zaitsev, Konstantin
Pubblicazione: (2024)
From Monolingual to Bilingual: Investigating Language Conditioning in Large Language Models for Psycholinguistic Tasks
di: Yuan, Shuzhou, et al.
Pubblicazione: (2025)
di: Yuan, Shuzhou, et al.
Pubblicazione: (2025)
Combining Distantly Supervised Models with In Context Learning for Monolingual and Cross-Lingual Relation Extraction
di: Rathore, Vipul, et al.
Pubblicazione: (2025)
di: Rathore, Vipul, et al.
Pubblicazione: (2025)
Context-Aware Monolingual Human Evaluation of Machine Translation
di: Picinini, Silvio, et al.
Pubblicazione: (2025)
di: Picinini, Silvio, et al.
Pubblicazione: (2025)
Distilling Monolingual and Crosslingual Word-in-Context Representations
di: Arase, Yuki, et al.
Pubblicazione: (2024)
di: Arase, Yuki, et al.
Pubblicazione: (2024)
UrduLM: A Resource-Efficient Monolingual Urdu Language Model
di: Ali, Syed Muhammad, et al.
Pubblicazione: (2026)
di: Ali, Syed Muhammad, et al.
Pubblicazione: (2026)
Team QUST at SemEval-2024 Task 8: A Comprehensive Study of Monolingual and Multilingual Approaches for Detecting AI-generated Text
di: Xu, Xiaoman, et al.
Pubblicazione: (2024)
di: Xu, Xiaoman, et al.
Pubblicazione: (2024)
Connecting the Dots: What Graph-Based Text Representations Work Best for Text Classification Using Graph Neural Networks?
di: Bugueño, Margarita, et al.
Pubblicazione: (2023)
di: Bugueño, Margarita, et al.
Pubblicazione: (2023)
Rethinking Graph-Based Document Classification: Learning Data-Driven Structures Beyond Heuristic Approaches
di: Bugueño, Margarita, et al.
Pubblicazione: (2025)
di: Bugueño, Margarita, et al.
Pubblicazione: (2025)
Multilingual Test-Time Scaling via Initial Thought Transfer
di: Bajpai, Prasoon, et al.
Pubblicazione: (2025)
di: Bajpai, Prasoon, et al.
Pubblicazione: (2025)
Unsupervised Cross-Lingual Part-of-Speech Tagging with Monolingual Corpora Only
di: Zheng, Jianyu
Pubblicazione: (2026)
di: Zheng, Jianyu
Pubblicazione: (2026)
The Privileged Students: On the Value of Initialization in Multilingual Knowledge Distillation
di: Wibowo, Haryo Akbarianto, et al.
Pubblicazione: (2024)
di: Wibowo, Haryo Akbarianto, et al.
Pubblicazione: (2024)
Pretraining Strategies using Monolingual and Parallel Data for Low-Resource Machine Translation
di: Nguefack, Idriss Nguepi, et al.
Pubblicazione: (2025)
di: Nguefack, Idriss Nguepi, et al.
Pubblicazione: (2025)
LuxIT: A Luxembourgish Instruction Tuning Dataset from Monolingual Seed Data
di: Valline, Julian, et al.
Pubblicazione: (2025)
di: Valline, Julian, et al.
Pubblicazione: (2025)
HAMLET: Healthcare-focused Adaptive Multilingual Learning Embedding-based Topic Modeling
di: Sakai, Hajar, et al.
Pubblicazione: (2025)
di: Sakai, Hajar, et al.
Pubblicazione: (2025)
Beyond Monolingual Assumptions: A Survey of Code-Switched NLP in the Era of Large Language Models across Modalities
di: Sheth, Rajvee, et al.
Pubblicazione: (2025)
di: Sheth, Rajvee, et al.
Pubblicazione: (2025)
TiME: Tiny Monolingual Encoders for Efficient NLP Pipelines
di: Schulmeister, David, et al.
Pubblicazione: (2025)
di: Schulmeister, David, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Token Distillation: Attention-aware Input Embeddings For New Tokens
di: Dobler, Konstantin, et al.
Pubblicazione: (2025) -
Language Adaptation on a Tight Academic Compute Budget: Tokenizer Swapping Works and Pure bfloat16 Is Enough
di: Dobler, Konstantin, et al.
Pubblicazione: (2024) -
I Don't Know: Explicit Modeling of Uncertainty with an [IDK] Token
di: Cohen, Roi, et al.
Pubblicazione: (2024) -
The Scandinavian Embedding Benchmarks: Comprehensive Assessment of Multilingual and Monolingual Text Embedding
di: Enevoldsen, Kenneth, et al.
Pubblicazione: (2024) -
Multilingual Reasoning Gym: Multilingual Scaling of Procedural Reasoning Environments
di: Dobler, Konstantin, et al.
Pubblicazione: (2026)