Breaking the Curse of Multilinguality with Cross-lingual Expert Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Blevins, Terra, Limisiewicz, Tomasz, Gururangan, Suchin, Li, Margaret, Gonen, Hila, Smith, Noah A., Zettlemoyer, Luke |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MYTE: Morphology-Driven Byte Encoding for Better and Fairer Multilingual Language Modeling
di: Limisiewicz, Tomasz, et al.
Pubblicazione: (2024)
di: Limisiewicz, Tomasz, et al.
Pubblicazione: (2024)
Demystifying Prompts in Language Models via Perplexity Estimation
di: Gonen, Hila, et al.
Pubblicazione: (2022)
di: Gonen, Hila, et al.
Pubblicazione: (2022)
Does Liking Yellow Imply Driving a School Bus? Semantic Leakage in Language Models
di: Gonen, Hila, et al.
Pubblicazione: (2024)
di: Gonen, Hila, et al.
Pubblicazione: (2024)
MAGNET: Improving the Multilingual Fairness of Language Models with Adaptive Gradient-Based Tokenization
di: Ahia, Orevaoghene, et al.
Pubblicazione: (2024)
di: Ahia, Orevaoghene, et al.
Pubblicazione: (2024)
Comparing Hallucination Detection Metrics for Multilingual Generation
di: Kang, Haoqiang, et al.
Pubblicazione: (2024)
di: Kang, Haoqiang, et al.
Pubblicazione: (2024)
Time is Encoded in the Weights of Finetuned Language Models
di: Nylund, Kai, et al.
Pubblicazione: (2023)
di: Nylund, Kai, et al.
Pubblicazione: (2023)
Parameter Alignment Mitigates Catastrophic Forgetting in Multilingual Expert Language Models
di: Ahuja, Sanchit, et al.
Pubblicazione: (2026)
di: Ahuja, Sanchit, et al.
Pubblicazione: (2026)
SILO Language Models: Isolating Legal Risk In a Nonparametric Datastore
di: Min, Sewon, et al.
Pubblicazione: (2023)
di: Min, Sewon, et al.
Pubblicazione: (2023)
Accommodation Goes Both Ways: Studying Linguistic Convergence Between Humans and Language Models
di: Blevins, Terra
Pubblicazione: (2026)
di: Blevins, Terra
Pubblicazione: (2026)
Bolmo: Byteifying the Next Generation of Language Models
di: Minixhofer, Benjamin, et al.
Pubblicazione: (2025)
di: Minixhofer, Benjamin, et al.
Pubblicazione: (2025)
Rewriting History: A Recipe for Interventional Analyses to Study Data Effects on Model Behavior
di: Nadkarni, Rahul, et al.
Pubblicazione: (2025)
di: Nadkarni, Rahul, et al.
Pubblicazione: (2025)
OMNIGUARD: An Efficient Approach for AI Safety Moderation Across Languages and Modalities
di: Verma, Sahil, et al.
Pubblicazione: (2025)
di: Verma, Sahil, et al.
Pubblicazione: (2025)
Beyond Literal Token Overlap: Token Alignability for Multilinguality
di: Hämmerl, Katharina, et al.
Pubblicazione: (2025)
di: Hämmerl, Katharina, et al.
Pubblicazione: (2025)
Cross-lingual Transfer of Reward Models in Multilingual Alignment
di: Hong, Jiwoo, et al.
Pubblicazione: (2024)
di: Hong, Jiwoo, et al.
Pubblicazione: (2024)
Compute Optimal Tokenization
di: Limisiewicz, Tomasz, et al.
Pubblicazione: (2026)
di: Limisiewicz, Tomasz, et al.
Pubblicazione: (2026)
Detecting Pretraining Data from Large Language Models
di: Shi, Weijia, et al.
Pubblicazione: (2023)
di: Shi, Weijia, et al.
Pubblicazione: (2023)
Cross-lingual Editing in Multilingual Language Models
di: Beniwal, Himanshu, et al.
Pubblicazione: (2024)
di: Beniwal, Himanshu, et al.
Pubblicazione: (2024)
Targeted Multilingual Adaptation for Low-resource Language Families
di: Downey, C. M., et al.
Pubblicazione: (2024)
di: Downey, C. M., et al.
Pubblicazione: (2024)
Dual Debiasing: Remove Stereotypes and Keep Factual Gender for Fair Language Modeling and Translation
di: Limisiewicz, Tomasz, et al.
Pubblicazione: (2025)
di: Limisiewicz, Tomasz, et al.
Pubblicazione: (2025)
Multilingual Large Language Models and Curse of Multilinguality
di: Gurgurov, Daniil, et al.
Pubblicazione: (2024)
di: Gurgurov, Daniil, et al.
Pubblicazione: (2024)
Universal NER: A Gold-Standard Multilingual Named Entity Recognition Benchmark
di: Mayhew, Stephen, et al.
Pubblicazione: (2023)
di: Mayhew, Stephen, et al.
Pubblicazione: (2023)
Slicing and Dicing: Configuring Optimal Mixtures of Experts
di: Li, Margaret, et al.
Pubblicazione: (2026)
di: Li, Margaret, et al.
Pubblicazione: (2026)
Universal NER v2: Towards a Massively Multilingual Named Entity Recognition Benchmark
di: Blevins, Terra, et al.
Pubblicazione: (2026)
di: Blevins, Terra, et al.
Pubblicazione: (2026)
Cross-lingual Self-Consistency for Multilingual Reasoning with Language Models
di: Elhady, Ahmed, et al.
Pubblicazione: (2026)
di: Elhady, Ahmed, et al.
Pubblicazione: (2026)
Improving In-context Learning of Multilingual Generative Language Models with Cross-lingual Alignment
di: Li, Chong, et al.
Pubblicazione: (2023)
di: Li, Chong, et al.
Pubblicazione: (2023)
Lost in Multilinguality: Dissecting Cross-lingual Factual Inconsistency in Transformer Language Models
di: Wang, Mingyang, et al.
Pubblicazione: (2025)
di: Wang, Mingyang, et al.
Pubblicazione: (2025)
Debiasing Algorithm through Model Adaptation
di: Limisiewicz, Tomasz, et al.
Pubblicazione: (2023)
di: Limisiewicz, Tomasz, et al.
Pubblicazione: (2023)
Fast Byte Latent Transformer
di: Kallini, Julie, et al.
Pubblicazione: (2026)
di: Kallini, Julie, et al.
Pubblicazione: (2026)
LESS: Selecting Influential Data for Targeted Instruction Tuning
di: Xia, Mengzhou, et al.
Pubblicazione: (2024)
di: Xia, Mengzhou, et al.
Pubblicazione: (2024)
Do language models accommodate their users? A study of linguistic convergence
di: Blevins, Terra, et al.
Pubblicazione: (2025)
di: Blevins, Terra, et al.
Pubblicazione: (2025)
Voices Unheard: NLP Resources and Models for Yorùbá Regional Dialects
di: Ahia, Orevaoghene, et al.
Pubblicazione: (2024)
di: Ahia, Orevaoghene, et al.
Pubblicazione: (2024)
Relation Extraction or Pattern Matching? Unravelling the Generalisation Limits of Language Models for Biographical RE
di: Arzt, Varvara, et al.
Pubblicazione: (2025)
di: Arzt, Varvara, et al.
Pubblicazione: (2025)
Diversity-driven Data Selection for Language Model Tuning through Sparse Autoencoder
di: Yang, Xianjun, et al.
Pubblicazione: (2025)
di: Yang, Xianjun, et al.
Pubblicazione: (2025)
Evaluating Copyright Takedown Methods for Language Models
di: Wei, Boyi, et al.
Pubblicazione: (2024)
di: Wei, Boyi, et al.
Pubblicazione: (2024)
AboutMe: Using Self-Descriptions in Webpages to Document the Effects of English Pretraining Data Filters
di: Lucy, Li, et al.
Pubblicazione: (2024)
di: Lucy, Li, et al.
Pubblicazione: (2024)
What Drives Cross-lingual Ranking? Retrieval Approaches with Multilingual Language Models
di: Goworek, Roksana, et al.
Pubblicazione: (2025)
di: Goworek, Roksana, et al.
Pubblicazione: (2025)
Multilingual Generative Retrieval via Cross-lingual Semantic Compression
di: Huang, Yuxin, et al.
Pubblicazione: (2025)
di: Huang, Yuxin, et al.
Pubblicazione: (2025)
Effects of Cross-lingual Evidence in Multilingual Medical Question Answering
di: Yeginbergen, Anar, et al.
Pubblicazione: (2026)
di: Yeginbergen, Anar, et al.
Pubblicazione: (2026)
HumanEval-XL: A Multilingual Code Generation Benchmark for Cross-lingual Natural Language Generalization
di: Peng, Qiwei, et al.
Pubblicazione: (2024)
di: Peng, Qiwei, et al.
Pubblicazione: (2024)
(Mis)Fitting: A Survey of Scaling Laws
di: Li, Margaret, et al.
Pubblicazione: (2025)
di: Li, Margaret, et al.
Pubblicazione: (2025)
Documenti analoghi
-
MYTE: Morphology-Driven Byte Encoding for Better and Fairer Multilingual Language Modeling
di: Limisiewicz, Tomasz, et al.
Pubblicazione: (2024) -
Demystifying Prompts in Language Models via Perplexity Estimation
di: Gonen, Hila, et al.
Pubblicazione: (2022) -
Does Liking Yellow Imply Driving a School Bus? Semantic Leakage in Language Models
di: Gonen, Hila, et al.
Pubblicazione: (2024) -
MAGNET: Improving the Multilingual Fairness of Language Models with Adaptive Gradient-Based Tokenization
di: Ahia, Orevaoghene, et al.
Pubblicazione: (2024) -
Comparing Hallucination Detection Metrics for Multilingual Generation
di: Kang, Haoqiang, et al.
Pubblicazione: (2024)