MAGNET: Improving the Multilingual Fairness of Language Models with Adaptive Gradient-Based Tokenization
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Ahia, Orevaoghene, Kumar, Sachin, Gonen, Hila, Hofmann, Valentin, Limisiewicz, Tomasz, Tsvetkov, Yulia, Smith, Noah A. |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
MYTE: Morphology-Driven Byte Encoding for Better and Fairer Multilingual Language Modeling
von: Limisiewicz, Tomasz, et al.
Veröffentlicht: (2024)
von: Limisiewicz, Tomasz, et al.
Veröffentlicht: (2024)
Voices Unheard: NLP Resources and Models for Yorùbá Regional Dialects
von: Ahia, Orevaoghene, et al.
Veröffentlicht: (2024)
von: Ahia, Orevaoghene, et al.
Veröffentlicht: (2024)
FLEXITOKENS: Flexible Tokenization for Evolving Language Models
von: Owodunni, Abraham Toluwase, et al.
Veröffentlicht: (2025)
von: Owodunni, Abraham Toluwase, et al.
Veröffentlicht: (2025)
BASS: Benchmarking Audio LMs for Musical Structure and Semantic Reasoning
von: Jang, Min, et al.
Veröffentlicht: (2026)
von: Jang, Min, et al.
Veröffentlicht: (2026)
Breaking the Curse of Multilinguality with Cross-lingual Expert Language Models
von: Blevins, Terra, et al.
Veröffentlicht: (2024)
von: Blevins, Terra, et al.
Veröffentlicht: (2024)
Extracting Lexical Features from Dialects via Interpretable Dialect Classifiers
von: Xie, Roy, et al.
Veröffentlicht: (2024)
von: Xie, Roy, et al.
Veröffentlicht: (2024)
Broken Tokens? Your Language Model can Secretly Handle Non-Canonical Tokenizations
von: Zheng, Brian Siyuan, et al.
Veröffentlicht: (2025)
von: Zheng, Brian Siyuan, et al.
Veröffentlicht: (2025)
BLAB: Brutally Long Audio Bench
von: Ahia, Orevaoghene, et al.
Veröffentlicht: (2025)
von: Ahia, Orevaoghene, et al.
Veröffentlicht: (2025)
Teaching LLMs to Abstain across Languages via Multilingual Feedback
von: Feng, Shangbin, et al.
Veröffentlicht: (2024)
von: Feng, Shangbin, et al.
Veröffentlicht: (2024)
DIALECTBENCH: A NLP Benchmark for Dialects, Varieties, and Closely-Related Languages
von: Faisal, Fahim, et al.
Veröffentlicht: (2024)
von: Faisal, Fahim, et al.
Veröffentlicht: (2024)
Beyond Literal Token Overlap: Token Alignability for Multilinguality
von: Hämmerl, Katharina, et al.
Veröffentlicht: (2025)
von: Hämmerl, Katharina, et al.
Veröffentlicht: (2025)
ComPO: Community Preferences for Language Model Personalization
von: Kumar, Sachin, et al.
Veröffentlicht: (2024)
von: Kumar, Sachin, et al.
Veröffentlicht: (2024)
Dual Debiasing: Remove Stereotypes and Keep Factual Gender for Fair Language Modeling and Translation
von: Limisiewicz, Tomasz, et al.
Veröffentlicht: (2025)
von: Limisiewicz, Tomasz, et al.
Veröffentlicht: (2025)
IDIOLEX: Unified and Continuous Representations for Idiolectal and Stylistic Variation
von: Kantharuban, Anjali, et al.
Veröffentlicht: (2026)
von: Kantharuban, Anjali, et al.
Veröffentlicht: (2026)
Demystifying Prompts in Language Models via Perplexity Estimation
von: Gonen, Hila, et al.
Veröffentlicht: (2022)
von: Gonen, Hila, et al.
Veröffentlicht: (2022)
Rewriting History: A Recipe for Interventional Analyses to Study Data Effects on Model Behavior
von: Nadkarni, Rahul, et al.
Veröffentlicht: (2025)
von: Nadkarni, Rahul, et al.
Veröffentlicht: (2025)
Does Liking Yellow Imply Driving a School Bus? Semantic Leakage in Language Models
von: Gonen, Hila, et al.
Veröffentlicht: (2024)
von: Gonen, Hila, et al.
Veröffentlicht: (2024)
Bolmo: Byteifying the Next Generation of Language Models
von: Minixhofer, Benjamin, et al.
Veröffentlicht: (2025)
von: Minixhofer, Benjamin, et al.
Veröffentlicht: (2025)
David helps Goliath: Inference-Time Collaboration Between Small Specialized and Large General Diffusion LMs
von: Han, Xiaochuang, et al.
Veröffentlicht: (2023)
von: Han, Xiaochuang, et al.
Veröffentlicht: (2023)
Tuning Language Models by Proxy
von: Liu, Alisa, et al.
Veröffentlicht: (2024)
von: Liu, Alisa, et al.
Veröffentlicht: (2024)
Compute Optimal Tokenization
von: Limisiewicz, Tomasz, et al.
Veröffentlicht: (2026)
von: Limisiewicz, Tomasz, et al.
Veröffentlicht: (2026)
Debiasing Algorithm through Model Adaptation
von: Limisiewicz, Tomasz, et al.
Veröffentlicht: (2023)
von: Limisiewicz, Tomasz, et al.
Veröffentlicht: (2023)
Continually Adding New Languages to Multilingual Language Models
von: Owodunni, Abraham Toluwase, et al.
Veröffentlicht: (2025)
von: Owodunni, Abraham Toluwase, et al.
Veröffentlicht: (2025)
Finding Flawed Fictions: Evaluating Complex Reasoning in Language Models via Plot Hole Detection
von: Ahuja, Kabir, et al.
Veröffentlicht: (2025)
von: Ahuja, Kabir, et al.
Veröffentlicht: (2025)
Frame-Level Internal Tool Use for Temporal Grounding in Audio LMs
von: An, Joesph, et al.
Veröffentlicht: (2026)
von: An, Joesph, et al.
Veröffentlicht: (2026)
The Single-Multi Evolution Loop for Self-Improving Model Collaboration Systems
von: Feng, Shangbin, et al.
Veröffentlicht: (2026)
von: Feng, Shangbin, et al.
Veröffentlicht: (2026)
P^3SUM: Preserving Author's Perspective in News Summarization with Diffusion Language Models
von: Liu, Yuhan, et al.
Veröffentlicht: (2023)
von: Liu, Yuhan, et al.
Veröffentlicht: (2023)
ScienceMeter: Tracking Scientific Knowledge Updates in Language Models
von: Wang, Yike, et al.
Veröffentlicht: (2025)
von: Wang, Yike, et al.
Veröffentlicht: (2025)
Critical Learning Periods: Leveraging Early Training Dynamics for Efficient Data Pruning
von: Chimoto, Everlyn Asiko, et al.
Veröffentlicht: (2024)
von: Chimoto, Everlyn Asiko, et al.
Veröffentlicht: (2024)
SPARTA ALIGNMENT: Collectively Aligning Multiple Language Models through Combat
von: Jiang, Yuru, et al.
Veröffentlicht: (2025)
von: Jiang, Yuru, et al.
Veröffentlicht: (2025)
The Art of Saying No: Contextual Noncompliance in Language Models
von: Brahman, Faeze, et al.
Veröffentlicht: (2024)
von: Brahman, Faeze, et al.
Veröffentlicht: (2024)
Dementia Through Different Eyes: Explainable Modeling of Human and LLM Perceptions for Early Awareness
von: Peled-Cohen, Lotem, et al.
Veröffentlicht: (2025)
von: Peled-Cohen, Lotem, et al.
Veröffentlicht: (2025)
Quantifying Language Models' Sensitivity to Spurious Features in Prompt Design or: How I learned to start worrying about prompt formatting
von: Sclar, Melanie, et al.
Veröffentlicht: (2023)
von: Sclar, Melanie, et al.
Veröffentlicht: (2023)
Among Us: Measuring and Mitigating Malicious Contributions in Model Collaboration Systems
von: Yang, Ziyuan, et al.
Veröffentlicht: (2026)
von: Yang, Ziyuan, et al.
Veröffentlicht: (2026)
Can Language Models Solve Graph Problems in Natural Language?
von: Wang, Heng, et al.
Veröffentlicht: (2023)
von: Wang, Heng, et al.
Veröffentlicht: (2023)
Learning Syntax Without Planting Trees: Understanding Hierarchical Generalization in Transformers
von: Ahuja, Kabir, et al.
Veröffentlicht: (2024)
von: Ahuja, Kabir, et al.
Veröffentlicht: (2024)
Knowledge Card: Filling LLMs' Knowledge Gaps with Plug-in Specialized Language Models
von: Feng, Shangbin, et al.
Veröffentlicht: (2023)
von: Feng, Shangbin, et al.
Veröffentlicht: (2023)
What Does the Bot Say? Opportunities and Risks of Large Language Models in Social Media Bot Detection
von: Feng, Shangbin, et al.
Veröffentlicht: (2024)
von: Feng, Shangbin, et al.
Veröffentlicht: (2024)
Resolving Knowledge Conflicts in Large Language Models
von: Wang, Yike, et al.
Veröffentlicht: (2023)
von: Wang, Yike, et al.
Veröffentlicht: (2023)
COMPASS: COntinual Multilingual PEFT with Adaptive Semantic Sampling
von: Flynn, Noah
Veröffentlicht: (2026)
von: Flynn, Noah
Veröffentlicht: (2026)
Ähnliche Einträge
-
MYTE: Morphology-Driven Byte Encoding for Better and Fairer Multilingual Language Modeling
von: Limisiewicz, Tomasz, et al.
Veröffentlicht: (2024) -
Voices Unheard: NLP Resources and Models for Yorùbá Regional Dialects
von: Ahia, Orevaoghene, et al.
Veröffentlicht: (2024) -
FLEXITOKENS: Flexible Tokenization for Evolving Language Models
von: Owodunni, Abraham Toluwase, et al.
Veröffentlicht: (2025) -
BASS: Benchmarking Audio LMs for Musical Structure and Semantic Reasoning
von: Jang, Min, et al.
Veröffentlicht: (2026) -
Breaking the Curse of Multilinguality with Cross-lingual Expert Language Models
von: Blevins, Terra, et al.
Veröffentlicht: (2024)