How Language Directions Align with Token Geometry in Multilingual LLMs
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Kim, JaeSeong, Lee, Suan |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Smoothie-Qwen: Post-Hoc Smoothing to Reduce Language Bias in Multilingual LLMs
von: Ji, SeungWon, et al.
Veröffentlicht: (2025)
von: Ji, SeungWon, et al.
Veröffentlicht: (2025)
How does a Language-Specific Tokenizer affect LLMs?
von: Seo, Jean, et al.
Veröffentlicht: (2025)
von: Seo, Jean, et al.
Veröffentlicht: (2025)
Accelerating Multilingual Language Model for Excessively Tokenized Languages
von: Hong, Jimin, et al.
Veröffentlicht: (2024)
von: Hong, Jimin, et al.
Veröffentlicht: (2024)
Controlling Language Confusion in Multilingual LLMs
von: Lee, Nahyun, et al.
Veröffentlicht: (2025)
von: Lee, Nahyun, et al.
Veröffentlicht: (2025)
AlignX: Advancing Multilingual Large Language Models with Multilingual Representation Alignment
von: Bu, Mengyu, et al.
Veröffentlicht: (2025)
von: Bu, Mengyu, et al.
Veröffentlicht: (2025)
LatinX: Aligning a Multilingual TTS Model with Direct Preference Optimization
von: Chary, Luis Felipe, et al.
Veröffentlicht: (2025)
von: Chary, Luis Felipe, et al.
Veröffentlicht: (2025)
Improving Multilingual Language Models by Aligning Representations through Steering
von: Mahmoud, Omar, et al.
Veröffentlicht: (2025)
von: Mahmoud, Omar, et al.
Veröffentlicht: (2025)
Beyond Early-Token Bias: Model-Specific and Language-Specific Position Effects in Multilingual LLMs
von: Menschikov, Mikhail, et al.
Veröffentlicht: (2025)
von: Menschikov, Mikhail, et al.
Veröffentlicht: (2025)
What is Your Favorite Gender, MLM? Gender Bias Evaluation in Multilingual Masked Language Models
von: Yu, Jeongrok, et al.
Veröffentlicht: (2024)
von: Yu, Jeongrok, et al.
Veröffentlicht: (2024)
One Tokenizer To Rule Them All: Emergent Language Plasticity via Multilingual Tokenizers
von: Abagyan, Diana, et al.
Veröffentlicht: (2025)
von: Abagyan, Diana, et al.
Veröffentlicht: (2025)
WoLF: Wide-scope Large Language Model Framework for CXR Understanding
von: Kang, Seil, et al.
Veröffentlicht: (2024)
von: Kang, Seil, et al.
Veröffentlicht: (2024)
TASE: Token Awareness and Structured Evaluation for Multilingual Language Models
von: Zhao, Chenzhuo, et al.
Veröffentlicht: (2025)
von: Zhao, Chenzhuo, et al.
Veröffentlicht: (2025)
Multilingual Tokenization through the Lens of Indian Languages: Challenges and Insights
von: Karthika, N J, et al.
Veröffentlicht: (2025)
von: Karthika, N J, et al.
Veröffentlicht: (2025)
How Does Quantization Affect Multilingual LLMs?
von: Marchisio, Kelly, et al.
Veröffentlicht: (2024)
von: Marchisio, Kelly, et al.
Veröffentlicht: (2024)
CM-Align: Consistency-based Multilingual Alignment for Large Language Models
von: Zhang, Xue, et al.
Veröffentlicht: (2025)
von: Zhang, Xue, et al.
Veröffentlicht: (2025)
Improving Conversational Abilities of Quantized Large Language Models via Direct Preference Alignment
von: Lee, Janghwan, et al.
Veröffentlicht: (2024)
von: Lee, Janghwan, et al.
Veröffentlicht: (2024)
Beyond Literal Token Overlap: Token Alignability for Multilinguality
von: Hämmerl, Katharina, et al.
Veröffentlicht: (2025)
von: Hämmerl, Katharina, et al.
Veröffentlicht: (2025)
TASTE-Streaming: Towards Streamable Text-Aligned Speech Tokenization and Embedding for Spoken Language Modeling
von: Tseng, Liang-Hsuan, et al.
Veröffentlicht: (2026)
von: Tseng, Liang-Hsuan, et al.
Veröffentlicht: (2026)
Do Political Opinions Transfer Between Western Languages? An Analysis of Unaligned and Aligned Multilingual LLMs
von: Weeber, Franziska, et al.
Veröffentlicht: (2025)
von: Weeber, Franziska, et al.
Veröffentlicht: (2025)
Optimizing Korean-Centric LLMs via Token Pruning
von: Kim, Hoyeol, et al.
Veröffentlicht: (2026)
von: Kim, Hoyeol, et al.
Veröffentlicht: (2026)
Aligning Language Models to Explicitly Handle Ambiguity
von: Kim, Hyuhng Joon, et al.
Veröffentlicht: (2024)
von: Kim, Hyuhng Joon, et al.
Veröffentlicht: (2024)
TASTE: Text-Aligned Speech Tokenization and Embedding for Spoken Language Modeling
von: Tseng, Liang-Hsuan, et al.
Veröffentlicht: (2025)
von: Tseng, Liang-Hsuan, et al.
Veröffentlicht: (2025)
From Unaligned to Aligned: Scaling Multilingual LLMs with Multi-Way Parallel Corpora
von: Shen, Yingli, et al.
Veröffentlicht: (2025)
von: Shen, Yingli, et al.
Veröffentlicht: (2025)
How Does Alignment Enhance LLMs' Multilingual Capabilities? A Language Neurons Perspective
von: Zhang, Shimao, et al.
Veröffentlicht: (2025)
von: Zhang, Shimao, et al.
Veröffentlicht: (2025)
Less Data Less Tokens: Multilingual Unification Learning for Efficient Test-Time Reasoning in LLMs
von: Chen, Kang, et al.
Veröffentlicht: (2025)
von: Chen, Kang, et al.
Veröffentlicht: (2025)
AlignFreeze: Navigating the Impact of Realignment on the Layers of Multilingual Models Across Diverse Languages
von: Bakos, Steve, et al.
Veröffentlicht: (2025)
von: Bakos, Steve, et al.
Veröffentlicht: (2025)
CORAL: Adaptive Retrieval Loop for Culturally-Aligned Multilingual RAG
von: Lee, Nayeon, et al.
Veröffentlicht: (2026)
von: Lee, Nayeon, et al.
Veröffentlicht: (2026)
Turning English-centric LLMs Into Polyglots: How Much Multilinguality Is Needed?
von: Kew, Tannon, et al.
Veröffentlicht: (2023)
von: Kew, Tannon, et al.
Veröffentlicht: (2023)
Do LLMs Truly Benefit from Longer Context in Automatic Post-Editing?
von: Kim, Ahrii, et al.
Veröffentlicht: (2026)
von: Kim, Ahrii, et al.
Veröffentlicht: (2026)
Pragmatic inference of scalar implicature by LLMs
von: Cho, Ye-eun, et al.
Veröffentlicht: (2024)
von: Cho, Ye-eun, et al.
Veröffentlicht: (2024)
I Am Aligned, But With Whom? MENA Values Benchmark for Evaluating Cultural Alignment and Multilingual Bias in LLMs
von: Zahraei, Pardis Sadat, et al.
Veröffentlicht: (2025)
von: Zahraei, Pardis Sadat, et al.
Veröffentlicht: (2025)
KiC: Keyword-inspired Cascade for Cost-Efficient Text Generation with LLMs
von: Kim, Woo-Chan, et al.
Veröffentlicht: (2025)
von: Kim, Woo-Chan, et al.
Veröffentlicht: (2025)
Pruning Multilingual Large Language Models for Multilingual Inference
von: Kim, Hwichan, et al.
Veröffentlicht: (2024)
von: Kim, Hwichan, et al.
Veröffentlicht: (2024)
A Shared Geometry of Difficulty in Multilingual Language Models
von: Civelli, Stefano, et al.
Veröffentlicht: (2026)
von: Civelli, Stefano, et al.
Veröffentlicht: (2026)
The Token Tax: Systematic Bias in Multilingual Tokenization
von: Lundin, Jessica M., et al.
Veröffentlicht: (2025)
von: Lundin, Jessica M., et al.
Veröffentlicht: (2025)
Language Bias under Conflicting Information in Multilingual LLMs
von: Östling, Robert, et al.
Veröffentlicht: (2026)
von: Östling, Robert, et al.
Veröffentlicht: (2026)
Investigating the Influence of Language on Sycophantic Behavior of Multilingual LLMs
von: Aldahlawi, Bayan Abdullah, et al.
Veröffentlicht: (2026)
von: Aldahlawi, Bayan Abdullah, et al.
Veröffentlicht: (2026)
Refusal Direction is Universal Across Safety-Aligned Languages
von: Wang, Xinpeng, et al.
Veröffentlicht: (2025)
von: Wang, Xinpeng, et al.
Veröffentlicht: (2025)
Registering Source Tokens to Target Language Spaces in Multilingual Neural Machine Translation
von: Qu, Zhi, et al.
Veröffentlicht: (2025)
von: Qu, Zhi, et al.
Veröffentlicht: (2025)
MAGNET: Improving the Multilingual Fairness of Language Models with Adaptive Gradient-Based Tokenization
von: Ahia, Orevaoghene, et al.
Veröffentlicht: (2024)
von: Ahia, Orevaoghene, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Smoothie-Qwen: Post-Hoc Smoothing to Reduce Language Bias in Multilingual LLMs
von: Ji, SeungWon, et al.
Veröffentlicht: (2025) -
How does a Language-Specific Tokenizer affect LLMs?
von: Seo, Jean, et al.
Veröffentlicht: (2025) -
Accelerating Multilingual Language Model for Excessively Tokenized Languages
von: Hong, Jimin, et al.
Veröffentlicht: (2024) -
Controlling Language Confusion in Multilingual LLMs
von: Lee, Nahyun, et al.
Veröffentlicht: (2025) -
AlignX: Advancing Multilingual Large Language Models with Multilingual Representation Alignment
von: Bu, Mengyu, et al.
Veröffentlicht: (2025)