Salvato in:
| Autori principali: | Trinley, Katharina, Nakai, Toshiki, Anikina, Tatiana, Baeumel, Tanja |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2507.20279 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Multilingual Large Language Models and Curse of Multilinguality
di: Gurgurov, Daniil, et al.
Pubblicazione: (2024)
di: Gurgurov, Daniil, et al.
Pubblicazione: (2024)
Language Arithmetics: Towards Systematic Language Neuron Identification and Manipulation
di: Gurgurov, Daniil, et al.
Pubblicazione: (2025)
di: Gurgurov, Daniil, et al.
Pubblicazione: (2025)
TRepLiNa: Layer-wise CKA+REPINA Alignment Improves Low-Resource Machine Translation in Aya-23 8B
di: Nakai, Toshiki, et al.
Pubblicazione: (2025)
di: Nakai, Toshiki, et al.
Pubblicazione: (2025)
Disentangling Mathematical Reasoning in LLMs: A Methodological Investigation of Internal Mechanisms
di: Baeumel, Tanja, et al.
Pubblicazione: (2026)
di: Baeumel, Tanja, et al.
Pubblicazione: (2026)
Multilingual Political Views of Large Language Models: Identification and Steering
di: Gurgurov, Daniil, et al.
Pubblicazione: (2025)
di: Gurgurov, Daniil, et al.
Pubblicazione: (2025)
Generation-Step-Aware Framework for Cross-Modal Representation and Control in Multilingual Speech-Text Models
di: Nakai, Toshiki, et al.
Pubblicazione: (2026)
di: Nakai, Toshiki, et al.
Pubblicazione: (2026)
When Scale Meets Diversity: Evaluating Language Models on Fine-Grained Multilingual Claim Verification
di: Shcharbakova, Hanna, et al.
Pubblicazione: (2025)
di: Shcharbakova, Hanna, et al.
Pubblicazione: (2025)
The Latin Substrate: How Language Models Represent and Mediate Script Choice
di: Gurgurov, Daniil, et al.
Pubblicazione: (2026)
di: Gurgurov, Daniil, et al.
Pubblicazione: (2026)
Aya 23: Open Weight Releases to Further Multilingual Progress
di: Aryabumi, Viraat, et al.
Pubblicazione: (2024)
di: Aryabumi, Viraat, et al.
Pubblicazione: (2024)
Sparse Subnetwork Enhancement for Underrepresented Languages in Large Language Models
di: Gurgurov, Daniil, et al.
Pubblicazione: (2025)
di: Gurgurov, Daniil, et al.
Pubblicazione: (2025)
Large Language Models for Multilingual Previously Fact-Checked Claim Detection
di: Vykopal, Ivan, et al.
Pubblicazione: (2025)
di: Vykopal, Ivan, et al.
Pubblicazione: (2025)
Aya Model: An Instruction Finetuned Open-Access Multilingual Language Model
di: Üstün, Ahmet, et al.
Pubblicazione: (2024)
di: Üstün, Ahmet, et al.
Pubblicazione: (2024)
Tiny Aya: Bridging Scale and Multilingual Depth
di: Salamanca, Alejandro R., et al.
Pubblicazione: (2026)
di: Salamanca, Alejandro R., et al.
Pubblicazione: (2026)
Multilingual Steering by Design: Multilingual Sparse Autoencoders and Principled Layer Selection
di: Ghussin, Yusser Al, et al.
Pubblicazione: (2026)
di: Ghussin, Yusser Al, et al.
Pubblicazione: (2026)
StAyaL | Multilingual Style Transfer
di: Thakrar, Karishma, et al.
Pubblicazione: (2025)
di: Thakrar, Karishma, et al.
Pubblicazione: (2025)
A Rigorous Evaluation of LLM Data Generation Strategies for Low-Resource Languages
di: Anikina, Tatiana, et al.
Pubblicazione: (2025)
di: Anikina, Tatiana, et al.
Pubblicazione: (2025)
Aya Vision: Advancing the Frontier of Multilingual Multimodality
di: Dash, Saurabh, et al.
Pubblicazione: (2025)
di: Dash, Saurabh, et al.
Pubblicazione: (2025)
The Lookahead Limitation: Why Multi-Operand Addition is Hard for LLMs
di: Baeumel, Tanja, et al.
Pubblicazione: (2025)
di: Baeumel, Tanja, et al.
Pubblicazione: (2025)
How Does Quantization Affect Multilingual LLMs?
di: Marchisio, Kelly, et al.
Pubblicazione: (2024)
di: Marchisio, Kelly, et al.
Pubblicazione: (2024)
Modular Arithmetic: Language Models Solve Math Digit by Digit
di: Baeumel, Tanja, et al.
Pubblicazione: (2025)
di: Baeumel, Tanja, et al.
Pubblicazione: (2025)
Aya Dataset: An Open-Access Collection for Multilingual Instruction Tuning
di: Singh, Shivalika, et al.
Pubblicazione: (2024)
di: Singh, Shivalika, et al.
Pubblicazione: (2024)
Aya Expanse: Combining Research Breakthroughs for a New Multilingual Frontier
di: Dang, John, et al.
Pubblicazione: (2024)
di: Dang, John, et al.
Pubblicazione: (2024)
Sparse-Autoencoder-Guided Internal Representation Unlearning for Large Language Models
di: Yamashita, Tomoya, et al.
Pubblicazione: (2025)
di: Yamashita, Tomoya, et al.
Pubblicazione: (2025)
Cross-Refine: Improving Natural Language Explanation Generation by Learning in Tandem
di: Wang, Qianli, et al.
Pubblicazione: (2024)
di: Wang, Qianli, et al.
Pubblicazione: (2024)
Beyond English-Centric LLMs: What Language Do Multilingual Language Models Think in?
di: Zhong, Chengzhi, et al.
Pubblicazione: (2024)
di: Zhong, Chengzhi, et al.
Pubblicazione: (2024)
How Does Code Pretraining Affect Language Model Task Performance?
di: Petty, Jackson, et al.
Pubblicazione: (2024)
di: Petty, Jackson, et al.
Pubblicazione: (2024)
Multilingual Datasets for Custom Input Extraction and Explanation Requests Parsing in Conversational XAI Systems
di: Wang, Qianli, et al.
Pubblicazione: (2025)
di: Wang, Qianli, et al.
Pubblicazione: (2025)
LLMCheckup: Conversational Examination of Large Language Models via Interpretability Tools and Self-Explanations
di: Wang, Qianli, et al.
Pubblicazione: (2024)
di: Wang, Qianli, et al.
Pubblicazione: (2024)
Language Matters: How Do Multilingual Input and Reasoning Paths Affect Large Reasoning Models?
di: Tam, Zhi Rui, et al.
Pubblicazione: (2025)
di: Tam, Zhi Rui, et al.
Pubblicazione: (2025)
CoXQL: A Dataset for Parsing Explanation Requests in Conversational XAI Systems
di: Wang, Qianli, et al.
Pubblicazione: (2024)
di: Wang, Qianli, et al.
Pubblicazione: (2024)
How Does Alignment Enhance LLMs' Multilingual Capabilities? A Language Neurons Perspective
di: Zhang, Shimao, et al.
Pubblicazione: (2025)
di: Zhang, Shimao, et al.
Pubblicazione: (2025)
What Affects the Effective Depth of Large Language Models?
di: Hu, Yi, et al.
Pubblicazione: (2025)
di: Hu, Yi, et al.
Pubblicazione: (2025)
What Causes Knowledge Loss in Multilingual Language Models?
di: Khelli, Maria, et al.
Pubblicazione: (2025)
di: Khelli, Maria, et al.
Pubblicazione: (2025)
From Weights to Activations: Is Steering the Next Frontier of Adaptation?
di: Ostermann, Simon, et al.
Pubblicazione: (2026)
di: Ostermann, Simon, et al.
Pubblicazione: (2026)
What Makes Two Language Models Think Alike?
di: Salle, Jeanne, et al.
Pubblicazione: (2024)
di: Salle, Jeanne, et al.
Pubblicazione: (2024)
Truth as a Trajectory: What Internal Representations Reveal About Large Language Model Reasoning
di: Damirchi, Hamed, et al.
Pubblicazione: (2026)
di: Damirchi, Hamed, et al.
Pubblicazione: (2026)
AlignX: Advancing Multilingual Large Language Models with Multilingual Representation Alignment
di: Bu, Mengyu, et al.
Pubblicazione: (2025)
di: Bu, Mengyu, et al.
Pubblicazione: (2025)
How to Connect Speech Foundation Models and Large Language Models? What Matters and What Does Not
di: Verdini, Francesco, et al.
Pubblicazione: (2024)
di: Verdini, Francesco, et al.
Pubblicazione: (2024)
Tokenization and Representation Biases in Multilingual Models on Dialectal NLP Tasks
di: Kanjirangat, Vani, et al.
Pubblicazione: (2025)
di: Kanjirangat, Vani, et al.
Pubblicazione: (2025)
What Drives Performance in Multilingual Language Models?
di: Nezhad, Sina Bagheri, et al.
Pubblicazione: (2024)
di: Nezhad, Sina Bagheri, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Multilingual Large Language Models and Curse of Multilinguality
di: Gurgurov, Daniil, et al.
Pubblicazione: (2024) -
Language Arithmetics: Towards Systematic Language Neuron Identification and Manipulation
di: Gurgurov, Daniil, et al.
Pubblicazione: (2025) -
TRepLiNa: Layer-wise CKA+REPINA Alignment Improves Low-Resource Machine Translation in Aya-23 8B
di: Nakai, Toshiki, et al.
Pubblicazione: (2025) -
Disentangling Mathematical Reasoning in LLMs: A Methodological Investigation of Internal Mechanisms
di: Baeumel, Tanja, et al.
Pubblicazione: (2026) -
Multilingual Political Views of Large Language Models: Identification and Steering
di: Gurgurov, Daniil, et al.
Pubblicazione: (2025)