Language Arithmetics: Towards Systematic Language Neuron Identification and Manipulation
Fuente:
arXiv
Salvato in:
| Autori principali: | Gurgurov, Daniil, Trinley, Katharina, Ghussin, Yusser Al, Baeumel, Tanja, van Genabith, Josef, Ostermann, Simon |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Modular Arithmetic: Language Models Solve Math Digit by Digit
di: Baeumel, Tanja, et al.
Pubblicazione: (2025)
di: Baeumel, Tanja, et al.
Pubblicazione: (2025)
Multilingual Steering by Design: Multilingual Sparse Autoencoders and Principled Layer Selection
di: Ghussin, Yusser Al, et al.
Pubblicazione: (2026)
di: Ghussin, Yusser Al, et al.
Pubblicazione: (2026)
Sparse Subnetwork Enhancement for Underrepresented Languages in Large Language Models
di: Gurgurov, Daniil, et al.
Pubblicazione: (2025)
di: Gurgurov, Daniil, et al.
Pubblicazione: (2025)
The Latin Substrate: How Language Models Represent and Mediate Script Choice
di: Gurgurov, Daniil, et al.
Pubblicazione: (2026)
di: Gurgurov, Daniil, et al.
Pubblicazione: (2026)
CLaS-Bench: A Cross-Lingual Alignment and Steering Benchmark
di: Gurgurov, Daniil, et al.
Pubblicazione: (2026)
di: Gurgurov, Daniil, et al.
Pubblicazione: (2026)
Multilingual Political Views of Large Language Models: Identification and Steering
di: Gurgurov, Daniil, et al.
Pubblicazione: (2025)
di: Gurgurov, Daniil, et al.
Pubblicazione: (2025)
DFKI-MLT at SemEval-2026 TASK 7: Steering Multilingual Models Towards Cultural Knowledge
di: Ghussin, Yusser Al, et al.
Pubblicazione: (2026)
di: Ghussin, Yusser Al, et al.
Pubblicazione: (2026)
On Multilingual Encoder Language Model Compression for Low-Resource Languages
di: Gurgurov, Daniil, et al.
Pubblicazione: (2025)
di: Gurgurov, Daniil, et al.
Pubblicazione: (2025)
The Lookahead Limitation: Why Multi-Operand Addition is Hard for LLMs
di: Baeumel, Tanja, et al.
Pubblicazione: (2025)
di: Baeumel, Tanja, et al.
Pubblicazione: (2025)
Disentangling Mathematical Reasoning in LLMs: A Methodological Investigation of Internal Mechanisms
di: Baeumel, Tanja, et al.
Pubblicazione: (2026)
di: Baeumel, Tanja, et al.
Pubblicazione: (2026)
Small Models, Big Impact: Efficient Corpus and Graph-Based Adaptation of Small Multilingual Language Models for Low-Resource Languages
di: Gurgurov, Daniil, et al.
Pubblicazione: (2025)
di: Gurgurov, Daniil, et al.
Pubblicazione: (2025)
What Language(s) Does Aya-23 Think In? How Multilinguality Affects Internal Language Representations
di: Trinley, Katharina, et al.
Pubblicazione: (2025)
di: Trinley, Katharina, et al.
Pubblicazione: (2025)
ReasonXL: Shifting LLM Reasoning Language Without Sacrificing Performance
di: Gurgurov, Daniil, et al.
Pubblicazione: (2026)
di: Gurgurov, Daniil, et al.
Pubblicazione: (2026)
GrEmLIn: A Repository of Green Baseline Embeddings for 87 Low-Resource Languages Injected with Multilingual Graph Knowledge
di: Gurgurov, Daniil, et al.
Pubblicazione: (2024)
di: Gurgurov, Daniil, et al.
Pubblicazione: (2024)
Adapting Multilingual LLMs to Low-Resource Languages with Knowledge Graphs via Adapters
di: Gurgurov, Daniil, et al.
Pubblicazione: (2024)
di: Gurgurov, Daniil, et al.
Pubblicazione: (2024)
Probing Context Localization of Polysemous Words in Pre-trained Language Model Sub-Layers
di: Vijayakumar, Soniya, et al.
Pubblicazione: (2024)
di: Vijayakumar, Soniya, et al.
Pubblicazione: (2024)
From Weights to Activations: Is Steering the Next Frontier of Adaptation?
di: Ostermann, Simon, et al.
Pubblicazione: (2026)
di: Ostermann, Simon, et al.
Pubblicazione: (2026)
Multilingual Large Language Models and Curse of Multilinguality
di: Gurgurov, Daniil, et al.
Pubblicazione: (2024)
di: Gurgurov, Daniil, et al.
Pubblicazione: (2024)
Why Does Reinforcement Learning Generalize? A Feature-Level Mechanistic Study of Post-Training in Large Language Models
di: Shi, Dan, et al.
Pubblicazione: (2026)
di: Shi, Dan, et al.
Pubblicazione: (2026)
AutoPsyC: Automatic Recognition of Psychodynamic Conflicts from Semi-structured Interviews with Large Language Models
di: Hossain, Sayed Muddashir, et al.
Pubblicazione: (2025)
di: Hossain, Sayed Muddashir, et al.
Pubblicazione: (2025)
Sign Language Translation with Sentence Embedding Supervision
di: Hamidullah, Yasser, et al.
Pubblicazione: (2025)
di: Hamidullah, Yasser, et al.
Pubblicazione: (2025)
Image-to-LaTeX Converter for Mathematical Formulas and Text
di: Gurgurov, Daniil, et al.
Pubblicazione: (2024)
di: Gurgurov, Daniil, et al.
Pubblicazione: (2024)
Spatio-temporal Sign Language Representation and Translation
di: Hamidullah, Yasser, et al.
Pubblicazione: (2025)
di: Hamidullah, Yasser, et al.
Pubblicazione: (2025)
Seeing, Signing, and Saying: A Vision-Language Model-Assisted Pipeline for Sign Language Data Acquisition and Curation from Social Media
di: Yazdani, Shakib, et al.
Pubblicazione: (2025)
di: Yazdani, Shakib, et al.
Pubblicazione: (2025)
When Scale Meets Diversity: Evaluating Language Models on Fine-Grained Multilingual Claim Verification
di: Shcharbakova, Hanna, et al.
Pubblicazione: (2025)
di: Shcharbakova, Hanna, et al.
Pubblicazione: (2025)
SONAR-SLT: Multilingual Sign Language Translation via Language-Agnostic Sentence Embedding Supervision
di: Hamidullah, Yasser, et al.
Pubblicazione: (2025)
di: Hamidullah, Yasser, et al.
Pubblicazione: (2025)
A Critical Study of Automatic Evaluation in Sign Language Translation
di: Yazdani, Shakib, et al.
Pubblicazione: (2025)
di: Yazdani, Shakib, et al.
Pubblicazione: (2025)
Reverse Probing: Evaluating Knowledge Transfer via Finetuned Task Embeddings for Coreference Resolution
di: Anikina, Tatiana, et al.
Pubblicazione: (2025)
di: Anikina, Tatiana, et al.
Pubblicazione: (2025)
When your Cousin has the Right Connections: Unsupervised Bilingual Lexicon Induction for Related Data-Imbalanced Languages
di: Bafna, Niyati, et al.
Pubblicazione: (2023)
di: Bafna, Niyati, et al.
Pubblicazione: (2023)
Soft Language Prompts for Language Transfer
di: Vykopal, Ivan, et al.
Pubblicazione: (2024)
di: Vykopal, Ivan, et al.
Pubblicazione: (2024)
When Flores Bloomz Wrong: Cross-Direction Contamination in Machine Translation Evaluation
di: Tan, David, et al.
Pubblicazione: (2026)
di: Tan, David, et al.
Pubblicazione: (2026)
Measuring Spurious Correlation in Classification: 'Clever Hans' in Translationese
di: Borah, Angana, et al.
Pubblicazione: (2023)
di: Borah, Angana, et al.
Pubblicazione: (2023)
LLMCheckup: Conversational Examination of Large Language Models via Interpretability Tools and Self-Explanations
di: Wang, Qianli, et al.
Pubblicazione: (2024)
di: Wang, Qianli, et al.
Pubblicazione: (2024)
The AI Language Proficiency Monitor -- Tracking the Progress of LLMs on Multilingual Benchmarks
di: Pomerenke, David, et al.
Pubblicazione: (2025)
di: Pomerenke, David, et al.
Pubblicazione: (2025)
Interpreting Arithmetic Mechanism in Large Language Models through Comparative Neuron Analysis
di: Yu, Zeping, et al.
Pubblicazione: (2024)
di: Yu, Zeping, et al.
Pubblicazione: (2024)
Rewiring the Transformer with Depth-Wise LSTMs
di: Xu, Hongfei, et al.
Pubblicazione: (2020)
di: Xu, Hongfei, et al.
Pubblicazione: (2020)
Cross-Prompt Encoder for Low-Performing Languages
di: Mikaberidze, Beso, et al.
Pubblicazione: (2025)
di: Mikaberidze, Beso, et al.
Pubblicazione: (2025)
Generative Large Language Models in Automated Fact-Checking: A Survey
di: Vykopal, Ivan, et al.
Pubblicazione: (2024)
di: Vykopal, Ivan, et al.
Pubblicazione: (2024)
A Rigorous Evaluation of LLM Data Generation Strategies for Low-Resource Languages
di: Anikina, Tatiana, et al.
Pubblicazione: (2025)
di: Anikina, Tatiana, et al.
Pubblicazione: (2025)
PETra: A Multilingual Corpus of Pragmatic Explicitation in Translation
di: Osmelak, Doreen, et al.
Pubblicazione: (2025)
di: Osmelak, Doreen, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Modular Arithmetic: Language Models Solve Math Digit by Digit
di: Baeumel, Tanja, et al.
Pubblicazione: (2025) -
Multilingual Steering by Design: Multilingual Sparse Autoencoders and Principled Layer Selection
di: Ghussin, Yusser Al, et al.
Pubblicazione: (2026) -
Sparse Subnetwork Enhancement for Underrepresented Languages in Large Language Models
di: Gurgurov, Daniil, et al.
Pubblicazione: (2025) -
The Latin Substrate: How Language Models Represent and Mediate Script Choice
di: Gurgurov, Daniil, et al.
Pubblicazione: (2026) -
CLaS-Bench: A Cross-Lingual Alignment and Steering Benchmark
di: Gurgurov, Daniil, et al.
Pubblicazione: (2026)