What Causes Knowledge Loss in Multilingual Language Models?
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Khelli, Maria, Cahyawijaya, Samuel, Purwarianti, Ayu, Winata, Genta Indra |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Towards Efficient and Robust VQA-NLE Data Generation with Large Vision-Language Models
par: Irawan, Patrick Amadeus, et autres
Publié: (2024)
par: Irawan, Patrick Amadeus, et autres
Publié: (2024)
LinguAlchemy: Fusing Typological and Geographical Elements for Unseen Language Generalization
par: Adilazuarda, Muhammad Farid, et autres
Publié: (2024)
par: Adilazuarda, Muhammad Farid, et autres
Publié: (2024)
Momento: Evaluating Persistent Memory and Reasoning with Multi-Session Agentic Conversations
par: Merin, Adril Putra, et autres
Publié: (2026)
par: Merin, Adril Putra, et autres
Publié: (2026)
IndoPref: A Multi-Domain Pairwise Preference Dataset for Indonesian
par: Wiyono, Vanessa Rebecca, et autres
Publié: (2025)
par: Wiyono, Vanessa Rebecca, et autres
Publié: (2025)
MINERS: Multilingual Language Models as Semantic Retrievers
par: Winata, Genta Indra, et autres
Publié: (2024)
par: Winata, Genta Indra, et autres
Publié: (2024)
Language Surgery in Multilingual Large Language Models
par: Lopo, Joanito Agili, et autres
Publié: (2025)
par: Lopo, Joanito Agili, et autres
Publié: (2025)
ProxyLM: Predicting Language Model Performance on Multilingual Tasks via Proxy Models
par: Anugraha, David, et autres
Publié: (2024)
par: Anugraha, David, et autres
Publié: (2024)
Enhancing Natural Language Inference Performance with Knowledge Graph for COVID-19 Automated Fact-Checking in Indonesian Language
par: Muharram, Arief Purnama, et autres
Publié: (2024)
par: Muharram, Arief Purnama, et autres
Publié: (2024)
Cendol: Open Instruction-tuned Generative Large Language Models for Indonesian Languages
par: Cahyawijaya, Samuel, et autres
Publié: (2024)
par: Cahyawijaya, Samuel, et autres
Publié: (2024)
Entropy2Vec: Crosslingual Language Modeling Entropy as End-to-End Learnable Language Representations
par: Irawan, Patrick Amadeus, et autres
Publié: (2025)
par: Irawan, Patrick Amadeus, et autres
Publié: (2025)
Linguistics Theory Meets LLM: Code-Switched Text Generation via Equivalence Constrained Large Language Models
par: Kuwanto, Garry, et autres
Publié: (2024)
par: Kuwanto, Garry, et autres
Publié: (2024)
TextGames: Learning to Self-Play Text-Based Puzzle Games via Language Model Reasoning
par: Hudi, Frederikus, et autres
Publié: (2025)
par: Hudi, Frederikus, et autres
Publié: (2025)
PingPong: A Natural Benchmark for Multi-Turn Code-Switching Dialogues
par: Farhansyah, Mohammad Rifqi, et autres
Publié: (2026)
par: Farhansyah, Mohammad Rifqi, et autres
Publié: (2026)
Could We Have Had Better Multilingual LLMs If English Was Not the Central Language?
par: Diandaru, Ryandito, et autres
Publié: (2024)
par: Diandaru, Ryandito, et autres
Publié: (2024)
LLM for Everyone: Representing the Underrepresented in Large Language Models
par: Cahyawijaya, Samuel
Publié: (2024)
par: Cahyawijaya, Samuel
Publié: (2024)
M4-RAG: A Massive-Scale Multilingual Multi-Cultural Multimodal RAG
par: Anugraha, David, et autres
Publié: (2025)
par: Anugraha, David, et autres
Publié: (2025)
Macaron: Controlled, Human-Written Benchmark for Multilingual and Multicultural Reasoning via Template-Filling
par: Elsetohy, Alaa, et autres
Publié: (2026)
par: Elsetohy, Alaa, et autres
Publié: (2026)
mR3: Multilingual Rubric-Agnostic Reward Reasoning Models
par: Anugraha, David, et autres
Publié: (2025)
par: Anugraha, David, et autres
Publié: (2025)
Do Language Models Understand Honorific Systems in Javanese?
par: Farhansyah, Mohammad Rifqi, et autres
Publié: (2025)
par: Farhansyah, Mohammad Rifqi, et autres
Publié: (2025)
Enhancing Indonesian Automatic Speech Recognition: Evaluating Multilingual Models with Diverse Speech Variabilities
par: Adila, Aulia, et autres
Publié: (2024)
par: Adila, Aulia, et autres
Publié: (2024)
Vision Language Models are Confused Tourists
par: Irawan, Patrick Amadeus, et autres
Publié: (2025)
par: Irawan, Patrick Amadeus, et autres
Publié: (2025)
MetaMetrics-MT: Tuning Meta-Metrics for Machine Translation via Human Preference Calibration
par: Anugraha, David, et autres
Publié: (2024)
par: Anugraha, David, et autres
Publié: (2024)
SEADialogues: A Multilingual Culturally Grounded Multi-turn Dialogue Dataset on Southeast Asian Languages
par: Kautsar, Muhammad Dehan Al, et autres
Publié: (2025)
par: Kautsar, Muhammad Dehan Al, et autres
Publié: (2025)
MetaMetrics: Calibrating Metrics For Generation Tasks Using Human Preferences
par: Winata, Genta Indra, et autres
Publié: (2024)
par: Winata, Genta Indra, et autres
Publié: (2024)
High-Dimensional Interlingual Representations of Large Language Models
par: Wilie, Bryan, et autres
Publié: (2025)
par: Wilie, Bryan, et autres
Publié: (2025)
Behind Maya: Building a Multilingual Vision Language Model
par: Alam, Nahid, et autres
Publié: (2025)
par: Alam, Nahid, et autres
Publié: (2025)
LLMs Are Few-Shot In-Context Low-Resource Language Learners
par: Cahyawijaya, Samuel, et autres
Publié: (2024)
par: Cahyawijaya, Samuel, et autres
Publié: (2024)
Preference Tuning with Human Feedback on Language, Speech, and Vision Tasks: A Survey
par: Winata, Genta Indra, et autres
Publié: (2024)
par: Winata, Genta Indra, et autres
Publié: (2024)
Belief Revision: The Adaptability of Large Language Models Reasoning
par: Wilie, Bryan, et autres
Publié: (2024)
par: Wilie, Bryan, et autres
Publié: (2024)
Leveraging Parameter Space Symmetries for Reasoning Skill Transfer in LLMs
par: Horoi, Stefan, et autres
Publié: (2025)
par: Horoi, Stefan, et autres
Publié: (2025)
QLESS: A Quantized Approach for Data Valuation and Selection in Large Language Model Fine-Tuning
par: Ananta, Moses, et autres
Publié: (2025)
par: Ananta, Moses, et autres
Publié: (2025)
SEACrowd: A Multilingual Multimodal Data Hub and Benchmark Suite for Southeast Asian Languages
par: Lovenia, Holy, et autres
Publié: (2024)
par: Lovenia, Holy, et autres
Publié: (2024)
Beyond Transfer Accuracy: Faithful Circuits for Controlled Low-Resource Adaptation
par: Nur'aini, Khumaisa, et autres
Publié: (2026)
par: Nur'aini, Khumaisa, et autres
Publié: (2026)
Thank You, Stingray: Multilingual Large Language Models Can Not (Yet) Disambiguate Cross-Lingual Word Sense
par: Cahyawijaya, Samuel, et autres
Publié: (2024)
par: Cahyawijaya, Samuel, et autres
Publié: (2024)
Linguistic Minimal Pairs Elicit Linguistic Similarity in Large Language Models
par: Zhou, Xinyu, et autres
Publié: (2024)
par: Zhou, Xinyu, et autres
Publié: (2024)
Maya: An Instruction Finetuned Multilingual Multimodal Model
par: Alam, Nahid, et autres
Publié: (2024)
par: Alam, Nahid, et autres
Publié: (2024)
R3: Robust Rubric-Agnostic Reward Models
par: Anugraha, David, et autres
Publié: (2025)
par: Anugraha, David, et autres
Publié: (2025)
DriveThru: a Document Extraction Platform and Benchmark Datasets for Indonesian Local Language Archives
par: Farhansyah, Mohammad Rifqi, et autres
Publié: (2024)
par: Farhansyah, Mohammad Rifqi, et autres
Publié: (2024)
Negative Object Presence Evaluation (NOPE) to Measure Object Hallucination in Vision-Language Models
par: Lovenia, Holy, et autres
Publié: (2023)
par: Lovenia, Holy, et autres
Publié: (2023)
T1: A Tool-Oriented Conversational Dataset for Multi-Turn Agentic Planning
par: Chakraborty, Amartya, et autres
Publié: (2025)
par: Chakraborty, Amartya, et autres
Publié: (2025)
Documents similaires
-
Towards Efficient and Robust VQA-NLE Data Generation with Large Vision-Language Models
par: Irawan, Patrick Amadeus, et autres
Publié: (2024) -
LinguAlchemy: Fusing Typological and Geographical Elements for Unseen Language Generalization
par: Adilazuarda, Muhammad Farid, et autres
Publié: (2024) -
Momento: Evaluating Persistent Memory and Reasoning with Multi-Session Agentic Conversations
par: Merin, Adril Putra, et autres
Publié: (2026) -
IndoPref: A Multi-Domain Pairwise Preference Dataset for Indonesian
par: Wiyono, Vanessa Rebecca, et autres
Publié: (2025) -
MINERS: Multilingual Language Models as Semantic Retrievers
par: Winata, Genta Indra, et autres
Publié: (2024)