Cendol: Open Instruction-tuned Generative Large Language Models for Indonesian Languages
Fuente:
arXiv
Salvato in:
| Autori principali: | Cahyawijaya, Samuel, Lovenia, Holy, Koto, Fajri, Putri, Rifki Afina, Dave, Emmanuel, Lee, Jhonson, Shadieq, Nuur, Cenggoro, Wawan, Akbar, Salsabil Maulana, Mahendra, Muhammad Ihza, Putri, Dea Annisayanti, Wilie, Bryan, Winata, Genta Indra, Aji, Alham Fikri, Purwarianti, Ayu, Fung, Pascale |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Adapting Language Models to Indonesian Local Languages: An Empirical Study of Language Transferability on Zero-Shot Settings
di: Putri, Rifki Afina
Pubblicazione: (2025)
di: Putri, Rifki Afina
Pubblicazione: (2025)
LinguAlchemy: Fusing Typological and Geographical Elements for Unseen Language Generalization
di: Adilazuarda, Muhammad Farid, et al.
Pubblicazione: (2024)
di: Adilazuarda, Muhammad Farid, et al.
Pubblicazione: (2024)
What Causes Knowledge Loss in Multilingual Language Models?
di: Khelli, Maria, et al.
Pubblicazione: (2025)
di: Khelli, Maria, et al.
Pubblicazione: (2025)
Entropy2Vec: Crosslingual Language Modeling Entropy as End-to-End Learnable Language Representations
di: Irawan, Patrick Amadeus, et al.
Pubblicazione: (2025)
di: Irawan, Patrick Amadeus, et al.
Pubblicazione: (2025)
LLMs Are Few-Shot In-Context Low-Resource Language Learners
di: Cahyawijaya, Samuel, et al.
Pubblicazione: (2024)
di: Cahyawijaya, Samuel, et al.
Pubblicazione: (2024)
Towards Efficient and Robust VQA-NLE Data Generation with Large Vision-Language Models
di: Irawan, Patrick Amadeus, et al.
Pubblicazione: (2024)
di: Irawan, Patrick Amadeus, et al.
Pubblicazione: (2024)
Vision Language Models are Confused Tourists
di: Irawan, Patrick Amadeus, et al.
Pubblicazione: (2025)
di: Irawan, Patrick Amadeus, et al.
Pubblicazione: (2025)
Language Surgery in Multilingual Large Language Models
di: Lopo, Joanito Agili, et al.
Pubblicazione: (2025)
di: Lopo, Joanito Agili, et al.
Pubblicazione: (2025)
Thank You, Stingray: Multilingual Large Language Models Can Not (Yet) Disambiguate Cross-Lingual Word Sense
di: Cahyawijaya, Samuel, et al.
Pubblicazione: (2024)
di: Cahyawijaya, Samuel, et al.
Pubblicazione: (2024)
Macaron: Controlled, Human-Written Benchmark for Multilingual and Multicultural Reasoning via Template-Filling
di: Elsetohy, Alaa, et al.
Pubblicazione: (2026)
di: Elsetohy, Alaa, et al.
Pubblicazione: (2026)
TextGames: Learning to Self-Play Text-Based Puzzle Games via Language Model Reasoning
di: Hudi, Frederikus, et al.
Pubblicazione: (2025)
di: Hudi, Frederikus, et al.
Pubblicazione: (2025)
Negative Object Presence Evaluation (NOPE) to Measure Object Hallucination in Vision-Language Models
di: Lovenia, Holy, et al.
Pubblicazione: (2023)
di: Lovenia, Holy, et al.
Pubblicazione: (2023)
Can LLM Generate Culturally Relevant Commonsense QA Data? Case Study in Indonesian and Sundanese
di: Putri, Rifki Afina, et al.
Pubblicazione: (2024)
di: Putri, Rifki Afina, et al.
Pubblicazione: (2024)
SEADialogues: A Multilingual Culturally Grounded Multi-turn Dialogue Dataset on Southeast Asian Languages
di: Kautsar, Muhammad Dehan Al, et al.
Pubblicazione: (2025)
di: Kautsar, Muhammad Dehan Al, et al.
Pubblicazione: (2025)
Do Language Models Understand Honorific Systems in Javanese?
di: Farhansyah, Mohammad Rifqi, et al.
Pubblicazione: (2025)
di: Farhansyah, Mohammad Rifqi, et al.
Pubblicazione: (2025)
High-Dimensional Interlingual Representations of Large Language Models
di: Wilie, Bryan, et al.
Pubblicazione: (2025)
di: Wilie, Bryan, et al.
Pubblicazione: (2025)
Cracking the Code: Multi-domain LLM Evaluation on Real-World Professional Exams in Indonesia
di: Koto, Fajri
Pubblicazione: (2024)
di: Koto, Fajri
Pubblicazione: (2024)
Quality Assurance of Total Carotenoids and Quercetin in Marigold Flowers ( Tagetes erecta L.) as Edible Flowers
di: Kusumiyati Kusumiyati, et al.
Pubblicazione: (2025)
di: Kusumiyati Kusumiyati, et al.
Pubblicazione: (2025)
IndoPref: A Multi-Domain Pairwise Preference Dataset for Indonesian
di: Wiyono, Vanessa Rebecca, et al.
Pubblicazione: (2025)
di: Wiyono, Vanessa Rebecca, et al.
Pubblicazione: (2025)
Momento: Evaluating Persistent Memory and Reasoning with Multi-Session Agentic Conversations
di: Merin, Adril Putra, et al.
Pubblicazione: (2026)
di: Merin, Adril Putra, et al.
Pubblicazione: (2026)
Belief Revision: The Adaptability of Large Language Models Reasoning
di: Wilie, Bryan, et al.
Pubblicazione: (2024)
di: Wilie, Bryan, et al.
Pubblicazione: (2024)
Beyond Transfer Accuracy: Faithful Circuits for Controlled Low-Resource Adaptation
di: Nur'aini, Khumaisa, et al.
Pubblicazione: (2026)
di: Nur'aini, Khumaisa, et al.
Pubblicazione: (2026)
QLESS: A Quantized Approach for Data Valuation and Selection in Large Language Model Fine-Tuning
di: Ananta, Moses, et al.
Pubblicazione: (2025)
di: Ananta, Moses, et al.
Pubblicazione: (2025)
PingPong: A Natural Benchmark for Multi-Turn Code-Switching Dialogues
di: Farhansyah, Mohammad Rifqi, et al.
Pubblicazione: (2026)
di: Farhansyah, Mohammad Rifqi, et al.
Pubblicazione: (2026)
BEnQA: A Question Answering and Reasoning Benchmark for Bengali and English
di: Shafayat, Sheikh, et al.
Pubblicazione: (2024)
di: Shafayat, Sheikh, et al.
Pubblicazione: (2024)
JuICE: A Benchmark for Evaluating LLM-Judge in Identifying Cultural Errors
di: Jin, Jiho, et al.
Pubblicazione: (2026)
di: Jin, Jiho, et al.
Pubblicazione: (2026)
LoraxBench: A Multitask, Multilingual Benchmark Suite for 20 Indonesian Languages
di: Aji, Alham Fikri, et al.
Pubblicazione: (2025)
di: Aji, Alham Fikri, et al.
Pubblicazione: (2025)
MLKV: Multi-Layer Key-Value Heads for Memory Efficient Transformer Decoding
di: Zuhri, Zayd Muhammad Kawakibi, et al.
Pubblicazione: (2024)
di: Zuhri, Zayd Muhammad Kawakibi, et al.
Pubblicazione: (2024)
MINERS: Multilingual Language Models as Semantic Retrievers
di: Winata, Genta Indra, et al.
Pubblicazione: (2024)
di: Winata, Genta Indra, et al.
Pubblicazione: (2024)
Beyond Probabilities: Unveiling the Misalignment in Evaluating Large Language Models
di: Lyu, Chenyang, et al.
Pubblicazione: (2024)
di: Lyu, Chenyang, et al.
Pubblicazione: (2024)
Balanced Multi-Factor In-Context Learning for Multilingual Large Language Models
di: Kaneko, Masahiro, et al.
Pubblicazione: (2025)
di: Kaneko, Masahiro, et al.
Pubblicazione: (2025)
Culturally-Nuanced Story Generation for Reasoning in Low-Resource Languages: The Case of Javanese and Sundanese
di: Pranida, Salsabila Zahirah, et al.
Pubblicazione: (2025)
di: Pranida, Salsabila Zahirah, et al.
Pubblicazione: (2025)
Extracting General-use Transformers for Low-resource Languages via Knowledge Distillation
di: Cruz, Jan Christian Blaise, et al.
Pubblicazione: (2025)
di: Cruz, Jan Christian Blaise, et al.
Pubblicazione: (2025)
AMIR-GRPO: Inducing Implicit Preference Signals into GRPO
di: Yari, Amir Hossein, et al.
Pubblicazione: (2026)
di: Yari, Amir Hossein, et al.
Pubblicazione: (2026)
Unveiling Cultural Blind Spots: Analyzing the Limitations of mLLMs in Procedural Text Comprehension
di: Yari, Amir Hossein, et al.
Pubblicazione: (2025)
di: Yari, Amir Hossein, et al.
Pubblicazione: (2025)
Language-Specific Latent Process Hinders Cross-Lingual Performance
di: Lim, Zheng Wei, et al.
Pubblicazione: (2025)
di: Lim, Zheng Wei, et al.
Pubblicazione: (2025)
Exploring Language-Agnosticity in Function Vectors: A Case Study in Machine Translation
di: Laiyk, Nurkhan, et al.
Pubblicazione: (2026)
di: Laiyk, Nurkhan, et al.
Pubblicazione: (2026)
High-Dimension Human Value Representation in Large Language Models
di: Cahyawijaya, Samuel, et al.
Pubblicazione: (2024)
di: Cahyawijaya, Samuel, et al.
Pubblicazione: (2024)
KazMMLU: Evaluating Language Models on Kazakh, Russian, and Regional Knowledge of Kazakhstan
di: Togmanov, Mukhammed, et al.
Pubblicazione: (2025)
di: Togmanov, Mukhammed, et al.
Pubblicazione: (2025)
Parallel Tokenizers: Rethinking Vocabulary Design for Cross-Lingual Transfer
di: Kautsar, Muhammad Dehan Al, et al.
Pubblicazione: (2025)
di: Kautsar, Muhammad Dehan Al, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Adapting Language Models to Indonesian Local Languages: An Empirical Study of Language Transferability on Zero-Shot Settings
di: Putri, Rifki Afina
Pubblicazione: (2025) -
LinguAlchemy: Fusing Typological and Geographical Elements for Unseen Language Generalization
di: Adilazuarda, Muhammad Farid, et al.
Pubblicazione: (2024) -
What Causes Knowledge Loss in Multilingual Language Models?
di: Khelli, Maria, et al.
Pubblicazione: (2025) -
Entropy2Vec: Crosslingual Language Modeling Entropy as End-to-End Learnable Language Representations
di: Irawan, Patrick Amadeus, et al.
Pubblicazione: (2025) -
LLMs Are Few-Shot In-Context Low-Resource Language Learners
di: Cahyawijaya, Samuel, et al.
Pubblicazione: (2024)