SEADialogues: A Multilingual Culturally Grounded Multi-turn Dialogue Dataset on Southeast Asian Languages
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Kautsar, Muhammad Dehan Al, Candra, Aswin, Hakim, Muhammad Alif Al, Kahfi, Maxalmina Satria, Koto, Fajri, Aji, Alham Fikri, Limkonchotiwat, Peerat, Chuangsuwanich, Ekapol, Winata, Genta Indra |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Vision Language Models are Confused Tourists
von: Irawan, Patrick Amadeus, et al.
Veröffentlicht: (2025)
von: Irawan, Patrick Amadeus, et al.
Veröffentlicht: (2025)
Parallel Tokenizers: Rethinking Vocabulary Design for Cross-Lingual Transfer
von: Kautsar, Muhammad Dehan Al, et al.
Veröffentlicht: (2025)
von: Kautsar, Muhammad Dehan Al, et al.
Veröffentlicht: (2025)
Language Surgery in Multilingual Large Language Models
von: Lopo, Joanito Agili, et al.
Veröffentlicht: (2025)
von: Lopo, Joanito Agili, et al.
Veröffentlicht: (2025)
Macaron: Controlled, Human-Written Benchmark for Multilingual and Multicultural Reasoning via Template-Filling
von: Elsetohy, Alaa, et al.
Veröffentlicht: (2026)
von: Elsetohy, Alaa, et al.
Veröffentlicht: (2026)
What Do Indonesians Really Need from Language Technology? A Nationwide Survey
von: Kautsar, Muhammad Dehan Al, et al.
Veröffentlicht: (2025)
von: Kautsar, Muhammad Dehan Al, et al.
Veröffentlicht: (2025)
Grounding AI-in-Education Development in Teachers' Voices: Findings from a National Survey in Indonesia
von: Aisyah, Nurul, et al.
Veröffentlicht: (2026)
von: Aisyah, Nurul, et al.
Veröffentlicht: (2026)
TextGames: Learning to Self-Play Text-Based Puzzle Games via Language Model Reasoning
von: Hudi, Frederikus, et al.
Veröffentlicht: (2025)
von: Hudi, Frederikus, et al.
Veröffentlicht: (2025)
LinguAlchemy: Fusing Typological and Geographical Elements for Unseen Language Generalization
von: Adilazuarda, Muhammad Farid, et al.
Veröffentlicht: (2024)
von: Adilazuarda, Muhammad Farid, et al.
Veröffentlicht: (2024)
IndoSafety: Culturally Grounded Safety for LLMs in Indonesian Languages
von: Azmi, Muhammad Falensi, et al.
Veröffentlicht: (2025)
von: Azmi, Muhammad Falensi, et al.
Veröffentlicht: (2025)
Space Decomposition for Sentence Embedding
von: Ponwitayarat, Wuttikorn, et al.
Veröffentlicht: (2024)
von: Ponwitayarat, Wuttikorn, et al.
Veröffentlicht: (2024)
Preserving Fairness and Safety in Quantized LLMs Through Critical Weight Protection
von: Hakim, Muhammad Alif Al, et al.
Veröffentlicht: (2026)
von: Hakim, Muhammad Alif Al, et al.
Veröffentlicht: (2026)
Simulating Training Data Leakage in Multiple-Choice Benchmarks for LLM Evaluation
von: Hidayat, Naila Shafirni, et al.
Veröffentlicht: (2025)
von: Hidayat, Naila Shafirni, et al.
Veröffentlicht: (2025)
Evaluating Vision-Language and Large Language Models for Automated Student Assessment in Indonesian Classrooms
von: Aisyah, Nurul, et al.
Veröffentlicht: (2025)
von: Aisyah, Nurul, et al.
Veröffentlicht: (2025)
Entropy2Vec: Crosslingual Language Modeling Entropy as End-to-End Learnable Language Representations
von: Irawan, Patrick Amadeus, et al.
Veröffentlicht: (2025)
von: Irawan, Patrick Amadeus, et al.
Veröffentlicht: (2025)
SEA-SafeguardBench: Evaluating AI Safety in SEA Languages and Cultures
von: Tasawong, Panuthep, et al.
Veröffentlicht: (2025)
von: Tasawong, Panuthep, et al.
Veröffentlicht: (2025)
SEA-Guard: Culturally Grounded Multilingual Safeguard for Southeast Asia
von: Tasawong, Panuthep, et al.
Veröffentlicht: (2026)
von: Tasawong, Panuthep, et al.
Veröffentlicht: (2026)
Decom-Renorm-Merge: Model Merging on the Right Space Improves Multitasking
von: Chaichana, Yuatyong, et al.
Veröffentlicht: (2025)
von: Chaichana, Yuatyong, et al.
Veröffentlicht: (2025)
Do Language Models Understand Honorific Systems in Javanese?
von: Farhansyah, Mohammad Rifqi, et al.
Veröffentlicht: (2025)
von: Farhansyah, Mohammad Rifqi, et al.
Veröffentlicht: (2025)
Role-Aware Language Models for Secure and Contextualized Access Control in Organizations
von: Almheiri, Saeed, et al.
Veröffentlicht: (2025)
von: Almheiri, Saeed, et al.
Veröffentlicht: (2025)
Mangosteen: An Open Thai Corpus for Language Model Pretraining
von: Phatthiyaphaibun, Wannaphong, et al.
Veröffentlicht: (2025)
von: Phatthiyaphaibun, Wannaphong, et al.
Veröffentlicht: (2025)
PingPong: A Natural Benchmark for Multi-Turn Code-Switching Dialogues
von: Farhansyah, Mohammad Rifqi, et al.
Veröffentlicht: (2026)
von: Farhansyah, Mohammad Rifqi, et al.
Veröffentlicht: (2026)
WangchanThaiInstruct: An instruction-following Dataset for Culture-Aware, Multitask, and Multi-domain Evaluation in Thai
von: Limkonchotiwat, Peerat, et al.
Veröffentlicht: (2025)
von: Limkonchotiwat, Peerat, et al.
Veröffentlicht: (2025)
LoraxBench: A Multitask, Multilingual Benchmark Suite for 20 Indonesian Languages
von: Aji, Alham Fikri, et al.
Veröffentlicht: (2025)
von: Aji, Alham Fikri, et al.
Veröffentlicht: (2025)
Improving Low-Resource Machine Translation via Round-Trip Reinforcement Learning
von: Attia, Ahmed, et al.
Veröffentlicht: (2026)
von: Attia, Ahmed, et al.
Veröffentlicht: (2026)
Daisy-TTS: Simulating Wider Spectrum of Emotions via Prosody Embedding Decomposition
von: Chevi, Rendi, et al.
Veröffentlicht: (2024)
von: Chevi, Rendi, et al.
Veröffentlicht: (2024)
Efficient and Interpretable Grammatical Error Correction with Mixture of Experts
von: Qorib, Muhammad Reza, et al.
Veröffentlicht: (2024)
von: Qorib, Muhammad Reza, et al.
Veröffentlicht: (2024)
Towards Better Understanding of Program-of-Thought Reasoning in Cross-Lingual and Multilingual Environments
von: Payoungkhamdee, Patomporn, et al.
Veröffentlicht: (2025)
von: Payoungkhamdee, Patomporn, et al.
Veröffentlicht: (2025)
WangchanLion and WangchanX MRC Eval
von: Phatthiyaphaibun, Wannaphong, et al.
Veröffentlicht: (2024)
von: Phatthiyaphaibun, Wannaphong, et al.
Veröffentlicht: (2024)
Cendol: Open Instruction-tuned Generative Large Language Models for Indonesian Languages
von: Cahyawijaya, Samuel, et al.
Veröffentlicht: (2024)
von: Cahyawijaya, Samuel, et al.
Veröffentlicht: (2024)
MLKV: Multi-Layer Key-Value Heads for Memory Efficient Transformer Decoding
von: Zuhri, Zayd Muhammad Kawakibi, et al.
Veröffentlicht: (2024)
von: Zuhri, Zayd Muhammad Kawakibi, et al.
Veröffentlicht: (2024)
Cracking the Code: Multi-domain LLM Evaluation on Real-World Professional Exams in Indonesia
von: Koto, Fajri
Veröffentlicht: (2024)
von: Koto, Fajri
Veröffentlicht: (2024)
From Surveys to Narratives: Rethinking Cultural Value Adaptation in LLMs
von: Adilazuarda, Muhammad Farid, et al.
Veröffentlicht: (2025)
von: Adilazuarda, Muhammad Farid, et al.
Veröffentlicht: (2025)
Data Laundering: Artificially Boosting Benchmark Results through Knowledge Distillation
von: Mansurov, Jonibek, et al.
Veröffentlicht: (2024)
von: Mansurov, Jonibek, et al.
Veröffentlicht: (2024)
Balanced Multi-Factor In-Context Learning for Multilingual Large Language Models
von: Kaneko, Masahiro, et al.
Veröffentlicht: (2025)
von: Kaneko, Masahiro, et al.
Veröffentlicht: (2025)
Sense Representations Are Inducible Interfaces
von: Cruz, Jan Christian Blaise, et al.
Veröffentlicht: (2026)
von: Cruz, Jan Christian Blaise, et al.
Veröffentlicht: (2026)
LLM Olympiad: Why Model Evaluation Needs a Sealed Exam
von: Cruz, Jan Christian Blaise, et al.
Veröffentlicht: (2026)
von: Cruz, Jan Christian Blaise, et al.
Veröffentlicht: (2026)
Extracting General-use Transformers for Low-resource Languages via Knowledge Distillation
von: Cruz, Jan Christian Blaise, et al.
Veröffentlicht: (2025)
von: Cruz, Jan Christian Blaise, et al.
Veröffentlicht: (2025)
Beyond Probabilities: Unveiling the Misalignment in Evaluating Large Language Models
von: Lyu, Chenyang, et al.
Veröffentlicht: (2024)
von: Lyu, Chenyang, et al.
Veröffentlicht: (2024)
Crosslingual Reasoning through Test-Time Scaling
von: Yong, Zheng-Xin, et al.
Veröffentlicht: (2025)
von: Yong, Zheng-Xin, et al.
Veröffentlicht: (2025)
QLESS: A Quantized Approach for Data Valuation and Selection in Large Language Model Fine-Tuning
von: Ananta, Moses, et al.
Veröffentlicht: (2025)
von: Ananta, Moses, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Vision Language Models are Confused Tourists
von: Irawan, Patrick Amadeus, et al.
Veröffentlicht: (2025) -
Parallel Tokenizers: Rethinking Vocabulary Design for Cross-Lingual Transfer
von: Kautsar, Muhammad Dehan Al, et al.
Veröffentlicht: (2025) -
Language Surgery in Multilingual Large Language Models
von: Lopo, Joanito Agili, et al.
Veröffentlicht: (2025) -
Macaron: Controlled, Human-Written Benchmark for Multilingual and Multicultural Reasoning via Template-Filling
von: Elsetohy, Alaa, et al.
Veröffentlicht: (2026) -
What Do Indonesians Really Need from Language Technology? A Nationwide Survey
von: Kautsar, Muhammad Dehan Al, et al.
Veröffentlicht: (2025)