SEA-BED: How Do Embedding Models Represent Southeast Asian Languages?
Fuente:
arXiv
Saved in:
| Main Authors: | Ponwitayarat, Wuttikorn, Limkonchotiwat, Peerat, Ng, Raymond, Montalan, Jann Railey, Aung, Thura, Ngui, Jian Gang, Susanto, Yosephine, Tjhi, William Chandra, Tasawong, Panuthep, Cambria, Erik, Chuangsuwanich, Ekapol, Nutanong, Sarana |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Space Decomposition for Sentence Embedding
by: Ponwitayarat, Wuttikorn, et al.
Published: (2024)
by: Ponwitayarat, Wuttikorn, et al.
Published: (2024)
BURMESE-SAN: Burmese NLP Benchmark for Evaluating Large Language Models
by: Aung, Thura, et al.
Published: (2026)
by: Aung, Thura, et al.
Published: (2026)
SEA-HELM: Southeast Asian Holistic Evaluation of Language Models
by: Susanto, Yosephine, et al.
Published: (2025)
by: Susanto, Yosephine, et al.
Published: (2025)
SEA-Guard: Culturally Grounded Multilingual Safeguard for Southeast Asia
by: Tasawong, Panuthep, et al.
Published: (2026)
by: Tasawong, Panuthep, et al.
Published: (2026)
SEA-SafeguardBench: Evaluating AI Safety in SEA Languages and Cultures
by: Tasawong, Panuthep, et al.
Published: (2025)
by: Tasawong, Panuthep, et al.
Published: (2025)
Assessing Thai Dialect Performance in LLMs with Automatic Benchmarks and Human Evaluation
by: Limkonchotiwat, Peerat, et al.
Published: (2025)
by: Limkonchotiwat, Peerat, et al.
Published: (2025)
Mangosteen: An Open Thai Corpus for Language Model Pretraining
by: Phatthiyaphaibun, Wannaphong, et al.
Published: (2025)
by: Phatthiyaphaibun, Wannaphong, et al.
Published: (2025)
Kalahi: A handcrafted, grassroots cultural LLM evaluation suite for Filipino
by: Montalan, Jann Railey, et al.
Published: (2024)
by: Montalan, Jann Railey, et al.
Published: (2024)
WangchanThaiInstruct: An instruction-following Dataset for Culture-Aware, Multitask, and Multi-domain Evaluation in Thai
by: Limkonchotiwat, Peerat, et al.
Published: (2025)
by: Limkonchotiwat, Peerat, et al.
Published: (2025)
SEA-LION: Southeast Asian Languages in One Network
by: Ng, Raymond, et al.
Published: (2025)
by: Ng, Raymond, et al.
Published: (2025)
Towards Better Understanding of Program-of-Thought Reasoning in Cross-Lingual and Multilingual Environments
by: Payoungkhamdee, Patomporn, et al.
Published: (2025)
by: Payoungkhamdee, Patomporn, et al.
Published: (2025)
WangchanLion and WangchanX MRC Eval
by: Phatthiyaphaibun, Wannaphong, et al.
Published: (2024)
by: Phatthiyaphaibun, Wannaphong, et al.
Published: (2024)
When Better Teachers Don't Make Better Students: Revisiting Knowledge Distillation for CLIP Models in VQA
by: Tuchinda, Pume, et al.
Published: (2025)
by: Tuchinda, Pume, et al.
Published: (2025)
NitiBench: A Comprehensive Study of LLM Framework Capabilities for Thai Legal Question Answering
by: Akarajaradwong, Pawitsapak, et al.
Published: (2025)
by: Akarajaradwong, Pawitsapak, et al.
Published: (2025)
Decom-Renorm-Merge: Model Merging on the Right Space Improves Multitasking
by: Chaichana, Yuatyong, et al.
Published: (2025)
by: Chaichana, Yuatyong, et al.
Published: (2025)
Distilling Multilingual Vision-Language Models: When Smaller Models Stay Multilingual
by: Sriratanawilai, Sukrit, et al.
Published: (2025)
by: Sriratanawilai, Sukrit, et al.
Published: (2025)
Can Group Relative Policy Optimization Improve Thai Legal Reasoning and Question Answering?
by: Akarajaradwong, Pawitsapak, et al.
Published: (2025)
by: Akarajaradwong, Pawitsapak, et al.
Published: (2025)
SEADialogues: A Multilingual Culturally Grounded Multi-turn Dialogue Dataset on Southeast Asian Languages
by: Kautsar, Muhammad Dehan Al, et al.
Published: (2025)
by: Kautsar, Muhammad Dehan Al, et al.
Published: (2025)
Evaluating Perspectival Biases in Cross-Modal Retrieval
by: Saengsukhiran, Teerapol, et al.
Published: (2025)
by: Saengsukhiran, Teerapol, et al.
Published: (2025)
MultiLexNorm++: A Unified Benchmark and a Generative Model for Lexical Normalization for Asian Languages
by: Buaphet, Weerayut, et al.
Published: (2026)
by: Buaphet, Weerayut, et al.
Published: (2026)
THAI Speech Emotion Recognition (THAI-SER) corpus
by: Wongpithayadisai, Jilamika, et al.
Published: (2025)
by: Wongpithayadisai, Jilamika, et al.
Published: (2025)
Batayan: A Filipino NLP benchmark for evaluating Large Language Models
by: Montalan, Jann Railey, et al.
Published: (2025)
by: Montalan, Jann Railey, et al.
Published: (2025)
Explainable Depression Detection using Masked Hard Instance Mining
by: Prakrankamanant, Patawee, et al.
Published: (2025)
by: Prakrankamanant, Patawee, et al.
Published: (2025)
MrRank: Improving Question Answering Retrieval System through Multi-Result Ranking Model
by: Khamnuansin, Danupat, et al.
Published: (2024)
by: Khamnuansin, Danupat, et al.
Published: (2024)
Amplifying Artifacts with Speech Enhancement in Voice Anti-spoofing
by: Trachu, Thanapat, et al.
Published: (2025)
by: Trachu, Thanapat, et al.
Published: (2025)
Thunder : Unified Regression-Diffusion Speech Enhancement with a Single Reverse Step using Brownian Bridge
by: Trachu, Thanapat, et al.
Published: (2024)
by: Trachu, Thanapat, et al.
Published: (2024)
Addressing Topic Leakage in Cross-Topic Evaluation for Authorship Verification
by: Sawatphol, Jitkapat, et al.
Published: (2024)
by: Sawatphol, Jitkapat, et al.
Published: (2024)
Mitigating Language Bias in Cross-Lingual Job Retrieval: A Recruitment Platform Perspective
by: Laosaengpha, Napat, et al.
Published: (2025)
by: Laosaengpha, Napat, et al.
Published: (2025)
Spatial Language Likelihood Grounding Network for Bayesian Fusion of Human-Robot Observations
by: Sitdhipol, Supawich, et al.
Published: (2025)
by: Sitdhipol, Supawich, et al.
Published: (2025)
Prior Prompt Engineering for Reinforcement Fine-Tuning
by: Taveekitworachai, Pittawat, et al.
Published: (2025)
by: Taveekitworachai, Pittawat, et al.
Published: (2025)
A Two-Phase Stability Study of LLM Judges and Bar Council Examiners on Thai Bar-Exam Free-Form Essays
by: Akarajaradwong, Pawitsapak, et al.
Published: (2026)
by: Akarajaradwong, Pawitsapak, et al.
Published: (2026)
Seed-Free Synthetic Data Generation Framework for Instruction-Tuning LLMs: A Case Study in Thai
by: Pengpun, Parinthapat, et al.
Published: (2024)
by: Pengpun, Parinthapat, et al.
Published: (2024)
Learning Job Title Representation from Job Description Aggregation Network
by: Laosaengpha, Napat, et al.
Published: (2024)
by: Laosaengpha, Napat, et al.
Published: (2024)
Exploring Cross-Client Memorization of Training Data in Large Language Models for Federated Learning
by: Udsa, Tinnakit, et al.
Published: (2025)
by: Udsa, Tinnakit, et al.
Published: (2025)
SEACrowd: A Multilingual Multimodal Data Hub and Benchmark Suite for Southeast Asian Languages
by: Lovenia, Holy, et al.
Published: (2024)
by: Lovenia, Holy, et al.
Published: (2024)
KAConvText: Novel Approach to Burmese Sentence Classification using Kolmogorov-Arnold Convolution
by: Thu, Ye Kyaw, et al.
Published: (2025)
by: Thu, Ye Kyaw, et al.
Published: (2025)
Towards an integrative approach to the study of brain-environment interactions in human and non-human primate
by: Thura, David
Published: (2025)
by: Thura, David
Published: (2025)
A Model Methodology for Selecting Women's Studies Core Journals.
by: Mack, Thura
Published: (1991)
by: Mack, Thura
Published: (1991)
ASR Error Correction in Low-Resource Burmese with Alignment-Enhanced Transformers using Phonetic Features
by: Lin, Ye Bhone, et al.
Published: (2025)
by: Lin, Ye Bhone, et al.
Published: (2025)
Global MMLU: Understanding and Addressing Cultural and Linguistic Biases in Multilingual Evaluation
by: Singh, Shivalika, et al.
Published: (2024)
by: Singh, Shivalika, et al.
Published: (2024)
Similar Items
-
Space Decomposition for Sentence Embedding
by: Ponwitayarat, Wuttikorn, et al.
Published: (2024) -
BURMESE-SAN: Burmese NLP Benchmark for Evaluating Large Language Models
by: Aung, Thura, et al.
Published: (2026) -
SEA-HELM: Southeast Asian Holistic Evaluation of Language Models
by: Susanto, Yosephine, et al.
Published: (2025) -
SEA-Guard: Culturally Grounded Multilingual Safeguard for Southeast Asia
by: Tasawong, Panuthep, et al.
Published: (2026) -
SEA-SafeguardBench: Evaluating AI Safety in SEA Languages and Cultures
by: Tasawong, Panuthep, et al.
Published: (2025)