Representing the Under-Represented: Cultural and Core Capability Benchmarks for Developing Thai Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Kim, Dahyun, Lee, Sukyung, Kim, Yungi, Rutherford, Attapol, Park, Chanjun |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Dataverse: Open-Source ETL (Extract, Transform, Load) Pipeline for Large Language Models
di: Park, Hyunbyung, et al.
Pubblicazione: (2024)
di: Park, Hyunbyung, et al.
Pubblicazione: (2024)
Open Ko-LLM Leaderboard: Evaluating Large Language Models in Korean with Ko-H5 Benchmark
di: Park, Chanjun, et al.
Pubblicazione: (2024)
di: Park, Chanjun, et al.
Pubblicazione: (2024)
1 Trillion Token (1TT) Platform: A Novel Framework for Efficient Data Sharing and Compensation in Large Language Models
di: Park, Chanjun, et al.
Pubblicazione: (2024)
di: Park, Chanjun, et al.
Pubblicazione: (2024)
Open Ko-LLM Leaderboard2: Bridging Foundational and Practical Evaluation for Korean LLMs
di: Kim, Hyeonwoo, et al.
Pubblicazione: (2024)
di: Kim, Hyeonwoo, et al.
Pubblicazione: (2024)
LP Data Pipeline: Lightweight, Purpose-driven Data Pipeline for Large Language Models
di: Kim, Yungi, et al.
Pubblicazione: (2024)
di: Kim, Yungi, et al.
Pubblicazione: (2024)
Evalverse: Unified and Accessible Library for Large Language Model Evaluation
di: Kim, Jihoo, et al.
Pubblicazione: (2024)
di: Kim, Jihoo, et al.
Pubblicazione: (2024)
Rethinking KenLM: Good and Bad Model Ensembles for Efficient Text Quality Filtering in Large Web Corpora
di: Kim, Yungi, et al.
Pubblicazione: (2024)
di: Kim, Yungi, et al.
Pubblicazione: (2024)
InstaTrans: An Instruction-Aware Translation Framework for Non-English Instruction Datasets
di: Kim, Yungi, et al.
Pubblicazione: (2024)
di: Kim, Yungi, et al.
Pubblicazione: (2024)
PhayaThaiBERT: Enhancing a Pretrained Thai Language Model with Unassimilated Loanwords
di: Sriwirote, Panyut, et al.
Pubblicazione: (2023)
di: Sriwirote, Panyut, et al.
Pubblicazione: (2023)
sDPO: Don't Use Your Data All at Once
di: Kim, Dahyun, et al.
Pubblicazione: (2024)
di: Kim, Dahyun, et al.
Pubblicazione: (2024)
SAAS: Solving Ability Amplification Strategy for Enhanced Mathematical Reasoning in Large Language Models
di: Kim, Hyeonwoo, et al.
Pubblicazione: (2024)
di: Kim, Hyeonwoo, et al.
Pubblicazione: (2024)
OpenJAI-v1.0: An Open Thai Large Language Model
di: Trakuekul, Pontakorn, et al.
Pubblicazione: (2025)
di: Trakuekul, Pontakorn, et al.
Pubblicazione: (2025)
FLEX: A Benchmark for Evaluating Robustness of Fairness in Large Language Models
di: Jung, Dahyun, et al.
Pubblicazione: (2025)
di: Jung, Dahyun, et al.
Pubblicazione: (2025)
AyutthayaAlpha: A Thai-Latin Script Transliteration Transformer
di: Lauc, Davor, et al.
Pubblicazione: (2024)
di: Lauc, Davor, et al.
Pubblicazione: (2024)
Model-Based Data-Centric AI: Bridging the Divide Between Academic Ideals and Industrial Pragmatism
di: Park, Chanjun, et al.
Pubblicazione: (2024)
di: Park, Chanjun, et al.
Pubblicazione: (2024)
SOLAR 10.7B: Scaling Large Language Models with Simple yet Effective Depth Up-Scaling
di: Kim, Dahyun, et al.
Pubblicazione: (2023)
di: Kim, Dahyun, et al.
Pubblicazione: (2023)
KITE: A Benchmark for Evaluating Korean Instruction-Following Abilities in Large Language Models
di: Kim, Dongjun, et al.
Pubblicazione: (2025)
di: Kim, Dongjun, et al.
Pubblicazione: (2025)
Understanding LLM Development Through Longitudinal Study: Insights from the Open Ko-LLM Leaderboard
di: Park, Chanjun, et al.
Pubblicazione: (2024)
di: Park, Chanjun, et al.
Pubblicazione: (2024)
CoME: An Unlearning-based Approach to Conflict-free Model Editing
di: Jung, Dahyun, et al.
Pubblicazione: (2025)
di: Jung, Dahyun, et al.
Pubblicazione: (2025)
Alternative Speech: Complementary Method to Counter-Narrative for Better Discourse
di: Lee, Seungyoon, et al.
Pubblicazione: (2024)
di: Lee, Seungyoon, et al.
Pubblicazione: (2024)
Benchmark Profiling: Mechanistic Diagnosis of LLM Benchmarks
di: Kim, Dongjun, et al.
Pubblicazione: (2025)
di: Kim, Dongjun, et al.
Pubblicazione: (2025)
LLM for Everyone: Representing the Underrepresented in Large Language Models
di: Cahyawijaya, Samuel
Pubblicazione: (2024)
di: Cahyawijaya, Samuel
Pubblicazione: (2024)
HALO: An Ontology for Representing and Categorizing Hallucinations in Large Language Models
di: Nananukul, Navapat, et al.
Pubblicazione: (2023)
di: Nananukul, Navapat, et al.
Pubblicazione: (2023)
JAI-1: A Thai-Centric Large Language Model
di: Rutherford, Attapol T., et al.
Pubblicazione: (2025)
di: Rutherford, Attapol T., et al.
Pubblicazione: (2025)
Language Models Represent Beliefs of Self and Others
di: Zhu, Wentao, et al.
Pubblicazione: (2024)
di: Zhu, Wentao, et al.
Pubblicazione: (2024)
MIRAGE: A Metric-Intensive Benchmark for Retrieval-Augmented Generation Evaluation
di: Park, Chanhee, et al.
Pubblicazione: (2025)
di: Park, Chanhee, et al.
Pubblicazione: (2025)
Language Models Represent Space and Time
di: Gurnee, Wes, et al.
Pubblicazione: (2023)
di: Gurnee, Wes, et al.
Pubblicazione: (2023)
Examining Alignment of Large Language Models through Representative Heuristics: The Case of Political Stereotypes
di: Jeoung, Sullam, et al.
Pubblicazione: (2025)
di: Jeoung, Sullam, et al.
Pubblicazione: (2025)
EconCausal: A Context-Aware Economic Reasoning Benchmark for Large Language Models
di: Lee, Donggyu, et al.
Pubblicazione: (2025)
di: Lee, Donggyu, et al.
Pubblicazione: (2025)
Nunchi-Bench: Benchmarking Language Models on Cultural Reasoning with a Focus on Korean Superstition
di: Kim, Kyuhee, et al.
Pubblicazione: (2025)
di: Kim, Kyuhee, et al.
Pubblicazione: (2025)
Developing a Pragmatic Benchmark for Assessing Korean Legal Language Understanding in Large Language Models
di: Kim, Yeeun, et al.
Pubblicazione: (2024)
di: Kim, Yeeun, et al.
Pubblicazione: (2024)
When Is Enough Not Enough? Illusory Completion in Search Agents
di: Ko, Dayoon, et al.
Pubblicazione: (2026)
di: Ko, Dayoon, et al.
Pubblicazione: (2026)
DICE-BENCH: Evaluating the Tool-Use Capabilities of Large Language Models in Multi-Round, Multi-Party Dialogues
di: Jang, Kyochul, et al.
Pubblicazione: (2025)
di: Jang, Kyochul, et al.
Pubblicazione: (2025)
PCEval: A Benchmark for Evaluating Physical Computing Capabilities of Large Language Models
di: Song, Inpyo, et al.
Pubblicazione: (2025)
di: Song, Inpyo, et al.
Pubblicazione: (2025)
ZEBRA: Leveraging Model-Behavioral Knowledge for Zero-Annotation Preference Dataset Construction
di: Jung, Jeesu, et al.
Pubblicazione: (2025)
di: Jung, Jeesu, et al.
Pubblicazione: (2025)
ChatLang-8: An LLM-Based Synthetic Data Generation Framework for Grammatical Error Correction
di: Park, Jeiyoon, et al.
Pubblicazione: (2024)
di: Park, Jeiyoon, et al.
Pubblicazione: (2024)
CharacterGPT: A Persona Reconstruction Framework for Role-Playing Agents
di: Park, Jeiyoon, et al.
Pubblicazione: (2024)
di: Park, Jeiyoon, et al.
Pubblicazione: (2024)
Aspect-Level Obfuscated Sentiment in Thai Financial Disclosures and Its Impact on Abnormal Returns
di: Rutherford, Attapol T., et al.
Pubblicazione: (2025)
di: Rutherford, Attapol T., et al.
Pubblicazione: (2025)
ModelCitizens: Representing Community Voices in Online Safety
di: Suvarna, Ashima, et al.
Pubblicazione: (2025)
di: Suvarna, Ashima, et al.
Pubblicazione: (2025)
Dynamic Benchmarking of Reasoning Capabilities in Code Large Language Models Under Data Contamination
di: Chen, Simin, et al.
Pubblicazione: (2025)
di: Chen, Simin, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Dataverse: Open-Source ETL (Extract, Transform, Load) Pipeline for Large Language Models
di: Park, Hyunbyung, et al.
Pubblicazione: (2024) -
Open Ko-LLM Leaderboard: Evaluating Large Language Models in Korean with Ko-H5 Benchmark
di: Park, Chanjun, et al.
Pubblicazione: (2024) -
1 Trillion Token (1TT) Platform: A Novel Framework for Efficient Data Sharing and Compensation in Large Language Models
di: Park, Chanjun, et al.
Pubblicazione: (2024) -
Open Ko-LLM Leaderboard2: Bridging Foundational and Practical Evaluation for Korean LLMs
di: Kim, Hyeonwoo, et al.
Pubblicazione: (2024) -
LP Data Pipeline: Lightweight, Purpose-driven Data Pipeline for Large Language Models
di: Kim, Yungi, et al.
Pubblicazione: (2024)