Guardado en:
| Autores principales: | Kim, Kyuhee, Lee, Surin, Lee, Sangah |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2404.01140 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
K-Act2Emo: Korean Commonsense Knowledge Graph for Indirect Emotional Expression
por: Kim, Kyuhee, et al.
Publicado: (2024)
por: Kim, Kyuhee, et al.
Publicado: (2024)
Nunchi-Bench: Benchmarking Language Models on Cultural Reasoning with a Focus on Korean Superstition
por: Kim, Kyuhee, et al.
Publicado: (2025)
por: Kim, Kyuhee, et al.
Publicado: (2025)
KoBALT: Korean Benchmark For Advanced Linguistic Tasks
por: Shin, Hyopil, et al.
Publicado: (2025)
por: Shin, Hyopil, et al.
Publicado: (2025)
KoCoSa: Korean Context-aware Sarcasm Detection Dataset
por: Kim, Yumin, et al.
Publicado: (2024)
por: Kim, Yumin, et al.
Publicado: (2024)
SDS KoPub VDR: A Benchmark Dataset for Visual Document Retrieval in Korean Public Documents
por: Lee, Jaehoon, et al.
Publicado: (2025)
por: Lee, Jaehoon, et al.
Publicado: (2025)
Mergen: The First Manchu-Korean Machine Translation Model Trained on Augmented Data
por: Seo, Jean, et al.
Publicado: (2023)
por: Seo, Jean, et al.
Publicado: (2023)
Open Ko-LLM Leaderboard: Evaluating Large Language Models in Korean with Ko-H5 Benchmark
por: Park, Chanjun, et al.
Publicado: (2024)
por: Park, Chanjun, et al.
Publicado: (2024)
CARBD-Ko: A Contextually Annotated Review Benchmark Dataset for Aspect-Level Sentiment Classification in Korean
por: Jang, Dongjun, et al.
Publicado: (2024)
por: Jang, Dongjun, et al.
Publicado: (2024)
KoBBQ: Korean Bias Benchmark for Question Answering
por: Jin, Jiho, et al.
Publicado: (2023)
por: Jin, Jiho, et al.
Publicado: (2023)
Thunder-KoNUBench: A Corpus-Aligned Benchmark for Korean Negation Understanding
por: Jung, Sungmok, et al.
Publicado: (2026)
por: Jung, Sungmok, et al.
Publicado: (2026)
KoSimpleQA: A Korean Factuality Benchmark with an Analysis of Reasoning LLMs
por: Ko, Donghyeon, et al.
Publicado: (2025)
por: Ko, Donghyeon, et al.
Publicado: (2025)
Ko-PIQA: A Korean Physical Commonsense Reasoning Dataset with Cultural Context
por: Choi, Dasol, et al.
Publicado: (2025)
por: Choi, Dasol, et al.
Publicado: (2025)
Open Ko-LLM Leaderboard2: Bridging Foundational and Practical Evaluation for Korean LLMs
por: Kim, Hyeonwoo, et al.
Publicado: (2024)
por: Kim, Hyeonwoo, et al.
Publicado: (2024)
Making Sense of Korean Sentences: A Comprehensive Evaluation of LLMs through KoSEnd Dataset
por: Yu, Seunguk, et al.
Publicado: (2025)
por: Yu, Seunguk, et al.
Publicado: (2025)
KOMBO: Korean Character Representations Based on the Combination Rules of Subcharacters
por: Kim, SungHo, et al.
Publicado: (2026)
por: Kim, SungHo, et al.
Publicado: (2026)
KoDialogBench: Evaluating Conversational Understanding of Language Models with Korean Dialogue Benchmark
por: Jang, Seongbo, et al.
Publicado: (2024)
por: Jang, Seongbo, et al.
Publicado: (2024)
Generating Visual Stories with Grounded and Coreferent Characters
por: Liu, Danyang, et al.
Publicado: (2024)
por: Liu, Danyang, et al.
Publicado: (2024)
KoACD: The First Korean Adolescent Dataset for Cognitive Distortion Analysis via Role-Switching Multi-LLM Negotiation
por: Kim, JunSeo, et al.
Publicado: (2025)
por: Kim, JunSeo, et al.
Publicado: (2025)
Ko-MuSR: A Multistep Soft Reasoning Benchmark for LLMs Capable of Understanding Korean
por: Park, Chanwoo, et al.
Publicado: (2025)
por: Park, Chanwoo, et al.
Publicado: (2025)
KoBLEX: Open Legal Question Answering with Multi-hop Reasoning
por: Lee, Jihyung, et al.
Publicado: (2025)
por: Lee, Jihyung, et al.
Publicado: (2025)
KoGEC : Korean Grammatical Error Correction with Pre-trained Translation Models
por: Kim, Taeeun, et al.
Publicado: (2025)
por: Kim, Taeeun, et al.
Publicado: (2025)
KoWit-24: A Richly Annotated Dataset of Wordplay in News Headlines
por: Baranov, Alexander, et al.
Publicado: (2025)
por: Baranov, Alexander, et al.
Publicado: (2025)
ManWav: The First Manchu ASR Model
por: Seo, Jean, et al.
Publicado: (2024)
por: Seo, Jean, et al.
Publicado: (2024)
ThaiCoref: Thai Coreference Resolution Dataset
por: Trakuekul, Pontakorn, et al.
Publicado: (2024)
por: Trakuekul, Pontakorn, et al.
Publicado: (2024)
Do LLMs Game Formalization? Evaluating Faithfulness in Logical Reasoning
por: Kim, Kyuhee, et al.
Publicado: (2026)
por: Kim, Kyuhee, et al.
Publicado: (2026)
Computational Representations of Character Significance in Novels
por: Mian, Haaris, et al.
Publicado: (2026)
por: Mian, Haaris, et al.
Publicado: (2026)
Making Qwen3 Think in Korean with Reinforcement Learning
por: Lee, Jungyup, et al.
Publicado: (2025)
por: Lee, Jungyup, et al.
Publicado: (2025)
KMI: A Dataset of Korean Motivational Interviewing Dialogues for Psychotherapy
por: Kim, Hyunjong, et al.
Publicado: (2025)
por: Kim, Hyunjong, et al.
Publicado: (2025)
TriBench-Ko: Evaluating LLM Risks in Judicial Workflows
por: Lee, Haesung, et al.
Publicado: (2026)
por: Lee, Haesung, et al.
Publicado: (2026)
KorNAT: LLM Alignment Benchmark for Korean Social Values and Common Knowledge
por: Lee, Jiyoung, et al.
Publicado: (2024)
por: Lee, Jiyoung, et al.
Publicado: (2024)
Diverse Word Choices, Same Reference: Annotating Lexically-Rich Cross-Document Coreference
por: Zhukova, Anastasia, et al.
Publicado: (2026)
por: Zhukova, Anastasia, et al.
Publicado: (2026)
Piecing Together Cross-Document Coreference Resolution Datasets: Systematic Dataset Analysis and Unification
por: Zhukova, Anastasia, et al.
Publicado: (2026)
por: Zhukova, Anastasia, et al.
Publicado: (2026)
KPoEM: A Human-Annotated Dataset for Emotion Classification and RAG-Based Poetry Generation in Korean Modern Poetry
por: Lim, Iro, et al.
Publicado: (2025)
por: Lim, Iro, et al.
Publicado: (2025)
HAE-RAE Bench: Evaluation of Korean Knowledge in Language Models
por: Son, Guijin, et al.
Publicado: (2023)
por: Son, Guijin, et al.
Publicado: (2023)
KoGNER: A Novel Framework for Knowledge Graph Distillation on Biomedical Named Entity Recognition
por: Zhang, Heming, et al.
Publicado: (2025)
por: Zhang, Heming, et al.
Publicado: (2025)
[Lions: 1] and [Tigers: 2] and [Bears: 3], Oh My! Literary Coreference Annotation with LLMs
por: Hicke, Rebecca M. M., et al.
Publicado: (2024)
por: Hicke, Rebecca M. M., et al.
Publicado: (2024)
KoALa-Bench: Evaluating Large Audio Language Models on Korean Speech Understanding and Faithfulness
por: Kim, Jinyoung, et al.
Publicado: (2026)
por: Kim, Jinyoung, et al.
Publicado: (2026)
The Elephant in the Coreference Room: Resolving Coreference in Full-Length French Fiction Works
por: Bourgois, Antoine, et al.
Publicado: (2025)
por: Bourgois, Antoine, et al.
Publicado: (2025)
Thunder-DeID: Accurate and Efficient De-identification Framework for Korean Court Judgments
por: Hahm, Sungeun, et al.
Publicado: (2025)
por: Hahm, Sungeun, et al.
Publicado: (2025)
Multimodal Coreference Resolution for Chinese Social Media Dialogues: Dataset and Benchmark Approach
por: Li, Xingyu, et al.
Publicado: (2025)
por: Li, Xingyu, et al.
Publicado: (2025)
Ejemplares similares
-
K-Act2Emo: Korean Commonsense Knowledge Graph for Indirect Emotional Expression
por: Kim, Kyuhee, et al.
Publicado: (2024) -
Nunchi-Bench: Benchmarking Language Models on Cultural Reasoning with a Focus on Korean Superstition
por: Kim, Kyuhee, et al.
Publicado: (2025) -
KoBALT: Korean Benchmark For Advanced Linguistic Tasks
por: Shin, Hyopil, et al.
Publicado: (2025) -
KoCoSa: Korean Context-aware Sarcasm Detection Dataset
por: Kim, Yumin, et al.
Publicado: (2024) -
SDS KoPub VDR: A Benchmark Dataset for Visual Document Retrieval in Korean Public Documents
por: Lee, Jaehoon, et al.
Publicado: (2025)