KIT-19: A Comprehensive Korean Instruction Toolkit on 19 Tasks for Fine-Tuning Korean Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Jang, Dongjun, Byun, Sungjoo, Jo, Hyemi, Shin, Hyopil |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
A Study on How Attention Scores in the BERT Model are Aware of Lexical Categories in Syntactic and Semantic Tasks on the GLUE Benchmark
par: Jang, Dongjun, et autres
Publié: (2024)
par: Jang, Dongjun, et autres
Publié: (2024)
CARBD-Ko: A Contextually Annotated Review Benchmark Dataset for Aspect-Level Sentiment Classification in Korean
par: Jang, Dongjun, et autres
Publié: (2024)
par: Jang, Dongjun, et autres
Publié: (2024)
Korean Bio-Medical Corpus (KBMC) for Medical Named Entity Recognition
par: Byun, Sungjoo, et autres
Publié: (2024)
par: Byun, Sungjoo, et autres
Publié: (2024)
KoBALT: Korean Benchmark For Advanced Linguistic Tasks
par: Shin, Hyopil, et autres
Publié: (2025)
par: Shin, Hyopil, et autres
Publié: (2025)
RCScore: Quantifying Response Consistency in Large Language Models
par: Jang, Dongjun, et autres
Publié: (2025)
par: Jang, Dongjun, et autres
Publié: (2025)
P-CoT: A Pedagogically-motivated Participatory Chain-of-Thought Prompting for Phonological Reasoning in LLMs
par: Jang, Dongjun, et autres
Publié: (2025)
par: Jang, Dongjun, et autres
Publié: (2025)
Mergen: The First Manchu-Korean Machine Translation Model Trained on Augmented Data
par: Seo, Jean, et autres
Publié: (2023)
par: Seo, Jean, et autres
Publié: (2023)
KITE: A Benchmark for Evaluating Korean Instruction-Following Abilities in Large Language Models
par: Kim, Dongjun, et autres
Publié: (2025)
par: Kim, Dongjun, et autres
Publié: (2025)
DAHL: Domain-specific Automated Hallucination Evaluation of Long-Form Text through a Benchmark Dataset in Biomedicine
par: Seo, Jean, et autres
Publié: (2024)
par: Seo, Jean, et autres
Publié: (2024)
How does a Language-Specific Tokenizer affect LLMs?
par: Seo, Jean, et autres
Publié: (2025)
par: Seo, Jean, et autres
Publié: (2025)
Pragmatic Competence Evaluation of Large Language Models for the Korean Language
par: Park, Dojun, et autres
Publié: (2024)
par: Park, Dojun, et autres
Publié: (2024)
KoDialogBench: Evaluating Conversational Understanding of Language Models with Korean Dialogue Benchmark
par: Jang, Seongbo, et autres
Publié: (2024)
par: Jang, Seongbo, et autres
Publié: (2024)
KoALa-Bench: Evaluating Large Audio Language Models on Korean Speech Understanding and Faithfulness
par: Kim, Jinyoung, et autres
Publié: (2026)
par: Kim, Jinyoung, et autres
Publié: (2026)
FunctionChat-Bench: Comprehensive Evaluation of Language Models' Generative Capabilities in Korean Tool-use Dialogs
par: Lee, Shinbok, et autres
Publié: (2024)
par: Lee, Shinbok, et autres
Publié: (2024)
EVOKE: Emotion Vocabulary Of Korean and English
par: Jung, Yoonwon, et autres
Publié: (2026)
par: Jung, Yoonwon, et autres
Publié: (2026)
LegalMidm: Use-Case-Driven Legal Domain Specialization for Korean Large Language Model
par: Jang, Youngjoon, et autres
Publié: (2026)
par: Jang, Youngjoon, et autres
Publié: (2026)
KORMo: Korean Open Reasoning Model for Everyone
par: Kim, Minjun, et autres
Publié: (2025)
par: Kim, Minjun, et autres
Publié: (2025)
Dynamics of Instruction Fine-Tuning for Chinese Large Language Models
par: Song, Chiyu, et autres
Publié: (2023)
par: Song, Chiyu, et autres
Publié: (2023)
Phased Instruction Fine-Tuning for Large Language Models
par: Pang, Wei, et autres
Publié: (2024)
par: Pang, Wei, et autres
Publié: (2024)
Optimizing Language Augmentation for Multilingual Large Language Models: A Case Study on Korean
par: Choi, ChangSu, et autres
Publié: (2024)
par: Choi, ChangSu, et autres
Publié: (2024)
From Ground Trust to Truth: Disparities in Offensive Language Judgments on Contemporary Korean Political Discourse
par: Yu, Seunguk, et autres
Publié: (2025)
par: Yu, Seunguk, et autres
Publié: (2025)
K-UD: Revising Korean Universal Dependencies Guidelines
par: Kim, Kyuwon, et autres
Publié: (2024)
par: Kim, Kyuwon, et autres
Publié: (2024)
HAE-RAE Bench: Evaluation of Korean Knowledge in Language Models
par: Son, Guijin, et autres
Publié: (2023)
par: Son, Guijin, et autres
Publié: (2023)
Linguistically Informed Graph Model and Semantic Contrastive Learning for Korean Short Text Classification
par: Yoo, JaeGeon, et autres
Publié: (2026)
par: Yoo, JaeGeon, et autres
Publié: (2026)
GECKO: Generative Language Model for English, Code and Korean
par: Oh, Sungwoo, et autres
Publié: (2024)
par: Oh, Sungwoo, et autres
Publié: (2024)
UKTA: Unified Korean Text Analyzer
par: Ahn, Seokho, et autres
Publié: (2025)
par: Ahn, Seokho, et autres
Publié: (2025)
Developing a Pragmatic Benchmark for Assessing Korean Legal Language Understanding in Large Language Models
par: Kim, Yeeun, et autres
Publié: (2024)
par: Kim, Yeeun, et autres
Publié: (2024)
MoFE: Mixture of Frozen Experts Architecture
par: Seo, Jean, et autres
Publié: (2025)
par: Seo, Jean, et autres
Publié: (2025)
KMI: A Dataset of Korean Motivational Interviewing Dialogues for Psychotherapy
par: Kim, Hyunjong, et autres
Publié: (2025)
par: Kim, Hyunjong, et autres
Publié: (2025)
KULTURE Bench: A Benchmark for Assessing Language Model in Korean Cultural Context
par: Wang, Xiaonan, et autres
Publié: (2024)
par: Wang, Xiaonan, et autres
Publié: (2024)
KMMLU: Measuring Massive Multitask Language Understanding in Korean
par: Son, Guijin, et autres
Publié: (2024)
par: Son, Guijin, et autres
Publié: (2024)
Word Segmentation for Asian Languages: Chinese, Korean, and Japanese
par: Rho, Matthew, et autres
Publié: (2024)
par: Rho, Matthew, et autres
Publié: (2024)
LLaVA-Docent: Instruction Tuning with Multimodal Large Language Model to Support Art Appreciation Education
par: Lee, Unggi, et autres
Publié: (2024)
par: Lee, Unggi, et autres
Publié: (2024)
VARCO-VISION: Expanding Frontiers in Korean Vision-Language Models
par: Ju, Jeongho, et autres
Publié: (2024)
par: Ju, Jeongho, et autres
Publié: (2024)
Parser agreement and disagreement in L2 Korean UD: Implications for human-in-the-loop annotation
par: Sung, Hakyung, et autres
Publié: (2026)
par: Sung, Hakyung, et autres
Publié: (2026)
KFinEval-Pilot: A Comprehensive Benchmark Suite for Korean Financial Language Understanding
par: Hwang, Bokwang, et autres
Publié: (2025)
par: Hwang, Bokwang, et autres
Publié: (2025)
Unlocking Korean Verbs: A User-Friendly Exploration into the Verb Lexicon
par: Song, Seohyun, et autres
Publié: (2024)
par: Song, Seohyun, et autres
Publié: (2024)
KoSimpleQA: A Korean Factuality Benchmark with an Analysis of Reasoning LLMs
par: Ko, Donghyeon, et autres
Publié: (2025)
par: Ko, Donghyeon, et autres
Publié: (2025)
BrailleLLM: Braille Instruction Tuning with Large Language Models for Braille Domain Tasks
par: Huang, Tianyuan, et autres
Publié: (2025)
par: Huang, Tianyuan, et autres
Publié: (2025)
GIFT: Guided Fine-Tuning and Transfer for Enhancing Instruction-Tuned Language Models
par: Ruan, Zhiwen, et autres
Publié: (2026)
par: Ruan, Zhiwen, et autres
Publié: (2026)
Documents similaires
-
A Study on How Attention Scores in the BERT Model are Aware of Lexical Categories in Syntactic and Semantic Tasks on the GLUE Benchmark
par: Jang, Dongjun, et autres
Publié: (2024) -
CARBD-Ko: A Contextually Annotated Review Benchmark Dataset for Aspect-Level Sentiment Classification in Korean
par: Jang, Dongjun, et autres
Publié: (2024) -
Korean Bio-Medical Corpus (KBMC) for Medical Named Entity Recognition
par: Byun, Sungjoo, et autres
Publié: (2024) -
KoBALT: Korean Benchmark For Advanced Linguistic Tasks
par: Shin, Hyopil, et autres
Publié: (2025) -
RCScore: Quantifying Response Consistency in Large Language Models
par: Jang, Dongjun, et autres
Publié: (2025)