Making Qwen3 Think in Korean with Reinforcement Learning
Fuente:
arXiv
Guardado en:
| Autores principales: | Lee, Jungyup, Kim, Jemin, Park, Sang, Lee, SeungJae |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Smoothie-Qwen: Post-Hoc Smoothing to Reduce Language Bias in Multilingual LLMs
por: Ji, SeungWon, et al.
Publicado: (2025)
por: Ji, SeungWon, et al.
Publicado: (2025)
DNA 1.0 Technical Report
por: Lee, Jungyup, et al.
Publicado: (2025)
por: Lee, Jungyup, et al.
Publicado: (2025)
Handling Korean Out-of-Vocabulary Words with Phoneme Representation Learning
por: Kim, Nayeon, et al.
Publicado: (2025)
por: Kim, Nayeon, et al.
Publicado: (2025)
A Mean-Reverting Model of Exchange Rate Risk Premium Using Ornstein-Uhlenbeck Dynamics
por: Hwang, SeungJae
Publicado: (2025)
por: Hwang, SeungJae
Publicado: (2025)
KOMBO: Korean Character Representations Based on the Combination Rules of Subcharacters
por: Kim, SungHo, et al.
Publicado: (2026)
por: Kim, SungHo, et al.
Publicado: (2026)
SCRIPT: A Subcharacter Compositional Representation Injection Module for Korean Pre-Trained Language Models
por: Kim, SungHo, et al.
Publicado: (2026)
por: Kim, SungHo, et al.
Publicado: (2026)
SDS KoPub VDR: A Benchmark Dataset for Visual Document Retrieval in Korean Public Documents
por: Lee, Jaehoon, et al.
Publicado: (2025)
por: Lee, Jaehoon, et al.
Publicado: (2025)
A Survey on Inference Engines for Large Language Models: Perspectives on Optimization and Efficiency
por: Park, Sihyeong, et al.
Publicado: (2025)
por: Park, Sihyeong, et al.
Publicado: (2025)
Pragmatic Competence Evaluation of Large Language Models for the Korean Language
por: Park, Dojun, et al.
Publicado: (2024)
por: Park, Dojun, et al.
Publicado: (2024)
Thunder-DeID: Accurate and Efficient De-identification Framework for Korean Court Judgments
por: Hahm, Sungeun, et al.
Publicado: (2025)
por: Hahm, Sungeun, et al.
Publicado: (2025)
Thunder-LLM: Efficiently Adapting LLMs to Korean with Minimal Resources
por: Kim, Jinpyo, et al.
Publicado: (2025)
por: Kim, Jinpyo, et al.
Publicado: (2025)
Evaluating Large language models on Understanding Korean indirect Speech acts
por: Koo, Youngeun, et al.
Publicado: (2025)
por: Koo, Youngeun, et al.
Publicado: (2025)
Polishing Every Facet of the GEM: Testing Linguistic Competence of LLMs and Humans in Korean
por: Kim, SungHo, et al.
Publicado: (2025)
por: Kim, SungHo, et al.
Publicado: (2025)
Do LLMs Need Inherent Reasoning Before Reinforcement Learning? A Study in Korean Self-Correction
por: Kim, Hongjin, et al.
Publicado: (2026)
por: Kim, Hongjin, et al.
Publicado: (2026)
KoCoNovel: Annotated Dataset of Character Coreference in Korean Novels
por: Kim, Kyuhee, et al.
Publicado: (2024)
por: Kim, Kyuhee, et al.
Publicado: (2024)
Mentor-KD: Making Small Language Models Better Multi-step Reasoners
por: Lee, Hojae, et al.
Publicado: (2024)
por: Lee, Hojae, et al.
Publicado: (2024)
K/DA: Automated Data Generation Pipeline for Detoxifying Implicitly Offensive Language in Korean
por: Jeon, Minkyeong, et al.
Publicado: (2025)
por: Jeon, Minkyeong, et al.
Publicado: (2025)
Qwen3 Technical Report
por: Yang, An, et al.
Publicado: (2025)
por: Yang, An, et al.
Publicado: (2025)
K-Act2Emo: Korean Commonsense Knowledge Graph for Indirect Emotional Expression
por: Kim, Kyuhee, et al.
Publicado: (2024)
por: Kim, Kyuhee, et al.
Publicado: (2024)
KVoiceBench, KOpenAudioBench, and KMMAU: Agent-Driven Korean Speech Benchmarks for Evaluating SpeechLMs
por: Kim, Haechan, et al.
Publicado: (2026)
por: Kim, Haechan, et al.
Publicado: (2026)
Open Ko-LLM Leaderboard2: Bridging Foundational and Practical Evaluation for Korean LLMs
por: Kim, Hyeonwoo, et al.
Publicado: (2024)
por: Kim, Hyeonwoo, et al.
Publicado: (2024)
Can Code-Switched Texts Activate a Knowledge Switch in LLMs? A Case Study on English-Korean Code-Switching
por: Kim, Seoyeon, et al.
Publicado: (2024)
por: Kim, Seoyeon, et al.
Publicado: (2024)
Open Ko-LLM Leaderboard: Evaluating Large Language Models in Korean with Ko-H5 Benchmark
por: Park, Chanjun, et al.
Publicado: (2024)
por: Park, Chanjun, et al.
Publicado: (2024)
Think, Verbalize, then Speak: Bridging Complex Thoughts and Comprehensible Speech
por: Woo, Sang Hoon, et al.
Publicado: (2025)
por: Woo, Sang Hoon, et al.
Publicado: (2025)
Qwen3Guard Technical Report
por: Zhao, Haiquan, et al.
Publicado: (2025)
por: Zhao, Haiquan, et al.
Publicado: (2025)
Exploring the Trade-Offs: Quantization Methods, Task Difficulty, and Model Size in Large Language Models From Edge to Giant
por: Lee, Jemin, et al.
Publicado: (2024)
por: Lee, Jemin, et al.
Publicado: (2024)
KorNAT: LLM Alignment Benchmark for Korean Social Values and Common Knowledge
por: Lee, Jiyoung, et al.
Publicado: (2024)
por: Lee, Jiyoung, et al.
Publicado: (2024)
K-BrowseComp: A Web Browsing Agent Benchmark Grounded in Korean Contexts
por: Lee, Nahyun, et al.
Publicado: (2026)
por: Lee, Nahyun, et al.
Publicado: (2026)
HAE-RAE Bench: Evaluation of Korean Knowledge in Language Models
por: Son, Guijin, et al.
Publicado: (2023)
por: Son, Guijin, et al.
Publicado: (2023)
KMMLU: Measuring Massive Multitask Language Understanding in Korean
por: Son, Guijin, et al.
Publicado: (2024)
por: Son, Guijin, et al.
Publicado: (2024)
QwenLong-L1: Towards Long-Context Large Reasoning Models with Reinforcement Learning
por: Wan, Fanqi, et al.
Publicado: (2025)
por: Wan, Fanqi, et al.
Publicado: (2025)
Linguistically Informed Graph Model and Semantic Contrastive Learning for Korean Short Text Classification
por: Yoo, JaeGeon, et al.
Publicado: (2026)
por: Yoo, JaeGeon, et al.
Publicado: (2026)
TranSentence: Speech-to-speech Translation via Language-agnostic Sentence-level Speech Encoding without Language-parallel Data
por: Kim, Seung-Bin, et al.
Publicado: (2024)
por: Kim, Seung-Bin, et al.
Publicado: (2024)
Qwen3-Coder-Next Technical Report
por: Cao, Ruisheng, et al.
Publicado: (2026)
por: Cao, Ruisheng, et al.
Publicado: (2026)
Qwen3-VL-Embedding and Qwen3-VL-Reranker: A Unified Framework for State-of-the-Art Multimodal Retrieval and Ranking
por: Li, Mingxin, et al.
Publicado: (2026)
por: Li, Mingxin, et al.
Publicado: (2026)
Rewarding How Models Think Pedagogically: Integrating Pedagogical Reasoning and Thinking Rewards for LLMs in Education
por: Lee, Unggi, et al.
Publicado: (2026)
por: Lee, Unggi, et al.
Publicado: (2026)
Thinking with DistilQwen: A Tale of Four Distilled Reasoning and Reward Model Series
por: Cai, Wenrui, et al.
Publicado: (2025)
por: Cai, Wenrui, et al.
Publicado: (2025)
Optimizing Language Augmentation for Multilingual Large Language Models: A Case Study on Korean
por: Choi, ChangSu, et al.
Publicado: (2024)
por: Choi, ChangSu, et al.
Publicado: (2024)
Nunchi-Bench: Benchmarking Language Models on Cultural Reasoning with a Focus on Korean Superstition
por: Kim, Kyuhee, et al.
Publicado: (2025)
por: Kim, Kyuhee, et al.
Publicado: (2025)
Thunder-KoNUBench: A Corpus-Aligned Benchmark for Korean Negation Understanding
por: Jung, Sungmok, et al.
Publicado: (2026)
por: Jung, Sungmok, et al.
Publicado: (2026)
Ejemplares similares
-
Smoothie-Qwen: Post-Hoc Smoothing to Reduce Language Bias in Multilingual LLMs
por: Ji, SeungWon, et al.
Publicado: (2025) -
DNA 1.0 Technical Report
por: Lee, Jungyup, et al.
Publicado: (2025) -
Handling Korean Out-of-Vocabulary Words with Phoneme Representation Learning
por: Kim, Nayeon, et al.
Publicado: (2025) -
A Mean-Reverting Model of Exchange Rate Risk Premium Using Ornstein-Uhlenbeck Dynamics
por: Hwang, SeungJae
Publicado: (2025) -
KOMBO: Korean Character Representations Based on the Combination Rules of Subcharacters
por: Kim, SungHo, et al.
Publicado: (2026)