ZEBRA: Leveraging Model-Behavioral Knowledge for Zero-Annotation Preference Dataset Construction
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Jung, Jeesu, Park, Chanjun, Jung, Sangkeun |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Exploring Domain Robust Lightweight Reward Models based on Router Mechanism
par: Namgoong, Hyuk, et autres
Publié: (2024)
par: Namgoong, Hyuk, et autres
Publié: (2024)
LED: A Benchmark for Evaluating Layout Error Detection in Document Analysis
par: Heo, Inbum, et autres
Publié: (2026)
par: Heo, Inbum, et autres
Publié: (2026)
InstaTrans: An Instruction-Aware Translation Framework for Non-English Instruction Datasets
par: Kim, Yungi, et autres
Publié: (2024)
par: Kim, Yungi, et autres
Publié: (2024)
CoME: An Unlearning-based Approach to Conflict-free Model Editing
par: Jung, Dahyun, et autres
Publié: (2025)
par: Jung, Dahyun, et autres
Publié: (2025)
FLEX: A Benchmark for Evaluating Robustness of Fairness in Large Language Models
par: Jung, Dahyun, et autres
Publié: (2025)
par: Jung, Dahyun, et autres
Publié: (2025)
Alternative Speech: Complementary Method to Counter-Narrative for Better Discourse
par: Lee, Seungyoon, et autres
Publié: (2024)
par: Lee, Seungyoon, et autres
Publié: (2024)
Legend: Leveraging Representation Engineering to Annotate Safety Margin for Preference Datasets
par: Feng, Duanyu, et autres
Publié: (2024)
par: Feng, Duanyu, et autres
Publié: (2024)
Understanding LLM Development Through Longitudinal Study: Insights from the Open Ko-LLM Leaderboard
par: Park, Chanjun, et autres
Publié: (2024)
par: Park, Chanjun, et autres
Publié: (2024)
Exploring Cross-Cultural Differences in English Hate Speech Annotations: From Dataset Construction to Analysis
par: Lee, Nayeon, et autres
Publié: (2023)
par: Lee, Nayeon, et autres
Publié: (2023)
Model-Based Data-Centric AI: Bridging the Divide Between Academic Ideals and Industrial Pragmatism
par: Park, Chanjun, et autres
Publié: (2024)
par: Park, Chanjun, et autres
Publié: (2024)
Reasoning Steps as Curriculum: Using Depth of Thought as a Difficulty Signal for Tuning LLMs
par: Jung, Jeesu, et autres
Publié: (2025)
par: Jung, Jeesu, et autres
Publié: (2025)
ChatLang-8: An LLM-Based Synthetic Data Generation Framework for Grammatical Error Correction
par: Park, Jeiyoon, et autres
Publié: (2024)
par: Park, Jeiyoon, et autres
Publié: (2024)
CharacterGPT: A Persona Reconstruction Framework for Role-Playing Agents
par: Park, Jeiyoon, et autres
Publié: (2024)
par: Park, Jeiyoon, et autres
Publié: (2024)
KITE: A Benchmark for Evaluating Korean Instruction-Following Abilities in Large Language Models
par: Kim, Dongjun, et autres
Publié: (2025)
par: Kim, Dongjun, et autres
Publié: (2025)
Guidance-Based Prompt Data Augmentation in Specialized Domains for Named Entity Recognition
par: Kang, Hyeonseok, et autres
Publié: (2024)
par: Kang, Hyeonseok, et autres
Publié: (2024)
MIRAGE: A Metric-Intensive Benchmark for Retrieval-Augmented Generation Evaluation
par: Park, Chanhee, et autres
Publié: (2025)
par: Park, Chanhee, et autres
Publié: (2025)
Sensory-Aware Sequential Recommendation via Review-Distilled Representations
par: Yoon, Yeo Chan, et autres
Publié: (2026)
par: Yoon, Yeo Chan, et autres
Publié: (2026)
Evaluating Large Language Models on the 2026 Korean CSAT Mathematics Exam: Measuring Mathematical Ability in a Zero-Data-Leakage Setting
par: Pyeon, Goun, et autres
Publié: (2025)
par: Pyeon, Goun, et autres
Publié: (2025)
Dataverse: Open-Source ETL (Extract, Transform, Load) Pipeline for Large Language Models
par: Park, Hyunbyung, et autres
Publié: (2024)
par: Park, Hyunbyung, et autres
Publié: (2024)
Representing the Under-Represented: Cultural and Core Capability Benchmarks for Developing Thai Large Language Models
par: Kim, Dahyun, et autres
Publié: (2024)
par: Kim, Dahyun, et autres
Publié: (2024)
MultiDocFusion: Hierarchical and Multimodal Chunking Pipeline for Enhanced RAG on Long Industrial Documents
par: Shin, Joongmin, et autres
Publié: (2026)
par: Shin, Joongmin, et autres
Publié: (2026)
Improving Multi-hop Logical Reasoning in Knowledge Graphs with Context-Aware Query Representation Learning
par: Kim, Jeonghoon, et autres
Publié: (2024)
par: Kim, Jeonghoon, et autres
Publié: (2024)
MP2D: An Automated Topic Shift Dialogue Generation Framework Leveraging Knowledge Graphs
par: Hwang, Yerin, et autres
Publié: (2024)
par: Hwang, Yerin, et autres
Publié: (2024)
UniGen: Universal Domain Generalization for Sentiment Classification via Zero-shot Dataset Generation
par: Choi, Juhwan, et autres
Publié: (2024)
par: Choi, Juhwan, et autres
Publié: (2024)
Evalverse: Unified and Accessible Library for Large Language Model Evaluation
par: Kim, Jihoo, et autres
Publié: (2024)
par: Kim, Jihoo, et autres
Publié: (2024)
System Message Generation for User Preferences using Open-Source Models
par: Jeong, Minbyul, et autres
Publié: (2025)
par: Jeong, Minbyul, et autres
Publié: (2025)
LED Benchmark: Diagnosing Structural Layout Errors for Document Layout Analysis
par: Heo, Inbum, et autres
Publié: (2025)
par: Heo, Inbum, et autres
Publié: (2025)
LP Data Pipeline: Lightweight, Purpose-driven Data Pipeline for Large Language Models
par: Kim, Yungi, et autres
Publié: (2024)
par: Kim, Yungi, et autres
Publié: (2024)
Rethinking KenLM: Good and Bad Model Ensembles for Efficient Text Quality Filtering in Large Web Corpora
par: Kim, Yungi, et autres
Publié: (2024)
par: Kim, Yungi, et autres
Publié: (2024)
From Ambiguity to Accuracy: The Transformative Effect of Coreference Resolution on Retrieval-Augmented Generation systems
par: Jang, Youngjoon, et autres
Publié: (2025)
par: Jang, Youngjoon, et autres
Publié: (2025)
Personalized LLM Decoding via Contrasting Personal Preference
par: Bu, Hyungjune, et autres
Publié: (2025)
par: Bu, Hyungjune, et autres
Publié: (2025)
Graphusion: Leveraging Large Language Models for Scientific Knowledge Graph Fusion and Construction in NLP Education
par: Yang, Rui, et autres
Publié: (2024)
par: Yang, Rui, et autres
Publié: (2024)
TiTok: Transfer Token-level Knowledge via Contrastive Excess to Transplant LoRA
par: Jung, Chanjoo, et autres
Publié: (2025)
par: Jung, Chanjoo, et autres
Publié: (2025)
Aggregated Knowledge Model: Enhancing Domain-Specific QA with Fine-Tuned and Retrieval-Augmented Generation Models
par: Liu, Fengchen, et autres
Publié: (2024)
par: Liu, Fengchen, et autres
Publié: (2024)
VPO: Leveraging the Number of Votes in Preference Optimization
par: Cho, Jae Hyeon, et autres
Publié: (2024)
par: Cho, Jae Hyeon, et autres
Publié: (2024)
SAAS: Solving Ability Amplification Strategy for Enhanced Mathematical Reasoning in Large Language Models
par: Kim, Hyeonwoo, et autres
Publié: (2024)
par: Kim, Hyeonwoo, et autres
Publié: (2024)
HealthGenie: Empowering Users with Healthy Dietary Guidance through Knowledge Graph and Large Language Models
par: Gao, Fan, et autres
Publié: (2025)
par: Gao, Fan, et autres
Publié: (2025)
1 Trillion Token (1TT) Platform: A Novel Framework for Efficient Data Sharing and Compensation in Large Language Models
par: Park, Chanjun, et autres
Publié: (2024)
par: Park, Chanjun, et autres
Publié: (2024)
CLST: Cold-Start Mitigation in Knowledge Tracing by Aligning a Generative Language Model as a Students' Knowledge Tracer
par: Jung, Heeseok, et autres
Publié: (2024)
par: Jung, Heeseok, et autres
Publié: (2024)
From Patient Consultations to Graphs: Leveraging LLMs for Patient Journey Knowledge Graph Construction
par: Khatib, Hassan S. Al, et autres
Publié: (2025)
par: Khatib, Hassan S. Al, et autres
Publié: (2025)
Documents similaires
-
Exploring Domain Robust Lightweight Reward Models based on Router Mechanism
par: Namgoong, Hyuk, et autres
Publié: (2024) -
LED: A Benchmark for Evaluating Layout Error Detection in Document Analysis
par: Heo, Inbum, et autres
Publié: (2026) -
InstaTrans: An Instruction-Aware Translation Framework for Non-English Instruction Datasets
par: Kim, Yungi, et autres
Publié: (2024) -
CoME: An Unlearning-based Approach to Conflict-free Model Editing
par: Jung, Dahyun, et autres
Publié: (2025) -
FLEX: A Benchmark for Evaluating Robustness of Fairness in Large Language Models
par: Jung, Dahyun, et autres
Publié: (2025)