ZEBRA: Leveraging Model-Behavioral Knowledge for Zero-Annotation Preference Dataset Construction
Fuente:
arXiv
Guardado en:
| Autores principales: | Jung, Jeesu, Park, Chanjun, Jung, Sangkeun |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Exploring Domain Robust Lightweight Reward Models based on Router Mechanism
por: Namgoong, Hyuk, et al.
Publicado: (2024)
por: Namgoong, Hyuk, et al.
Publicado: (2024)
LED: A Benchmark for Evaluating Layout Error Detection in Document Analysis
por: Heo, Inbum, et al.
Publicado: (2026)
por: Heo, Inbum, et al.
Publicado: (2026)
InstaTrans: An Instruction-Aware Translation Framework for Non-English Instruction Datasets
por: Kim, Yungi, et al.
Publicado: (2024)
por: Kim, Yungi, et al.
Publicado: (2024)
CoME: An Unlearning-based Approach to Conflict-free Model Editing
por: Jung, Dahyun, et al.
Publicado: (2025)
por: Jung, Dahyun, et al.
Publicado: (2025)
FLEX: A Benchmark for Evaluating Robustness of Fairness in Large Language Models
por: Jung, Dahyun, et al.
Publicado: (2025)
por: Jung, Dahyun, et al.
Publicado: (2025)
Alternative Speech: Complementary Method to Counter-Narrative for Better Discourse
por: Lee, Seungyoon, et al.
Publicado: (2024)
por: Lee, Seungyoon, et al.
Publicado: (2024)
Legend: Leveraging Representation Engineering to Annotate Safety Margin for Preference Datasets
por: Feng, Duanyu, et al.
Publicado: (2024)
por: Feng, Duanyu, et al.
Publicado: (2024)
Understanding LLM Development Through Longitudinal Study: Insights from the Open Ko-LLM Leaderboard
por: Park, Chanjun, et al.
Publicado: (2024)
por: Park, Chanjun, et al.
Publicado: (2024)
Exploring Cross-Cultural Differences in English Hate Speech Annotations: From Dataset Construction to Analysis
por: Lee, Nayeon, et al.
Publicado: (2023)
por: Lee, Nayeon, et al.
Publicado: (2023)
Model-Based Data-Centric AI: Bridging the Divide Between Academic Ideals and Industrial Pragmatism
por: Park, Chanjun, et al.
Publicado: (2024)
por: Park, Chanjun, et al.
Publicado: (2024)
Reasoning Steps as Curriculum: Using Depth of Thought as a Difficulty Signal for Tuning LLMs
por: Jung, Jeesu, et al.
Publicado: (2025)
por: Jung, Jeesu, et al.
Publicado: (2025)
ChatLang-8: An LLM-Based Synthetic Data Generation Framework for Grammatical Error Correction
por: Park, Jeiyoon, et al.
Publicado: (2024)
por: Park, Jeiyoon, et al.
Publicado: (2024)
CharacterGPT: A Persona Reconstruction Framework for Role-Playing Agents
por: Park, Jeiyoon, et al.
Publicado: (2024)
por: Park, Jeiyoon, et al.
Publicado: (2024)
KITE: A Benchmark for Evaluating Korean Instruction-Following Abilities in Large Language Models
por: Kim, Dongjun, et al.
Publicado: (2025)
por: Kim, Dongjun, et al.
Publicado: (2025)
Guidance-Based Prompt Data Augmentation in Specialized Domains for Named Entity Recognition
por: Kang, Hyeonseok, et al.
Publicado: (2024)
por: Kang, Hyeonseok, et al.
Publicado: (2024)
MIRAGE: A Metric-Intensive Benchmark for Retrieval-Augmented Generation Evaluation
por: Park, Chanhee, et al.
Publicado: (2025)
por: Park, Chanhee, et al.
Publicado: (2025)
Sensory-Aware Sequential Recommendation via Review-Distilled Representations
por: Yoon, Yeo Chan, et al.
Publicado: (2026)
por: Yoon, Yeo Chan, et al.
Publicado: (2026)
Evaluating Large Language Models on the 2026 Korean CSAT Mathematics Exam: Measuring Mathematical Ability in a Zero-Data-Leakage Setting
por: Pyeon, Goun, et al.
Publicado: (2025)
por: Pyeon, Goun, et al.
Publicado: (2025)
Dataverse: Open-Source ETL (Extract, Transform, Load) Pipeline for Large Language Models
por: Park, Hyunbyung, et al.
Publicado: (2024)
por: Park, Hyunbyung, et al.
Publicado: (2024)
Representing the Under-Represented: Cultural and Core Capability Benchmarks for Developing Thai Large Language Models
por: Kim, Dahyun, et al.
Publicado: (2024)
por: Kim, Dahyun, et al.
Publicado: (2024)
MultiDocFusion: Hierarchical and Multimodal Chunking Pipeline for Enhanced RAG on Long Industrial Documents
por: Shin, Joongmin, et al.
Publicado: (2026)
por: Shin, Joongmin, et al.
Publicado: (2026)
Improving Multi-hop Logical Reasoning in Knowledge Graphs with Context-Aware Query Representation Learning
por: Kim, Jeonghoon, et al.
Publicado: (2024)
por: Kim, Jeonghoon, et al.
Publicado: (2024)
MP2D: An Automated Topic Shift Dialogue Generation Framework Leveraging Knowledge Graphs
por: Hwang, Yerin, et al.
Publicado: (2024)
por: Hwang, Yerin, et al.
Publicado: (2024)
UniGen: Universal Domain Generalization for Sentiment Classification via Zero-shot Dataset Generation
por: Choi, Juhwan, et al.
Publicado: (2024)
por: Choi, Juhwan, et al.
Publicado: (2024)
Evalverse: Unified and Accessible Library for Large Language Model Evaluation
por: Kim, Jihoo, et al.
Publicado: (2024)
por: Kim, Jihoo, et al.
Publicado: (2024)
System Message Generation for User Preferences using Open-Source Models
por: Jeong, Minbyul, et al.
Publicado: (2025)
por: Jeong, Minbyul, et al.
Publicado: (2025)
LED Benchmark: Diagnosing Structural Layout Errors for Document Layout Analysis
por: Heo, Inbum, et al.
Publicado: (2025)
por: Heo, Inbum, et al.
Publicado: (2025)
LP Data Pipeline: Lightweight, Purpose-driven Data Pipeline for Large Language Models
por: Kim, Yungi, et al.
Publicado: (2024)
por: Kim, Yungi, et al.
Publicado: (2024)
Rethinking KenLM: Good and Bad Model Ensembles for Efficient Text Quality Filtering in Large Web Corpora
por: Kim, Yungi, et al.
Publicado: (2024)
por: Kim, Yungi, et al.
Publicado: (2024)
From Ambiguity to Accuracy: The Transformative Effect of Coreference Resolution on Retrieval-Augmented Generation systems
por: Jang, Youngjoon, et al.
Publicado: (2025)
por: Jang, Youngjoon, et al.
Publicado: (2025)
Personalized LLM Decoding via Contrasting Personal Preference
por: Bu, Hyungjune, et al.
Publicado: (2025)
por: Bu, Hyungjune, et al.
Publicado: (2025)
Graphusion: Leveraging Large Language Models for Scientific Knowledge Graph Fusion and Construction in NLP Education
por: Yang, Rui, et al.
Publicado: (2024)
por: Yang, Rui, et al.
Publicado: (2024)
TiTok: Transfer Token-level Knowledge via Contrastive Excess to Transplant LoRA
por: Jung, Chanjoo, et al.
Publicado: (2025)
por: Jung, Chanjoo, et al.
Publicado: (2025)
Aggregated Knowledge Model: Enhancing Domain-Specific QA with Fine-Tuned and Retrieval-Augmented Generation Models
por: Liu, Fengchen, et al.
Publicado: (2024)
por: Liu, Fengchen, et al.
Publicado: (2024)
VPO: Leveraging the Number of Votes in Preference Optimization
por: Cho, Jae Hyeon, et al.
Publicado: (2024)
por: Cho, Jae Hyeon, et al.
Publicado: (2024)
SAAS: Solving Ability Amplification Strategy for Enhanced Mathematical Reasoning in Large Language Models
por: Kim, Hyeonwoo, et al.
Publicado: (2024)
por: Kim, Hyeonwoo, et al.
Publicado: (2024)
HealthGenie: Empowering Users with Healthy Dietary Guidance through Knowledge Graph and Large Language Models
por: Gao, Fan, et al.
Publicado: (2025)
por: Gao, Fan, et al.
Publicado: (2025)
1 Trillion Token (1TT) Platform: A Novel Framework for Efficient Data Sharing and Compensation in Large Language Models
por: Park, Chanjun, et al.
Publicado: (2024)
por: Park, Chanjun, et al.
Publicado: (2024)
CLST: Cold-Start Mitigation in Knowledge Tracing by Aligning a Generative Language Model as a Students' Knowledge Tracer
por: Jung, Heeseok, et al.
Publicado: (2024)
por: Jung, Heeseok, et al.
Publicado: (2024)
From Patient Consultations to Graphs: Leveraging LLMs for Patient Journey Knowledge Graph Construction
por: Khatib, Hassan S. Al, et al.
Publicado: (2025)
por: Khatib, Hassan S. Al, et al.
Publicado: (2025)
Ejemplares similares
-
Exploring Domain Robust Lightweight Reward Models based on Router Mechanism
por: Namgoong, Hyuk, et al.
Publicado: (2024) -
LED: A Benchmark for Evaluating Layout Error Detection in Document Analysis
por: Heo, Inbum, et al.
Publicado: (2026) -
InstaTrans: An Instruction-Aware Translation Framework for Non-English Instruction Datasets
por: Kim, Yungi, et al.
Publicado: (2024) -
CoME: An Unlearning-based Approach to Conflict-free Model Editing
por: Jung, Dahyun, et al.
Publicado: (2025) -
FLEX: A Benchmark for Evaluating Robustness of Fairness in Large Language Models
por: Jung, Dahyun, et al.
Publicado: (2025)