Retrieval-Augmented Fine-Tuning With Preference Optimization For Visual Program Generation
Fuente:
arXiv
Guardado en:
| Autores principales: | Kang, Deokhyung, Cho, Jeonghun, Jeon, Yejin, Jang, Sunbin, Lee, Minsub, Cho, Jawoon, Lee, Gary Geunbae |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
K-COMP: Retrieval-Augmented Medical Domain Question Answering With Knowledge-Injected Compressor
por: Cho, Jeonghun, et al.
Publicado: (2025)
por: Cho, Jeonghun, et al.
Publicado: (2025)
Self-Correcting Code Generation Using Small Language Models
por: Cho, Jeonghun, et al.
Publicado: (2025)
por: Cho, Jeonghun, et al.
Publicado: (2025)
Denoising Table-Text Retrieval for Open-Domain Question Answering
por: Kang, Deokhyung, et al.
Publicado: (2024)
por: Kang, Deokhyung, et al.
Publicado: (2024)
Learning When to Translate for Multilingual Reasoning
por: Kang, Deokhyung, et al.
Publicado: (2026)
por: Kang, Deokhyung, et al.
Publicado: (2026)
Ontology-Free General-Domain Knowledge Graph-to-Text Generation Dataset Synthesis using Large Language Model
por: Kim, Daehee, et al.
Publicado: (2024)
por: Kim, Daehee, et al.
Publicado: (2024)
Cross-lingual Back-Parsing: Utterance Synthesis from Meaning Representation for Zero-Resource Semantic Parsing
por: Kang, Deokhyung, et al.
Publicado: (2024)
por: Kang, Deokhyung, et al.
Publicado: (2024)
Safeguarding RAG Pipelines with GMTP: A Gradient-based Masked Token Probability Method for Poisoned Document Detection
por: Kim, San, et al.
Publicado: (2025)
por: Kim, San, et al.
Publicado: (2025)
Why Do Multilingual Reasoning Gaps Emerge in Reasoning Language Models?
por: Kang, Deokhyung, et al.
Publicado: (2025)
por: Kang, Deokhyung, et al.
Publicado: (2025)
EnSToM: Enhancing Dialogue Systems with Entropy-Scaled Steering Vectors for Topic Maintenance
por: Suh, Heejae, et al.
Publicado: (2025)
por: Suh, Heejae, et al.
Publicado: (2025)
Merging Triggers, Breaking Backdoors: Defensive Poisoning for Instruction-Tuned Language Models
por: Kim, San, et al.
Publicado: (2026)
por: Kim, San, et al.
Publicado: (2026)
An Investigation Into Explainable Audio Hate Speech Detection
por: An, Jinmyeong, et al.
Publicado: (2024)
por: An, Jinmyeong, et al.
Publicado: (2024)
Speak & Spell: LLM-Driven Controllable Phonetic Error Augmentation for Robust Dialogue State Tracking
por: Lee, Jihyun, et al.
Publicado: (2024)
por: Lee, Jihyun, et al.
Publicado: (2024)
GuRE:Generative Query REwriter for Legal Passage Retrieval
por: Kim, Daehee, et al.
Publicado: (2025)
por: Kim, Daehee, et al.
Publicado: (2025)
Autoregressive Score Generation for Multi-trait Essay Scoring
por: Do, Heejin, et al.
Publicado: (2024)
por: Do, Heejin, et al.
Publicado: (2024)
Model Fusion through Bayesian Optimization in Language Model Fine-Tuning
por: Jang, Chaeyun, et al.
Publicado: (2024)
por: Jang, Chaeyun, et al.
Publicado: (2024)
Preference Packing: Efficient Preference Optimization for Large Language Models
por: Cho, Jaekyung
Publicado: (2026)
por: Cho, Jaekyung
Publicado: (2026)
Mixture-of-Experts with Intermediate CTC Supervision for Accented Speech Recognition
por: Lee, Wonjun, et al.
Publicado: (2026)
por: Lee, Wonjun, et al.
Publicado: (2026)
Difficulty-Controllable Cloze Question Distractor Generation
por: Kang, Seokhoon, et al.
Publicado: (2025)
por: Kang, Seokhoon, et al.
Publicado: (2025)
STEPER: Step-wise Knowledge Distillation for Enhancing Reasoning Ability in Multi-Step Retrieval-Augmented Language Models
por: Lee, Kyumin, et al.
Publicado: (2025)
por: Lee, Kyumin, et al.
Publicado: (2025)
Key-Element-Informed sLLM Tuning for Document Summarization
por: Ryu, Sangwon, et al.
Publicado: (2024)
por: Ryu, Sangwon, et al.
Publicado: (2024)
Multi-Facet Blending for Faceted Query-by-Example Retrieval
por: Do, Heejin, et al.
Publicado: (2024)
por: Do, Heejin, et al.
Publicado: (2024)
Leveraging the Interplay Between Syntactic and Acoustic Cues for Optimizing Korean TTS Pause Formation
por: Jeon, Yejin, et al.
Publicado: (2024)
por: Jeon, Yejin, et al.
Publicado: (2024)
PSY-STEP: Structuring Therapeutic Targets and Action Sequences for Proactive Counseling Dialogue Systems
por: Lee, Jihyun, et al.
Publicado: (2026)
por: Lee, Jihyun, et al.
Publicado: (2026)
Adversarial DPO: Harnessing Harmful Data for Reducing Toxicity with Minimal Impact on Coherence and Evasiveness in Dialogue Agents
por: Kim, San, et al.
Publicado: (2024)
por: Kim, San, et al.
Publicado: (2024)
Leveraging What's Overfixed: Post-Correction via LLM Grammatical Error Overcorrection
por: Park, Taehee, et al.
Publicado: (2025)
por: Park, Taehee, et al.
Publicado: (2025)
Teach-to-Reason with Scoring: Self-Explainable Rationale-Driven Multi-Trait Essay Scoring
por: Do, Heejin, et al.
Publicado: (2025)
por: Do, Heejin, et al.
Publicado: (2025)
Autoregressive Multi-trait Essay Scoring via Reinforcement Learning with Scoring-aware Multiple Rewards
por: Do, Heejin, et al.
Publicado: (2024)
por: Do, Heejin, et al.
Publicado: (2024)
Towards Prompt Generalization: Grammar-aware Cross-Prompt Automated Essay Scoring
por: Do, Heejin, et al.
Publicado: (2025)
por: Do, Heejin, et al.
Publicado: (2025)
VPO: Leveraging the Number of Votes in Preference Optimization
por: Cho, Jae Hyeon, et al.
Publicado: (2024)
por: Cho, Jae Hyeon, et al.
Publicado: (2024)
DSG-KD: Knowledge Distillation from Domain-Specific to General Language Models
por: Cho, Sangyeon, et al.
Publicado: (2024)
por: Cho, Sangyeon, et al.
Publicado: (2024)
Instruction Tuning with Human Curriculum
por: Lee, Bruce W., et al.
Publicado: (2023)
por: Lee, Bruce W., et al.
Publicado: (2023)
Reliable Decision Making via Calibration Oriented Retrieval Augmented Generation
por: Jang, Chaeyun, et al.
Publicado: (2024)
por: Jang, Chaeyun, et al.
Publicado: (2024)
Multi-Dimensional Optimization for Text Summarization via Reinforcement Learning
por: Ryu, Sangwon, et al.
Publicado: (2024)
por: Ryu, Sangwon, et al.
Publicado: (2024)
MIRROR: Multimodal Cognitive Reframing Therapy for Rolling with Resistance
por: Kim, Subin, et al.
Publicado: (2025)
por: Kim, Subin, et al.
Publicado: (2025)
Acoustic Feature Mixup for Balanced Multi-aspect Pronunciation Assessment
por: Do, Heejin, et al.
Publicado: (2024)
por: Do, Heejin, et al.
Publicado: (2024)
Unlocking Fine-Grained and Within-Utterance Speaking Style Control in Prompt-Based Text-to-Speech Models
por: Kang, Jaehoon, et al.
Publicado: (2026)
por: Kang, Jaehoon, et al.
Publicado: (2026)
Aggregated Knowledge Model: Enhancing Domain-Specific QA with Fine-Tuned and Retrieval-Augmented Generation Models
por: Liu, Fengchen, et al.
Publicado: (2024)
por: Liu, Fengchen, et al.
Publicado: (2024)
PanicToCalm: A Proactive Counseling Agent for Panic Attacks
por: Lee, Jihyun, et al.
Publicado: (2025)
por: Lee, Jihyun, et al.
Publicado: (2025)
Multimodal Cognitive Reframing Therapy via Multi-hop Psychotherapeutic Reasoning
por: Kim, Subin, et al.
Publicado: (2025)
por: Kim, Subin, et al.
Publicado: (2025)
Distilling LLM Agent into Small Models with Retrieval and Code Tools
por: Kang, Minki, et al.
Publicado: (2025)
por: Kang, Minki, et al.
Publicado: (2025)
Ejemplares similares
-
K-COMP: Retrieval-Augmented Medical Domain Question Answering With Knowledge-Injected Compressor
por: Cho, Jeonghun, et al.
Publicado: (2025) -
Self-Correcting Code Generation Using Small Language Models
por: Cho, Jeonghun, et al.
Publicado: (2025) -
Denoising Table-Text Retrieval for Open-Domain Question Answering
por: Kang, Deokhyung, et al.
Publicado: (2024) -
Learning When to Translate for Multilingual Reasoning
por: Kang, Deokhyung, et al.
Publicado: (2026) -
Ontology-Free General-Domain Knowledge Graph-to-Text Generation Dataset Synthesis using Large Language Model
por: Kim, Daehee, et al.
Publicado: (2024)