Improving Conversational Abilities of Quantized Large Language Models via Direct Preference Alignment
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Lee, Janghwan, Park, Seongmin, Hong, Sukjin, Kim, Minsoo, Chang, Du-Seong, Choi, Jungwook |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
RILQ: Rank-Insensitive LoRA-based Quantization Error Compensation for Boosting 2-bit Large Language Model Accuracy
par: Lee, Geonho, et autres
Publié: (2024)
par: Lee, Geonho, et autres
Publié: (2024)
Enhancing Computation Efficiency in Large Language Models through Weight and Activation Quantization
par: Lee, Janghwan, et autres
Publié: (2023)
par: Lee, Janghwan, et autres
Publié: (2023)
InfiniPot: Infinite Context Processing on Memory-Constrained LLMs
par: Kim, Minsoo, et autres
Publié: (2024)
par: Kim, Minsoo, et autres
Publié: (2024)
Review-driven Personalized Preference Reasoning with Large Language Models for Recommendation
par: Kim, Jieyong, et autres
Publié: (2024)
par: Kim, Jieyong, et autres
Publié: (2024)
Improving Multi-lingual Alignment Through Soft Contrastive Learning
par: Park, Minsu, et autres
Publié: (2024)
par: Park, Minsu, et autres
Publié: (2024)
Selectively Dilated Convolution for Accuracy-Preserving Sparse Pillar-based Embedded 3D Object Detection
par: Park, Seongmin, et autres
Publié: (2024)
par: Park, Seongmin, et autres
Publié: (2024)
SPADE: Sparse Pillar-based 3D Object Detection Accelerator for Autonomous Driving
par: Lee, Minjae, et autres
Publié: (2023)
par: Lee, Minjae, et autres
Publié: (2023)
InfiniPot-V: Memory-Constrained KV Cache Compression for Streaming Video Understanding
par: Kim, Minsoo, et autres
Publié: (2025)
par: Kim, Minsoo, et autres
Publié: (2025)
Enhancing Psychotherapy Counseling: A Data Augmentation Pipeline Leveraging Large Language Models for Counseling Conversations
par: Kim, Jun-Woo, et autres
Publié: (2024)
par: Kim, Jun-Woo, et autres
Publié: (2024)
Spread Preference Annotation: Direct Preference Judgment for Efficient LLM Alignment
par: Kim, Dongyoung, et autres
Publié: (2024)
par: Kim, Dongyoung, et autres
Publié: (2024)
Enhancing Generalization in Data-free Quantization via Mixup-class Prompting
par: Park, Jiwoong, et autres
Publié: (2025)
par: Park, Jiwoong, et autres
Publié: (2025)
SAAS: Solving Ability Amplification Strategy for Enhanced Mathematical Reasoning in Large Language Models
par: Kim, Hyeonwoo, et autres
Publié: (2024)
par: Kim, Hyeonwoo, et autres
Publié: (2024)
MapCoder-Lite: Distilling Multi-Agent Coding into a Single Small LLM
par: Lee, Woongkyu, et autres
Publié: (2025)
par: Lee, Woongkyu, et autres
Publié: (2025)
AMXFP4: Taming Activation Outliers with Asymmetric Microscaling Floating-Point for 4-bit LLM Inference
par: Lee, Janghwan, et autres
Publié: (2024)
par: Lee, Janghwan, et autres
Publié: (2024)
OWQ: Outlier-Aware Weight Quantization for Efficient Fine-Tuning and Inference of Large Language Models
par: Lee, Changhun, et autres
Publié: (2023)
par: Lee, Changhun, et autres
Publié: (2023)
Benchmarking Direct Preference Optimization for Medical Large Vision-Language Models
par: Kim, Dain, et autres
Publié: (2026)
par: Kim, Dain, et autres
Publié: (2026)
Quantization-Aware Imitation-Learning for Resource-Efficient Robotic Control
par: Park, Seongmin, et autres
Publié: (2024)
par: Park, Seongmin, et autres
Publié: (2024)
How Language Directions Align with Token Geometry in Multilingual LLMs
par: Kim, JaeSeong, et autres
Publié: (2025)
par: Kim, JaeSeong, et autres
Publié: (2025)
Alignment Data Map for Efficient Preference Data Selection and Diagnosis
par: Lee, Seohyeong, et autres
Publié: (2025)
par: Lee, Seohyeong, et autres
Publié: (2025)
KITE: A Benchmark for Evaluating Korean Instruction-Following Abilities in Large Language Models
par: Kim, Dongjun, et autres
Publié: (2025)
par: Kim, Dongjun, et autres
Publié: (2025)
FedPDPO: Federated Personalized Direct Preference Optimization for Large Language Model Alignment
par: Zhu, Kewen, et autres
Publié: (2026)
par: Zhu, Kewen, et autres
Publié: (2026)
Zero-Shot Multi-Hop Question Answering via Monte-Carlo Tree Search with Large Language Models
par: Lee, Seongmin, et autres
Publié: (2024)
par: Lee, Seongmin, et autres
Publié: (2024)
Ask Optimal Questions: Aligning Large Language Models with Retriever's Preference in Conversation
par: Yoon, Chanwoong, et autres
Publié: (2024)
par: Yoon, Chanwoong, et autres
Publié: (2024)
Preference Alignment Improves Language Model-Based TTS
par: Tian, Jinchuan, et autres
Publié: (2024)
par: Tian, Jinchuan, et autres
Publié: (2024)
A Survey on Personalized and Pluralistic Preference Alignment in Large Language Models
par: Xie, Zhouhang, et autres
Publié: (2025)
par: Xie, Zhouhang, et autres
Publié: (2025)
DiaTool-DPO: Multi-Turn Direct Preference Optimization for Tool-Augmented Large Language Models
par: Jung, Sunghee, et autres
Publié: (2025)
par: Jung, Sunghee, et autres
Publié: (2025)
Enhancing the Reasoning Ability of Multimodal Large Language Models via Mixed Preference Optimization
par: Wang, Weiyun, et autres
Publié: (2024)
par: Wang, Weiyun, et autres
Publié: (2024)
SemPA: Improving Sentence Embeddings of Large Language Models through Semantic Preference Alignment
par: Chen, Ziyang, et autres
Publié: (2026)
par: Chen, Ziyang, et autres
Publié: (2026)
Saliency-Aware Quantized Imitation Learning for Efficient Robotic Control
par: Park, Seongmin, et autres
Publié: (2025)
par: Park, Seongmin, et autres
Publié: (2025)
Improving Mortality Prediction After Radiotherapy with Large Language Model Structuring of Large-Scale Unstructured Electronic Health Records
par: Park, Sangjoon, et autres
Publié: (2024)
par: Park, Sangjoon, et autres
Publié: (2024)
Reasoning Abilities of Large Language Models: In-Depth Analysis on the Abstraction and Reasoning Corpus
par: Lee, Seungpil, et autres
Publié: (2024)
par: Lee, Seungpil, et autres
Publié: (2024)
Model-Based Data-Centric AI: Bridging the Divide Between Academic Ideals and Industrial Pragmatism
par: Park, Chanjun, et autres
Publié: (2024)
par: Park, Chanjun, et autres
Publié: (2024)
From RLHF to Direct Alignment: A Theoretical Unification of Preference Learning for Large Language Models
par: Raheja, Tarun, et autres
Publié: (2026)
par: Raheja, Tarun, et autres
Publié: (2026)
Prefixing Attention Sinks can Mitigate Activation Outliers for Large Language Model Quantization
par: Son, Seungwoo, et autres
Publié: (2024)
par: Son, Seungwoo, et autres
Publié: (2024)
Can Large Language Models be Good Emotional Supporter? Mitigating Preference Bias on Emotional Support Conversation
par: Kang, Dongjin, et autres
Publié: (2024)
par: Kang, Dongjin, et autres
Publié: (2024)
Evaluating the Ability of Large Language Models to Reason about Cardinal Directions
par: Cohn, Anthony G, et autres
Publié: (2024)
par: Cohn, Anthony G, et autres
Publié: (2024)
Improving the Robustness of Large Language Models via Consistency Alignment
par: Zhao, Yukun, et autres
Publié: (2024)
par: Zhao, Yukun, et autres
Publié: (2024)
SeDi-Instruct: Enhancing Alignment of Language Models through Self-Directed Instruction Generation
par: Kim, Jungwoo, et autres
Publié: (2025)
par: Kim, Jungwoo, et autres
Publié: (2025)
Robust Preference Alignment via Directional Neighborhood Consensus
par: Mao, Ruochen, et autres
Publié: (2025)
par: Mao, Ruochen, et autres
Publié: (2025)
Direct Preference Knowledge Distillation for Large Language Models
par: Li, Yixing, et autres
Publié: (2024)
par: Li, Yixing, et autres
Publié: (2024)
Documents similaires
-
RILQ: Rank-Insensitive LoRA-based Quantization Error Compensation for Boosting 2-bit Large Language Model Accuracy
par: Lee, Geonho, et autres
Publié: (2024) -
Enhancing Computation Efficiency in Large Language Models through Weight and Activation Quantization
par: Lee, Janghwan, et autres
Publié: (2023) -
InfiniPot: Infinite Context Processing on Memory-Constrained LLMs
par: Kim, Minsoo, et autres
Publié: (2024) -
Review-driven Personalized Preference Reasoning with Large Language Models for Recommendation
par: Kim, Jieyong, et autres
Publié: (2024) -
Improving Multi-lingual Alignment Through Soft Contrastive Learning
par: Park, Minsu, et autres
Publié: (2024)