S2H-DPO: Hardness-Aware Preference Optimization for Vision-Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Shukla, Nitish, Jandial, Surgan, Ross, Arun |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Enhancing Single-Image Facial Demorphing using Multimodal Large Language Models
par: Shukla, Nitish, et autres
Publié: (2026)
par: Shukla, Nitish, et autres
Publié: (2026)
dc-GAN: Dual-Conditioned GAN for Face Demorphing From a Single Morph
par: Shukla, Nitish, et autres
Publié: (2024)
par: Shukla, Nitish, et autres
Publié: (2024)
Facial Demorphing via Identity Preserving Image Decomposition
par: Shukla, Nitish, et autres
Publié: (2024)
par: Shukla, Nitish, et autres
Publié: (2024)
Facial Demorphing from a Single Morph Using a Latent Conditional GAN
par: Shukla, Nitish, et autres
Publié: (2025)
par: Shukla, Nitish, et autres
Publié: (2025)
Metric for Evaluating Performance of Reference-Free Demorphing Methods
par: Shukla, Nitish, et autres
Publié: (2025)
par: Shukla, Nitish, et autres
Publié: (2025)
diffDemorph: Extending Reference-Free Demorphing to Unseen Faces
par: Shukla, Nitish, et autres
Publié: (2025)
par: Shukla, Nitish, et autres
Publié: (2025)
LEAST: "Local" text-conditioned image style transfer
par: Singh, Silky, et autres
Publié: (2024)
par: Singh, Silky, et autres
Publié: (2024)
ReEdit: Multimodal Exemplar-Based Image Editing with Diffusion Models
par: Srivastava, Ashutosh, et autres
Publié: (2024)
par: Srivastava, Ashutosh, et autres
Publié: (2024)
Towards Efficient Exemplar Based Image Editing with Multimodal VLMs
par: Jadhav, Avadhoot, et autres
Publié: (2025)
par: Jadhav, Avadhoot, et autres
Publié: (2025)
Benchmarking Foundation Models for Zero-Shot Biometric Tasks
par: Sony, Redwan, et autres
Publié: (2025)
par: Sony, Redwan, et autres
Publié: (2025)
CLIP-DPO: Vision-Language Models as a Source of Preference for Fixing Hallucinations in LVLMs
par: Ouali, Yassine, et autres
Publié: (2024)
par: Ouali, Yassine, et autres
Publié: (2024)
MIA-DPO: Multi-Image Augmented Direct Preference Optimization For Large Vision-Language Models
par: Liu, Ziyu, et autres
Publié: (2024)
par: Liu, Ziyu, et autres
Publié: (2024)
V-DPO: Mitigating Hallucination in Large Vision Language Models via Vision-Guided Direct Preference Optimization
par: Xie, Yuxi, et autres
Publié: (2024)
par: Xie, Yuxi, et autres
Publié: (2024)
DeDPO: Debiased Direct Preference Optimization for Diffusion Models
par: Pham, Khiem, et autres
Publié: (2026)
par: Pham, Khiem, et autres
Publié: (2026)
DenseDPO: Fine-Grained Temporal Preference Optimization for Video Diffusion Models
par: Wu, Ziyi, et autres
Publié: (2025)
par: Wu, Ziyi, et autres
Publié: (2025)
VL-DPO: Vision-Language-Guided Finetuning for Preference-Aligned Autonomous Driving
par: Xu, Zhefan, et autres
Publié: (2026)
par: Xu, Zhefan, et autres
Publié: (2026)
AVC-DPO: Aligned Video Captioning via Direct Preference Optimization
par: Tang, Jiyang, et autres
Publié: (2025)
par: Tang, Jiyang, et autres
Publié: (2025)
mDPO: Conditional Preference Optimization for Multimodal Large Language Models
par: Wang, Fei, et autres
Publié: (2024)
par: Wang, Fei, et autres
Publié: (2024)
When Preferences Diverge: Aligning Diffusion Models with Minority-Aware Adaptive DPO
par: Zhang, Lingfan, et autres
Publié: (2025)
par: Zhang, Lingfan, et autres
Publié: (2025)
DreamBoothDPO: Improving Personalized Generation using Direct Preference Optimization
par: Ayupov, Shamil, et autres
Publié: (2025)
par: Ayupov, Shamil, et autres
Publié: (2025)
SymDPO: Boosting In-Context Learning of Large Multimodal Models with Symbol Demonstration Direct Preference Optimization
par: Jia, Hongrui, et autres
Publié: (2024)
par: Jia, Hongrui, et autres
Publié: (2024)
SEE-DPO: Self Entropy Enhanced Direct Preference Optimization
par: Shekhar, Shivanshu, et autres
Publié: (2024)
par: Shekhar, Shivanshu, et autres
Publié: (2024)
RealDPO: Real or Not Real, that is the Preference
par: Cheng, Guo, et autres
Publié: (2025)
par: Cheng, Guo, et autres
Publié: (2025)
Mitigating Hallucinations in Large Vision-Language Models via DPO: On-Policy Data Hold the Key
par: Yang, Zhihe, et autres
Publié: (2025)
par: Yang, Zhihe, et autres
Publié: (2025)
HuViDPO:Enhancing Video Generation through Direct Preference Optimization for Human-Centric Alignment
par: Jiang, Lifan, et autres
Publié: (2025)
par: Jiang, Lifan, et autres
Publié: (2025)
InpaintDPO: Mitigating Spatial Relationship Hallucinations in Foreground-conditioned Inpainting via Diverse Preference Optimization
par: Li, Qirui, et autres
Publié: (2025)
par: Li, Qirui, et autres
Publié: (2025)
$ϕ$-DPO: Fairness Direct Preference Optimization Approach to Continual Learning in Large Multimodal Models
par: Truong, Thanh-Dat, et autres
Publié: (2026)
par: Truong, Thanh-Dat, et autres
Publié: (2026)
VistaDPO: Video Hierarchical Spatial-Temporal Direct Preference Optimization for Large Video Models
par: Huang, Haojian, et autres
Publié: (2025)
par: Huang, Haojian, et autres
Publié: (2025)
LPOI: Listwise Preference Optimization for Vision Language Models
par: Zadeh, Fatemeh Pesaran, et autres
Publié: (2025)
par: Zadeh, Fatemeh Pesaran, et autres
Publié: (2025)
Benchmarking Direct Preference Optimization for Medical Large Vision-Language Models
par: Kim, Dain, et autres
Publié: (2026)
par: Kim, Dain, et autres
Publié: (2026)
Delta-LLaVA: Base-then-Specialize Alignment for Token-Efficient Vision-Language Models
par: Zamini, Mohamad, et autres
Publié: (2025)
par: Zamini, Mohamad, et autres
Publié: (2025)
Task Preference Optimization: Improving Multimodal Large Language Models with Vision Task Alignment
par: Yan, Ziang, et autres
Publié: (2024)
par: Yan, Ziang, et autres
Publié: (2024)
RS-DPO: A Hybrid Rejection Sampling and Direct Preference Optimization Method for Alignment of Large Language Models
par: Khaki, Saeed, et autres
Publié: (2024)
par: Khaki, Saeed, et autres
Publié: (2024)
ISR-DPO: Aligning Large Multimodal Models for Videos by Iterative Self-Retrospective DPO
par: Ahn, Daechul, et autres
Publié: (2024)
par: Ahn, Daechul, et autres
Publié: (2024)
Zero-Shot Product Attribute Labeling with Vision-Language Models: A Three-Tier Evaluation Framework
par: Shukla, Shubham, et autres
Publié: (2026)
par: Shukla, Shubham, et autres
Publié: (2026)
Reg-DPO: SFT-Regularized Direct Preference Optimization with GT-Pair for Improving Video Generation
par: Du, Jie, et autres
Publié: (2025)
par: Du, Jie, et autres
Publié: (2025)
Iris-SAM: Iris Segmentation Using a Foundation Model
par: Farmanifard, Parisa, et autres
Publié: (2024)
par: Farmanifard, Parisa, et autres
Publié: (2024)
Debiasing Multimodal Large Language Models via Noise-Aware Preference Optimization
par: Zhang, Zefeng, et autres
Publié: (2025)
par: Zhang, Zefeng, et autres
Publié: (2025)
Unified Generation and Self-Verification for Vision-Language Models via Advantage Decoupled Preference Optimization
par: Qiu, Xinyu, et autres
Publié: (2026)
par: Qiu, Xinyu, et autres
Publié: (2026)
Uni-DPO: A Unified Paradigm for Dynamic Preference Optimization of LLMs
par: Peng, Shangpin, et autres
Publié: (2025)
par: Peng, Shangpin, et autres
Publié: (2025)
Documents similaires
-
Enhancing Single-Image Facial Demorphing using Multimodal Large Language Models
par: Shukla, Nitish, et autres
Publié: (2026) -
dc-GAN: Dual-Conditioned GAN for Face Demorphing From a Single Morph
par: Shukla, Nitish, et autres
Publié: (2024) -
Facial Demorphing via Identity Preserving Image Decomposition
par: Shukla, Nitish, et autres
Publié: (2024) -
Facial Demorphing from a Single Morph Using a Latent Conditional GAN
par: Shukla, Nitish, et autres
Publié: (2025) -
Metric for Evaluating Performance of Reference-Free Demorphing Methods
par: Shukla, Nitish, et autres
Publié: (2025)