$ϕ$-DPO: Fairness Direct Preference Optimization Approach to Continual Learning in Large Multimodal Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Truong, Thanh-Dat, Tran, Huu-Thien, Cothren, Jackson, Raj, Bhiksha, Luu, Khoa |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
FALCON: Fairness Learning via Contrastive Attention Approach to Continual Semantic Scene Understanding
di: Truong, Thanh-Dat, et al.
Pubblicazione: (2023)
di: Truong, Thanh-Dat, et al.
Pubblicazione: (2023)
Directed-Tokens: A Robust Multi-Modality Alignment Approach to Large Language-Vision Models
di: Truong, Thanh-Dat, et al.
Pubblicazione: (2025)
di: Truong, Thanh-Dat, et al.
Pubblicazione: (2025)
ED-SAM: An Efficient Diffusion Sampling Approach to Domain Generalization in Vision-Language Foundation Models
di: Truong, Thanh-Dat, et al.
Pubblicazione: (2024)
di: Truong, Thanh-Dat, et al.
Pubblicazione: (2024)
BIMA: Bijective Maximum Likelihood Learning Approach to Hallucination Prediction and Mitigation in Large Vision-Language Models
di: Tran, Huu-Thien, et al.
Pubblicazione: (2025)
di: Tran, Huu-Thien, et al.
Pubblicazione: (2025)
CONDA: Continual Unsupervised Domain Adaptation Learning in Visual Perception for Self-Driving Cars
di: Truong, Thanh-Dat, et al.
Pubblicazione: (2022)
di: Truong, Thanh-Dat, et al.
Pubblicazione: (2022)
MANGO: Multimodal Attention-based Normalizing Flow Approach to Fusion Learning
di: Truong, Thanh-Dat, et al.
Pubblicazione: (2025)
di: Truong, Thanh-Dat, et al.
Pubblicazione: (2025)
Cross-view Action Recognition Understanding From Exocentric to Egocentric Perspective
di: Truong, Thanh-Dat, et al.
Pubblicazione: (2023)
di: Truong, Thanh-Dat, et al.
Pubblicazione: (2023)
Multi-view Action Recognition via Directed Gromov-Wasserstein Discrepancy
di: Nguyen, Hoang-Quan, et al.
Pubblicazione: (2024)
di: Nguyen, Hoang-Quan, et al.
Pubblicazione: (2024)
BRAIN: Bias-Mitigation Continual Learning Approach to Vision-Brain Understanding
di: Nguyen, Xuan-Bac, et al.
Pubblicazione: (2025)
di: Nguyen, Xuan-Bac, et al.
Pubblicazione: (2025)
EAGLE: Efficient Adaptive Geometry-based Learning in Cross-view Understanding
di: Truong, Thanh-Dat, et al.
Pubblicazione: (2024)
di: Truong, Thanh-Dat, et al.
Pubblicazione: (2024)
Towards Robust and Fair Vision Learning in Open-World Environments
di: Truong, Thanh-Dat
Pubblicazione: (2024)
di: Truong, Thanh-Dat
Pubblicazione: (2024)
MEX: Memory-efficient Approach to Referring Multi-Object Tracking
di: Tran, Huu-Thien, et al.
Pubblicazione: (2025)
di: Tran, Huu-Thien, et al.
Pubblicazione: (2025)
DINTR: Tracking via Diffusion-based Interpolation
di: Nguyen, Pha, et al.
Pubblicazione: (2024)
di: Nguyen, Pha, et al.
Pubblicazione: (2024)
Insect-Foundation: A Foundation Model and Large Multimodal Dataset for Vision-Language Insect Understanding
di: Truong, Thanh-Dat, et al.
Pubblicazione: (2025)
di: Truong, Thanh-Dat, et al.
Pubblicazione: (2025)
CYCLO: Cyclic Graph Transformer Approach to Multi-Object Relationship Modeling in Aerial Videos
di: Nguyen, Trong-Thuan, et al.
Pubblicazione: (2024)
di: Nguyen, Trong-Thuan, et al.
Pubblicazione: (2024)
HyperGLM: HyperGraph for Video Scene Graph Generation and Anticipation
di: Nguyen, Trong-Thuan, et al.
Pubblicazione: (2024)
di: Nguyen, Trong-Thuan, et al.
Pubblicazione: (2024)
THYME: Temporal Hierarchical-Cyclic Interactivity Modeling for Video Scene Graphs in Aerial Footage
di: Nguyen, Trong-Thuan, et al.
Pubblicazione: (2025)
di: Nguyen, Trong-Thuan, et al.
Pubblicazione: (2025)
Insect-Foundation: A Foundation Model and Large-scale 1M Dataset for Visual Insect Understanding
di: Nguyen, Hoang-Quan, et al.
Pubblicazione: (2023)
di: Nguyen, Hoang-Quan, et al.
Pubblicazione: (2023)
SymDPO: Boosting In-Context Learning of Large Multimodal Models with Symbol Demonstration Direct Preference Optimization
di: Jia, Hongrui, et al.
Pubblicazione: (2024)
di: Jia, Hongrui, et al.
Pubblicazione: (2024)
FLAASH: Flow-Attention Adaptive Semantic Hierarchical Fusion for Multi-Modal Tobacco Content Analysis
di: Chappa, Naga VS Raviteja, et al.
Pubblicazione: (2024)
di: Chappa, Naga VS Raviteja, et al.
Pubblicazione: (2024)
DeDPO: Debiased Direct Preference Optimization for Diffusion Models
di: Pham, Khiem, et al.
Pubblicazione: (2026)
di: Pham, Khiem, et al.
Pubblicazione: (2026)
AVC-DPO: Aligned Video Captioning via Direct Preference Optimization
di: Tang, Jiyang, et al.
Pubblicazione: (2025)
di: Tang, Jiyang, et al.
Pubblicazione: (2025)
SEE-DPO: Self Entropy Enhanced Direct Preference Optimization
di: Shekhar, Shivanshu, et al.
Pubblicazione: (2024)
di: Shekhar, Shivanshu, et al.
Pubblicazione: (2024)
mDPO: Conditional Preference Optimization for Multimodal Large Language Models
di: Wang, Fei, et al.
Pubblicazione: (2024)
di: Wang, Fei, et al.
Pubblicazione: (2024)
DreamBoothDPO: Improving Personalized Generation using Direct Preference Optimization
di: Ayupov, Shamil, et al.
Pubblicazione: (2025)
di: Ayupov, Shamil, et al.
Pubblicazione: (2025)
VistaDPO: Video Hierarchical Spatial-Temporal Direct Preference Optimization for Large Video Models
di: Huang, Haojian, et al.
Pubblicazione: (2025)
di: Huang, Haojian, et al.
Pubblicazione: (2025)
MIA-DPO: Multi-Image Augmented Direct Preference Optimization For Large Vision-Language Models
di: Liu, Ziyu, et al.
Pubblicazione: (2024)
di: Liu, Ziyu, et al.
Pubblicazione: (2024)
V-DPO: Mitigating Hallucination in Large Vision Language Models via Vision-Guided Direct Preference Optimization
di: Xie, Yuxi, et al.
Pubblicazione: (2024)
di: Xie, Yuxi, et al.
Pubblicazione: (2024)
COBRA: A Continual Learning Approach to Vision-Brain Understanding
di: Nguyen, Xuan-Bac, et al.
Pubblicazione: (2024)
di: Nguyen, Xuan-Bac, et al.
Pubblicazione: (2024)
HuViDPO:Enhancing Video Generation through Direct Preference Optimization for Human-Centric Alignment
di: Jiang, Lifan, et al.
Pubblicazione: (2025)
di: Jiang, Lifan, et al.
Pubblicazione: (2025)
ISR-DPO: Aligning Large Multimodal Models for Videos by Iterative Self-Retrospective DPO
di: Ahn, Daechul, et al.
Pubblicazione: (2024)
di: Ahn, Daechul, et al.
Pubblicazione: (2024)
Reg-DPO: SFT-Regularized Direct Preference Optimization with GT-Pair for Improving Video Generation
di: Du, Jie, et al.
Pubblicazione: (2025)
di: Du, Jie, et al.
Pubblicazione: (2025)
Fast Online 3D Multi-Camera Multi-Object Tracking and Pose Estimation
di: Van Ma, Linh, et al.
Pubblicazione: (2026)
di: Van Ma, Linh, et al.
Pubblicazione: (2026)
HIG: Hierarchical Interlacement Graph Approach to Scene Graph Generation in Video Understanding
di: Nguyen, Trong-Thuan, et al.
Pubblicazione: (2023)
di: Nguyen, Trong-Thuan, et al.
Pubblicazione: (2023)
A Dual-Module Denoising Approach with Curriculum Learning for Enhancing Multimodal Aspect-Based Sentiment Analysis
di: Van Doan, Nguyen, et al.
Pubblicazione: (2024)
di: Van Doan, Nguyen, et al.
Pubblicazione: (2024)
RS-DPO: A Hybrid Rejection Sampling and Direct Preference Optimization Method for Alignment of Large Language Models
di: Khaki, Saeed, et al.
Pubblicazione: (2024)
di: Khaki, Saeed, et al.
Pubblicazione: (2024)
Curriculum-DPO++: Direct Preference Optimization via Data and Model Curricula for Text-to-Image Generation
di: Croitoru, Florinel-Alin, et al.
Pubblicazione: (2026)
di: Croitoru, Florinel-Alin, et al.
Pubblicazione: (2026)
DenseDPO: Fine-Grained Temporal Preference Optimization for Video Diffusion Models
di: Wu, Ziyi, et al.
Pubblicazione: (2025)
di: Wu, Ziyi, et al.
Pubblicazione: (2025)
S2H-DPO: Hardness-Aware Preference Optimization for Vision-Language Models
di: Shukla, Nitish, et al.
Pubblicazione: (2026)
di: Shukla, Nitish, et al.
Pubblicazione: (2026)
AS400-DET: Detection using Deep Learning Model for IBM i (AS/400)
di: Tran, Thanh, et al.
Pubblicazione: (2025)
di: Tran, Thanh, et al.
Pubblicazione: (2025)
Documenti analoghi
-
FALCON: Fairness Learning via Contrastive Attention Approach to Continual Semantic Scene Understanding
di: Truong, Thanh-Dat, et al.
Pubblicazione: (2023) -
Directed-Tokens: A Robust Multi-Modality Alignment Approach to Large Language-Vision Models
di: Truong, Thanh-Dat, et al.
Pubblicazione: (2025) -
ED-SAM: An Efficient Diffusion Sampling Approach to Domain Generalization in Vision-Language Foundation Models
di: Truong, Thanh-Dat, et al.
Pubblicazione: (2024) -
BIMA: Bijective Maximum Likelihood Learning Approach to Hallucination Prediction and Mitigation in Large Vision-Language Models
di: Tran, Huu-Thien, et al.
Pubblicazione: (2025) -
CONDA: Continual Unsupervised Domain Adaptation Learning in Visual Perception for Self-Driving Cars
di: Truong, Thanh-Dat, et al.
Pubblicazione: (2022)