Re-Align: Aligning Vision Language Models via Retrieval-Augmented Direct Preference Optimization
Fuente:
arXiv
Guardado en:
| Autores principales: | Xing, Shuo, Li, Peiran, Wang, Yuping, Bai, Ruizheng, Wang, Yueqi, Hu, Chan-Wei, Qian, Chengxuan, Yao, Huaxiu, Tu, Zhengzhong |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
DecAlign: Hierarchical Cross-Modal Alignment for Decoupled Multimodal Representation Learning
por: Qian, Chengxuan, et al.
Publicado: (2025)
por: Qian, Chengxuan, et al.
Publicado: (2025)
mRAG: Elucidating the Design Space of Multi-modal Retrieval-Augmented Generation
por: Hu, Chan-Wei, et al.
Publicado: (2025)
por: Hu, Chan-Wei, et al.
Publicado: (2025)
MMedPO: Aligning Medical Vision-Language Models with Clinical-Aware Multimodal Preference Optimization
por: Zhu, Kangyu, et al.
Publicado: (2024)
por: Zhu, Kangyu, et al.
Publicado: (2024)
Aligning Modalities in Vision Large Language Models via Preference Fine-tuning
por: Zhou, Yiyang, et al.
Publicado: (2024)
por: Zhou, Yiyang, et al.
Publicado: (2024)
Synergistic Weak-Strong Collaboration by Aligning Preferences
por: Jiao, Yizhu, et al.
Publicado: (2025)
por: Jiao, Yizhu, et al.
Publicado: (2025)
Region-R1: Reinforcing Query-Side Region Cropping for Multi-Modal Re-Ranking
por: Hu, Chan-Wei, et al.
Publicado: (2026)
por: Hu, Chan-Wei, et al.
Publicado: (2026)
VLM-3R: Vision-Language Models Augmented with Instruction-Aligned 3D Reconstruction
por: Fan, Zhiwen, et al.
Publicado: (2025)
por: Fan, Zhiwen, et al.
Publicado: (2025)
Aligning Large Vision-Language Models by Deep Reinforcement Learning and Direct Preference Optimization
por: Nguyen, Thanh Thi, et al.
Publicado: (2025)
por: Nguyen, Thanh Thi, et al.
Publicado: (2025)
Aligning CodeLLMs with Direct Preference Optimization
por: Miao, Yibo, et al.
Publicado: (2024)
por: Miao, Yibo, et al.
Publicado: (2024)
GuideSR: Rethinking Guidance for One-Step High-Fidelity Diffusion-Based Super-Resolution
por: Arora, Aditya, et al.
Publicado: (2025)
por: Arora, Aditya, et al.
Publicado: (2025)
Aligning Large Language Models with Searcher Preferences
por: Wu, Wei, et al.
Publicado: (2026)
por: Wu, Wei, et al.
Publicado: (2026)
ReAlign: Optimizing the Visual Document Retriever with Reasoning-Guided Fine-Grained Alignment
por: Yang, Hao, et al.
Publicado: (2026)
por: Yang, Hao, et al.
Publicado: (2026)
Can Large Vision Language Models Read Maps Like a Human?
por: Xing, Shuo, et al.
Publicado: (2025)
por: Xing, Shuo, et al.
Publicado: (2025)
Demystifying the Visual Quality Paradox in Multimodal Large Language Models
por: Xing, Shuo, et al.
Publicado: (2025)
por: Xing, Shuo, et al.
Publicado: (2025)
Edit Away and My Face Will not Stay: Personal Biometric Defense against Malicious Generative Editing
por: Wang, Hanhui, et al.
Publicado: (2024)
por: Wang, Hanhui, et al.
Publicado: (2024)
OpenEMMA: Open-Source Multimodal Model for End-to-End Autonomous Driving
por: Xing, Shuo, et al.
Publicado: (2024)
por: Xing, Shuo, et al.
Publicado: (2024)
SQL-Commenter: Aligning Large Language Models for SQL Comment Generation with Direct Preference Optimization
por: Yu, Lei, et al.
Publicado: (2026)
por: Yu, Lei, et al.
Publicado: (2026)
Smoothed Preference Optimization via ReNoise Inversion for Aligning Diffusion Models with Varied Human Preferences
por: Lu, Yunhong, et al.
Publicado: (2025)
por: Lu, Yunhong, et al.
Publicado: (2025)
AlignGroup: Learning and Aligning Group Consensus with Member Preferences for Group Recommendation
por: Xu, Jinfeng, et al.
Publicado: (2024)
por: Xu, Jinfeng, et al.
Publicado: (2024)
Aligning Diffusion Language Models via Unpaired Preference Optimization
por: Jindal, Vaibhav, et al.
Publicado: (2025)
por: Jindal, Vaibhav, et al.
Publicado: (2025)
RACE-Align: Retrieval-Augmented and Chain-of-Thought Enhanced Preference Alignment for Large Language Models
por: Yan, Qihang, et al.
Publicado: (2025)
por: Yan, Qihang, et al.
Publicado: (2025)
AdaptFuse: Training-Free Sequential Preference Learning via Externalized Bayesian Inference
por: Lin, Fangzhou, et al.
Publicado: (2026)
por: Lin, Fangzhou, et al.
Publicado: (2026)
AutoTrust: Benchmarking Trustworthiness in Large Vision Language Models for Autonomous Driving
por: Xing, Shuo, et al.
Publicado: (2024)
por: Xing, Shuo, et al.
Publicado: (2024)
D-Fusion: Direct Preference Optimization for Aligning Diffusion Models with Visually Consistent Samples
por: Hu, Zijing, et al.
Publicado: (2025)
por: Hu, Zijing, et al.
Publicado: (2025)
fMRI-LM: Towards a Universal Foundation Model for Language-Aligned fMRI Understanding
por: Wei, Yuxiang, et al.
Publicado: (2025)
por: Wei, Yuxiang, et al.
Publicado: (2025)
Aligning Language Models for Versatile Text-based Item Retrieval
por: Lei, Yuxuan, et al.
Publicado: (2024)
por: Lei, Yuxuan, et al.
Publicado: (2024)
AVC-DPO: Aligned Video Captioning via Direct Preference Optimization
por: Tang, Jiyang, et al.
Publicado: (2025)
por: Tang, Jiyang, et al.
Publicado: (2025)
Forward KL Regularized Preference Optimization for Aligning Diffusion Policies
por: Shan, Zhao, et al.
Publicado: (2024)
por: Shan, Zhao, et al.
Publicado: (2024)
Does RLVR Extend Reasoning Boundaries? Investigating Capability Expansion in Vision-Language Models
por: Shen, Minghe, et al.
Publicado: (2025)
por: Shen, Minghe, et al.
Publicado: (2025)
LifeAlign: Lifelong Alignment for Large Language Models with Memory-Augmented Focalized Preference Optimization
por: Li, Junsong, et al.
Publicado: (2025)
por: Li, Junsong, et al.
Publicado: (2025)
SpeechAlign: Aligning Speech Generation to Human Preferences
por: Zhang, Dong, et al.
Publicado: (2024)
por: Zhang, Dong, et al.
Publicado: (2024)
SEER: Self-Aligned Evidence Extraction for Retrieval-Augmented Generation
por: Zhao, Xinping, et al.
Publicado: (2024)
por: Zhao, Xinping, et al.
Publicado: (2024)
ADHMR: Aligning Diffusion-based Human Mesh Recovery via Direct Preference Optimization
por: Shen, Wenhao, et al.
Publicado: (2025)
por: Shen, Wenhao, et al.
Publicado: (2025)
UniOcc: A Unified Benchmark for Occupancy Forecasting and Prediction in Autonomous Driving
por: Wang, Yuping, et al.
Publicado: (2025)
por: Wang, Yuping, et al.
Publicado: (2025)
AlignDiff: Aligning Diverse Human Preferences via Behavior-Customisable Diffusion Model
por: Dong, Zibin, et al.
Publicado: (2023)
por: Dong, Zibin, et al.
Publicado: (2023)
MetaAlign: Align Large Language Models with Diverse Preferences during Inference Time
por: Zhang, Mozhi, et al.
Publicado: (2024)
por: Zhang, Mozhi, et al.
Publicado: (2024)
Aligning Multimodal Sequential Recommendations via Robust Direct Preference Optimization with Sparse MoE
por: Huang, Hejin, et al.
Publicado: (2026)
por: Huang, Hejin, et al.
Publicado: (2026)
MARS: Modality-Aligned Retrieval for Sequence Augmented CTR Prediction
por: Xiao, Yutian, et al.
Publicado: (2025)
por: Xiao, Yutian, et al.
Publicado: (2025)
Soft Preference Optimization: Aligning Language Models to Expert Distributions
por: Sharifnassab, Arsalan, et al.
Publicado: (2024)
por: Sharifnassab, Arsalan, et al.
Publicado: (2024)
Aligning Web Query Generation with Ranking Objectives via Direct Preference Optimization
por: Coelho, João, et al.
Publicado: (2025)
por: Coelho, João, et al.
Publicado: (2025)
Ejemplares similares
-
DecAlign: Hierarchical Cross-Modal Alignment for Decoupled Multimodal Representation Learning
por: Qian, Chengxuan, et al.
Publicado: (2025) -
mRAG: Elucidating the Design Space of Multi-modal Retrieval-Augmented Generation
por: Hu, Chan-Wei, et al.
Publicado: (2025) -
MMedPO: Aligning Medical Vision-Language Models with Clinical-Aware Multimodal Preference Optimization
por: Zhu, Kangyu, et al.
Publicado: (2024) -
Aligning Modalities in Vision Large Language Models via Preference Fine-tuning
por: Zhou, Yiyang, et al.
Publicado: (2024) -
Synergistic Weak-Strong Collaboration by Aligning Preferences
por: Jiao, Yizhu, et al.
Publicado: (2025)