Modality-Balancing Preference Optimization of Large Multimodal Models by Adversarial Negative Mining
Fuente:
arXiv
Salvato in:
| Autori principali: | Liu, Chenxi, Xiong, Tianyi, Chen, Yanshuo, Chen, Ruibo, Wu, Yihan, Guo, Junfeng, Zhou, Tianyi, Huang, Heng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
A Watermark for Order-Agnostic Language Models
di: Chen, Ruibo, et al.
Pubblicazione: (2024)
di: Chen, Ruibo, et al.
Pubblicazione: (2024)
Learning from Self-Debate: Preparing Reasoning Models for Multi-Agent Debate
di: Liu, Chenxi, et al.
Pubblicazione: (2026)
di: Liu, Chenxi, et al.
Pubblicazione: (2026)
Improved Unbiased Watermark for Large Language Models
di: Chen, Ruibo, et al.
Pubblicazione: (2025)
di: Chen, Ruibo, et al.
Pubblicazione: (2025)
De-mark: Watermark Removal in Large Language Models
di: Chen, Ruibo, et al.
Pubblicazione: (2024)
di: Chen, Ruibo, et al.
Pubblicazione: (2024)
Your Vision-Language Model Itself Is a Strong Filter: Towards High-Quality Instruction Tuning with Data Selection
di: Chen, Ruibo, et al.
Pubblicazione: (2024)
di: Chen, Ruibo, et al.
Pubblicazione: (2024)
Few-Shot Class Incremental Learning with Attention-Aware Self-Adaptive Prompt
di: Liu, Chenxi, et al.
Pubblicazione: (2024)
di: Liu, Chenxi, et al.
Pubblicazione: (2024)
Towards Copyright Protection for Knowledge Bases of Retrieval-augmented Language Models via Reasoning
di: Guo, Junfeng, et al.
Pubblicazione: (2025)
di: Guo, Junfeng, et al.
Pubblicazione: (2025)
LLaVA-Critic: Learning to Evaluate Multimodal Models
di: Xiong, Tianyi, et al.
Pubblicazione: (2024)
di: Xiong, Tianyi, et al.
Pubblicazione: (2024)
Importance Sampling for Multi-Negative Multimodal Direct Preference Optimization
di: Li, Xintong, et al.
Pubblicazione: (2025)
di: Li, Xintong, et al.
Pubblicazione: (2025)
Strengthening Multimodal Large Language Model with Bootstrapped Preference Optimization
di: Pi, Renjie, et al.
Pubblicazione: (2024)
di: Pi, Renjie, et al.
Pubblicazione: (2024)
OPTune: Efficient Online Preference Tuning
di: Chen, Lichang, et al.
Pubblicazione: (2024)
di: Chen, Lichang, et al.
Pubblicazione: (2024)
mDPO: Conditional Preference Optimization for Multimodal Large Language Models
di: Wang, Fei, et al.
Pubblicazione: (2024)
di: Wang, Fei, et al.
Pubblicazione: (2024)
Multi-Crit: Benchmarking Multimodal Judges on Pluralistic Criteria-Following
di: Xiong, Tianyi, et al.
Pubblicazione: (2025)
di: Xiong, Tianyi, et al.
Pubblicazione: (2025)
Why 1 + 1 < 1 in Visual Token Pruning: Beyond Naive Integration via Multi-Objective Balanced Covering
di: Li, Yangfu, et al.
Pubblicazione: (2025)
di: Li, Yangfu, et al.
Pubblicazione: (2025)
Enhancing the Reasoning Ability of Multimodal Large Language Models via Mixed Preference Optimization
di: Wang, Weiyun, et al.
Pubblicazione: (2024)
di: Wang, Weiyun, et al.
Pubblicazione: (2024)
RotBench: Evaluating Multimodal Large Language Models on Identifying Image Rotation
di: Niu, Tianyi, et al.
Pubblicazione: (2025)
di: Niu, Tianyi, et al.
Pubblicazione: (2025)
Enhancing Visual-Language Modality Alignment in Large Vision Language Models via Self-Improvement
di: Wang, Xiyao, et al.
Pubblicazione: (2024)
di: Wang, Xiyao, et al.
Pubblicazione: (2024)
Mitigating Hallucinations in Large Vision-Language Models via Entity-Centric Multimodal Preference Optimization
di: Wu, Jiulong, et al.
Pubblicazione: (2025)
di: Wu, Jiulong, et al.
Pubblicazione: (2025)
Debiasing Multimodal Large Language Models via Noise-Aware Preference Optimization
di: Zhang, Zefeng, et al.
Pubblicazione: (2025)
di: Zhang, Zefeng, et al.
Pubblicazione: (2025)
AdPO: Enhancing the Adversarial Robustness of Large Vision-Language Models with Preference Optimization
di: Liu, Chaohu, et al.
Pubblicazione: (2025)
di: Liu, Chaohu, et al.
Pubblicazione: (2025)
Sandboxed Coding Agents are Competitive Omni-modal Task Solvers
di: Chen, Dongping, et al.
Pubblicazione: (2026)
di: Chen, Dongping, et al.
Pubblicazione: (2026)
Clinical Cognition Alignment for Gastrointestinal Diagnosis with Multimodal LLMs
di: Zheng, Huan, et al.
Pubblicazione: (2026)
di: Zheng, Huan, et al.
Pubblicazione: (2026)
Towards Visual Text Grounding of Multimodal Large Language Model
di: Li, Ming, et al.
Pubblicazione: (2025)
di: Li, Ming, et al.
Pubblicazione: (2025)
CritiQ: Mining Data Quality Criteria from Human Preferences
di: Guo, Honglin, et al.
Pubblicazione: (2025)
di: Guo, Honglin, et al.
Pubblicazione: (2025)
Multimodal Prompt Learning with Missing Modalities for Sentiment Analysis and Emotion Recognition
di: Guo, Zirun, et al.
Pubblicazione: (2024)
di: Guo, Zirun, et al.
Pubblicazione: (2024)
MMGR: Multi-Modal Generative Reasoning
di: Cai, Zefan, et al.
Pubblicazione: (2025)
di: Cai, Zefan, et al.
Pubblicazione: (2025)
A Resilient and Accessible Distribution-Preserving Watermark for Large Language Models
di: Wu, Yihan, et al.
Pubblicazione: (2023)
di: Wu, Yihan, et al.
Pubblicazione: (2023)
More Haste, Less Speed: Weaker Single-Layer Watermark Improves Distortion-Free Watermark Ensembles
di: Chen, Ruibo, et al.
Pubblicazione: (2026)
di: Chen, Ruibo, et al.
Pubblicazione: (2026)
Towards Harmless Multimodal Assistants with Blind Preference Optimization
di: Li, Yongqi, et al.
Pubblicazione: (2025)
di: Li, Yongqi, et al.
Pubblicazione: (2025)
Benchmarking Direct Preference Optimization for Medical Large Vision-Language Models
di: Kim, Dain, et al.
Pubblicazione: (2026)
di: Kim, Dain, et al.
Pubblicazione: (2026)
R1-SyntheticVL: Is Synthetic Data from Generative Models Ready for Multimodal Large Language Model?
di: Zhang, Jingyi, et al.
Pubblicazione: (2026)
di: Zhang, Jingyi, et al.
Pubblicazione: (2026)
LLMs Improving LLMs: Agentic Discovery for Test-Time Scaling
di: Zheng, Tong, et al.
Pubblicazione: (2026)
di: Zheng, Tong, et al.
Pubblicazione: (2026)
How Language Models Process Negation
di: Zhou, Zhejian, et al.
Pubblicazione: (2026)
di: Zhou, Zhejian, et al.
Pubblicazione: (2026)
Optimizing Length Compression in Large Reasoning Models
di: Cheng, Zhengxiang, et al.
Pubblicazione: (2025)
di: Cheng, Zhengxiang, et al.
Pubblicazione: (2025)
Uncertainty-Aware Exploratory Direct Preference Optimization for Multimodal Large Language Models
di: Zhang, Huatian, et al.
Pubblicazione: (2026)
di: Zhang, Huatian, et al.
Pubblicazione: (2026)
Aligning Modalities in Vision Large Language Models via Preference Fine-tuning
di: Zhou, Yiyang, et al.
Pubblicazione: (2024)
di: Zhou, Yiyang, et al.
Pubblicazione: (2024)
Multi-Objective Linguistic Control of Large Language Models
di: Nguyen, Dang, et al.
Pubblicazione: (2024)
di: Nguyen, Dang, et al.
Pubblicazione: (2024)
HallusionBench: An Advanced Diagnostic Suite for Entangled Language Hallucination and Visual Illusion in Large Vision-Language Models
di: Guan, Tianrui, et al.
Pubblicazione: (2023)
di: Guan, Tianrui, et al.
Pubblicazione: (2023)
DiffPO: Diffusion-styled Preference Optimization for Efficient Inference-Time Alignment of Large Language Models
di: Chen, Ruizhe, et al.
Pubblicazione: (2025)
di: Chen, Ruizhe, et al.
Pubblicazione: (2025)
Robust Multimodal Large Language Models Against Modality Conflict
di: Zhang, Zongmeng, et al.
Pubblicazione: (2025)
di: Zhang, Zongmeng, et al.
Pubblicazione: (2025)
Documenti analoghi
-
A Watermark for Order-Agnostic Language Models
di: Chen, Ruibo, et al.
Pubblicazione: (2024) -
Learning from Self-Debate: Preparing Reasoning Models for Multi-Agent Debate
di: Liu, Chenxi, et al.
Pubblicazione: (2026) -
Improved Unbiased Watermark for Large Language Models
di: Chen, Ruibo, et al.
Pubblicazione: (2025) -
De-mark: Watermark Removal in Large Language Models
di: Chen, Ruibo, et al.
Pubblicazione: (2024) -
Your Vision-Language Model Itself Is a Strong Filter: Towards High-Quality Instruction Tuning with Data Selection
di: Chen, Ruibo, et al.
Pubblicazione: (2024)