MJ-Bench: Is Your Multimodal Reward Model Really a Good Judge for Text-to-Image Generation?
Fuente:
arXiv
Salvato in:
| Autori principali: | Chen, Zhaorun, Du, Yichao, Wen, Zichen, Zhou, Yiyang, Cui, Chenhang, Weng, Zhenzhen, Tu, Haoqin, Wang, Chaoqi, Tong, Zhengwei, Huang, Qinglan, Chen, Canyu, Ye, Qinghao, Zhu, Zhihong, Zhang, Yuqing, Zhou, Jiawei, Zhao, Zhuokai, Rafailov, Rafael, Finn, Chelsea, Yao, Huaxiu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Aligning Modalities in Vision Large Language Models via Preference Fine-tuning
di: Zhou, Yiyang, et al.
Pubblicazione: (2024)
di: Zhou, Yiyang, et al.
Pubblicazione: (2024)
MJ-VIDEO: Fine-Grained Benchmarking and Rewarding Video Preferences in Video Generation
di: Tong, Haibo, et al.
Pubblicazione: (2025)
di: Tong, Haibo, et al.
Pubblicazione: (2025)
Fine-Grained Verifiers: Preference Modeling as Next-token Prediction in Vision-Language Alignment
di: Cui, Chenhang, et al.
Pubblicazione: (2024)
di: Cui, Chenhang, et al.
Pubblicazione: (2024)
HALC: Object Hallucination Reduction via Adaptive Focal-Contrast Decoding
di: Chen, Zhaorun, et al.
Pubblicazione: (2024)
di: Chen, Zhaorun, et al.
Pubblicazione: (2024)
Analyzing and Mitigating Object Hallucination in Large Vision-Language Models
di: Zhou, Yiyang, et al.
Pubblicazione: (2023)
di: Zhou, Yiyang, et al.
Pubblicazione: (2023)
AutoPRM: Automating Procedural Supervision for Multi-Step Reasoning via Controllable Question Decomposition
di: Chen, Zhaorun, et al.
Pubblicazione: (2024)
di: Chen, Zhaorun, et al.
Pubblicazione: (2024)
Calibrated Self-Rewarding Vision Language Models
di: Zhou, Yiyang, et al.
Pubblicazione: (2024)
di: Zhou, Yiyang, et al.
Pubblicazione: (2024)
Enhancing Vision-Language Model Reliability with Uncertainty-Guided Dropout Decoding
di: Fang, Yixiong, et al.
Pubblicazione: (2024)
di: Fang, Yixiong, et al.
Pubblicazione: (2024)
From $r$ to $Q^*$: Your Language Model is Secretly a Q-Function
di: Rafailov, Rafael, et al.
Pubblicazione: (2024)
di: Rafailov, Rafael, et al.
Pubblicazione: (2024)
Disentangling Length from Quality in Direct Preference Optimization
di: Park, Ryan, et al.
Pubblicazione: (2024)
di: Park, Ryan, et al.
Pubblicazione: (2024)
MMIE: Massive Multimodal Interleaved Comprehension Benchmark for Large Vision-Language Models
di: Xia, Peng, et al.
Pubblicazione: (2024)
di: Xia, Peng, et al.
Pubblicazione: (2024)
Improving Alignment in LVLMs with Debiased Self-Judgment
di: Yang, Sihan, et al.
Pubblicazione: (2025)
di: Yang, Sihan, et al.
Pubblicazione: (2025)
Efficient Imitation Learning with Conservative World Models
di: Kolev, Victor, et al.
Pubblicazione: (2024)
di: Kolev, Victor, et al.
Pubblicazione: (2024)
PERSONA: A Reproducible Testbed for Pluralistic Alignment
di: Castricato, Louis, et al.
Pubblicazione: (2024)
di: Castricato, Louis, et al.
Pubblicazione: (2024)
Can Knowledge Editing Really Correct Hallucinations?
di: Huang, Baixiang, et al.
Pubblicazione: (2024)
di: Huang, Baixiang, et al.
Pubblicazione: (2024)
Beyond Reward Hacking: Causal Rewards for Large Language Model Alignment
di: Wang, Chaoqi, et al.
Pubblicazione: (2025)
di: Wang, Chaoqi, et al.
Pubblicazione: (2025)
Preference Optimization with Multi-Sample Comparisons
di: Wang, Chaoqi, et al.
Pubblicazione: (2024)
di: Wang, Chaoqi, et al.
Pubblicazione: (2024)
Beyond Training: Dynamic Token Merging for Zero-Shot Video Understanding
di: Zhang, Yiming, et al.
Pubblicazione: (2024)
di: Zhang, Yiming, et al.
Pubblicazione: (2024)
RankCLIP: Ranking-Consistent Language-Image Pretraining
di: Zhang, Yiming, et al.
Pubblicazione: (2024)
di: Zhang, Yiming, et al.
Pubblicazione: (2024)
GRAPE: Generalizing Robot Policy via Preference Alignment
di: Zhang, Zijian, et al.
Pubblicazione: (2024)
di: Zhang, Zijian, et al.
Pubblicazione: (2024)
Token-Level LLM Collaboration via FusionRoute
di: Xiong, Nuoya, et al.
Pubblicazione: (2026)
di: Xiong, Nuoya, et al.
Pubblicazione: (2026)
MOTO: Offline Pre-training to Online Fine-tuning for Model-based Robot Learning
di: Rafailov, Rafael, et al.
Pubblicazione: (2024)
di: Rafailov, Rafael, et al.
Pubblicazione: (2024)
Direct Preference Optimization: Your Language Model is Secretly a Reward Model
di: Rafailov, Rafael, et al.
Pubblicazione: (2023)
di: Rafailov, Rafael, et al.
Pubblicazione: (2023)
Safe Reinforcement Learning via Hierarchical Adaptive Chance-Constraint Safeguards
di: Chen, Zhaorun, et al.
Pubblicazione: (2023)
di: Chen, Zhaorun, et al.
Pubblicazione: (2023)
Universal Neural Functionals
di: Zhou, Allan, et al.
Pubblicazione: (2024)
di: Zhou, Allan, et al.
Pubblicazione: (2024)
Does Doing Good Always Bring Good? Employees' Attribution Matters in Their Reactions to Proactive Corporate Social Responsibility
di: Qi Song, et al.
Pubblicazione: (2025)
di: Qi Song, et al.
Pubblicazione: (2025)
Just Enough Thinking: Efficient Reasoning with Adaptive Length Penalties Reinforcement Learning
di: Xiang, Violet, et al.
Pubblicazione: (2025)
di: Xiang, Violet, et al.
Pubblicazione: (2025)
Agent Q: Advanced Reasoning and Learning for Autonomous AI Agents
di: Putta, Pranav, et al.
Pubblicazione: (2024)
di: Putta, Pranav, et al.
Pubblicazione: (2024)
Conservative Prediction via Data-Driven Confidence Minimization
di: Choi, Caroline, et al.
Pubblicazione: (2023)
di: Choi, Caroline, et al.
Pubblicazione: (2023)
When Visualizing is the First Step to Reasoning: MIRA, a Benchmark for Visual Chain-of-Thought
di: Zhou, Yiyang, et al.
Pubblicazione: (2025)
di: Zhou, Yiyang, et al.
Pubblicazione: (2025)
Contrastive Preference Learning: Learning from Human Feedback without RL
di: Hejna, Joey, et al.
Pubblicazione: (2023)
di: Hejna, Joey, et al.
Pubblicazione: (2023)
Improving Domain Generalization with Domain Relations
di: Yao, Huaxiu, et al.
Pubblicazione: (2023)
di: Yao, Huaxiu, et al.
Pubblicazione: (2023)
Scaling Laws for Reward Model Overoptimization in Direct Alignment Algorithms
di: Rafailov, Rafael, et al.
Pubblicazione: (2024)
di: Rafailov, Rafael, et al.
Pubblicazione: (2024)
Export Market, Digital Empowerment and Female Skill Demand: Evidence From Online Recruitment Data
di: Jing Lu, et al.
Pubblicazione: (2026)
di: Jing Lu, et al.
Pubblicazione: (2026)
Are Synthetic Time-series Data Really not as Good as Real Data?
di: Fu, Fanzhe, et al.
Pubblicazione: (2024)
di: Fu, Fanzhe, et al.
Pubblicazione: (2024)
Can LLM-Generated Misinformation Be Detected?
di: Chen, Canyu, et al.
Pubblicazione: (2023)
di: Chen, Canyu, et al.
Pubblicazione: (2023)
Securing Reliability: A Brief Overview on Enhancing In-Context Learning for Foundation Models
di: Huang, Yunpeng, et al.
Pubblicazione: (2024)
di: Huang, Yunpeng, et al.
Pubblicazione: (2024)
Do Existing Testing Tools Really Uncover Gender Bias in Text-to-Image Models?
di: Lyu, Yunbo, et al.
Pubblicazione: (2025)
di: Lyu, Yunbo, et al.
Pubblicazione: (2025)
PointLLM-R: Enhancing 3D Point Cloud Reasoning via Chain-of-Thought
di: Chen, Chaoqi, et al.
Pubblicazione: (2026)
di: Chen, Chaoqi, et al.
Pubblicazione: (2026)
Preference Fine-Tuning of LLMs Should Leverage Suboptimal, On-Policy Data
di: Tajwar, Fahim, et al.
Pubblicazione: (2024)
di: Tajwar, Fahim, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Aligning Modalities in Vision Large Language Models via Preference Fine-tuning
di: Zhou, Yiyang, et al.
Pubblicazione: (2024) -
MJ-VIDEO: Fine-Grained Benchmarking and Rewarding Video Preferences in Video Generation
di: Tong, Haibo, et al.
Pubblicazione: (2025) -
Fine-Grained Verifiers: Preference Modeling as Next-token Prediction in Vision-Language Alignment
di: Cui, Chenhang, et al.
Pubblicazione: (2024) -
HALC: Object Hallucination Reduction via Adaptive Focal-Contrast Decoding
di: Chen, Zhaorun, et al.
Pubblicazione: (2024) -
Analyzing and Mitigating Object Hallucination in Large Vision-Language Models
di: Zhou, Yiyang, et al.
Pubblicazione: (2023)