Fake it till You Make it: Reward Modeling as Discriminative Prediction
Fuente:
arXiv
Salvato in:
| Autori principali: | Liu, Runtao, Zhan, Jiahao, He, Yingqing, Wei, Chen, Yuille, Alan, Chen, Qifeng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
VideoDPO: Omni-Preference Alignment for Video Diffusion Generation
di: Liu, Runtao, et al.
Pubblicazione: (2024)
di: Liu, Runtao, et al.
Pubblicazione: (2024)
ModelGrow: Continual Text-to-Video Pre-training with Model Expansion and Language Understanding Enhancement
di: Rao, Zhefan, et al.
Pubblicazione: (2024)
di: Rao, Zhefan, et al.
Pubblicazione: (2024)
Latent Guard: a Safety Framework for Text-to-image Generation
di: Liu, Runtao, et al.
Pubblicazione: (2024)
di: Liu, Runtao, et al.
Pubblicazione: (2024)
LongVideoAgent: Multi-Agent Reasoning with Long Videos
di: Liu, Runtao, et al.
Pubblicazione: (2025)
di: Liu, Runtao, et al.
Pubblicazione: (2025)
AlignGuard: Scalable Safety Alignment for Text-to-Image Generation
di: Liu, Runtao, et al.
Pubblicazione: (2024)
di: Liu, Runtao, et al.
Pubblicazione: (2024)
Robust-R1: Degradation-Aware Reasoning for Robust Visual Understanding
di: Tang, Jiaqi, et al.
Pubblicazione: (2025)
di: Tang, Jiaqi, et al.
Pubblicazione: (2025)
Leveraging AI Predicted and Expert Revised Annotations in Interactive Segmentation: Continual Tuning or Full Training?
di: Zhang, Tiezheng, et al.
Pubblicazione: (2024)
di: Zhang, Tiezheng, et al.
Pubblicazione: (2024)
Dynamic Analysis and Adaptive Discriminator for Fake News Detection
di: Su, Xinqi, et al.
Pubblicazione: (2024)
di: Su, Xinqi, et al.
Pubblicazione: (2024)
Fake It till You Make It: Curricular Dynamic Forgery Augmentations towards General Deepfake Detection
di: Lin, Yuzhen, et al.
Pubblicazione: (2024)
di: Lin, Yuzhen, et al.
Pubblicazione: (2024)
LLMs Meet Multimodal Generation and Editing: A Survey
di: He, Yingqing, et al.
Pubblicazione: (2024)
di: He, Yingqing, et al.
Pubblicazione: (2024)
Shared LoRA Subspaces for almost Strict Continual Learning
di: Kaushik, Prakhar, et al.
Pubblicazione: (2026)
di: Kaushik, Prakhar, et al.
Pubblicazione: (2026)
The Universal Weight Subspace Hypothesis
di: Kaushik, Prakhar, et al.
Pubblicazione: (2025)
di: Kaushik, Prakhar, et al.
Pubblicazione: (2025)
SpA2V: Harnessing Spatial Auditory Cues for Audio-driven Spatially-aware Video Generation
di: Pham, Kien T., et al.
Pubblicazione: (2025)
di: Pham, Kien T., et al.
Pubblicazione: (2025)
FoundObj: Self-supervised Foundation Models as Rewards for Label-free 3D Object Segmentation
di: Zhang, Zihui, et al.
Pubblicazione: (2026)
di: Zhang, Zihui, et al.
Pubblicazione: (2026)
Ancestral Mamba: Enhancing Selective Discriminant Space Model with Online Visual Prototype Learning for Efficient and Robust Discriminant Approach
di: Qin, Jiahao, et al.
Pubblicazione: (2025)
di: Qin, Jiahao, et al.
Pubblicazione: (2025)
A Bayesian Approach to OOD Robustness in Image Classification
di: Kaushik, Prakhar, et al.
Pubblicazione: (2024)
di: Kaushik, Prakhar, et al.
Pubblicazione: (2024)
Differences That Matter: Auditing Models for Capability Gap Discovery and Rectification
di: Liu, Qihao, et al.
Pubblicazione: (2025)
di: Liu, Qihao, et al.
Pubblicazione: (2025)
GENFIG1: Visual Summaries of Scholarly Work as a Challenge for Vision-Language Models
di: Guan, Yaohan, et al.
Pubblicazione: (2026)
di: Guan, Yaohan, et al.
Pubblicazione: (2026)
Fake It Till You Make It: Using Synthetic Data and Domain Knowledge for Improved Text-Based Learning for LGE Detection
di: Jacob, Athira J, et al.
Pubblicazione: (2025)
di: Jacob, Athira J, et al.
Pubblicazione: (2025)
Zoom and Shift are All You Need
di: Qin, Jiahao
Pubblicazione: (2024)
di: Qin, Jiahao
Pubblicazione: (2024)
GARDO: Reinforcing Diffusion Models without Reward Hacking
di: He, Haoran, et al.
Pubblicazione: (2025)
di: He, Haoran, et al.
Pubblicazione: (2025)
MosaicFusion: Diffusion Models as Data Augmenters for Large Vocabulary Instance Segmentation
di: Xie, Jiahao, et al.
Pubblicazione: (2023)
di: Xie, Jiahao, et al.
Pubblicazione: (2023)
Open Your Eyes: Vision Enhances Message Passing Neural Networks in Link Prediction
di: Wei, Yanbin, et al.
Pubblicazione: (2025)
di: Wei, Yanbin, et al.
Pubblicazione: (2025)
Can You Count to Nine? A Human Evaluation Benchmark for Counting Limits in Modern Text-to-Video Models
di: Guo, Xuyang, et al.
Pubblicazione: (2025)
di: Guo, Xuyang, et al.
Pubblicazione: (2025)
RewardFlow: Generate Images by Optimizing What You Reward
di: Susladkar, Onkar, et al.
Pubblicazione: (2026)
di: Susladkar, Onkar, et al.
Pubblicazione: (2026)
Spatial457: A Diagnostic Benchmark for 6D Spatial Reasoning of Large Multimodal Models
di: Wang, Xingrui, et al.
Pubblicazione: (2025)
di: Wang, Xingrui, et al.
Pubblicazione: (2025)
The Paradigm Shift: A Comprehensive Survey on Large Vision Language Models for Multimodal Fake News Detection
di: Ai, Wei, et al.
Pubblicazione: (2026)
di: Ai, Wei, et al.
Pubblicazione: (2026)
Towards High-Order Mean Flow Generative Models: Feasibility, Expressivity, and Provably Efficient Criteria
di: Cao, Yang, et al.
Pubblicazione: (2025)
di: Cao, Yang, et al.
Pubblicazione: (2025)
Source-Free and Image-Only Unsupervised Domain Adaptation for Category Level Object Pose Estimation
di: Kaushik, Prakhar, et al.
Pubblicazione: (2024)
di: Kaushik, Prakhar, et al.
Pubblicazione: (2024)
Masking Improves Contrastive Self-Supervised Learning for ConvNets, and Saliency Tells You Where
di: Chin, Zhi-Yi, et al.
Pubblicazione: (2023)
di: Chin, Zhi-Yi, et al.
Pubblicazione: (2023)
Compositional 4D Dynamic Scenes Understanding with Physics Priors for Video Question Answering
di: Wang, Xingrui, et al.
Pubblicazione: (2024)
di: Wang, Xingrui, et al.
Pubblicazione: (2024)
Using Human Feedback to Fine-tune Diffusion Models without Any Reward Model
di: Yang, Kai, et al.
Pubblicazione: (2023)
di: Yang, Kai, et al.
Pubblicazione: (2023)
FuRL: Visual-Language Models as Fuzzy Rewards for Reinforcement Learning
di: Fu, Yuwei, et al.
Pubblicazione: (2024)
di: Fu, Yuwei, et al.
Pubblicazione: (2024)
Intention-aware Denoising Diffusion Model for Trajectory Prediction
di: Liu, Chen, et al.
Pubblicazione: (2024)
di: Liu, Chen, et al.
Pubblicazione: (2024)
Online Reward-Weighted Fine-Tuning of Flow Matching with Wasserstein Regularization
di: Fan, Jiajun, et al.
Pubblicazione: (2025)
di: Fan, Jiajun, et al.
Pubblicazione: (2025)
Reward Score Matching: Unifying Reward-based Fine-tuning for Flow and Diffusion Models
di: Lee, Jeongjae, et al.
Pubblicazione: (2026)
di: Lee, Jeongjae, et al.
Pubblicazione: (2026)
Occlusion-Aware Diffusion Model for Pedestrian Intention Prediction
di: Liu, Yu, et al.
Pubblicazione: (2025)
di: Liu, Yu, et al.
Pubblicazione: (2025)
IG Captioner: Information Gain Captioners are Strong Zero-shot Classifiers
di: Yang, Chenglin, et al.
Pubblicazione: (2023)
di: Yang, Chenglin, et al.
Pubblicazione: (2023)
Perception-R1: Advancing Multimodal Reasoning Capabilities of MLLMs via Visual Perception Reward
di: Xiao, Tong, et al.
Pubblicazione: (2025)
di: Xiao, Tong, et al.
Pubblicazione: (2025)
VideoRewardBench: Comprehensive Evaluation of Multimodal Reward Models for Video Understanding
di: Zhang, Zhihong, et al.
Pubblicazione: (2025)
di: Zhang, Zhihong, et al.
Pubblicazione: (2025)
Documenti analoghi
-
VideoDPO: Omni-Preference Alignment for Video Diffusion Generation
di: Liu, Runtao, et al.
Pubblicazione: (2024) -
ModelGrow: Continual Text-to-Video Pre-training with Model Expansion and Language Understanding Enhancement
di: Rao, Zhefan, et al.
Pubblicazione: (2024) -
Latent Guard: a Safety Framework for Text-to-image Generation
di: Liu, Runtao, et al.
Pubblicazione: (2024) -
LongVideoAgent: Multi-Agent Reasoning with Long Videos
di: Liu, Runtao, et al.
Pubblicazione: (2025) -
AlignGuard: Scalable Safety Alignment for Text-to-Image Generation
di: Liu, Runtao, et al.
Pubblicazione: (2024)