Diffusion-Classifier Synergy: Reward-Aligned Learning via Mutual Boosting Loop for FSCIL
Fuente:
arXiv
Guardado en:
| Autores principales: | Wu, Ruitao, Zhao, Yifan, Chen, Guangyao, Li, Jia |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Learning Yourself: Class-Incremental Semantic Segmentation with Language-Inspired Bootstrapped Disentanglement
por: Wu, Ruitao, et al.
Publicado: (2025)
por: Wu, Ruitao, et al.
Publicado: (2025)
PL-FSCIL: Harnessing the Power of Prompts for Few-Shot Class-Incremental Learning
por: Tian, Songsong, et al.
Publicado: (2024)
por: Tian, Songsong, et al.
Publicado: (2024)
Mamba-FSCIL: Dynamic Adaptation with Selective State Space Model for Few-Shot Class-Incremental Learning
por: Li, Xiaojie, et al.
Publicado: (2024)
por: Li, Xiaojie, et al.
Publicado: (2024)
PC-Diffusion: Aligning Diffusion Models with Human Preferences via Preference Classifier
por: Wang, Shaomeng, et al.
Publicado: (2025)
por: Wang, Shaomeng, et al.
Publicado: (2025)
A Dense Reward View on Aligning Text-to-Image Diffusion with Preference
por: Yang, Shentao, et al.
Publicado: (2024)
por: Yang, Shentao, et al.
Publicado: (2024)
RewardSDS: Aligning Score Distillation via Reward-Weighted Sampling
por: Chachy, Itay, et al.
Publicado: (2025)
por: Chachy, Itay, et al.
Publicado: (2025)
Aligning Few-Step Diffusion Models with Dense Reward Difference Learning
por: Zhang, Ziyi, et al.
Publicado: (2024)
por: Zhang, Ziyi, et al.
Publicado: (2024)
RFSR: Improving ISR Diffusion Models via Reward Feedback Learning
por: Sun, Xiaopeng, et al.
Publicado: (2024)
por: Sun, Xiaopeng, et al.
Publicado: (2024)
MutualVPR: A Mutual Learning Framework for Resolving Supervision Inconsistencies via Adaptive Clustering
por: Gu, Qiwen, et al.
Publicado: (2024)
por: Gu, Qiwen, et al.
Publicado: (2024)
DiffusionReward: Enhancing Blind Face Restoration through Reward Feedback Learning
por: Wu, Bin, et al.
Publicado: (2025)
por: Wu, Bin, et al.
Publicado: (2025)
Boosting Audio Visual Question Answering via Key Semantic-Aware Cues
por: Li, Guangyao, et al.
Publicado: (2024)
por: Li, Guangyao, et al.
Publicado: (2024)
AVC-DPO: Aligned Video Captioning via Direct Preference Optimization
por: Tang, Jiyang, et al.
Publicado: (2025)
por: Tang, Jiyang, et al.
Publicado: (2025)
PISCES: Annotation-free Text-to-Video Post-Training via Optimal Transport-Aligned Rewards
por: Le, Minh-Quan, et al.
Publicado: (2026)
por: Le, Minh-Quan, et al.
Publicado: (2026)
Geo-Align: Video Generation Alignment via Metric Geometry Reward
por: Li, Zizun, et al.
Publicado: (2026)
por: Li, Zizun, et al.
Publicado: (2026)
Diffusion-DRF: Free, Rich, and Differentiable Reward for Video Diffusion Fine-Tuning
por: Wang, Yifan, et al.
Publicado: (2026)
por: Wang, Yifan, et al.
Publicado: (2026)
RefReward-SR: LR-Conditioned Reward Modeling for Preference-Aligned Super-Resolution
por: Song, Yushuai, et al.
Publicado: (2026)
por: Song, Yushuai, et al.
Publicado: (2026)
When Every Millisecond Counts: Real-Time Anomaly Detection via the Multimodal Asynchronous Hybrid Network
por: Xiao, Dong, et al.
Publicado: (2025)
por: Xiao, Dong, et al.
Publicado: (2025)
How to Use Diffusion Priors under Sparse Views?
por: Wang, Qisen, et al.
Publicado: (2024)
por: Wang, Qisen, et al.
Publicado: (2024)
Nodule-Aligned Latent Space Learning with LLM-Driven Multimodal Diffusion for Lung Nodule Progression Prediction
por: Song, James, et al.
Publicado: (2026)
por: Song, James, et al.
Publicado: (2026)
Diffusion Reward: Learning Rewards via Conditional Video Diffusion
por: Huang, Tao, et al.
Publicado: (2023)
por: Huang, Tao, et al.
Publicado: (2023)
PointSmile: Point Self-supervised Learning via Curriculum Mutual Information
por: Li, Xin, et al.
Publicado: (2023)
por: Li, Xin, et al.
Publicado: (2023)
StereoDiff: Stereo-Diffusion Synergy for Video Depth Estimation
por: Li, Haodong, et al.
Publicado: (2025)
por: Li, Haodong, et al.
Publicado: (2025)
AlignDiff: Learning Physically-Grounded Camera Alignment via Diffusion
por: Xie, Liuyue, et al.
Publicado: (2025)
por: Xie, Liuyue, et al.
Publicado: (2025)
Accurate Explanation Model for Image Classifiers using Class Association Embedding
por: Xie, Ruitao, et al.
Publicado: (2024)
por: Xie, Ruitao, et al.
Publicado: (2024)
Provoking Multi-modal Few-Shot LVLM via Exploration-Exploitation In-Context Learning
por: Chen, Cheng, et al.
Publicado: (2025)
por: Chen, Cheng, et al.
Publicado: (2025)
AssetDropper: Asset Extraction via Diffusion Models with Reward-Driven Optimization
por: Li, Lanjiong, et al.
Publicado: (2025)
por: Li, Lanjiong, et al.
Publicado: (2025)
MotionRL: Align Text-to-Motion Generation to Human Preferences with Multi-Reward Reinforcement Learning
por: Liu, Xiaoyang, et al.
Publicado: (2024)
por: Liu, Xiaoyang, et al.
Publicado: (2024)
ChronosObserver: Taming 4D World with Hyperspace Diffusion Sampling
por: Wang, Qisen, et al.
Publicado: (2025)
por: Wang, Qisen, et al.
Publicado: (2025)
Boosting Latent Diffusion Models via Disentangled Representation Alignment
por: Page, John, et al.
Publicado: (2026)
por: Page, John, et al.
Publicado: (2026)
Uni-Classifier: Leveraging Video Diffusion Priors for Universal Guidance Classifier
por: Zhou, Yujie, et al.
Publicado: (2026)
por: Zhou, Yujie, et al.
Publicado: (2026)
Boosting Virtual Agent Learning and Reasoning: A Step-Wise, Multi-Dimensional, and Generalist Reward Model with Benchmark
por: Miao, Bingchen, et al.
Publicado: (2025)
por: Miao, Bingchen, et al.
Publicado: (2025)
Improving Vision-language Models with Perception-centric Process Reward Models
por: Min, Yingqian, et al.
Publicado: (2026)
por: Min, Yingqian, et al.
Publicado: (2026)
AlignGen: Boosting Personalized Image Generation with Cross-Modality Prior Alignment
por: Lin, Yiheng, et al.
Publicado: (2025)
por: Lin, Yiheng, et al.
Publicado: (2025)
AToM: Aligning Text-to-Motion Model at Event-Level with GPT-4Vision Reward
por: Han, Haonan, et al.
Publicado: (2024)
por: Han, Haonan, et al.
Publicado: (2024)
AlignTok: Aligning Visual Foundation Encoders to Tokenizers for Diffusion Models
por: Chen, Bowei, et al.
Publicado: (2025)
por: Chen, Bowei, et al.
Publicado: (2025)
Enhancing Diffusion-based Restoration Models via Difficulty-Adaptive Reinforcement Learning with IQA Reward
por: Xu, Xiaogang, et al.
Publicado: (2025)
por: Xu, Xiaogang, et al.
Publicado: (2025)
ReAlign: Text-to-Motion Generation via Step-Aware Reward-Guided Alignment
por: Weng, Wanjiang, et al.
Publicado: (2025)
por: Weng, Wanjiang, et al.
Publicado: (2025)
Boosting Adverse Weather Crowd Counting via Multi-queue Contrastive Learning
por: Pan, Tianhang, et al.
Publicado: (2024)
por: Pan, Tianhang, et al.
Publicado: (2024)
M3Depth: Wavelet-Enhanced Depth Estimation on Mars via Mutual Boosting of Dual-Modal Data
por: Li, Junjie, et al.
Publicado: (2025)
por: Li, Junjie, et al.
Publicado: (2025)
EditReward: A Human-Aligned Reward Model for Instruction-Guided Image Editing
por: Wu, Keming, et al.
Publicado: (2025)
por: Wu, Keming, et al.
Publicado: (2025)
Ejemplares similares
-
Learning Yourself: Class-Incremental Semantic Segmentation with Language-Inspired Bootstrapped Disentanglement
por: Wu, Ruitao, et al.
Publicado: (2025) -
PL-FSCIL: Harnessing the Power of Prompts for Few-Shot Class-Incremental Learning
por: Tian, Songsong, et al.
Publicado: (2024) -
Mamba-FSCIL: Dynamic Adaptation with Selective State Space Model for Few-Shot Class-Incremental Learning
por: Li, Xiaojie, et al.
Publicado: (2024) -
PC-Diffusion: Aligning Diffusion Models with Human Preferences via Preference Classifier
por: Wang, Shaomeng, et al.
Publicado: (2025) -
A Dense Reward View on Aligning Text-to-Image Diffusion with Preference
por: Yang, Shentao, et al.
Publicado: (2024)