Beyond the Dirac Delta: Mitigating Diversity Collapse in Reinforcement Fine-Tuning for Versatile Image Generation
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Liu, Jinmei, Li, Haoru, Sun, Zhenhong, Chen, Chaofeng, Bian, Yatao, Wang, Bo, Dong, Daoyi, Chen, Chunlin, Wang, Zhi |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Scalable In-Context Q-Learning
von: Liu, Jinmei, et al.
Veröffentlicht: (2025)
von: Liu, Jinmei, et al.
Veröffentlicht: (2025)
Mixture-of-Experts Meets In-Context Reinforcement Learning
von: Wu, Wenhao, et al.
Veröffentlicht: (2025)
von: Wu, Wenhao, et al.
Veröffentlicht: (2025)
Tomography of Quantum States from Structured Measurements via quantum-aware transformer
von: Ma, Hailan, et al.
Veröffentlicht: (2023)
von: Ma, Hailan, et al.
Veröffentlicht: (2023)
StoryBlender: Inter-Shot Consistent and Editable 3D Storyboard with Spatial-temporal Dynamics
von: Li, Bingliang, et al.
Veröffentlicht: (2026)
von: Li, Bingliang, et al.
Veröffentlicht: (2026)
Text-to-Decision Agent: Offline Meta-Reinforcement Learning from Natural Language Supervision
von: Zhang, Shilin, et al.
Veröffentlicht: (2025)
von: Zhang, Shilin, et al.
Veröffentlicht: (2025)
Continual Offline Reinforcement Learning via Diffusion-based Dual Generative Replay
von: Liu, Jinmei, et al.
Veröffentlicht: (2024)
von: Liu, Jinmei, et al.
Veröffentlicht: (2024)
Learning Informative Latent Representation for Quantum State Tomography
von: Ma, Hailan, et al.
Veröffentlicht: (2023)
von: Ma, Hailan, et al.
Veröffentlicht: (2023)
T$^3$-S2S: Training-free Triplet Tuning for Sketch to Scene Synthesis in Controllable Concept Art Generation
von: Sun, Zhenhong, et al.
Veröffentlicht: (2024)
von: Sun, Zhenhong, et al.
Veröffentlicht: (2024)
Hierarchical and Step-Layer-Wise Tuning of Attention Specialty for Multi-Instance Synthesis in Diffusion Transformers
von: Zhang, Chunyang, et al.
Veröffentlicht: (2025)
von: Zhang, Chunyang, et al.
Veröffentlicht: (2025)
Diversity-Incentivized Exploration for Versatile Reasoning
von: Hu, Zican, et al.
Veröffentlicht: (2025)
von: Hu, Zican, et al.
Veröffentlicht: (2025)
Conditional Diffusion Model for Multi-Agent Dynamic Task Decomposition
von: Zhu, Yanda, et al.
Veröffentlicht: (2025)
von: Zhu, Yanda, et al.
Veröffentlicht: (2025)
Learning Diverse Natural Behaviors for Enhancing the Agility of Quadrupedal Robots
von: Fu, Huiqiao, et al.
Veröffentlicht: (2025)
von: Fu, Huiqiao, et al.
Veröffentlicht: (2025)
Safe Delta: Consistently Preserving Safety when Fine-Tuning LLMs on Diverse Datasets
von: Lu, Ning, et al.
Veröffentlicht: (2025)
von: Lu, Ning, et al.
Veröffentlicht: (2025)
3DXTalker: Unifying Identity, Lip Sync, Emotion, and Spatial Dynamics in Expressive 3D Talking Avatars
von: Wang, Zhongju, et al.
Veröffentlicht: (2026)
von: Wang, Zhongju, et al.
Veröffentlicht: (2026)
How Interpretable Are Interpretable Graph Neural Networks?
von: Chen, Yongqiang, et al.
Veröffentlicht: (2024)
von: Chen, Yongqiang, et al.
Veröffentlicht: (2024)
DiverseGRPO: Mitigating Mode Collapse in Image Generation via Diversity-Aware GRPO
von: Liu, Henglin, et al.
Veröffentlicht: (2025)
von: Liu, Henglin, et al.
Veröffentlicht: (2025)
Preserving Diversity in Supervised Fine-Tuning of Large Language Models
von: Li, Ziniu, et al.
Veröffentlicht: (2024)
von: Li, Ziniu, et al.
Veröffentlicht: (2024)
Cross-Domain Underwater Image Enhancement Guided by No-Reference Image Quality Assessment: A Transfer Learning Approach
von: Zhang, Zhi, et al.
Veröffentlicht: (2025)
von: Zhang, Zhi, et al.
Veröffentlicht: (2025)
Supervised Learning Guarantee for Quantum AdaBoost
von: Wang, Yabo, et al.
Veröffentlicht: (2024)
von: Wang, Yabo, et al.
Veröffentlicht: (2024)
EHA: Entanglement-variational Hardware-efficient Ansatz for Eigensolvers
von: Wang, Xin, et al.
Veröffentlicht: (2023)
von: Wang, Xin, et al.
Veröffentlicht: (2023)
Visual-RFT: Visual Reinforcement Fine-Tuning
von: Liu, Ziyu, et al.
Veröffentlicht: (2025)
von: Liu, Ziyu, et al.
Veröffentlicht: (2025)
MoFO: Momentum-Filtered Optimizer for Mitigating Forgetting in LLM Fine-Tuning
von: Chen, Yupeng, et al.
Veröffentlicht: (2024)
von: Chen, Yupeng, et al.
Veröffentlicht: (2024)
Reinforcement Fine-Tuning Naturally Mitigates Forgetting in Continual Post-Training
von: Lai, Song, et al.
Veröffentlicht: (2025)
von: Lai, Song, et al.
Veröffentlicht: (2025)
FlexCAD: Unified and Versatile Controllable CAD Generation with Fine-tuned Large Language Models
von: Zhang, Zhanwei, et al.
Veröffentlicht: (2024)
von: Zhang, Zhanwei, et al.
Veröffentlicht: (2024)
Beyond Mode Collapse: Distribution Matching for Diverse Reasoning
von: Li, Xiaozhe, et al.
Veröffentlicht: (2026)
von: Li, Xiaozhe, et al.
Veröffentlicht: (2026)
Mitigating Forgetting in LLM Fine-Tuning via Low-Perplexity Token Learning
von: Wu, Chao-Chung, et al.
Veröffentlicht: (2025)
von: Wu, Chao-Chung, et al.
Veröffentlicht: (2025)
The Choice of Divergence: A Neglected Key to Mitigating Diversity Collapse in Reinforcement Learning with Verifiable Reward
von: Li, Long, et al.
Veröffentlicht: (2025)
von: Li, Long, et al.
Veröffentlicht: (2025)
On the Entropy Dynamics in Reinforcement Fine-Tuning of Large Language Models
von: Wang, Shumin, et al.
Veröffentlicht: (2026)
von: Wang, Shumin, et al.
Veröffentlicht: (2026)
CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies
von: Chen, Keyu, et al.
Veröffentlicht: (2026)
von: Chen, Keyu, et al.
Veröffentlicht: (2026)
Trainability Enhancement of Parameterized Quantum Circuits via Reduced-Domain Parameter Initialization
von: Wang, Yabo, et al.
Veröffentlicht: (2023)
von: Wang, Yabo, et al.
Veröffentlicht: (2023)
Discretizing Continuous Action Space with Unimodal Probability Distributions for On-Policy Reinforcement Learning
von: Zhu, Yuanyang, et al.
Veröffentlicht: (2024)
von: Zhu, Yuanyang, et al.
Veröffentlicht: (2024)
Measuring Diversity in Synthetic Datasets
von: Zhu, Yuchang, et al.
Veröffentlicht: (2025)
von: Zhu, Yuchang, et al.
Veröffentlicht: (2025)
Beyond Verifiable Rewards: Rubric-Based GRM for Reinforced Fine-Tuning SWE Agents
von: Huang, Jiawei, et al.
Veröffentlicht: (2026)
von: Huang, Jiawei, et al.
Veröffentlicht: (2026)
Visual Agentic Reinforcement Fine-Tuning
von: Liu, Ziyu, et al.
Veröffentlicht: (2025)
von: Liu, Ziyu, et al.
Veröffentlicht: (2025)
Exponentially-enhanced Quantum Non-Hermitian Sensing via Optimized Coherent Drive
von: Bao, Liying, et al.
Veröffentlicht: (2021)
von: Bao, Liying, et al.
Veröffentlicht: (2021)
Beyond Imitation: Reinforcement Learning Fine-Tuning for Adaptive Diffusion Navigation Policies
von: Sheng, Junhe, et al.
Veröffentlicht: (2026)
von: Sheng, Junhe, et al.
Veröffentlicht: (2026)
MIXRTs: Toward Interpretable Multi-Agent Reinforcement Learning via Mixing Recurrent Soft Decision Trees
von: Liu, Zichuan, et al.
Veröffentlicht: (2022)
von: Liu, Zichuan, et al.
Veröffentlicht: (2022)
Reinforcement Fine-Tuning for Materials Design
von: Cao, Zhendong, et al.
Veröffentlicht: (2025)
von: Cao, Zhendong, et al.
Veröffentlicht: (2025)
Learning to Learn with Contrastive Meta-Objective
von: Wu, Shiguang, et al.
Veröffentlicht: (2024)
von: Wu, Shiguang, et al.
Veröffentlicht: (2024)
DARE the Extreme: Revisiting Delta-Parameter Pruning For Fine-Tuned Models
von: Deng, Wenlong, et al.
Veröffentlicht: (2024)
von: Deng, Wenlong, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Scalable In-Context Q-Learning
von: Liu, Jinmei, et al.
Veröffentlicht: (2025) -
Mixture-of-Experts Meets In-Context Reinforcement Learning
von: Wu, Wenhao, et al.
Veröffentlicht: (2025) -
Tomography of Quantum States from Structured Measurements via quantum-aware transformer
von: Ma, Hailan, et al.
Veröffentlicht: (2023) -
StoryBlender: Inter-Shot Consistent and Editable 3D Storyboard with Spatial-temporal Dynamics
von: Li, Bingliang, et al.
Veröffentlicht: (2026) -
Text-to-Decision Agent: Offline Meta-Reinforcement Learning from Natural Language Supervision
von: Zhang, Shilin, et al.
Veröffentlicht: (2025)