Power Reinforcement Post-Training of Text-to-Image Models with Super-Linear Advantage Shaping
Fuente:
arXiv
Saved in:
| Main Authors: | Sun, Haoyuan, Wang, Jing, Song, Yuxin, Lu, Yu, Fang, Bo, Luo, Yifu, Yin, Jun, Zeng, Pengyu, Zhang, Miao, Zhang, Tiantian, Wang, Xueqian, Lu, Shijian |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
TSCnet: A Text-driven Semantic-level Controllable Framework for Customized Low-Light Image Enhancement
by: Zhang, Miao, et al.
Published: (2025)
by: Zhang, Miao, et al.
Published: (2025)
Reinforcement Learning Meets Masked Generative Models: Mask-GRPO for Text-to-Image Generation
by: Luo, Yifu, et al.
Published: (2025)
by: Luo, Yifu, et al.
Published: (2025)
Reinforcement Fine-Tuning Powers Reasoning Capability of Multimodal Large Language Models
by: Sun, Haoyuan, et al.
Published: (2025)
by: Sun, Haoyuan, et al.
Published: (2025)
PromptLNet: Region-Adaptive Aesthetic Enhancement via Prompt Guidance in Low-Light Enhancement Net
by: Yin, Jun, et al.
Published: (2025)
by: Yin, Jun, et al.
Published: (2025)
ArchShapeNet:An Interpretable 3D-CNN Framework for Evaluating Architectural Shapes
by: Yin, Jun, et al.
Published: (2025)
by: Yin, Jun, et al.
Published: (2025)
Generalizing Alignment Paradigm of Text-to-Image Generation with Preferences through $f$-divergence Minimization
by: Sun, Haoyuan, et al.
Published: (2024)
by: Sun, Haoyuan, et al.
Published: (2024)
Wavelet Fourier Diffuser: Frequency-Aware Diffusion Model for Reinforcement Learning
by: Luo, Yifu, et al.
Published: (2025)
by: Luo, Yifu, et al.
Published: (2025)
Outlier-Aware Post-Training Quantization for Image Super-Resolution
by: Wang, Hailing, et al.
Published: (2025)
by: Wang, Hailing, et al.
Published: (2025)
UACER: An Uncertainty-Adaptive Critic Ensemble Framework for Robust Adversarial Reinforcement Learning
by: Wu, Jiaxi, et al.
Published: (2025)
by: Wu, Jiaxi, et al.
Published: (2025)
When to Lock Attention: Training-Free KV Control in Video Diffusion
by: Zeng, Tianyi, et al.
Published: (2026)
by: Zeng, Tianyi, et al.
Published: (2026)
OMR-Diffusion:Optimizing Multi-Round Enhanced Training in Diffusion Models for Improved Intent Understanding
by: Li, Kun, et al.
Published: (2025)
by: Li, Kun, et al.
Published: (2025)
GAgent: An Adaptive Rigid-Soft Gripping Agent with Vision Language Models for Complex Lighting Environments
by: Li, Zhuowei, et al.
Published: (2024)
by: Li, Zhuowei, et al.
Published: (2024)
A Method on Searching Better Activation Functions
by: Sun, Haoyuan, et al.
Published: (2024)
by: Sun, Haoyuan, et al.
Published: (2024)
FloorplanMAE:A self-supervised framework for complete floorplan generation from partial inputs
by: Yin, Jun, et al.
Published: (2025)
by: Yin, Jun, et al.
Published: (2025)
FloorPlan-DeepSeek (FPDS): A multimodal approach to floorplan generation using vector-based next room prediction
by: Yin, Jun, et al.
Published: (2025)
by: Yin, Jun, et al.
Published: (2025)
UrbanSense:A Framework for Quantitative Analysis of Urban Streetscapes leveraging Vision Large Language Models
by: Yin, Jun, et al.
Published: (2025)
by: Yin, Jun, et al.
Published: (2025)
Revisiting Plasticity in Visual Reinforcement Learning: Data, Modules and Training Stages
by: Ma, Guozheng, et al.
Published: (2023)
by: Ma, Guozheng, et al.
Published: (2023)
A Hybrid Force-Position Strategy for Shape Control of Deformable Linear Objects With Graph Attention Networks
by: Yu, Yanzhao, et al.
Published: (2025)
by: Yu, Yanzhao, et al.
Published: (2025)
Synthetic Curriculum Reinforces Compositional Text-to-Image Generation
by: Wang, Shijian, et al.
Published: (2025)
by: Wang, Shijian, et al.
Published: (2025)
Fast Super Robust Nonadiabatic Geometric Quantum Computation
by: Zhang, Yifu, et al.
Published: (2024)
by: Zhang, Yifu, et al.
Published: (2024)
ArchiLense: A Framework for Quantitative Analysis of Architectural Styles Based on Vision Large Language Models
by: Zhong, Jing, et al.
Published: (2025)
by: Zhong, Jing, et al.
Published: (2025)
Principled RL for Flow Matching Emerges from the Chunk-level Policy Optimization
by: Luo, Yifu, et al.
Published: (2025)
by: Luo, Yifu, et al.
Published: (2025)
Segment Any Architectural Facades (SAAF):An automatic segmentation model for building facades, walls and windows based on multimodal semantics guidance
by: Li, Peilin, et al.
Published: (2025)
by: Li, Peilin, et al.
Published: (2025)
RobustVLA: Robustness-Aware Reinforcement Post-Training for Vision-Language-Action Models
by: Zhang, Hongyin, et al.
Published: (2025)
by: Zhang, Hongyin, et al.
Published: (2025)
ViSS-R1: Self-Supervised Reinforcement Video Reasoning
by: Fang, Bo, et al.
Published: (2025)
by: Fang, Bo, et al.
Published: (2025)
Linear Quadratic Mean Field Games under Heterogeneous Erroneous Initial Information
by: Jin, Yuxin, et al.
Published: (2024)
by: Jin, Yuxin, et al.
Published: (2024)
Comment on Clinical, Prognostic, and Longitudinal Functional and Neuropsychological Features of West Nile Virus Neuroinvasive Disease in the United States: A Systematic Review and Meta‐Analysis
by: Yechao Yin, et al.
Published: (2025)
by: Yechao Yin, et al.
Published: (2025)
Offline Goal-Conditioned Reinforcement Learning for Safety-Critical Tasks with Recovery Policy
by: Cao, Chenyang, et al.
Published: (2024)
by: Cao, Chenyang, et al.
Published: (2024)
Balancing Signal and Variance: Adaptive Offline RL Post-Training for VLA Flow Models
by: Zhang, Hongyin, et al.
Published: (2025)
by: Zhang, Hongyin, et al.
Published: (2025)
Visual Jigsaw Post-Training Improves MLLMs
by: Wu, Penghao, et al.
Published: (2025)
by: Wu, Penghao, et al.
Published: (2025)
Embodied Co-Design for Rapidly Evolving Agents: Taxonomy, Frontiers, and Challenges
by: Wang, Yuxing, et al.
Published: (2025)
by: Wang, Yuxing, et al.
Published: (2025)
Genetic neonatal seizures in the neonatal intensive care unit: Diagnostic and prognostic implications for three families
by: Rongrong Chen, et al.
Published: (2024)
by: Rongrong Chen, et al.
Published: (2024)
MAGIC: Multi-Step Advantage-Gated Causal Influence for Multi-agent Reinforcement Learning
by: Yu, Haohan, et al.
Published: (2026)
by: Yu, Haohan, et al.
Published: (2026)
LiDAR-PTQ: Post-Training Quantization for Point Cloud 3D Object Detection
by: Zhou, Sifan, et al.
Published: (2024)
by: Zhou, Sifan, et al.
Published: (2024)
ReinDriveGen: Reinforcement Post-Training for Out-of-Distribution Driving Scene Generation
by: Zhang, Hao, et al.
Published: (2026)
by: Zhang, Hao, et al.
Published: (2026)
Super Tough High‐Flow Nylon Composites With Nylon Fiber‐Reinforcement
by: Yucheng Yin, et al.
Published: (2026)
by: Yucheng Yin, et al.
Published: (2026)
ADORA: Training Reasoning Models with Dynamic Advantage Estimation on Reinforcement Learning
by: Ren, Qingnan, et al.
Published: (2026)
by: Ren, Qingnan, et al.
Published: (2026)
Free Energy-Driven Reinforcement Learning with Adaptive Advantage Shaping for Unsupervised Reasoning in LLMs
by: Huang, Yiming, et al.
Published: (2026)
by: Huang, Yiming, et al.
Published: (2026)
TeRFS: Temporal-Evolving Radio Field Synthesis
by: Zhang, Pengyang, et al.
Published: (2026)
by: Zhang, Pengyang, et al.
Published: (2026)
UniDet-D: A Unified Dynamic Spectral Attention Model for Object Detection under Adverse Weathers
by: Zhang, Wei, et al.
Published: (2025)
by: Zhang, Wei, et al.
Published: (2025)
Similar Items
-
TSCnet: A Text-driven Semantic-level Controllable Framework for Customized Low-Light Image Enhancement
by: Zhang, Miao, et al.
Published: (2025) -
Reinforcement Learning Meets Masked Generative Models: Mask-GRPO for Text-to-Image Generation
by: Luo, Yifu, et al.
Published: (2025) -
Reinforcement Fine-Tuning Powers Reasoning Capability of Multimodal Large Language Models
by: Sun, Haoyuan, et al.
Published: (2025) -
PromptLNet: Region-Adaptive Aesthetic Enhancement via Prompt Guidance in Low-Light Enhancement Net
by: Yin, Jun, et al.
Published: (2025) -
ArchShapeNet:An Interpretable 3D-CNN Framework for Evaluating Architectural Shapes
by: Yin, Jun, et al.
Published: (2025)