SpatialReward: Verifiable Spatial Reward Modeling for Fine-Grained Spatial Consistency in Text-to-Image Generation
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhou, Sashuai, Zhou, Qiang, Ma, Junpeng, Cao, Yue, Hu, Ruofan, Zhang, Ziang, Yang, Xiaoda, Wang, Zhibin, Song, Jun, Yu, Cheng, Zheng, Bo, Zhao, Zhou |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SpatialReward: Bridging the Perception Gap in Online RL for Image Editing via Explicit Spatial Reasoning
di: Long, Yancheng, et al.
Pubblicazione: (2026)
di: Long, Yancheng, et al.
Pubblicazione: (2026)
Unified Thinker: A General Reasoning Modular Core for Image Generation
di: Zhou, Sashuai, et al.
Pubblicazione: (2026)
di: Zhou, Sashuai, et al.
Pubblicazione: (2026)
DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing
di: Yang, Hanqing, et al.
Pubblicazione: (2026)
di: Yang, Hanqing, et al.
Pubblicazione: (2026)
Enhancing Spatial Understanding in Image Generation via Reward Modeling
di: Tang, Zhenyu, et al.
Pubblicazione: (2026)
di: Tang, Zhenyu, et al.
Pubblicazione: (2026)
Spatial Preference Rewarding for MLLMs Spatial Understanding
di: Qiu, Han, et al.
Pubblicazione: (2025)
di: Qiu, Han, et al.
Pubblicazione: (2025)
SpatialEdit: Benchmarking Fine-Grained Image Spatial Editing
di: Xiao, Yicheng, et al.
Pubblicazione: (2026)
di: Xiao, Yicheng, et al.
Pubblicazione: (2026)
AirSpatialBot: A Spatially-Aware Aerial Agent for Fine-Grained Vehicle Attribute Recognization and Retrieval
di: Zhou, Yue, et al.
Pubblicazione: (2026)
di: Zhou, Yue, et al.
Pubblicazione: (2026)
Smooth Operator: Smooth Verifiable Reward Activates Spatial Reasoning Ability of Vision-Language Model
di: Jiao, Siwen, et al.
Pubblicazione: (2026)
di: Jiao, Siwen, et al.
Pubblicazione: (2026)
SA-IQA: Redefining Image Quality Assessment for Spatial Aesthetics with Multi-Dimensional Rewards
di: Gao, Yuan, et al.
Pubblicazione: (2025)
di: Gao, Yuan, et al.
Pubblicazione: (2025)
Intra-Trajectory Consistency for Reward Modeling
di: Zhou, Chaoyang, et al.
Pubblicazione: (2025)
di: Zhou, Chaoyang, et al.
Pubblicazione: (2025)
DocRetriever: A Plug-and-Play Framework for Multimodal Document Retrieval with Comprehensive Benchmark
di: Hu, Ruofan, et al.
Pubblicazione: (2026)
di: Hu, Ruofan, et al.
Pubblicazione: (2026)
GIFT: Global Irreplaceability Frame Targeting for Efficient Video Understanding
di: Ma, Junpeng, et al.
Pubblicazione: (2026)
di: Ma, Junpeng, et al.
Pubblicazione: (2026)
SASP: Strip-Aware Spatial Perception for Fine-Grained Bird Image Classification
di: Wang, Zheng
Pubblicazione: (2025)
di: Wang, Zheng
Pubblicazione: (2025)
GenSpace: Benchmarking Spatially-Aware Image Generation
di: Wang, Zehan, et al.
Pubblicazione: (2025)
di: Wang, Zehan, et al.
Pubblicazione: (2025)
Reinforced Embodied Planning with Verifiable Reward for Real-World Robotic Manipulation
di: Bo, Zitong, et al.
Pubblicazione: (2025)
di: Bo, Zitong, et al.
Pubblicazione: (2025)
SpatialThinker: Reinforcing 3D Reasoning in Multimodal LLMs via Spatial Rewards
di: Batra, Hunar, et al.
Pubblicazione: (2025)
di: Batra, Hunar, et al.
Pubblicazione: (2025)
Fine-Grained Spatially Varying Material Selection in Images
di: Guerrero-Viu, Julia, et al.
Pubblicazione: (2025)
di: Guerrero-Viu, Julia, et al.
Pubblicazione: (2025)
Enhancing Multi-modal Models with Heterogeneous MoE Adapters for Fine-tuning
di: Zhou, Sashuai, et al.
Pubblicazione: (2025)
di: Zhou, Sashuai, et al.
Pubblicazione: (2025)
SVQA-R1: Reinforcing Spatial Reasoning in MLLMs via View-Consistent Reward Optimization
di: Wang, Peiyao, et al.
Pubblicazione: (2025)
di: Wang, Peiyao, et al.
Pubblicazione: (2025)
TIPS: Text-Image Pretraining with Spatial awareness
di: Maninis, Kevis-Kokitsi, et al.
Pubblicazione: (2024)
di: Maninis, Kevis-Kokitsi, et al.
Pubblicazione: (2024)
Vision-Language Models as Differentiable Semantic and Spatial Rewards for Text-to-3D Generation
di: Bai, Weimin, et al.
Pubblicazione: (2025)
di: Bai, Weimin, et al.
Pubblicazione: (2025)
DSI-Bench: A Benchmark for Dynamic Spatial Intelligence
di: Zhang, Ziang, et al.
Pubblicazione: (2025)
di: Zhang, Ziang, et al.
Pubblicazione: (2025)
PICS: Pairwise Image Compositing with Spatial Interactions
di: Zhou, Hang, et al.
Pubblicazione: (2026)
di: Zhou, Hang, et al.
Pubblicazione: (2026)
Getting it Right: Improving Spatial Consistency in Text-to-Image Models
di: Chatterjee, Agneet, et al.
Pubblicazione: (2024)
di: Chatterjee, Agneet, et al.
Pubblicazione: (2024)
Measuring 3D Spatial Geometric Consistency in Dynamic Generated Videos
di: Dou, Weijia, et al.
Pubblicazione: (2026)
di: Dou, Weijia, et al.
Pubblicazione: (2026)
Consistent Human Image and Video Generation with Spatially Conditioned Diffusion
di: Cao, Mingdeng, et al.
Pubblicazione: (2024)
di: Cao, Mingdeng, et al.
Pubblicazione: (2024)
SChanger: Change Detection from a Semantic Change and Spatial Consistency Perspective
di: Zhou, Ziyu, et al.
Pubblicazione: (2025)
di: Zhou, Ziyu, et al.
Pubblicazione: (2025)
Rethinking Sample Polarity in Reinforcement Learning with Verifiable Rewards
di: Tang, Xinyu, et al.
Pubblicazione: (2025)
di: Tang, Xinyu, et al.
Pubblicazione: (2025)
Hyperspectral Image Denoising via Spatial-Spectral Recurrent Transformer
di: Fu, Guanyiman, et al.
Pubblicazione: (2023)
di: Fu, Guanyiman, et al.
Pubblicazione: (2023)
Multimodal LLMs as Customized Reward Models for Text-to-Image Generation
di: Zhou, Shijie, et al.
Pubblicazione: (2025)
di: Zhou, Shijie, et al.
Pubblicazione: (2025)
The Dynamic Team Orienteering Problem in Spatial Crowdsourcing: A Scenario Sampling Approach
di: Wu, Zhibin, et al.
Pubblicazione: (2026)
di: Wu, Zhibin, et al.
Pubblicazione: (2026)
Spatially Dispersive Lasing for Spectrally Encoded Imaging
di: Zhuang Li, et al.
Pubblicazione: (2026)
di: Zhuang Li, et al.
Pubblicazione: (2026)
PRMBench: A Fine-grained and Challenging Benchmark for Process-Level Reward Models
di: Song, Mingyang, et al.
Pubblicazione: (2025)
di: Song, Mingyang, et al.
Pubblicazione: (2025)
Understanding Reward Hacking in Text-to-Image Reinforcement Learning
di: Hong, Yunqi, et al.
Pubblicazione: (2026)
di: Hong, Yunqi, et al.
Pubblicazione: (2026)
Towards High Data Efficiency in Reinforcement Learning with Verifiable Reward
di: Tang, Xinyu, et al.
Pubblicazione: (2025)
di: Tang, Xinyu, et al.
Pubblicazione: (2025)
A Dense Reward View on Aligning Text-to-Image Diffusion with Preference
di: Yang, Shentao, et al.
Pubblicazione: (2024)
di: Yang, Shentao, et al.
Pubblicazione: (2024)
Self-Consistency of the Internal Reward Models Improves Self-Rewarding Language Models
di: Zhou, Xin, et al.
Pubblicazione: (2025)
di: Zhou, Xin, et al.
Pubblicazione: (2025)
Shrinking the Variance: Shrinkage Baselines for Reinforcement Learning with Verifiable Rewards
di: Zeng, Guanning, et al.
Pubblicazione: (2025)
di: Zeng, Guanning, et al.
Pubblicazione: (2025)
Self-Supervised Representation Learning with Spatial-Temporal Consistency for Sign Language Recognition
di: Zhao, Weichao, et al.
Pubblicazione: (2024)
di: Zhao, Weichao, et al.
Pubblicazione: (2024)
DCT-Mamba3D: Spectral Decorrelation and Spatial-Spectral Feature Extraction for Hyperspectral Image Classification
di: Cao, Weijia, et al.
Pubblicazione: (2025)
di: Cao, Weijia, et al.
Pubblicazione: (2025)
Documenti analoghi
-
SpatialReward: Bridging the Perception Gap in Online RL for Image Editing via Explicit Spatial Reasoning
di: Long, Yancheng, et al.
Pubblicazione: (2026) -
Unified Thinker: A General Reasoning Modular Core for Image Generation
di: Zhou, Sashuai, et al.
Pubblicazione: (2026) -
DDA-Thinker: Decoupled Dual-Atomic Reinforcement Learning for Reasoning-Driven Image Editing
di: Yang, Hanqing, et al.
Pubblicazione: (2026) -
Enhancing Spatial Understanding in Image Generation via Reward Modeling
di: Tang, Zhenyu, et al.
Pubblicazione: (2026) -
Spatial Preference Rewarding for MLLMs Spatial Understanding
di: Qiu, Han, et al.
Pubblicazione: (2025)