When Rubrics Fail: Error Enumeration as Reward in Reference-Free RL Post-Training for Virtual Try-On
Fuente:
arXiv
Saved in:
| Main Authors: | Ikezogwo, Wisdom, Seyfioglu, Mehmet Saygin, Krishna, Ranjay, Bouyarmane, Karim |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Quilt-LLaVA: Visual Instruction Tuning by Extracting Localized Narratives from Open-Source Histopathology Videos
by: Seyfioglu, Mehmet Saygin, et al.
Published: (2023)
by: Seyfioglu, Mehmet Saygin, et al.
Published: (2023)
MedicalNarratives: Connecting Medical Vision and Language with Localized Narratives
by: Ikezogwo, Wisdom O., et al.
Published: (2025)
by: Ikezogwo, Wisdom O., et al.
Published: (2025)
Diffuse to Choose: Enriching Image Conditioned Inpainting in Latent Diffusion Models for Virtual Try-All
by: Seyfioglu, Mehmet Saygin, et al.
Published: (2024)
by: Seyfioglu, Mehmet Saygin, et al.
Published: (2024)
Efficient Encoder-Free Pose Conditioning and Pose Control for Virtual Try-On
by: Li, Qi, et al.
Published: (2025)
by: Li, Qi, et al.
Published: (2025)
DiT-VTON: Diffusion Transformer Framework for Unified Multi-Category Virtual Try-On and Virtual Try-All with Integrated Image Editing
by: Li, Qi, et al.
Published: (2025)
by: Li, Qi, et al.
Published: (2025)
InstructVTON: Optimal Auto-Masking and Natural-Language-Guided Interactive Style Control for Inpainting-Based Virtual Try-On
by: Han, Julien, et al.
Published: (2025)
by: Han, Julien, et al.
Published: (2025)
Style-Instructed Mask-Free Virtual Try On
by: Zhang, Mengqi, et al.
Published: (2026)
by: Zhang, Mengqi, et al.
Published: (2026)
Quilt-1M: One Million Image-Text Pairs for Histopathology
by: Ikezogwo, Wisdom Oluchi, et al.
Published: (2023)
by: Ikezogwo, Wisdom Oluchi, et al.
Published: (2023)
PathFinder: A Multi-Modal Multi-Agent System for Medical Diagnostic Decision-Making Applied to Histopathology
by: Ghezloo, Fatemeh, et al.
Published: (2025)
by: Ghezloo, Fatemeh, et al.
Published: (2025)
DEFT-VTON: Efficient Virtual Try-On with Consistent Generalised H-Transform
by: Xu, Xingzi, et al.
Published: (2025)
by: Xu, Xingzi, et al.
Published: (2025)
RubricRL: Simple Generalizable Rewards for Text-to-Image Generation
by: Feng, Xuelu, et al.
Published: (2025)
by: Feng, Xuelu, et al.
Published: (2025)
OmniVTON: Training-Free Universal Virtual Try-On
by: Yang, Zhaotong, et al.
Published: (2025)
by: Yang, Zhaotong, et al.
Published: (2025)
Undress to Redress: A Training-Free Framework for Virtual Try-On
by: Li, Zhiying, et al.
Published: (2025)
by: Li, Zhiying, et al.
Published: (2025)
Reference-Free Image Quality Assessment for Virtual Try-On via Human Feedback
by: Hirakawa, Yuki, et al.
Published: (2026)
by: Hirakawa, Yuki, et al.
Published: (2026)
OmniVTON++: Training-Free Universal Virtual Try-On with Principal Pose Guidance
by: Yang, Zhaotong, et al.
Published: (2026)
by: Yang, Zhaotong, et al.
Published: (2026)
Synthetic Visual Genome 2: Extracting Large-scale Spatio-Temporal Scene Graphs from Videos
by: Gao, Ziqi, et al.
Published: (2026)
by: Gao, Ziqi, et al.
Published: (2026)
Fused-Planes: Why Train a Thousand Tri-Planes When You Can Share?
by: Kassab, Karim, et al.
Published: (2024)
by: Kassab, Karim, et al.
Published: (2024)
Enhancing Virtual Try-On with Synthetic Pairs and Error-Aware Noise Scheduling
by: Li, Nannan, et al.
Published: (2025)
by: Li, Nannan, et al.
Published: (2025)
BooW-VTON: Boosting In-the-Wild Virtual Try-On via Mask-Free Pseudo Data Training
by: Zhang, Xuanpu, et al.
Published: (2024)
by: Zhang, Xuanpu, et al.
Published: (2024)
Visual Preference Optimization with Rubric Rewards
by: Yu, Ya-Qi, et al.
Published: (2026)
by: Yu, Ya-Qi, et al.
Published: (2026)
Reinforcement Learning with Robust Rubric Rewards
by: Yu, Ya-Qi, et al.
Published: (2026)
by: Yu, Ya-Qi, et al.
Published: (2026)
You Only Judge Once: Multi-response Reward Modeling in a Single Forward Pass
by: Yang, Yinuo, et al.
Published: (2026)
by: Yang, Yinuo, et al.
Published: (2026)
RefTok: Reference-Based Tokenization for Video Generation
by: Fan, Xiang, et al.
Published: (2025)
by: Fan, Xiang, et al.
Published: (2025)
OmniTry: Virtual Try-On Anything without Masks
by: Feng, Yutong, et al.
Published: (2025)
by: Feng, Yutong, et al.
Published: (2025)
Ablate-to-Validate: Are Vision-Language Models Really Using Continuous Thought Tokens?
by: Zhang, Tianyi, et al.
Published: (2026)
by: Zhang, Tianyi, et al.
Published: (2026)
MF-VITON: High-Fidelity Mask-Free Virtual Try-On with Minimal Input
by: Wan, Zhenchen, et al.
Published: (2025)
by: Wan, Zhenchen, et al.
Published: (2025)
VTEdit-Bench: A Comprehensive Benchmark for Multi-Reference Image Editing Models in Virtual Try-On
by: Liang, Xiaoye, et al.
Published: (2026)
by: Liang, Xiaoye, et al.
Published: (2026)
GlamTry: Advancing Virtual Try-On for High-End Accessories
by: Chang, Ting-Yu, et al.
Published: (2024)
by: Chang, Ting-Yu, et al.
Published: (2024)
SAIL-RL: Guiding MLLMs in When and How to Think via Dual-Reward RL Tuning
by: Shu, Fangxun, et al.
Published: (2025)
by: Shu, Fangxun, et al.
Published: (2025)
PFDM: Parser-Free Virtual Try-on via Diffusion Model
by: Niu, Yunfang, et al.
Published: (2024)
by: Niu, Yunfang, et al.
Published: (2024)
Dynamic Try-On: Taming Video Virtual Try-on with Dynamic Attention Mechanism
by: Zheng, Jun, et al.
Published: (2024)
by: Zheng, Jun, et al.
Published: (2024)
Dress-ED: Instruction-Guided Editing for Virtual Try-On and Try-Off
by: Sanguigni, Fulvio, et al.
Published: (2026)
by: Sanguigni, Fulvio, et al.
Published: (2026)
Enhancing the Outcome Reward-based RL Training of MLLMs with Self-Consistency Sampling
by: Wang, Jiahao, et al.
Published: (2025)
by: Wang, Jiahao, et al.
Published: (2025)
Significance of Anatomical Constraints in Virtual Try-On
by: Roy, Debapriya, et al.
Published: (2024)
by: Roy, Debapriya, et al.
Published: (2024)
Progressive Limb-Aware Virtual Try-On
by: Han, Xiaoyu, et al.
Published: (2025)
by: Han, Xiaoyu, et al.
Published: (2025)
iTryOn: Mastering Interactive Video Virtual Try-On with Spatial-Semantic Guidance
by: Zheng, Jun, et al.
Published: (2026)
by: Zheng, Jun, et al.
Published: (2026)
DirectTryOn: One-Step Virtual Try-On via Straightened Conditional Transport
by: Sun, Xianbing, et al.
Published: (2026)
by: Sun, Xianbing, et al.
Published: (2026)
MagicTryOn: Harnessing Diffusion Transformer for Garment-Preserving Video Virtual Try-on
by: Li, Guangyuan, et al.
Published: (2025)
by: Li, Guangyuan, et al.
Published: (2025)
JCo-MVTON: Jointly Controllable Multi-Modal Diffusion Transformer for Mask-Free Virtual Try-on
by: Wang, Aowen, et al.
Published: (2025)
by: Wang, Aowen, et al.
Published: (2025)
MFP-VTON: Enhancing Mask-Free Person-to-Person Virtual Try-On via Diffusion Transformer
by: Shen, Le, et al.
Published: (2025)
by: Shen, Le, et al.
Published: (2025)
Similar Items
-
Quilt-LLaVA: Visual Instruction Tuning by Extracting Localized Narratives from Open-Source Histopathology Videos
by: Seyfioglu, Mehmet Saygin, et al.
Published: (2023) -
MedicalNarratives: Connecting Medical Vision and Language with Localized Narratives
by: Ikezogwo, Wisdom O., et al.
Published: (2025) -
Diffuse to Choose: Enriching Image Conditioned Inpainting in Latent Diffusion Models for Virtual Try-All
by: Seyfioglu, Mehmet Saygin, et al.
Published: (2024) -
Efficient Encoder-Free Pose Conditioning and Pose Control for Virtual Try-On
by: Li, Qi, et al.
Published: (2025) -
DiT-VTON: Diffusion Transformer Framework for Unified Multi-Category Virtual Try-On and Virtual Try-All with Integrated Image Editing
by: Li, Qi, et al.
Published: (2025)