Refinement via Regeneration: Enlarging Modification Space Boosts Image Refinement in Unified Multimodal Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Guo, Jiayi, Wang, Linqing, Wang, Jiangshan, Yue, Yang, Liu, Zeyu, Zhao, Zhiyuan, Lu, Qinglin, Huang, Gao, Wang, Chunyu |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SOAR: Self-Correction for Optimal Alignment and Refinement in Diffusion Models
di: Qin, You, et al.
Pubblicazione: (2026)
di: Qin, You, et al.
Pubblicazione: (2026)
Unified Multimodal Chain-of-Thought Reward Model through Reinforcement Fine-Tuning
di: Wang, Yibin, et al.
Pubblicazione: (2025)
di: Wang, Yibin, et al.
Pubblicazione: (2025)
Learning to Refine: Self-Refinement of Parallel Reasoning in LLMs
di: Wang, Qibin, et al.
Pubblicazione: (2025)
di: Wang, Qibin, et al.
Pubblicazione: (2025)
Zoom-Refine: Boosting High-Resolution Multimodal Understanding via Localized Zoom and Self-Refinement
di: Yu, Xuan, et al.
Pubblicazione: (2025)
di: Yu, Xuan, et al.
Pubblicazione: (2025)
Image-of-Thought Prompting for Visual Reasoning Refinement in Multimodal Large Language Models
di: Zhou, Qiji, et al.
Pubblicazione: (2024)
di: Zhou, Qiji, et al.
Pubblicazione: (2024)
Boosting Fidelity for Pre-Trained-Diffusion-Based Low-Light Image Enhancement via Condition Refinement
di: Xu, Xiaogang, et al.
Pubblicazione: (2025)
di: Xu, Xiaogang, et al.
Pubblicazione: (2025)
Clore: Interactive Pathology Image Segmentation with Click-based Local Refinement
di: Wang, Tiantong, et al.
Pubblicazione: (2026)
di: Wang, Tiantong, et al.
Pubblicazione: (2026)
ILLUME+: Illuminating Unified MLLM with Dual Visual Tokenization and Diffusion Refinement
di: Huang, Runhui, et al.
Pubblicazione: (2025)
di: Huang, Runhui, et al.
Pubblicazione: (2025)
COVE: Unleashing the Diffusion Feature Correspondence for Consistent Video Editing
di: Wang, Jiangshan, et al.
Pubblicazione: (2024)
di: Wang, Jiangshan, et al.
Pubblicazione: (2024)
Failure-Driven Workflow Refinement
di: Zhang, Jusheng, et al.
Pubblicazione: (2025)
di: Zhang, Jusheng, et al.
Pubblicazione: (2025)
Text-Driven Diverse Facial Texture Generation via Progressive Latent-Space Refinement
di: Wang, Chi, et al.
Pubblicazione: (2024)
di: Wang, Chi, et al.
Pubblicazione: (2024)
Latent Harmony: Synergistic Unified UHD Image Restoration via Latent Space Regularization and Controllable Refinement
di: Liu, Yidi, et al.
Pubblicazione: (2025)
di: Liu, Yidi, et al.
Pubblicazione: (2025)
BASIC: Boosting Visual Alignment with Intrinsic Refined Embeddings in Multimodal Large Language Models
di: Tang, Jianting, et al.
Pubblicazione: (2025)
di: Tang, Jianting, et al.
Pubblicazione: (2025)
PromptEnhancer: A Simple Approach to Enhance Text-to-Image Models via Chain-of-Thought Prompt Rewriting
di: Wang, Linqing, et al.
Pubblicazione: (2025)
di: Wang, Linqing, et al.
Pubblicazione: (2025)
HandRefiner: Refining Malformed Hands in Generated Images by Diffusion-based Conditional Inpainting
di: Lu, Wenquan, et al.
Pubblicazione: (2023)
di: Lu, Wenquan, et al.
Pubblicazione: (2023)
RefineRAG: Word-Level Poisoning Attacks via Retriever-Guided Text Refinement
di: Wang, Ziye, et al.
Pubblicazione: (2026)
di: Wang, Ziye, et al.
Pubblicazione: (2026)
Generalizable Audio Deepfake Detection via Latent Space Refinement and Augmentation
di: Huang, Wen, et al.
Pubblicazione: (2025)
di: Huang, Wen, et al.
Pubblicazione: (2025)
MVBoost: Boost 3D Reconstruction with Multi-View Refinement
di: Liu, Xiangyu, et al.
Pubblicazione: (2024)
di: Liu, Xiangyu, et al.
Pubblicazione: (2024)
Top-Down Semantic Refinement for Image Captioning
di: Zhang, Jusheng, et al.
Pubblicazione: (2025)
di: Zhang, Jusheng, et al.
Pubblicazione: (2025)
FreeBind: Free Lunch in Unified Multimodal Space via Knowledge Fusion
di: Wang, Zehan, et al.
Pubblicazione: (2024)
di: Wang, Zehan, et al.
Pubblicazione: (2024)
Mel-Refine: A Plug-and-Play Approach to Refine Mel-Spectrogram in Audio Generation
di: Guo, Hongming, et al.
Pubblicazione: (2024)
di: Guo, Hongming, et al.
Pubblicazione: (2024)
STARS: A Unified Framework for Singing Transcription, Alignment, and Refined Style Annotation
di: Guo, Wenxiang, et al.
Pubblicazione: (2025)
di: Guo, Wenxiang, et al.
Pubblicazione: (2025)
RefineAnything: Multimodal Region-Specific Refinement for Perfect Local Details
di: Zhou, Dewei, et al.
Pubblicazione: (2026)
di: Zhou, Dewei, et al.
Pubblicazione: (2026)
MRSAudio: A Large-Scale Multimodal Recorded Spatial Audio Dataset with Refined Annotations
di: Guo, Wenxiang, et al.
Pubblicazione: (2025)
di: Guo, Wenxiang, et al.
Pubblicazione: (2025)
DeepRefine: Agent-Compiled Knowledge Refinement via Reinforcement Learning
di: Huang, Haoyu, et al.
Pubblicazione: (2026)
di: Huang, Haoyu, et al.
Pubblicazione: (2026)
RMFlow: Refined Mean Flow by a Noise-Injection Step for Multimodal Generation
di: Huang, Yuhao, et al.
Pubblicazione: (2026)
di: Huang, Yuhao, et al.
Pubblicazione: (2026)
Explicit Planar Finite Element Elasticity Complexes and $C^1$ Elements on Barycentric Refinements
di: Chen, Chunyu, et al.
Pubblicazione: (2026)
di: Chen, Chunyu, et al.
Pubblicazione: (2026)
Adaptive Redundancy Regulation for Balanced Multimodal Information Refinement
di: Yang, Zhe, et al.
Pubblicazione: (2025)
di: Yang, Zhe, et al.
Pubblicazione: (2025)
Latent Refinement Decoding: Enhancing Diffusion-Based Language Models by Refining Belief States
di: Zhu, Qinglin, et al.
Pubblicazione: (2025)
di: Zhu, Qinglin, et al.
Pubblicazione: (2025)
RefineCatDiff: Toward High‐Quality Medical Image Segmentation via a Categorical Diffusion Refinement Framework
di: Feng Liu, et al.
Pubblicazione: (2025)
di: Feng Liu, et al.
Pubblicazione: (2025)
Search and Refine During Think: Facilitating Knowledge Refinement for Improved Retrieval-Augmented Reasoning
di: Shi, Yaorui, et al.
Pubblicazione: (2025)
di: Shi, Yaorui, et al.
Pubblicazione: (2025)
UniGenBench++: A Unified Semantic Evaluation Benchmark for Text-to-Image Generation
di: Wang, Yibin, et al.
Pubblicazione: (2025)
di: Wang, Yibin, et al.
Pubblicazione: (2025)
Dual‐Region Consistency Learning With Contrastive Refinement for Semi‐Supervised Medical Image Segmentation
di: Junmei Sun, et al.
Pubblicazione: (2025)
di: Junmei Sun, et al.
Pubblicazione: (2025)
MMC: Iterative Refinement of VLM Reasoning via MCTS-based Multimodal Critique
di: Liu, Shuhang, et al.
Pubblicazione: (2025)
di: Liu, Shuhang, et al.
Pubblicazione: (2025)
Prompt Alchemy: Automatic Prompt Refinement for Enhancing Code Generation
di: Ye, Sixiang, et al.
Pubblicazione: (2025)
di: Ye, Sixiang, et al.
Pubblicazione: (2025)
PPPR: Portable Plug-in Prompt Refiner for Text to Audio Generation
di: Shi, Shuchen, et al.
Pubblicazione: (2024)
di: Shi, Shuchen, et al.
Pubblicazione: (2024)
GRA: Detecting Oriented Objects through Group-wise Rotating and Attention
di: Wang, Jiangshan, et al.
Pubblicazione: (2024)
di: Wang, Jiangshan, et al.
Pubblicazione: (2024)
Region-Aware Text-to-Image Generation via Hard Binding and Soft Refinement
di: Chen, Zhennan, et al.
Pubblicazione: (2024)
di: Chen, Zhennan, et al.
Pubblicazione: (2024)
SAM as the Guide: Mastering Pseudo-Label Refinement in Semi-Supervised Referring Expression Segmentation
di: Yang, Danni, et al.
Pubblicazione: (2024)
di: Yang, Danni, et al.
Pubblicazione: (2024)
PreciseCache: Precise Feature Caching for Efficient and High-fidelity Video Generation
di: Wang, Jiangshan, et al.
Pubblicazione: (2026)
di: Wang, Jiangshan, et al.
Pubblicazione: (2026)
Documenti analoghi
-
SOAR: Self-Correction for Optimal Alignment and Refinement in Diffusion Models
di: Qin, You, et al.
Pubblicazione: (2026) -
Unified Multimodal Chain-of-Thought Reward Model through Reinforcement Fine-Tuning
di: Wang, Yibin, et al.
Pubblicazione: (2025) -
Learning to Refine: Self-Refinement of Parallel Reasoning in LLMs
di: Wang, Qibin, et al.
Pubblicazione: (2025) -
Zoom-Refine: Boosting High-Resolution Multimodal Understanding via Localized Zoom and Self-Refinement
di: Yu, Xuan, et al.
Pubblicazione: (2025) -
Image-of-Thought Prompting for Visual Reasoning Refinement in Multimodal Large Language Models
di: Zhou, Qiji, et al.
Pubblicazione: (2024)