Salvato in:
| Autori principali: | Wang, Shuyu, Li, Weiqi, Wang, Qian, Zhao, Shijie, Zhang, Jian |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2505.19149 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
VQ-Insight: Teaching VLMs for AI-Generated Video Quality Understanding via Progressive Visual Reinforcement Learning
di: Zhang, Xuanyu, et al.
Pubblicazione: (2025)
di: Zhang, Xuanyu, et al.
Pubblicazione: (2025)
Q-Insight: Understanding Image Quality via Visual Reinforcement Learning
di: Li, Weiqi, et al.
Pubblicazione: (2025)
di: Li, Weiqi, et al.
Pubblicazione: (2025)
UARE: A Unified Vision-Language Model for Image Quality Assessment, Restoration, and Enhancement
di: Li, Weiqi, et al.
Pubblicazione: (2025)
di: Li, Weiqi, et al.
Pubblicazione: (2025)
ComplexBench-Edit: Benchmarking Complex Instruction-Driven Image Editing via Compositional Dependencies
di: Wang, Chenglin, et al.
Pubblicazione: (2025)
di: Wang, Chenglin, et al.
Pubblicazione: (2025)
Lego-Edit: A General Image Editing Framework with Model-Level Bricks and MLLM Builder
di: Jia, Qifei, et al.
Pubblicazione: (2025)
di: Jia, Qifei, et al.
Pubblicazione: (2025)
EditCLIP: Representation Learning for Image Editing
di: Wang, Qian, et al.
Pubblicazione: (2025)
di: Wang, Qian, et al.
Pubblicazione: (2025)
InstructX: Towards Unified Visual Editing with MLLM Guidance
di: Mou, Chong, et al.
Pubblicazione: (2025)
di: Mou, Chong, et al.
Pubblicazione: (2025)
InsightEdit: Towards Better Instruction Following for Image Editing
di: Xu, Yingjing, et al.
Pubblicazione: (2024)
di: Xu, Yingjing, et al.
Pubblicazione: (2024)
Attribution Analysis Meets Model Editing: Advancing Knowledge Correction in Vision Language Models with VisEdit
di: Chen, Qizhou, et al.
Pubblicazione: (2024)
di: Chen, Qizhou, et al.
Pubblicazione: (2024)
DualEdit: Dual Editing for Knowledge Updating in Vision-Language Models
di: Shi, Zhiyi, et al.
Pubblicazione: (2025)
di: Shi, Zhiyi, et al.
Pubblicazione: (2025)
Moodifier: MLLM-Enhanced Emotion-Driven Image Editing
di: Ye, Jiarong, et al.
Pubblicazione: (2025)
di: Ye, Jiarong, et al.
Pubblicazione: (2025)
OmniDrag: Enabling Motion Control for Omnidirectional Image-to-Video Generation
di: Li, Weiqi, et al.
Pubblicazione: (2024)
di: Li, Weiqi, et al.
Pubblicazione: (2024)
VQ-Jarvis: Retrieval-Augmented Video Restoration Agent with Sharp Vision and Fast Thought
di: Zhang, Xuanyu, et al.
Pubblicazione: (2026)
di: Zhang, Xuanyu, et al.
Pubblicazione: (2026)
Edit Transfer: Learning Image Editing via Vision In-Context Relations
di: Chen, Lan, et al.
Pubblicazione: (2025)
di: Chen, Lan, et al.
Pubblicazione: (2025)
FireEdit: Fine-grained Instruction-based Image Editing via Region-aware Vision Language Model
di: Zhou, Jun, et al.
Pubblicazione: (2025)
di: Zhou, Jun, et al.
Pubblicazione: (2025)
FOCUS: Unified Vision-Language Modeling for Interactive Editing Driven by Referential Segmentation
di: Yang, Fan, et al.
Pubblicazione: (2025)
di: Yang, Fan, et al.
Pubblicazione: (2025)
AV-Edit: Multimodal Generative Sound Effect Editing via Audio-Visual Semantic Joint Control
di: Guo, Xinyue, et al.
Pubblicazione: (2025)
di: Guo, Xinyue, et al.
Pubblicazione: (2025)
When Privacy Meets Recovery: The Overlooked Half of Surrogate-Driven Privacy Preservation for MLLM Editing
di: Xu, Siyuan, et al.
Pubblicazione: (2025)
di: Xu, Siyuan, et al.
Pubblicazione: (2025)
EditGarment: An Instruction-Based Garment Editing Dataset Constructed with Automated MLLM Synthesis and Semantic-Aware Evaluation
di: Yin, Deqiang, et al.
Pubblicazione: (2025)
di: Yin, Deqiang, et al.
Pubblicazione: (2025)
Group Editing: Edit Multiple Images in One Go
di: Ma, Yue, et al.
Pubblicazione: (2026)
di: Ma, Yue, et al.
Pubblicazione: (2026)
Reasoning as Representation: Rethinking Visual Reinforcement Learning in Image Quality Assessment
di: Zhao, Shijie, et al.
Pubblicazione: (2025)
di: Zhao, Shijie, et al.
Pubblicazione: (2025)
Improved Adversarial Diffusion Compression for Real-World Video Super-Resolution
di: Chen, Bin, et al.
Pubblicazione: (2026)
di: Chen, Bin, et al.
Pubblicazione: (2026)
MDE-Edit: Masked Dual-Editing for Multi-Object Image Editing via Diffusion Models
di: Zhu, Hongyang, et al.
Pubblicazione: (2025)
di: Zhu, Hongyang, et al.
Pubblicazione: (2025)
MLLM-Enhanced Face Forgery Detection: A Vision-Language Fusion Solution
di: Peng, Siran, et al.
Pubblicazione: (2025)
di: Peng, Siran, et al.
Pubblicazione: (2025)
ReasonEdit: Editing Vision-Language Models using Human Reasoning
di: Qiu, Jiaxing, et al.
Pubblicazione: (2026)
di: Qiu, Jiaxing, et al.
Pubblicazione: (2026)
X-Edit: Exact, Explicit, and Explainable Null-Space Editing for Medical Vision Transformers
di: Liu, Yuanye, et al.
Pubblicazione: (2026)
di: Liu, Yuanye, et al.
Pubblicazione: (2026)
Beyond Simple Edits: X-Planner for Complex Instruction-Based Image Editing
di: Yeh, Chun-Hsiao, et al.
Pubblicazione: (2025)
di: Yeh, Chun-Hsiao, et al.
Pubblicazione: (2025)
Reasoning to Edit: Hypothetical Instruction-Based Image Editing with Visual Reasoning
di: He, Qingdong, et al.
Pubblicazione: (2025)
di: He, Qingdong, et al.
Pubblicazione: (2025)
FREE-Edit: Using Editing-aware Injection in Rectified Flow Models for Zero-shot Image-Driven Video Editing
di: Li, Maomao, et al.
Pubblicazione: (2026)
di: Li, Maomao, et al.
Pubblicazione: (2026)
TalkPhoto: A Versatile Training-Free Conversational Assistant for Intelligent Image Editing
di: Hu, Yujie, et al.
Pubblicazione: (2026)
di: Hu, Yujie, et al.
Pubblicazione: (2026)
ReasonEdit: Towards Reasoning-Enhanced Image Editing Models
di: Yin, Fukun, et al.
Pubblicazione: (2025)
di: Yin, Fukun, et al.
Pubblicazione: (2025)
Edit-Compass & EditReward-Compass: A Unified Benchmark for Image Editing and Reward Modeling
di: Bai, Xuehai, et al.
Pubblicazione: (2026)
di: Bai, Xuehai, et al.
Pubblicazione: (2026)
HulluEdit: Single-Pass Evidence-Consistent Subspace Editing for Mitigating Hallucinations in Large Vision-Language Models
di: Lin, Yangguang, et al.
Pubblicazione: (2026)
di: Lin, Yangguang, et al.
Pubblicazione: (2026)
DiT4Edit: Diffusion Transformer for Image Editing
di: Feng, Kunyu, et al.
Pubblicazione: (2024)
di: Feng, Kunyu, et al.
Pubblicazione: (2024)
POEM: Precise Object-level Editing via MLLM control
di: Schouten, Marco, et al.
Pubblicazione: (2025)
di: Schouten, Marco, et al.
Pubblicazione: (2025)
VersaViT: Enhancing MLLM Vision Backbones via Task-Guided Optimization
di: Liu, Yikun, et al.
Pubblicazione: (2026)
di: Liu, Yikun, et al.
Pubblicazione: (2026)
Edit-Your-Interest: Efficient Video Editing via Feature Most-Similar Propagation
di: Zuo, Yi, et al.
Pubblicazione: (2025)
di: Zuo, Yi, et al.
Pubblicazione: (2025)
360DVD: Controllable Panorama Video Generation with 360-Degree Video Diffusion Model
di: Wang, Qian, et al.
Pubblicazione: (2024)
di: Wang, Qian, et al.
Pubblicazione: (2024)
EditVerse: Unifying Image and Video Editing and Generation with In-Context Learning
di: Ju, Xuan, et al.
Pubblicazione: (2025)
di: Ju, Xuan, et al.
Pubblicazione: (2025)
ResetEdit: Precise Text-guided Editing of Generated Image via Resettable Starting Latent
di: Wang, Hanyi, et al.
Pubblicazione: (2026)
di: Wang, Hanyi, et al.
Pubblicazione: (2026)
Documenti analoghi
-
VQ-Insight: Teaching VLMs for AI-Generated Video Quality Understanding via Progressive Visual Reinforcement Learning
di: Zhang, Xuanyu, et al.
Pubblicazione: (2025) -
Q-Insight: Understanding Image Quality via Visual Reinforcement Learning
di: Li, Weiqi, et al.
Pubblicazione: (2025) -
UARE: A Unified Vision-Language Model for Image Quality Assessment, Restoration, and Enhancement
di: Li, Weiqi, et al.
Pubblicazione: (2025) -
ComplexBench-Edit: Benchmarking Complex Instruction-Driven Image Editing via Compositional Dependencies
di: Wang, Chenglin, et al.
Pubblicazione: (2025) -
Lego-Edit: A General Image Editing Framework with Model-Level Bricks and MLLM Builder
di: Jia, Qifei, et al.
Pubblicazione: (2025)