Image-POSER: Reflective RL for Multi-Expert Image Generation and Editing
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Mohebbi, Hossein, Abdulrahman, Mohammed, Miao, Yanting, Poupart, Pascal, Kothawade, Suraj |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Subject-driven Text-to-Image Generation via Preference-based Reinforcement Learning
par: Miao, Yanting, et autres
Publié: (2024)
par: Miao, Yanting, et autres
Publié: (2024)
Transcending Domains through Text-to-Image Diffusion: A Source-Free Approach to Domain Adaptation
par: Chopra, Shivang, et autres
Publié: (2023)
par: Chopra, Shivang, et autres
Publié: (2023)
A Minimalist Method for Fine-tuning Text-to-Image Diffusion Models
par: Miao, Yanting, et autres
Publié: (2025)
par: Miao, Yanting, et autres
Publié: (2025)
Layered Diffusion Model for One-Shot High Resolution Text-to-Image Synthesis
par: Khwaja, Emaad, et autres
Publié: (2024)
par: Khwaja, Emaad, et autres
Publié: (2024)
Source-Free Domain Adaptation with Diffusion-Guided Source Data Generation
par: Chopra, Shivang, et autres
Publié: (2024)
par: Chopra, Shivang, et autres
Publié: (2024)
MEPG:Multi-Expert Planning and Generation for Compositionally-Rich Image Generation
par: Zhao, Yuan, et autres
Publié: (2025)
par: Zhao, Yuan, et autres
Publié: (2025)
Single Image Iterative Subject-driven Generation and Editing
par: Shpitzer, Yair, et autres
Publié: (2025)
par: Shpitzer, Yair, et autres
Publié: (2025)
ImageEdit-R1: Boosting Multi-Agent Image Editing via Reinforcement Learning
par: Zhao, Yiran, et autres
Publié: (2026)
par: Zhao, Yiran, et autres
Publié: (2026)
Understanding Generative AI Capabilities in Everyday Image Editing Tasks
par: Taesiri, Mohammad Reza, et autres
Publié: (2025)
par: Taesiri, Mohammad Reza, et autres
Publié: (2025)
Consistent Video Editing as Flow-Driven Image-to-Video Generation
par: Wang, Ge, et autres
Publié: (2025)
par: Wang, Ge, et autres
Publié: (2025)
VAGS: Velocity Adaptive Guidance Scale for Image Editing and Generation
par: Luo, Yan, et autres
Publié: (2026)
par: Luo, Yan, et autres
Publié: (2026)
An Interpretable Local Editing Model for Counterfactual Medical Image Generation
par: Min, Hyungi, et autres
Publié: (2026)
par: Min, Hyungi, et autres
Publié: (2026)
OpenGPT-4o-Image: A Comprehensive Dataset for Advanced Image Generation and Editing
par: Chen, Zhihong, et autres
Publié: (2025)
par: Chen, Zhihong, et autres
Publié: (2025)
Coupled Diffusion Sampling for Training-Free Multi-View Image Editing
par: Alzayer, Hadi, et autres
Publié: (2025)
par: Alzayer, Hadi, et autres
Publié: (2025)
MSRAMIE: Multimodal Structured Reasoning Agent for Multi-instruction Image Editing
par: Qiu, Zhaoyuan, et autres
Publié: (2026)
par: Qiu, Zhaoyuan, et autres
Publié: (2026)
Fill the GAP: A Granular Alignment Paradigm for Visual Reasoning in Multimodal Large Language Models
par: Miao, Yanting, et autres
Publié: (2026)
par: Miao, Yanting, et autres
Publié: (2026)
RL-I2IT: Image-to-Image Translation with Deep Reinforcement Learning
par: Hu, Jing, et autres
Publié: (2023)
par: Hu, Jing, et autres
Publié: (2023)
IMAGAgent: Orchestrating Multi-Turn Image Editing via Constraint-Aware Planning and Reflection
par: Shen, Fei, et autres
Publié: (2026)
par: Shen, Fei, et autres
Publié: (2026)
DiffusionAgent: Navigating Expert Models for Agentic Image Generation
par: Qin, Jie, et autres
Publié: (2024)
par: Qin, Jie, et autres
Publié: (2024)
SINE: SINgle Image Editing with Text-to-Image Diffusion Models
par: Zhang, Zhixing, et autres
Publié: (2022)
par: Zhang, Zhixing, et autres
Publié: (2022)
InstructMoLE: Instruction-Guided Mixture of Low-rank Experts for Multi-Conditional Image Generation
par: Xiao, Jinqi, et autres
Publié: (2025)
par: Xiao, Jinqi, et autres
Publié: (2025)
RegionE: Adaptive Region-Aware Generation for Efficient Image Editing
par: Chen, Pengtao, et autres
Publié: (2025)
par: Chen, Pengtao, et autres
Publié: (2025)
ReflectCAP: Detailed Image Captioning with Reflective Memory
par: Min, Kyungmin, et autres
Publié: (2026)
par: Min, Kyungmin, et autres
Publié: (2026)
Inline Critic Steers Image Editing
par: Kang, Weitai, et autres
Publié: (2026)
par: Kang, Weitai, et autres
Publié: (2026)
BalCapRL: A Balanced Framework for RL-Based MLLM Image Captioning
par: Ye, Shaokai, et autres
Publié: (2026)
par: Ye, Shaokai, et autres
Publié: (2026)
Pathways on the Image Manifold: Image Editing via Video Generation
par: Rotstein, Noam, et autres
Publié: (2024)
par: Rotstein, Noam, et autres
Publié: (2024)
TAGE: Trustworthy Attribute Group Editing for Stable Few-shot Image Generation
par: Zhang, Ruicheng, et autres
Publié: (2024)
par: Zhang, Ruicheng, et autres
Publié: (2024)
ProSona: Prompt-Guided Personalization for Multi-Expert Medical Image Segmentation
par: Elgebaly, Aya, et autres
Publié: (2025)
par: Elgebaly, Aya, et autres
Publié: (2025)
Sparse Mixture-of-Experts for Multi-Channel Imaging: Are All Channel Interactions Required?
par: Yun, Sukwon, et autres
Publié: (2025)
par: Yun, Sukwon, et autres
Publié: (2025)
FreeEdit: Mask-free Reference-based Image Editing with Multi-modal Instruction
par: He, Runze, et autres
Publié: (2024)
par: He, Runze, et autres
Publié: (2024)
Probing Visual Planning in Image Editing Models
par: Zhou, Zhimu, et autres
Publié: (2026)
par: Zhou, Zhimu, et autres
Publié: (2026)
Condition Weaving Meets Expert Modulation: Towards Universal and Controllable Image Generation
par: Zhang, Guoqing, et autres
Publié: (2025)
par: Zhang, Guoqing, et autres
Publié: (2025)
SimGraph: A Unified Framework for Scene Graph-Based Image Generation and Editing
par: Vo, Thanh-Nhan, et autres
Publié: (2026)
par: Vo, Thanh-Nhan, et autres
Publié: (2026)
Spatio-Semantic Expert Routing Architecture with Mixture-of-Experts for Referring Image Segmentation
par: Dalaq, Alaa, et autres
Publié: (2026)
par: Dalaq, Alaa, et autres
Publié: (2026)
BrushEdit: All-In-One Image Inpainting and Editing
par: Li, Yaowei, et autres
Publié: (2024)
par: Li, Yaowei, et autres
Publié: (2024)
Towards Robust Sequential Decomposition for Complex Image Editing
par: Zeng, Zilai, et autres
Publié: (2026)
par: Zeng, Zilai, et autres
Publié: (2026)
$\texttt{Complex-Edit}$: CoT-Like Instruction Generation for Complexity-Controllable Image Editing Benchmark
par: Yang, Siwei, et autres
Publié: (2025)
par: Yang, Siwei, et autres
Publié: (2025)
DLEBench: Evaluating Small-scale Object Editing Ability for Instruction-based Image Editing Model
par: Hong, Shibo, et autres
Publié: (2026)
par: Hong, Shibo, et autres
Publié: (2026)
Reflective Human-Machine Co-adaptation for Enhanced Text-to-Image Generation Dialogue System
par: Feng, Yuheng, et autres
Publié: (2024)
par: Feng, Yuheng, et autres
Publié: (2024)
Personalized Image Editing in Text-to-Image Diffusion Models via Collaborative Direct Preference Optimization
par: Dunlop, Connor, et autres
Publié: (2025)
par: Dunlop, Connor, et autres
Publié: (2025)
Documents similaires
-
Subject-driven Text-to-Image Generation via Preference-based Reinforcement Learning
par: Miao, Yanting, et autres
Publié: (2024) -
Transcending Domains through Text-to-Image Diffusion: A Source-Free Approach to Domain Adaptation
par: Chopra, Shivang, et autres
Publié: (2023) -
A Minimalist Method for Fine-tuning Text-to-Image Diffusion Models
par: Miao, Yanting, et autres
Publié: (2025) -
Layered Diffusion Model for One-Shot High Resolution Text-to-Image Synthesis
par: Khwaja, Emaad, et autres
Publié: (2024) -
Source-Free Domain Adaptation with Diffusion-Guided Source Data Generation
par: Chopra, Shivang, et autres
Publié: (2024)