CAMEO: A Conditional and Quality-Aware Multi-Agent Image Editing Orchestrator
Fuente:
arXiv
Salvato in:
| Autori principali: | Pu, Yuhan, Zheng, Hao, Mo, Ziqian, Zhang, Hill, Fan, Tianyi, Wu, Shuhong, Wei, Jiaheng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MIRAGE: Benchmarking and Aligning Multi-Instance Image Editing
di: Liu, Ziqian, et al.
Pubblicazione: (2026)
di: Liu, Ziqian, et al.
Pubblicazione: (2026)
CAMEO: Correspondence-Attention Alignment for Multi-View Diffusion Models
di: Kwon, Minkyung, et al.
Pubblicazione: (2025)
di: Kwon, Minkyung, et al.
Pubblicazione: (2025)
Multi-Reward as Condition for Instruction-based Image Editing
di: Gu, Xin, et al.
Pubblicazione: (2024)
di: Gu, Xin, et al.
Pubblicazione: (2024)
CoSTA$\ast$: Cost-Sensitive Toolpath Agent for Multi-turn Image Editing
di: Gupta, Advait, et al.
Pubblicazione: (2025)
di: Gupta, Advait, et al.
Pubblicazione: (2025)
CARE-Edit: Condition-Aware Routing of Experts for Contextual Image Editing
di: Wang, Yucheng, et al.
Pubblicazione: (2026)
di: Wang, Yucheng, et al.
Pubblicazione: (2026)
FaSTA$^*$: Fast-Slow Toolpath Agent with Subroutine Mining for Efficient Multi-turn Image Editing
di: Gupta, Advait, et al.
Pubblicazione: (2025)
di: Gupta, Advait, et al.
Pubblicazione: (2025)
IMAGAgent: Orchestrating Multi-Turn Image Editing via Constraint-Aware Planning and Reflection
di: Shen, Fei, et al.
Pubblicazione: (2026)
di: Shen, Fei, et al.
Pubblicazione: (2026)
InstructGIE: Towards Generalizable Image Editing
di: Meng, Zichong, et al.
Pubblicazione: (2024)
di: Meng, Zichong, et al.
Pubblicazione: (2024)
BOOKAGENT: Orchestrating Safety-Aware Visual Narratives via Multi-Agent Cognitive Calibration
di: Gao, Bo, et al.
Pubblicazione: (2026)
di: Gao, Bo, et al.
Pubblicazione: (2026)
Image Quality Assessment: Exploring Quality Awareness via Memory-driven Distortion Patterns Matching
di: Lan, Xuting, et al.
Pubblicazione: (2026)
di: Lan, Xuting, et al.
Pubblicazione: (2026)
Multi-turn Consistent Image Editing
di: Zhou, Zijun, et al.
Pubblicazione: (2025)
di: Zhou, Zijun, et al.
Pubblicazione: (2025)
Redefining Quality Criteria and Distance-Aware Score Modeling for Image Editing Assessment
di: Zhang, Xinjie, et al.
Pubblicazione: (2026)
di: Zhang, Xinjie, et al.
Pubblicazione: (2026)
Anatomy-Aware Conditional Image-Text Retrieval
di: Zheng, Meng, et al.
Pubblicazione: (2025)
di: Zheng, Meng, et al.
Pubblicazione: (2025)
From Plans to Pixels: Learning to Plan and Orchestrate for Open-Ended Image Editing
di: Rajan, Anirudh Sundara, et al.
Pubblicazione: (2026)
di: Rajan, Anirudh Sundara, et al.
Pubblicazione: (2026)
3D-aware Image Generation and Editing with Multi-modal Conditions
di: Li, Bo, et al.
Pubblicazione: (2024)
di: Li, Bo, et al.
Pubblicazione: (2024)
DCI: Dual-Conditional Inversion for Boosting Diffusion-Based Image Editing
di: Li, Zixiang, et al.
Pubblicazione: (2025)
di: Li, Zixiang, et al.
Pubblicazione: (2025)
Talk2Image: A Multi-Agent System for Multi-Turn Image Generation and Editing
di: Ma, Shichao, et al.
Pubblicazione: (2025)
di: Ma, Shichao, et al.
Pubblicazione: (2025)
When VLMs Meet Image Classification: Test Sets Renovation via Missing Label Identification
di: Pang, Zirui, et al.
Pubblicazione: (2025)
di: Pang, Zirui, et al.
Pubblicazione: (2025)
FreeFlux: Understanding and Exploiting Layer-Specific Roles in RoPE-Based MMDiT for Versatile Image Editing
di: Wei, Tianyi, et al.
Pubblicazione: (2025)
di: Wei, Tianyi, et al.
Pubblicazione: (2025)
AnyEdit: Mastering Unified High-Quality Image Editing for Any Idea
di: Yu, Qifan, et al.
Pubblicazione: (2024)
di: Yu, Qifan, et al.
Pubblicazione: (2024)
Preserve, Reveal, Expand: Faithful 4D Video Editing with Region-Aware Conditioning
di: Hu, Zhangchi, et al.
Pubblicazione: (2026)
di: Hu, Zhangchi, et al.
Pubblicazione: (2026)
Dynamic Orchestration of Multi-Agent System for Real-World Multi-Image Agricultural VQA
di: Ke, Yan, et al.
Pubblicazione: (2025)
di: Ke, Yan, et al.
Pubblicazione: (2025)
UniRef-Image-Edit: Towards Scalable and Consistent Multi-Reference Image Editing
di: Wei, Hongyang, et al.
Pubblicazione: (2026)
di: Wei, Hongyang, et al.
Pubblicazione: (2026)
Global-Local Aware Scene Text Editing
di: Yang, Fuxiang, et al.
Pubblicazione: (2025)
di: Yang, Fuxiang, et al.
Pubblicazione: (2025)
CC-FMO: Camera-Conditioned Zero-Shot Single Image to 3D Scene Generation with Foundation Model Orchestration
di: Tang, Boshi, et al.
Pubblicazione: (2025)
di: Tang, Boshi, et al.
Pubblicazione: (2025)
CREA: A Collaborative Multi-Agent Framework for Creative Image Editing and Generation
di: Venkatesh, Kavana, et al.
Pubblicazione: (2025)
di: Venkatesh, Kavana, et al.
Pubblicazione: (2025)
Dragging with Geometry: From Pixels to Geometry-Guided Image Editing
di: Pu, Xinyu, et al.
Pubblicazione: (2025)
di: Pu, Xinyu, et al.
Pubblicazione: (2025)
GRADE: Benchmarking Discipline-Informed Reasoning in Image Editing
di: Liu, Mingxin, et al.
Pubblicazione: (2026)
di: Liu, Mingxin, et al.
Pubblicazione: (2026)
StyleQoRA: Quality-Aware Low-Rank Adaptation for Few-Shot Multi-Style Editing
di: Cao, Cong, et al.
Pubblicazione: (2025)
di: Cao, Cong, et al.
Pubblicazione: (2025)
Synergistic Perception and Generative Recomposition: A Multi-Agent Orchestration for Expert-Level Building Inspection
di: Zhong, Hui, et al.
Pubblicazione: (2026)
di: Zhong, Hui, et al.
Pubblicazione: (2026)
Guidance Free Image Editing via Explicit Conditioning
di: Noroozi, Mehdi, et al.
Pubblicazione: (2025)
di: Noroozi, Mehdi, et al.
Pubblicazione: (2025)
Context-Aware Autoregressive Models for Multi-Conditional Image Generation
di: Chen, Yixiao, et al.
Pubblicazione: (2025)
di: Chen, Yixiao, et al.
Pubblicazione: (2025)
Dual-Perspective Semantic-Aware Representation Blending for Multi-Label Image Recognition with Partial Labels
di: Pu, Tao, et al.
Pubblicazione: (2022)
di: Pu, Tao, et al.
Pubblicazione: (2022)
Rethinking Where to Edit: Task-Aware Localization for Instruction-Based Image Editing
di: He, Jingxuan, et al.
Pubblicazione: (2026)
di: He, Jingxuan, et al.
Pubblicazione: (2026)
PosBridge: Multi-View Positional Embedding Transplant for Identity-Aware Image Editing
di: Xiong, Peilin, et al.
Pubblicazione: (2025)
di: Xiong, Peilin, et al.
Pubblicazione: (2025)
FreeDiff: Progressive Frequency Truncation for Image Editing with Diffusion Models
di: Wu, Wei, et al.
Pubblicazione: (2024)
di: Wu, Wei, et al.
Pubblicazione: (2024)
Hollywood Town: Long-Video Generation via Cross-Modal Multi-Agent Orchestration
di: Wei, Zheng, et al.
Pubblicazione: (2025)
di: Wei, Zheng, et al.
Pubblicazione: (2025)
CCA: Collaborative Competitive Agents for Image Editing
di: Hang, Tiankai, et al.
Pubblicazione: (2024)
di: Hang, Tiankai, et al.
Pubblicazione: (2024)
InterCoG: Towards Spatially Precise Image Editing with Interleaved Chain-of-Grounding Reasoning
di: Wan, Yecong, et al.
Pubblicazione: (2026)
di: Wan, Yecong, et al.
Pubblicazione: (2026)
EditRefiner: A Human-Aligned Agentic Framework for Image Editing Refinement
di: Xu, Zitong, et al.
Pubblicazione: (2026)
di: Xu, Zitong, et al.
Pubblicazione: (2026)
Documenti analoghi
-
MIRAGE: Benchmarking and Aligning Multi-Instance Image Editing
di: Liu, Ziqian, et al.
Pubblicazione: (2026) -
CAMEO: Correspondence-Attention Alignment for Multi-View Diffusion Models
di: Kwon, Minkyung, et al.
Pubblicazione: (2025) -
Multi-Reward as Condition for Instruction-based Image Editing
di: Gu, Xin, et al.
Pubblicazione: (2024) -
CoSTA$\ast$: Cost-Sensitive Toolpath Agent for Multi-turn Image Editing
di: Gupta, Advait, et al.
Pubblicazione: (2025) -
CARE-Edit: Condition-Aware Routing of Experts for Contextual Image Editing
di: Wang, Yucheng, et al.
Pubblicazione: (2026)