MonetGPT: Solving Puzzles Enhances MLLMs' Image Retouching Skills
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Dutt, Niladri Shekhar, Ceylan, Duygu, Mitra, Niloy J. |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
LoST: Level of Semantics Tokenization for 3D Shapes
par: Dutt, Niladri Shekhar, et autres
Publié: (2026)
par: Dutt, Niladri Shekhar, et autres
Publié: (2026)
FlairGPT: Repurposing LLMs for Interior Designs
par: Littlefair, Gabrielle, et autres
Publié: (2025)
par: Littlefair, Gabrielle, et autres
Publié: (2025)
ProteusNeRF: Fast Lightweight NeRF Editing using 3D-Aware Image Context
par: Wang, Binglun, et autres
Publié: (2023)
par: Wang, Binglun, et autres
Publié: (2023)
Diffusion 3D Features (Diff3F): Decorating Untextured Shapes with Distilled Semantic Features
par: Dutt, Niladri Shekhar, et autres
Publié: (2023)
par: Dutt, Niladri Shekhar, et autres
Publié: (2023)
SMF: Template-free and Rig-free Animation Transfer using Kinetic Codes
par: Muralikrishnan, Sanjeev, et autres
Publié: (2025)
par: Muralikrishnan, Sanjeev, et autres
Publié: (2025)
Temporal Residual Jacobians For Rig-free Motion Transfer
par: Muralikrishnan, Sanjeev, et autres
Publié: (2024)
par: Muralikrishnan, Sanjeev, et autres
Publié: (2024)
FlairGPT: Repurposing LLMs for Interior Designs
par: Gabrielle Littlefair, et autres
Publié: (2025)
par: Gabrielle Littlefair, et autres
Publié: (2025)
GANFusion: Feed-Forward Text-to-3D with Diffusion in GAN Space
par: Attaiki, Souhaib, et autres
Publié: (2024)
par: Attaiki, Souhaib, et autres
Publié: (2024)
Enhancing Image Layout Control with Loss-Guided Diffusion Models
par: Patel, Zakaria, et autres
Publié: (2024)
par: Patel, Zakaria, et autres
Publié: (2024)
PRISM: A Unified Framework for Photorealistic Reconstruction and Intrinsic Scene Modeling
par: Dirik, Alara, et autres
Publié: (2025)
par: Dirik, Alara, et autres
Publié: (2025)
3D-GPT: Procedural 3D Modeling with Large Language Models
par: Sun, Chunyi, et autres
Publié: (2023)
par: Sun, Chunyi, et autres
Publié: (2023)
SkillMimic: Learning Basketball Interaction Skills from Demonstrations
par: Wang, Yinhuai, et autres
Publié: (2024)
par: Wang, Yinhuai, et autres
Publié: (2024)
Stochastic Poisson Surface Reconstruction with One Solve using Geometric Gaussian Processes
par: Holalkere, Sidhanth, et autres
Publié: (2025)
par: Holalkere, Sidhanth, et autres
Publié: (2025)
Neural Semantic Surface Maps
par: Morreale, Luca, et autres
Publié: (2023)
par: Morreale, Luca, et autres
Publié: (2023)
Full Dynamic Range Sky-Modelling For Image Based Lighting
par: Maquignaz, Ian J.
Publié: (2026)
par: Maquignaz, Ian J.
Publié: (2026)
One-Step Image Translation with Text-to-Image Models
par: Parmar, Gaurav, et autres
Publié: (2024)
par: Parmar, Gaurav, et autres
Publié: (2024)
Neural Garment Dynamics via Manifold-Aware Transformers
par: Li, Peizhuo, et autres
Publié: (2024)
par: Li, Peizhuo, et autres
Publié: (2024)
Generating Multi-Image Synthetic Data for Text-to-Image Customization
par: Kumari, Nupur, et autres
Publié: (2025)
par: Kumari, Nupur, et autres
Publié: (2025)
Customizing Text-to-Image Models with a Single Image Pair
par: Jones, Maxwell, et autres
Publié: (2024)
par: Jones, Maxwell, et autres
Publié: (2024)
Tight Inversion: Image-Conditioned Inversion for Real Image Editing
par: Kadosh, Edo, et autres
Publié: (2025)
par: Kadosh, Edo, et autres
Publié: (2025)
CADTalk: An Algorithm and Benchmark for Semantic Commenting of CAD Programs
par: Yuan, Haocheng, et autres
Publié: (2023)
par: Yuan, Haocheng, et autres
Publié: (2023)
DiffCSG: Differentiable CSG via Rasterization
par: Yuan, Haocheng, et autres
Publié: (2024)
par: Yuan, Haocheng, et autres
Publié: (2024)
GOEmbed: Gradient Origin Embeddings for Representation Agnostic 3D Feature Learning
par: Karnewar, Animesh, et autres
Publié: (2023)
par: Karnewar, Animesh, et autres
Publié: (2023)
Denoising Diffusion via Image-Based Rendering
par: Anciukevičius, Titas, et autres
Publié: (2024)
par: Anciukevičius, Titas, et autres
Publié: (2024)
CoatFusion: Controllable Material Coating in Images
par: Levy, Sagie, et autres
Publié: (2025)
par: Levy, Sagie, et autres
Publié: (2025)
SIDAR: Synthetic Image Dataset for Alignment & Restoration
par: Kwiatkowski, Monika, et autres
Publié: (2023)
par: Kwiatkowski, Monika, et autres
Publié: (2023)
Expressive Text-to-Image Generation with Rich Text
par: Ge, Songwei, et autres
Publié: (2023)
par: Ge, Songwei, et autres
Publié: (2023)
B-repLer: Language-guided Editing of CAD Models
par: Liu, Yilin, et autres
Publié: (2025)
par: Liu, Yilin, et autres
Publié: (2025)
Style Aligned Image Generation via Shared Attention
par: Hertz, Amir, et autres
Publié: (2023)
par: Hertz, Amir, et autres
Publié: (2023)
Learning Images Across Scales Using Adversarial Training
par: Wolski, Krzysztof, et autres
Publié: (2024)
par: Wolski, Krzysztof, et autres
Publié: (2024)
Consolidating Attention Features for Multi-view Image Editing
par: Patashnik, Or, et autres
Publié: (2024)
par: Patashnik, Or, et autres
Publié: (2024)
Enhancing Diffusion-based Point Cloud Generation with Smoothness Constraint
par: Li, Yukun, et autres
Publié: (2024)
par: Li, Yukun, et autres
Publié: (2024)
CookingDiffusion: Cooking Procedural Image Generation with Stable Diffusion
par: Wang, Yuan, et autres
Publié: (2025)
par: Wang, Yuan, et autres
Publié: (2025)
Assessing Open-world Forgetting in Generative Image Model Customization
par: Laria, Héctor, et autres
Publié: (2024)
par: Laria, Héctor, et autres
Publié: (2024)
Rethinking Score Distillation as a Bridge Between Image Distributions
par: McAllister, David, et autres
Publié: (2024)
par: McAllister, David, et autres
Publié: (2024)
Stable Flow: Vital Layers for Training-Free Image Editing
par: Avrahami, Omri, et autres
Publié: (2024)
par: Avrahami, Omri, et autres
Publié: (2024)
The Chosen One: Consistent Characters in Text-to-Image Diffusion Models
par: Avrahami, Omri, et autres
Publié: (2023)
par: Avrahami, Omri, et autres
Publié: (2023)
Conditional Balance: Improving Multi-Conditioning Trade-Offs in Image Generation
par: Cohen, Nadav Z., et autres
Publié: (2024)
par: Cohen, Nadav Z., et autres
Publié: (2024)
SPICE: A Synergistic, Precise, Iterative, and Customizable Image Editing Workflow
par: Tang, Kenan, et autres
Publié: (2025)
par: Tang, Kenan, et autres
Publié: (2025)
DiffUHaul: A Training-Free Method for Object Dragging in Images
par: Avrahami, Omri, et autres
Publié: (2024)
par: Avrahami, Omri, et autres
Publié: (2024)
Documents similaires
-
LoST: Level of Semantics Tokenization for 3D Shapes
par: Dutt, Niladri Shekhar, et autres
Publié: (2026) -
FlairGPT: Repurposing LLMs for Interior Designs
par: Littlefair, Gabrielle, et autres
Publié: (2025) -
ProteusNeRF: Fast Lightweight NeRF Editing using 3D-Aware Image Context
par: Wang, Binglun, et autres
Publié: (2023) -
Diffusion 3D Features (Diff3F): Decorating Untextured Shapes with Distilled Semantic Features
par: Dutt, Niladri Shekhar, et autres
Publié: (2023) -
SMF: Template-free and Rig-free Animation Transfer using Kinetic Codes
par: Muralikrishnan, Sanjeev, et autres
Publié: (2025)