Image Anything: Towards Reasoning-coherent and Training-free Multi-modal Image Generation
Fuente:
arXiv
Saved in:
| Main Authors: | Lyu, Yuanhuiyi, Zheng, Xu, Wang, Lin |
|---|---|
| Format: | Preprint |
| Published: |
2024
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
MoDA: Multi-modal Diffusion Architecture for Talking Head Generation
by: Li, Xinyang, et al.
Published: (2025)
by: Li, Xinyang, et al.
Published: (2025)
Material Anything: Generating Materials for Any 3D Object via Diffusion
by: Huang, Xin, et al.
Published: (2024)
by: Huang, Xin, et al.
Published: (2024)
Best Segmentation Buddies for Image-Shape Correspondence
by: Lang, Itai, et al.
Published: (2026)
by: Lang, Itai, et al.
Published: (2026)
Code-as-Room: Generating 3D Rooms from Top-Down View Images via Agentic Code Synthesis
by: Yang, Yixuan, et al.
Published: (2026)
by: Yang, Yixuan, et al.
Published: (2026)
ImageRAG: Dynamic Image Retrieval for Reference-Guided Image Generation
by: Shalev-Arkushin, Rotem, et al.
Published: (2025)
by: Shalev-Arkushin, Rotem, et al.
Published: (2025)
Exploring Multi-modal Neural Scene Representations With Applications on Thermal Imaging
by: Özer, Mert, et al.
Published: (2024)
by: Özer, Mert, et al.
Published: (2024)
Differentiable Convex Polyhedra Optimization from Multi-view Images
by: Ren, Daxuan, et al.
Published: (2024)
by: Ren, Daxuan, et al.
Published: (2024)
Multi-View Depth Consistent Image Generation Using Generative AI Models: Application on Architectural Design of University Buildings
by: Du, Xusheng, et al.
Published: (2025)
by: Du, Xusheng, et al.
Published: (2025)
Chord: Chain of Rendering Decomposition for PBR Material Estimation from Generated Texture Images
by: Ying, Zhi, et al.
Published: (2025)
by: Ying, Zhi, et al.
Published: (2025)
Anywhere: A Multi-Agent Framework for User-Guided, Reliable, and Diverse Foreground-Conditioned Image Generation
by: Xie, Tianyidan, et al.
Published: (2024)
by: Xie, Tianyidan, et al.
Published: (2024)
Ev-Layout: A Large-scale Event-based Multi-modal Dataset for Indoor Layout Estimation and Tracking
by: Guo, Xucheng, et al.
Published: (2025)
by: Guo, Xucheng, et al.
Published: (2025)
JeDi: Joint-Image Diffusion Models for Finetuning-Free Personalized Text-to-Image Generation
by: Zeng, Yu, et al.
Published: (2024)
by: Zeng, Yu, et al.
Published: (2024)
Colorful-Noise: Training-Free Low-Frequency Noise Manipulation for Color-Based Conditional Image Generation
by: Cohen, Nadav Z., et al.
Published: (2026)
by: Cohen, Nadav Z., et al.
Published: (2026)
Structure-Guided Image Completion with Image-level and Object-level Semantic Discriminators
by: Zheng, Haitian, et al.
Published: (2022)
by: Zheng, Haitian, et al.
Published: (2022)
Neural Image Space Tessellation efect
by: Du, Youyang, et al.
Published: (2026)
by: Du, Youyang, et al.
Published: (2026)
GARField: Group Anything with Radiance Fields
by: Kim, Chung Min, et al.
Published: (2024)
by: Kim, Chung Min, et al.
Published: (2024)
TelePhysics: Physics-Grounded Multi-Object Scene Generation from a Single Image with Real-Time Interaction
by: Zhang, Xin, et al.
Published: (2026)
by: Zhang, Xin, et al.
Published: (2026)
Inverse Rendering for High-Genus Surface Meshes from Multi-View Images
by: Gao, Xiang, et al.
Published: (2025)
by: Gao, Xiang, et al.
Published: (2025)
Towards Geometric and Textural Consistency 3D Scene Generation via Single Image-guided Model Generation and Layout Optimization
by: Tang, Xiang, et al.
Published: (2025)
by: Tang, Xiang, et al.
Published: (2025)
PrimitiveAnything: Human-Crafted 3D Primitive Assembly Generation with Auto-Regressive Transformer
by: Ye, Jingwen, et al.
Published: (2025)
by: Ye, Jingwen, et al.
Published: (2025)
MGFs: Masked Gaussian Fields for Meshing Building based on Multi-View Images
by: Wang, Tengfei, et al.
Published: (2024)
by: Wang, Tengfei, et al.
Published: (2024)
Sketch-Guided Scene Image Generation
by: Zhang, Tianyu, et al.
Published: (2024)
by: Zhang, Tianyu, et al.
Published: (2024)
DiffArtist: Towards Structure and Appearance Controllable Image Stylization
by: Jiang, Ruixiang, et al.
Published: (2024)
by: Jiang, Ruixiang, et al.
Published: (2024)
Towards Physically-Based Sky-Modeling For Image Based Lighting
by: Maquignaz, Ian J.
Published: (2025)
by: Maquignaz, Ian J.
Published: (2025)
Generating Multi-Image Synthetic Data for Text-to-Image Customization
by: Kumari, Nupur, et al.
Published: (2025)
by: Kumari, Nupur, et al.
Published: (2025)
GaussianAnything: Interactive Point Cloud Flow Matching For 3D Object Generation
by: Lan, Yushi, et al.
Published: (2024)
by: Lan, Yushi, et al.
Published: (2024)
FaceLift: Learning Generalizable Single Image 3D Face Reconstruction from Synthetic Heads
by: Lyu, Weijie, et al.
Published: (2024)
by: Lyu, Weijie, et al.
Published: (2024)
Block and Detail: Scaffolding Sketch-to-Image Generation
by: Sarukkai, Vishnu, et al.
Published: (2024)
by: Sarukkai, Vishnu, et al.
Published: (2024)
OmniFit: Multi-modal 3D Body Fitting via Scale-agnostic Dense Landmark Prediction
by: Cai, Zeyu, et al.
Published: (2026)
by: Cai, Zeyu, et al.
Published: (2026)
T$^3$-S2S: Training-free Triplet Tuning for Sketch to Scene Synthesis in Controllable Concept Art Generation
by: Sun, Zhenhong, et al.
Published: (2024)
by: Sun, Zhenhong, et al.
Published: (2024)
MeshAnything V2: Artist-Created Mesh Generation With Adjacent Mesh Tokenization
by: Chen, Yiwen, et al.
Published: (2024)
by: Chen, Yiwen, et al.
Published: (2024)
FlexPainter: Flexible and Multi-View Consistent Texture Generation
by: Yan, Dongyu, et al.
Published: (2025)
by: Yan, Dongyu, et al.
Published: (2025)
TANGLED: Generating 3D Hair Strands from Images with Arbitrary Styles and Viewpoints
by: Long, Pengyu, et al.
Published: (2025)
by: Long, Pengyu, et al.
Published: (2025)
Physics-driven Fire Modeling from Multi-view Images
by: Dorta, Gara, et al.
Published: (2018)
by: Dorta, Gara, et al.
Published: (2018)
MG-Gen: Single Image to Motion Graphics Generation
by: Shirakawa, Takahiro, et al.
Published: (2025)
by: Shirakawa, Takahiro, et al.
Published: (2025)
LiftImage3D: Lifting Any Single Image to 3D Gaussians with Video Generation Priors
by: Chen, Yabo, et al.
Published: (2024)
by: Chen, Yabo, et al.
Published: (2024)
Kiss3DGen: Repurposing Image Diffusion Models for 3D Asset Generation
by: Lin, Jiantao, et al.
Published: (2025)
by: Lin, Jiantao, et al.
Published: (2025)
X-Part: high fidelity and structure coherent shape decomposition
by: Yan, Xinhao, et al.
Published: (2025)
by: Yan, Xinhao, et al.
Published: (2025)
IntrinsicReal: Adapting IntrinsicAnything from Synthetic to Real Objects
by: Wei, Xiaokang, et al.
Published: (2025)
by: Wei, Xiaokang, et al.
Published: (2025)
NeuralFur: Animal Fur Reconstruction From Multi-View Images
by: Sklyarova, Vanessa, et al.
Published: (2026)
by: Sklyarova, Vanessa, et al.
Published: (2026)
Similar Items
-
MoDA: Multi-modal Diffusion Architecture for Talking Head Generation
by: Li, Xinyang, et al.
Published: (2025) -
Material Anything: Generating Materials for Any 3D Object via Diffusion
by: Huang, Xin, et al.
Published: (2024) -
Best Segmentation Buddies for Image-Shape Correspondence
by: Lang, Itai, et al.
Published: (2026) -
Code-as-Room: Generating 3D Rooms from Top-Down View Images via Agentic Code Synthesis
by: Yang, Yixuan, et al.
Published: (2026) -
ImageRAG: Dynamic Image Retrieval for Reference-Guided Image Generation
by: Shalev-Arkushin, Rotem, et al.
Published: (2025)