3D Object Manipulation in a Single Image using Generative Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Zhao, Ruisi, Zhang, Zechuan, Yang, Zongxin, Yang, Yi |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Are Image-to-Video Models Good Zero-Shot Image Editors?
por: Zhang, Zechuan, et al.
Publicado: (2025)
por: Zhang, Zechuan, et al.
Publicado: (2025)
SIFU: Side-view Conditioned Implicit Function for Real-world Usable Clothed Human Reconstruction
por: Zhang, Zechuan, et al.
Publicado: (2023)
por: Zhang, Zechuan, et al.
Publicado: (2023)
TRACE: High-Fidelity 3D Scene Editing via Tangible Reconstruction and Geometry-Aligned Contextual Video Masking
por: Hu, Jiyuan, et al.
Publicado: (2026)
por: Hu, Jiyuan, et al.
Publicado: (2026)
Stroke3D: Lifting 2D strokes into rigged 3D model via latent diffusion models
por: Zhao, Ruisi, et al.
Publicado: (2026)
por: Zhao, Ruisi, et al.
Publicado: (2026)
In-Context Edit: Enabling Instructional Image Editing with In-Context Generation in Large Scale Diffusion Transformer
por: Zhang, Zechuan, et al.
Publicado: (2025)
por: Zhang, Zechuan, et al.
Publicado: (2025)
3DIS: Depth-Driven Decoupled Instance Synthesis for Text-to-Image Generation
por: Zhou, Dewei, et al.
Publicado: (2024)
por: Zhou, Dewei, et al.
Publicado: (2024)
DreamRenderer: Taming Multi-Instance Attribute Control in Large-Scale Text-to-Image Models
por: Zhou, Dewei, et al.
Publicado: (2025)
por: Zhou, Dewei, et al.
Publicado: (2025)
MIGC++: Advanced Multi-Instance Generation Controller for Image Synthesis
por: Zhou, Dewei, et al.
Publicado: (2024)
por: Zhou, Dewei, et al.
Publicado: (2024)
Controllable 3D Face Generation with Conditional Style Code Diffusion
por: Shen, Xiaolong, et al.
Publicado: (2023)
por: Shen, Xiaolong, et al.
Publicado: (2023)
Origin Identification for Text-Guided Image-to-Image Diffusion Models
por: Wang, Wenhao, et al.
Publicado: (2025)
por: Wang, Wenhao, et al.
Publicado: (2025)
HeadStudio: Text to Animatable Head Avatars with 3D Gaussian Splatting
por: Zhou, Zhenglin, et al.
Publicado: (2024)
por: Zhou, Zhenglin, et al.
Publicado: (2024)
Scalable Video Object Segmentation with Identification Mechanism
por: Yang, Zongxin, et al.
Publicado: (2022)
por: Yang, Zongxin, et al.
Publicado: (2022)
GD^2-NeRF: Generative Detail Compensation via GAN and Diffusion for One-shot Generalizable Neural Radiance Fields
por: Pan, Xiao, et al.
Publicado: (2024)
por: Pan, Xiao, et al.
Publicado: (2024)
3DIS-FLUX: simple and efficient multi-instance generation with DiT rendering
por: Zhou, Dewei, et al.
Publicado: (2025)
por: Zhou, Dewei, et al.
Publicado: (2025)
IDPro: Flexible Interactive Video Object Segmentation by ID-queried Concurrent Propagation
por: Li, Kexin, et al.
Publicado: (2024)
por: Li, Kexin, et al.
Publicado: (2024)
High-fidelity 3D Object Generation from Single Image with RGBN-Volume Gaussian Reconstruction Model
por: Shen, Yiyang, et al.
Publicado: (2025)
por: Shen, Yiyang, et al.
Publicado: (2025)
GSOT3D: Towards Generic 3D Single Object Tracking in the Wild
por: Jiao, Yifan, et al.
Publicado: (2024)
por: Jiao, Yifan, et al.
Publicado: (2024)
Rethinking Cross-modal Interaction from a Top-down Perspective for Referring Video Object Segmentation
por: Liang, Chen, et al.
Publicado: (2021)
por: Liang, Chen, et al.
Publicado: (2021)
Controllable 3D Object Generation with Single Image Prompt
por: Lee, Jaeseok, et al.
Publicado: (2025)
por: Lee, Jaeseok, et al.
Publicado: (2025)
Efficient4D: Fast Dynamic 3D Object Generation from a Single-view Video
por: Pan, Zijie, et al.
Publicado: (2024)
por: Pan, Zijie, et al.
Publicado: (2024)
BideDPO: Conditional Image Generation with Simultaneous Text and Condition Alignment
por: Zhou, Dewei, et al.
Publicado: (2025)
por: Zhou, Dewei, et al.
Publicado: (2025)
RefineAnything: Multimodal Region-Specific Refinement for Perfect Local Details
por: Zhou, Dewei, et al.
Publicado: (2026)
por: Zhou, Dewei, et al.
Publicado: (2026)
Physically Compatible 3D Object Modeling from a Single Image
por: Guo, Minghao, et al.
Publicado: (2024)
por: Guo, Minghao, et al.
Publicado: (2024)
Compress3D: a Compressed Latent Space for 3D Generation from a Single Image
por: Zhang, Bowen, et al.
Publicado: (2024)
por: Zhang, Bowen, et al.
Publicado: (2024)
TransDiff: Diffusion-Based Method for Manipulating Transparent Objects Using a Single RGB-D Image
por: Wang, Haoxiao, et al.
Publicado: (2025)
por: Wang, Haoxiao, et al.
Publicado: (2025)
RSEdit: Text-Guided Image Editing for Remote Sensing
por: Zhenyuan, Chen, et al.
Publicado: (2026)
por: Zhenyuan, Chen, et al.
Publicado: (2026)
3DGeoDet: General-purpose Geometry-aware Image-based 3D Object Detection
por: Zhang, Yi, et al.
Publicado: (2025)
por: Zhang, Yi, et al.
Publicado: (2025)
GO-N3RDet: Geometry Optimized NeRF-enhanced 3D Object Detector
por: Li, Zechuan, et al.
Publicado: (2025)
por: Li, Zechuan, et al.
Publicado: (2025)
DoraemonGPT: Toward Understanding Dynamic Scenes with Large Language Models (Exemplified as A Video Agent)
por: Yang, Zongxin, et al.
Publicado: (2024)
por: Yang, Zongxin, et al.
Publicado: (2024)
Single-Slice-to-3D Reconstruction in Medical Imaging and Natural Objects: A Comparative Benchmark with SAM 3D
por: Luo, Yan, et al.
Publicado: (2026)
por: Luo, Yan, et al.
Publicado: (2026)
ImOV3D: Learning Open-Vocabulary Point Clouds 3D Object Detection from Only 2D Images
por: Yang, Timing, et al.
Publicado: (2024)
por: Yang, Timing, et al.
Publicado: (2024)
Object Fidelity Diffusion for Remote Sensing Image Generation
por: Ye, Ziqi, et al.
Publicado: (2025)
por: Ye, Ziqi, et al.
Publicado: (2025)
CUPID: Generative 3D Reconstruction via Joint Object and Pose Modeling
por: Huang, Binbin, et al.
Publicado: (2025)
por: Huang, Binbin, et al.
Publicado: (2025)
Consistency Diffusion Models for Single-Image 3D Reconstruction with Priors
por: Jiang, Chenru, et al.
Publicado: (2025)
por: Jiang, Chenru, et al.
Publicado: (2025)
Single Image, Any Face: Generalisable 3D Face Generation
por: Wang, Wenqing, et al.
Publicado: (2024)
por: Wang, Wenqing, et al.
Publicado: (2024)
PhyEdit: Towards Real-World Object Manipulation via Physically-Grounded Image Editing
por: Xu, Ruihang, et al.
Publicado: (2026)
por: Xu, Ruihang, et al.
Publicado: (2026)
AR-1-to-3: Single Image to Consistent 3D Object Generation via Next-View Prediction
por: Zhang, Xuying, et al.
Publicado: (2025)
por: Zhang, Xuying, et al.
Publicado: (2025)
PhyCAGE: Physically Plausible Compositional 3D Asset Generation from a Single Image
por: Yan, Han, et al.
Publicado: (2024)
por: Yan, Han, et al.
Publicado: (2024)
Hybrid Fourier Score Distillation for Efficient One Image to 3D Object Generation
por: Yang, Shuzhou, et al.
Publicado: (2024)
por: Yang, Shuzhou, et al.
Publicado: (2024)
IPDreamer: Appearance-Controllable 3D Object Generation with Complex Image Prompts
por: Zeng, Bohan, et al.
Publicado: (2023)
por: Zeng, Bohan, et al.
Publicado: (2023)
Ejemplares similares
-
Are Image-to-Video Models Good Zero-Shot Image Editors?
por: Zhang, Zechuan, et al.
Publicado: (2025) -
SIFU: Side-view Conditioned Implicit Function for Real-world Usable Clothed Human Reconstruction
por: Zhang, Zechuan, et al.
Publicado: (2023) -
TRACE: High-Fidelity 3D Scene Editing via Tangible Reconstruction and Geometry-Aligned Contextual Video Masking
por: Hu, Jiyuan, et al.
Publicado: (2026) -
Stroke3D: Lifting 2D strokes into rigged 3D model via latent diffusion models
por: Zhao, Ruisi, et al.
Publicado: (2026) -
In-Context Edit: Enabling Instructional Image Editing with In-Context Generation in Large Scale Diffusion Transformer
por: Zhang, Zechuan, et al.
Publicado: (2025)