Free-Form Scene Editor: Enabling Multi-Round Object Manipulation like in a 3D Engine
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Shuai, Xincheng, Qin, Zhenyuan, Ding, Henghui, Tao, Dacheng |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SceneDesigner: Controllable Multi-Object Image Generation with 9-DoF Pose Manipulation
par: Qin, Zhenyuan, et autres
Publié: (2025)
par: Qin, Zhenyuan, et autres
Publié: (2025)
Free-Form Motion Control: Controlling the 6D Poses of Camera and Objects in Video Generation
par: Shuai, Xincheng, et autres
Publié: (2025)
par: Shuai, Xincheng, et autres
Publié: (2025)
GlyphPrinter: Region-Grouped Direct Preference Optimization for Glyph-Accurate Visual Text Rendering
par: Shuai, Xincheng, et autres
Publié: (2026)
par: Shuai, Xincheng, et autres
Publié: (2026)
PSDesigner: Automated Graphic Design with a Human-Like Creative Workflow
par: Shuai, Xincheng, et autres
Publié: (2026)
par: Shuai, Xincheng, et autres
Publié: (2026)
A Survey of Multimodal-Guided Image Editing with Text-to-Image Diffusion Models
par: Shuai, Xincheng, et autres
Publié: (2024)
par: Shuai, Xincheng, et autres
Publié: (2024)
AnyI2V: Animating Any Conditional Image with Motion Control
par: Li, Ziye, et autres
Publié: (2025)
par: Li, Ziye, et autres
Publié: (2025)
RefMask3D: Language-Guided Transformer for 3D Referring Segmentation
par: He, Shuting, et autres
Publié: (2024)
par: He, Shuting, et autres
Publié: (2024)
On Geometry-Enhanced Parameter-Efficient Fine-Tuning for 3D Scene Segmentation
par: Tang, Liyao, et autres
Publié: (2025)
par: Tang, Liyao, et autres
Publié: (2025)
SceneExpander: Expanding 3D Scenes with Free-Form Inserted Views
par: He, Zijian, et autres
Publié: (2026)
par: He, Zijian, et autres
Publié: (2026)
MOVE: Motion-Guided Few-Shot Video Object Segmentation
par: Ying, Kaining, et autres
Publié: (2025)
par: Ying, Kaining, et autres
Publié: (2025)
SAM3-DMS: Decoupled Memory Selection for Multi-target Video Segmentation of SAM3
par: Shen, Ruiqi, et autres
Publié: (2026)
par: Shen, Ruiqi, et autres
Publié: (2026)
SimDistill: Simulated Multi-modal Distillation for BEV 3D Object Detection
par: Zhao, Haimei, et autres
Publié: (2023)
par: Zhao, Haimei, et autres
Publié: (2023)
Free-Editor: Zero-shot Text-driven 3D Scene Editing
par: Karim, Nazmul, et autres
Publié: (2023)
par: Karim, Nazmul, et autres
Publié: (2023)
Ref-SAM3D: Bridging SAM3D with Text for Reference 3D Reconstruction
par: Zhou, Yun, et autres
Publié: (2025)
par: Zhou, Yun, et autres
Publié: (2025)
MOSEv2: A More Challenging Dataset for Video Object Segmentation in Complex Scenes
par: Ding, Henghui, et autres
Publié: (2025)
par: Ding, Henghui, et autres
Publié: (2025)
EffectErase: Joint Video Object Removal and Insertion for High-Quality Effect Erasing
par: Fu, Yang, et autres
Publié: (2026)
par: Fu, Yang, et autres
Publié: (2026)
LAB-Det: Language as a Domain-Invariant Bridge for Training-Free One-Shot Domain Generalization in Object Detection
par: Zhang, Xu, et autres
Publié: (2026)
par: Zhang, Xu, et autres
Publié: (2026)
Decoupling Static and Hierarchical Motion Perception for Referring Video Segmentation
par: He, Shuting, et autres
Publié: (2024)
par: He, Shuting, et autres
Publié: (2024)
ArtiWorld: LLM-Driven Articulation of 3D Objects in Scenes
par: Yang, Yixuan, et autres
Publié: (2025)
par: Yang, Yixuan, et autres
Publié: (2025)
DriveEditor: A Unified 3D Information-Guided Framework for Controllable Object Editing in Driving Scenes
par: Liang, Yiyuan, et autres
Publié: (2024)
par: Liang, Yiyuan, et autres
Publié: (2024)
AerialMind: Towards Referring Multi-Object Tracking in UAV Scenarios
par: Chen, Chenglizhao, et autres
Publié: (2025)
par: Chen, Chenglizhao, et autres
Publié: (2025)
Object-Scene-Camera Decomposition and Recomposition for Data-Efficient Monocular 3D Object Detection
par: Kuang, Zhaonian, et autres
Publié: (2026)
par: Kuang, Zhaonian, et autres
Publié: (2026)
Syllables to Scenes: Literary-Guided Free-Viewpoint 3D Scene Synthesis from Japanese Haiku
par: Yu, Chunan, et autres
Publié: (2025)
par: Yu, Chunan, et autres
Publié: (2025)
Delving into Dynamic Scene Cue-Consistency for Robust 3D Multi-Object Tracking
par: Zhang, Haonan, et autres
Publié: (2025)
par: Zhang, Haonan, et autres
Publié: (2025)
FreeScene: Mixed Graph Diffusion for 3D Scene Synthesis from Free Prompts
par: Bai, Tongyuan, et autres
Publié: (2025)
par: Bai, Tongyuan, et autres
Publié: (2025)
Progressive Scaling Visual Object Tracking
par: Hong, Jack, et autres
Publié: (2025)
par: Hong, Jack, et autres
Publié: (2025)
3DSceneEditor: Controllable 3D Scene Editing with Gaussian Splatting
par: Yan, Ziyang, et autres
Publié: (2024)
par: Yan, Ziyang, et autres
Publié: (2024)
SteelDefectX: A Multi-Form Vision-Language Dataset and Benchmark for Steel Surface Defect Analysis
par: Zhao, Shuxian, et autres
Publié: (2026)
par: Zhao, Shuxian, et autres
Publié: (2026)
Scene-Conditional 3D Object Stylization and Composition
par: Zhou, Jinghao, et autres
Publié: (2023)
par: Zhou, Jinghao, et autres
Publié: (2023)
DeformGS: Scene Flow in Highly Deformable Scenes for Deformable Object Manipulation
par: Duisterhof, Bardienus P., et autres
Publié: (2023)
par: Duisterhof, Bardienus P., et autres
Publié: (2023)
DreamScene4D: Dynamic Multi-Object Scene Generation from Monocular Videos
par: Chu, Wen-Hsuan, et autres
Publié: (2024)
par: Chu, Wen-Hsuan, et autres
Publié: (2024)
D$^2$GS: Dense Depth Regularization for LiDAR-free Urban Scene Reconstruction
par: Xia, Kejing, et autres
Publié: (2025)
par: Xia, Kejing, et autres
Publié: (2025)
FreeInsert: Disentangled Text-Guided Object Insertion in 3D Gaussian Scene without Spatial Priors
par: Li, Chenxi, et autres
Publié: (2025)
par: Li, Chenxi, et autres
Publié: (2025)
MROSS: Multi-Round Region-based Optimization for Scene Sketching
par: Liang, Yiqi, et autres
Publié: (2024)
par: Liang, Yiqi, et autres
Publié: (2024)
Segment Anything Across Shots: A Method and Benchmark
par: Hu, Hengrui, et autres
Publié: (2025)
par: Hu, Hengrui, et autres
Publié: (2025)
Are Image-to-Video Models Good Zero-Shot Image Editors?
par: Zhang, Zechuan, et autres
Publié: (2025)
par: Zhang, Zechuan, et autres
Publié: (2025)
OptiPMB: Enhancing 3D Multi-Object Tracking with Optimized Poisson Multi-Bernoulli Filtering
par: Ding, Guanhua, et autres
Publié: (2025)
par: Ding, Guanhua, et autres
Publié: (2025)
Benchmarking Single-Step Inpainting Methods for Multi-Object 3D Gaussian Splatting Scenes
par: Dröge, Finn, et autres
Publié: (2026)
par: Dröge, Finn, et autres
Publié: (2026)
Who Generated This 3D Asset? Learning Source Attribution for Generative 3D Models
par: Ma, Sihan, et autres
Publié: (2026)
par: Ma, Sihan, et autres
Publié: (2026)
Towards Generalized and Training-Free Text-Guided Semantic Manipulation
par: Hong, Yu, et autres
Publié: (2025)
par: Hong, Yu, et autres
Publié: (2025)
Documents similaires
-
SceneDesigner: Controllable Multi-Object Image Generation with 9-DoF Pose Manipulation
par: Qin, Zhenyuan, et autres
Publié: (2025) -
Free-Form Motion Control: Controlling the 6D Poses of Camera and Objects in Video Generation
par: Shuai, Xincheng, et autres
Publié: (2025) -
GlyphPrinter: Region-Grouped Direct Preference Optimization for Glyph-Accurate Visual Text Rendering
par: Shuai, Xincheng, et autres
Publié: (2026) -
PSDesigner: Automated Graphic Design with a Human-Like Creative Workflow
par: Shuai, Xincheng, et autres
Publié: (2026) -
A Survey of Multimodal-Guided Image Editing with Text-to-Image Diffusion Models
par: Shuai, Xincheng, et autres
Publié: (2024)