Instructive3D: Editing Large Reconstruction Models with Text Instructions
Fuente:
arXiv
Salvato in:
| Autori principali: | Kathare, Kunal, Dhiman, Ankit, Gowda, K Vikas, Aravindan, Siddharth, Monga, Shubham, Vandrotti, Basavaraja Shanthappa, Boregowda, Lokesh R |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
UniC-Lift: Unified 3D Instance Segmentation via Contrastive Learning
di: Dhiman, Ankit, et al.
Pubblicazione: (2025)
di: Dhiman, Ankit, et al.
Pubblicazione: (2025)
ChromaDistill: Colorizing Monochrome Radiance Fields with Knowledge Distillation
di: Dhiman, Ankit, et al.
Pubblicazione: (2023)
di: Dhiman, Ankit, et al.
Pubblicazione: (2023)
Reflecting Reality: Enabling Diffusion Models to Produce Faithful Mirror Reflections
di: Dhiman, Ankit, et al.
Pubblicazione: (2024)
di: Dhiman, Ankit, et al.
Pubblicazione: (2024)
GaussianEditor: Editing 3D Gaussians Delicately with Text Instructions
di: Wang, Junjie, et al.
Pubblicazione: (2023)
di: Wang, Junjie, et al.
Pubblicazione: (2023)
PatchPoison: Poisoning Multi-View Datasets to Degrade 3D Reconstruction
di: Wadekar, Prajas, et al.
Pubblicazione: (2026)
di: Wadekar, Prajas, et al.
Pubblicazione: (2026)
Weather-Aware Object Detection Transformer for Domain Adaptation
di: Gharatappeh, Soheil, et al.
Pubblicazione: (2025)
di: Gharatappeh, Soheil, et al.
Pubblicazione: (2025)
Zero-Shot Product Attribute Labeling with Vision-Language Models: A Three-Tier Evaluation Framework
di: Shukla, Shubham, et al.
Pubblicazione: (2026)
di: Shukla, Shubham, et al.
Pubblicazione: (2026)
Limitations of NERF with pre-trained Vision Features for Few-Shot 3D Reconstruction
di: Sanjyal, Ankit
Pubblicazione: (2025)
di: Sanjyal, Ankit
Pubblicazione: (2025)
Can GPT-4o mini and Gemini 2.0 Flash Predict Fine-Grained Fashion Product Attributes? A Zero-Shot Analysis
di: Shukla, Shubham, et al.
Pubblicazione: (2025)
di: Shukla, Shubham, et al.
Pubblicazione: (2025)
MirrorVerse: Pushing Diffusion Models to Realistically Reflect the World
di: Dhiman, Ankit, et al.
Pubblicazione: (2025)
di: Dhiman, Ankit, et al.
Pubblicazione: (2025)
MOGRAS: Human Motion with Grasping in 3D Scenes
di: Bhosikar, Kunal, et al.
Pubblicazione: (2025)
di: Bhosikar, Kunal, et al.
Pubblicazione: (2025)
TPIE: Topology-Preserved Image Editing With Text Instructions
di: Jayakumar, Nivetha, et al.
Pubblicazione: (2024)
di: Jayakumar, Nivetha, et al.
Pubblicazione: (2024)
Text-to-3D Generation by 2D Editing
di: Li, Haoran, et al.
Pubblicazione: (2024)
di: Li, Haoran, et al.
Pubblicazione: (2024)
Cross-view geo-localization: a survey
di: Durgam, Abhilash, et al.
Pubblicazione: (2024)
di: Durgam, Abhilash, et al.
Pubblicazione: (2024)
Vinedresser3D: Agentic Text-guided 3D Editing
di: Chi, Yankuan, et al.
Pubblicazione: (2026)
di: Chi, Yankuan, et al.
Pubblicazione: (2026)
3D-LATTE: Latent Space 3D Editing from Textual Instructions
di: Parelli, Maria, et al.
Pubblicazione: (2025)
di: Parelli, Maria, et al.
Pubblicazione: (2025)
Watch Your Steps: Local Image and Scene Editing by Text Instructions
di: Mirzaei, Ashkan, et al.
Pubblicazione: (2023)
di: Mirzaei, Ashkan, et al.
Pubblicazione: (2023)
Global Attractor for a Reaction-Diffusion Model Arising in Biological Dynamic in 3D Soil Structure
di: Elghandouri, Mohamed, et al.
Pubblicazione: (2023)
di: Elghandouri, Mohamed, et al.
Pubblicazione: (2023)
InstructHumans: Editing Animated 3D Human Textures with Instructions
di: Zhu, Jiayin, et al.
Pubblicazione: (2024)
di: Zhu, Jiayin, et al.
Pubblicazione: (2024)
FogGuard: guarding YOLO against fog using perceptual loss
di: Gharatappeh, Soheil, et al.
Pubblicazione: (2024)
di: Gharatappeh, Soheil, et al.
Pubblicazione: (2024)
Revealing Directions for Text-guided 3D Face Editing
di: Chen, Zhuo, et al.
Pubblicazione: (2024)
di: Chen, Zhuo, et al.
Pubblicazione: (2024)
InstructUDrag: Joint Text Instructions and Object Dragging for Interactive Image Editing
di: Yu, Haoran, et al.
Pubblicazione: (2025)
di: Yu, Haoran, et al.
Pubblicazione: (2025)
CLIPDrag: Combining Text-based and Drag-based Instructions for Image Editing
di: Jiang, Ziqi, et al.
Pubblicazione: (2024)
di: Jiang, Ziqi, et al.
Pubblicazione: (2024)
Turbo-GS: Accelerating 3D Gaussian Fitting for High-Quality Radiance Fields
di: Dhiman, Ankit, et al.
Pubblicazione: (2024)
di: Dhiman, Ankit, et al.
Pubblicazione: (2024)
Feedforward 3D Editing via Text-Steerable Image-to-3D
di: Ma, Ziqi, et al.
Pubblicazione: (2025)
di: Ma, Ziqi, et al.
Pubblicazione: (2025)
RAIL: Region-Aware Instructive Learning for Semi-Supervised Tooth Segmentation in CBCT
di: Zhao, Chuyu, et al.
Pubblicazione: (2025)
di: Zhao, Chuyu, et al.
Pubblicazione: (2025)
Mr. DETR++: Instructive Multi-Route Training for Detection Transformers with Mixture-of-Experts
di: Zhang, Chang-Bin, et al.
Pubblicazione: (2024)
di: Zhang, Chang-Bin, et al.
Pubblicazione: (2024)
TIGER: Text-Instructed 3D Gaussian Retrieval and Coherent Editing
di: Xu, Teng, et al.
Pubblicazione: (2024)
di: Xu, Teng, et al.
Pubblicazione: (2024)
COSMo: CLIP Talks on Open-Set Multi-Target Domain Adaptation
di: Monga, Munish, et al.
Pubblicazione: (2024)
di: Monga, Munish, et al.
Pubblicazione: (2024)
GalaxyEdit: Large-Scale Image Editing Dataset with Enhanced Diffusion Adapter
di: Bala, Aniruddha, et al.
Pubblicazione: (2024)
di: Bala, Aniruddha, et al.
Pubblicazione: (2024)
Reg3D: Reconstructive Geometry Instruction Tuning for 3D Scene Understanding
di: Zheng, Hongpei, et al.
Pubblicazione: (2025)
di: Zheng, Hongpei, et al.
Pubblicazione: (2025)
Chat-Edit-3D: Interactive 3D Scene Editing via Text Prompts
di: Fang, Shuangkang, et al.
Pubblicazione: (2024)
di: Fang, Shuangkang, et al.
Pubblicazione: (2024)
CoCoNO: Attention Contrast-and-Complete for Initial Noise Optimization in Text-to-Image Synthesis
di: Sundaram, Aravindan, et al.
Pubblicazione: (2024)
di: Sundaram, Aravindan, et al.
Pubblicazione: (2024)
CoDA: Instructive Chain-of-Domain Adaptation with Severity-Aware Visual Prompt Tuning
di: Gong, Ziyang, et al.
Pubblicazione: (2024)
di: Gong, Ziyang, et al.
Pubblicazione: (2024)
MotionFix: Text-Driven 3D Human Motion Editing
di: Athanasiou, Nikos, et al.
Pubblicazione: (2024)
di: Athanasiou, Nikos, et al.
Pubblicazione: (2024)
Skull-to-Face: Anatomy-Guided 3D Facial Reconstruction and Editing
di: Liang, Yongqing, et al.
Pubblicazione: (2024)
di: Liang, Yongqing, et al.
Pubblicazione: (2024)
Turbo3D: Ultra-fast Text-to-3D Generation
di: Hu, Hanzhe, et al.
Pubblicazione: (2024)
di: Hu, Hanzhe, et al.
Pubblicazione: (2024)
DragScene: Interactive 3D Scene Editing with Single-view Drag Instructions
di: Gu, Chenghao, et al.
Pubblicazione: (2024)
di: Gu, Chenghao, et al.
Pubblicazione: (2024)
MaTe3D: Mask-guided Text-based 3D-aware Portrait Editing
di: Zhou, Kangneng, et al.
Pubblicazione: (2023)
di: Zhou, Kangneng, et al.
Pubblicazione: (2023)
Free-Editor: Zero-shot Text-driven 3D Scene Editing
di: Karim, Nazmul, et al.
Pubblicazione: (2023)
di: Karim, Nazmul, et al.
Pubblicazione: (2023)
Documenti analoghi
-
UniC-Lift: Unified 3D Instance Segmentation via Contrastive Learning
di: Dhiman, Ankit, et al.
Pubblicazione: (2025) -
ChromaDistill: Colorizing Monochrome Radiance Fields with Knowledge Distillation
di: Dhiman, Ankit, et al.
Pubblicazione: (2023) -
Reflecting Reality: Enabling Diffusion Models to Produce Faithful Mirror Reflections
di: Dhiman, Ankit, et al.
Pubblicazione: (2024) -
GaussianEditor: Editing 3D Gaussians Delicately with Text Instructions
di: Wang, Junjie, et al.
Pubblicazione: (2023) -
PatchPoison: Poisoning Multi-View Datasets to Degrade 3D Reconstruction
di: Wadekar, Prajas, et al.
Pubblicazione: (2026)