DreamPartGen: Semantically Grounded Part-Level 3D Generation via Collaborative Latent Denoising
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Yu, Tianjiao, Li, Xinzhuo, Wahed, Muntasir, Xiong, Jerry, Shen, Yifan, Shen, Ying, Lourentzou, Ismini |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Part$^{2}$GS: Part-aware Modeling of Articulated Objects using 3D Gaussian Splatting
par: Yu, Tianjiao, et autres
Publié: (2025)
par: Yu, Tianjiao, et autres
Publié: (2025)
CALICO: Part-Focused Semantic Co-Segmentation with Large Vision-Language Models
par: Nguyen, Kiet A., et autres
Publié: (2024)
par: Nguyen, Kiet A., et autres
Publié: (2024)
Phantom: Physics-Infused Video Generation via Joint Modeling of Visual and Latent Physical Dynamics
par: Shen, Ying, et autres
Publié: (2026)
par: Shen, Ying, et autres
Publié: (2026)
CoRe3D: Collaborative Reasoning as a Foundation for 3D Intelligence
par: Yu, Tianjiao, et autres
Publié: (2025)
par: Yu, Tianjiao, et autres
Publié: (2025)
Counterfactual Segmentation Reasoning: Diagnosing and Mitigating Pixel-Grounding Hallucination
par: Li, Xinzhuo, et autres
Publié: (2025)
par: Li, Xinzhuo, et autres
Publié: (2025)
Tiny but Trusted: Efficient Vision-Language Reasoning for Time-Series Anomaly Detection
par: Zhou, Xiaona, et autres
Publié: (2026)
par: Zhou, Xiaona, et autres
Publié: (2026)
PRIMA: Multi-Image Vision-Language Models for Reasoning Segmentation
par: Wahed, Muntasir, et autres
Publié: (2024)
par: Wahed, Muntasir, et autres
Publié: (2024)
Uncertainty in Action: Confidence Elicitation in Embodied Agents
par: Yu, Tianjiao, et autres
Publié: (2025)
par: Yu, Tianjiao, et autres
Publié: (2025)
MOCHA: Are Code Language Models Robust Against Multi-Turn Malicious Coding Prompts?
par: Wahed, Muntasir, et autres
Publié: (2025)
par: Wahed, Muntasir, et autres
Publié: (2025)
ELBA: Learning by Asking for Embodied Visual Navigation and Task Completion
par: Shen, Ying, et autres
Publié: (2023)
par: Shen, Ying, et autres
Publié: (2023)
Commonsense for Zero-Shot Natural Language Video Localization
par: Holla, Meghana, et autres
Publié: (2023)
par: Holla, Meghana, et autres
Publié: (2023)
EgoForge: Goal-Directed Egocentric World Simulator
par: Shen, Yifan, et autres
Publié: (2026)
par: Shen, Yifan, et autres
Publié: (2026)
RewardFlow: Generate Images by Optimizing What You Reward
par: Susladkar, Onkar, et autres
Publié: (2026)
par: Susladkar, Onkar, et autres
Publié: (2026)
3D-VCD: Hallucination Mitigation in 3D-LLM Embodied Agents through Visual Contrastive Decoding
par: Ogunleye, Makanjuola, et autres
Publié: (2026)
par: Ogunleye, Makanjuola, et autres
Publié: (2026)
PurpCode: Reasoning for Safer Code Generation
par: Liu, Jiawei, et autres
Publié: (2025)
par: Liu, Jiawei, et autres
Publié: (2025)
RAVEL: Rare Concept Generation and Editing via Graph-driven Relational Guidance
par: Venkatesh, Kavana, et autres
Publié: (2024)
par: Venkatesh, Kavana, et autres
Publié: (2024)
mTSBench: Benchmarking Multivariate Time Series Anomaly Detection and Model Selection at Scale
par: Zhou, Xiaona, et autres
Publié: (2025)
par: Zhou, Xiaona, et autres
Publié: (2025)
PALM: Progress-Aware Policy Learning via Affordance Reasoning for Long-Horizon Robotic Manipulation
par: Liu, Yuanzhe, et autres
Publié: (2026)
par: Liu, Yuanzhe, et autres
Publié: (2026)
Evaluating Cognitive Age Alignment in Interactive AI Agents
par: Shen, Yifan, et autres
Publié: (2026)
par: Shen, Yifan, et autres
Publié: (2026)
Hierarchical Dataset Selection for High-Quality Data Sharing
par: Zhou, Xiaona, et autres
Publié: (2025)
par: Zhou, Xiaona, et autres
Publié: (2025)
FAIR: Facilitating Artificial Intelligence Resilience in Manufacturing Industrial Internet
par: Zeng, Yingyan, et autres
Publié: (2025)
par: Zeng, Yingyan, et autres
Publié: (2025)
UniPart: Part-Level 3D Generation with Unified 3D Geom-Seg Latents
par: He, Xufan, et autres
Publié: (2025)
par: He, Xufan, et autres
Publié: (2025)
AutoPartGen: Autogressive 3D Part Generation and Discovery
par: Chen, Minghao, et autres
Publié: (2025)
par: Chen, Minghao, et autres
Publié: (2025)
Toward Cognitive Supersensing in Multimodal Large Language Model
par: Li, Boyi, et autres
Publié: (2026)
par: Li, Boyi, et autres
Publié: (2026)
Weakly-Supervised Affordance Grounding Guided by Part-Level Semantic Priors
par: Xu, Peiran, et autres
Publié: (2025)
par: Xu, Peiran, et autres
Publié: (2025)
SALAD: Part-Level Latent Diffusion for 3D Shape Generation and Manipulation
par: Koo, Juil, et autres
Publié: (2023)
par: Koo, Juil, et autres
Publié: (2023)
MMPlanner: Zero-Shot Multimodal Procedural Planning with Chain-of-Thought Object State Reasoning
par: Tabassum, Afrina, et autres
Publié: (2025)
par: Tabassum, Afrina, et autres
Publié: (2025)
uaMix-MAE: Efficient Tuning of Pretrained Audio Transformers with Unsupervised Audio Mixtures
par: Tabassum, Afrina, et autres
Publié: (2024)
par: Tabassum, Afrina, et autres
Publié: (2024)
OmniPart: Part-Aware 3D Generation with Semantic Decoupling and Structural Cohesion
par: Yang, Yunhan, et autres
Publié: (2025)
par: Yang, Yunhan, et autres
Publié: (2025)
Fine-Grained Preference Optimization Improves Spatial Reasoning in VLMs
par: Shen, Yifan, et autres
Publié: (2025)
par: Shen, Yifan, et autres
Publié: (2025)
LaTtE-Flow: Layerwise Timestep-Expert Flow-based Transformer
par: Shen, Ying, et autres
Publié: (2025)
par: Shen, Ying, et autres
Publié: (2025)
AnchoredDream: Zero-Shot 360° Indoor Scene Generation from a Single View via Geometric Grounding
par: Yao, Runmao, et autres
Publié: (2026)
par: Yao, Runmao, et autres
Publié: (2026)
PartGen: Part-level 3D Generation and Reconstruction with Multi-View Diffusion Models
par: Chen, Minghao, et autres
Publié: (2024)
par: Chen, Minghao, et autres
Publié: (2024)
SeaLion: Semantic Part-Aware Latent Point Diffusion Models for 3D Generation
par: Zhu, Dekai, et autres
Publié: (2025)
par: Zhu, Dekai, et autres
Publié: (2025)
SUM Parts: Benchmarking Part-Level Semantic Segmentation of Urban Meshes
par: Gao, Weixiao, et autres
Publié: (2025)
par: Gao, Weixiao, et autres
Publié: (2025)
ArtGen: Conditional Generative Modeling of Articulated Objects in Arbitrary Part-Level States
par: Wang, Haowen, et autres
Publié: (2025)
par: Wang, Haowen, et autres
Publié: (2025)
PartRAG: Retrieval-Augmented Part-Level 3D Generation and Editing
par: Li, Peize, et autres
Publié: (2026)
par: Li, Peize, et autres
Publié: (2026)
SegviGen: Repurposing 3D Generative Model for Part Segmentation
par: Li, Lin, et autres
Publié: (2026)
par: Li, Lin, et autres
Publié: (2026)
Parts-Mamba: Augmenting Joint Context with Part-Level Scanning for Occluded Human Skeleton
par: Shen, Tianyi, et autres
Publié: (2025)
par: Shen, Tianyi, et autres
Publié: (2025)
PhysChoreo: Physics-Controllable Video Generation with Part-Aware Semantic Grounding
par: Zhang, Haoze, et autres
Publié: (2025)
par: Zhang, Haoze, et autres
Publié: (2025)
Documents similaires
-
Part$^{2}$GS: Part-aware Modeling of Articulated Objects using 3D Gaussian Splatting
par: Yu, Tianjiao, et autres
Publié: (2025) -
CALICO: Part-Focused Semantic Co-Segmentation with Large Vision-Language Models
par: Nguyen, Kiet A., et autres
Publié: (2024) -
Phantom: Physics-Infused Video Generation via Joint Modeling of Visual and Latent Physical Dynamics
par: Shen, Ying, et autres
Publié: (2026) -
CoRe3D: Collaborative Reasoning as a Foundation for 3D Intelligence
par: Yu, Tianjiao, et autres
Publié: (2025) -
Counterfactual Segmentation Reasoning: Diagnosing and Mitigating Pixel-Grounding Hallucination
par: Li, Xinzhuo, et autres
Publié: (2025)