Cue3D: Quantifying the Role of Image Cues in Single-Image 3D Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Xiang, Wang, Zirui, Huang, Zixuan, Rehg, James M. |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Symmetry Strikes Back: From Single-Image Symmetry Detection to 3D Generation
par: Li, Xiang, et autres
Publié: (2024)
par: Li, Xiang, et autres
Publié: (2024)
Vinedresser3D: Agentic Text-guided 3D Editing
par: Chi, Yankuan, et autres
Publié: (2026)
par: Chi, Yankuan, et autres
Publié: (2026)
SPAR3D: Stable Point-Aware Reconstruction of 3D Objects from Single Images
par: Huang, Zixuan, et autres
Publié: (2025)
par: Huang, Zixuan, et autres
Publié: (2025)
MESC-3D:Mining Effective Semantic Cues for 3D Reconstruction from a Single Image
par: Li, Shaoming, et autres
Publié: (2025)
par: Li, Shaoming, et autres
Publié: (2025)
How Much 3D Do Video Foundation Models Encode?
par: Huang, Zixuan, et autres
Publié: (2025)
par: Huang, Zixuan, et autres
Publié: (2025)
When Eyes Betray AI: Social Gaze Consistency as a Semantic Cue for AI-Generated Image Detection
par: Kim, Jihyeon, et autres
Publié: (2026)
par: Kim, Jihyeon, et autres
Publié: (2026)
Syn3DTxt: Embedding 3D Cues for Scene Text Generation
par: Hsiung, Li-Syun, et autres
Publié: (2025)
par: Hsiung, Li-Syun, et autres
Publié: (2025)
DreamDance: Animating Human Images by Enriching 3D Geometry Cues from 2D Poses
par: Pang, Yatian, et autres
Publié: (2024)
par: Pang, Yatian, et autres
Publié: (2024)
Aggregating Diverse Cue Experts for AI-Generated Image Detection
par: Tan, Lei, et autres
Publié: (2026)
par: Tan, Lei, et autres
Publié: (2026)
Mono3R: Exploiting Monocular Cues for Geometric 3D Reconstruction
par: Li, Wenyu, et autres
Publié: (2025)
par: Li, Wenyu, et autres
Publié: (2025)
JM3D & JM3D-LLM: Elevating 3D Understanding with Joint Multi-modal Cues
par: Ji, Jiayi, et autres
Publié: (2023)
par: Ji, Jiayi, et autres
Publié: (2023)
Three Forensic Cues for JPEG AI Images
par: Bergmann, Sandra, et autres
Publié: (2025)
par: Bergmann, Sandra, et autres
Publié: (2025)
MonoPlane: Exploiting Monocular Geometric Cues for Generalizable 3D Plane Reconstruction
par: Zhao, Wang, et autres
Publié: (2024)
par: Zhao, Wang, et autres
Publié: (2024)
Delving into Dynamic Scene Cue-Consistency for Robust 3D Multi-Object Tracking
par: Zhang, Haonan, et autres
Publié: (2025)
par: Zhang, Haonan, et autres
Publié: (2025)
GaussianRoom: Improving 3D Gaussian Splatting with SDF Guidance and Monocular Cues for Indoor Scene Reconstruction
par: Xiang, Haodong, et autres
Publié: (2024)
par: Xiang, Haodong, et autres
Publié: (2024)
DGC-GNN: Leveraging Geometry and Color Cues for Visual Descriptor-Free 2D-3D Matching
par: Wang, Shuzhe, et autres
Publié: (2023)
par: Wang, Shuzhe, et autres
Publié: (2023)
UPose3D: Uncertainty-Aware 3D Human Pose Estimation with Cross-View and Temporal Cues
par: Davoodnia, Vandad, et autres
Publié: (2024)
par: Davoodnia, Vandad, et autres
Publié: (2024)
FUSE: Unifying Spectral and Semantic Cues for Robust AI-Generated Image Detection
par: Hossain, Md. Zahid, et autres
Publié: (2025)
par: Hossain, Md. Zahid, et autres
Publié: (2025)
Beyond First Impressions: Integrating Joint Multi-modal Cues for Comprehensive 3D Representation
par: Wang, Haowei, et autres
Publié: (2023)
par: Wang, Haowei, et autres
Publié: (2023)
Enhancing Vision-Language Tracking by Effectively Converting Textual Cues into Visual Cues
par: Feng, X., et autres
Publié: (2024)
par: Feng, X., et autres
Publié: (2024)
MOSE: Boosting Vision-based Roadside 3D Object Detection with Scene Cues
par: Chen, Xiahan, et autres
Publié: (2024)
par: Chen, Xiahan, et autres
Publié: (2024)
AGG: Amortized Generative 3D Gaussians for Single Image to 3D
par: Xu, Dejia, et autres
Publié: (2024)
par: Xu, Dejia, et autres
Publié: (2024)
3x2: 3D Object Part Segmentation by 2D Semantic Correspondences
par: Thai, Anh, et autres
Publié: (2024)
par: Thai, Anh, et autres
Publié: (2024)
Zooming from Context to Cue: Hierarchical Preference Optimization for Multi-Image MLLMs
par: Li, Xudong, et autres
Publié: (2025)
par: Li, Xudong, et autres
Publié: (2025)
2L3: Lifting Imperfect Generated 2D Images into Accurate 3D
par: Chen, Yizheng, et autres
Publié: (2024)
par: Chen, Yizheng, et autres
Publié: (2024)
DiffEye: Diffusion-Based Continuous Eye-Tracking Data Generation Conditioned on Natural Images
par: Kara, Ozgur, et autres
Publié: (2025)
par: Kara, Ozgur, et autres
Publié: (2025)
Learning Temporal Cues by Predicting Objects Move for Multi-camera 3D Object Detection
par: Moon, Seokha, et autres
Publié: (2024)
par: Moon, Seokha, et autres
Publié: (2024)
NeRF-Det++: Incorporating Semantic Cues and Perspective-aware Depth Supervision for Indoor Multi-View 3D Detection
par: Huang, Chenxi, et autres
Publié: (2024)
par: Huang, Chenxi, et autres
Publié: (2024)
MagicQuillV2: Precise and Interactive Image Editing with Layered Visual Cues
par: Liu, Zichen, et autres
Publié: (2025)
par: Liu, Zichen, et autres
Publié: (2025)
TripoSR: Fast 3D Object Reconstruction from a Single Image
par: Tochilkin, Dmitry, et autres
Publié: (2024)
par: Tochilkin, Dmitry, et autres
Publié: (2024)
PatchCue: Enhancing Vision-Language Model Reasoning with Patch-Based Visual Cues
par: Qi, Yukun, et autres
Publié: (2026)
par: Qi, Yukun, et autres
Publié: (2026)
Cues3D: Unleashing the Power of Sole NeRF for Consistent and Unique Instances in Open-Vocabulary 3D Panoptic Segmentation
par: Xue, Feng, et autres
Publié: (2025)
par: Xue, Feng, et autres
Publié: (2025)
Deep Polarization Cues for Single-shot Shape and Subsurface Scattering Estimation
par: Li, Chenhao, et autres
Publié: (2024)
par: Li, Chenhao, et autres
Publié: (2024)
Immune2V: Image Immunization Against Dual-Stream Image-to-Video Generation
par: Long, Zeqian, et autres
Publié: (2026)
par: Long, Zeqian, et autres
Publié: (2026)
FlexiDreamer: Single Image-to-3D Generation with FlexiCubes
par: Zhao, Ruowen, et autres
Publié: (2024)
par: Zhao, Ruowen, et autres
Publié: (2024)
NeRF-based Visualization of 3D Cues Supporting Data-Driven Spacecraft Pose Estimation
par: Legrand, Antoine, et autres
Publié: (2025)
par: Legrand, Antoine, et autres
Publié: (2025)
Shape Bias and Robustness Evaluation via Cue Decomposition for Image Classification and Segmentation
par: Heinert, Edgar, et autres
Publié: (2025)
par: Heinert, Edgar, et autres
Publié: (2025)
Tempo as the Stable Cue: Hierarchical Mixture of Tempo and Beat Experts for Music to 3D Dance Generation
par: Lyu, Guangtao, et autres
Publié: (2025)
par: Lyu, Guangtao, et autres
Publié: (2025)
RaGS: Unleashing 3D Gaussian Splatting from 4D Radar and Monocular Cues for 3D Object Detection
par: Bai, Xiaokai, et autres
Publié: (2025)
par: Bai, Xiaokai, et autres
Publié: (2025)
Single Image, Any Face: Generalisable 3D Face Generation
par: Wang, Wenqing, et autres
Publié: (2024)
par: Wang, Wenqing, et autres
Publié: (2024)
Documents similaires
-
Symmetry Strikes Back: From Single-Image Symmetry Detection to 3D Generation
par: Li, Xiang, et autres
Publié: (2024) -
Vinedresser3D: Agentic Text-guided 3D Editing
par: Chi, Yankuan, et autres
Publié: (2026) -
SPAR3D: Stable Point-Aware Reconstruction of 3D Objects from Single Images
par: Huang, Zixuan, et autres
Publié: (2025) -
MESC-3D:Mining Effective Semantic Cues for 3D Reconstruction from a Single Image
par: Li, Shaoming, et autres
Publié: (2025) -
How Much 3D Do Video Foundation Models Encode?
par: Huang, Zixuan, et autres
Publié: (2025)