ImageNet3D: Towards General-Purpose Object-Level 3D Understanding
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ma, Wufei, Zeng, Guanning, Zhang, Guofeng, Liu, Qihao, Zhang, Letian, Kortylewski, Adam, Liu, Yaoyao, Yuille, Alan |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
PASR: Pose-Aware 3D Shape Retrieval from Occluded Single Views
par: Shi, Jiaxin, et autres
Publié: (2026)
par: Shi, Jiaxin, et autres
Publié: (2026)
DIRECT-3D: Learning Direct Text-to-3D Generation on Massive Noisy 3D Data
par: Liu, Qihao, et autres
Publié: (2024)
par: Liu, Qihao, et autres
Publié: (2024)
Generating Images with 3D Annotations Using Diffusion Models
par: Ma, Wufei, et autres
Publié: (2023)
par: Ma, Wufei, et autres
Publié: (2023)
NOVUM: Neural Object Volumes for Robust Object Classification
par: Jesslen, Artur, et autres
Publié: (2023)
par: Jesslen, Artur, et autres
Publié: (2023)
DINeMo: Learning Neural Mesh Models with no 3D Annotations
par: Guo, Weijie, et autres
Publié: (2025)
par: Guo, Weijie, et autres
Publié: (2025)
Compositional 4D Dynamic Scenes Understanding with Physics Priors for Video Question Answering
par: Wang, Xingrui, et autres
Publié: (2024)
par: Wang, Xingrui, et autres
Publié: (2024)
4D-Animal: Freely Reconstructing Animatable 3D Animals from Videos
par: Zhong, Shanshan, et autres
Publié: (2025)
par: Zhong, Shanshan, et autres
Publié: (2025)
SpatialReasoner: Towards Explicit and Generalizable 3D Spatial Reasoning
par: Ma, Wufei, et autres
Publié: (2025)
par: Ma, Wufei, et autres
Publié: (2025)
Source-Free and Image-Only Unsupervised Domain Adaptation for Category Level Object Pose Estimation
par: Kaushik, Prakhar, et autres
Publié: (2024)
par: Kaushik, Prakhar, et autres
Publié: (2024)
TriDiff-4D: Fast 4D Generation through Diffusion-based Triplane Re-posing
par: Sheung, Eddie Pokming, et autres
Publié: (2025)
par: Sheung, Eddie Pokming, et autres
Publié: (2025)
Prompt-Based Exemplar Super-Compression and Regeneration for Class-Incremental Learning
par: Duan, Ruxiao, et autres
Publié: (2023)
par: Duan, Ruxiao, et autres
Publié: (2023)
Animal3D: A Comprehensive Dataset of 3D Animal Pose and Shape
par: Xu, Jiacong, et autres
Publié: (2023)
par: Xu, Jiacong, et autres
Publié: (2023)
Generative Adversarial Reasoner: Enhancing LLM Reasoning with Adversarial Reinforcement Learning
par: Liu, Qihao, et autres
Publié: (2025)
par: Liu, Qihao, et autres
Publié: (2025)
3DSRBench: A Comprehensive 3D Spatial Reasoning Benchmark
par: Ma, Wufei, et autres
Publié: (2024)
par: Ma, Wufei, et autres
Publié: (2024)
A Bayesian Approach to OOD Robustness in Image Classification
par: Kaushik, Prakhar, et autres
Publié: (2024)
par: Kaushik, Prakhar, et autres
Publié: (2024)
Learning a Category-level Object Pose Estimator without Pose Annotations
par: Tian, Fengrui, et autres
Publié: (2024)
par: Tian, Fengrui, et autres
Publié: (2024)
G3DR: Generative 3D Reconstruction in ImageNet
par: Reddy, Pradyumna, et autres
Publié: (2024)
par: Reddy, Pradyumna, et autres
Publié: (2024)
Rethinking Video-Text Understanding: Retrieval from Counterfactually Augmented Data
par: Ma, Wufei, et autres
Publié: (2024)
par: Ma, Wufei, et autres
Publié: (2024)
Category-Level 3D Correspondence in Camera Space via Morphable Object Priors
par: Sommer, Leonhard, et autres
Publié: (2026)
par: Sommer, Leonhard, et autres
Publié: (2026)
Unsupervised Learning of Category-Level 3D Pose from Object-Centric Videos
par: Sommer, Leonhard, et autres
Publié: (2024)
par: Sommer, Leonhard, et autres
Publié: (2024)
ImageNet-D: Benchmarking Neural Network Robustness on Diffusion Synthetic Object
par: Zhang, Chenshuang, et autres
Publié: (2024)
par: Zhang, Chenshuang, et autres
Publié: (2024)
SpatialLLM: A Compound 3D-Informed Design towards Spatially-Intelligent Large Multimodal Models
par: Ma, Wufei, et autres
Publié: (2025)
par: Ma, Wufei, et autres
Publié: (2025)
ReVision: Refining Video Diffusion with Explicit 3D Motion Modeling
par: Liu, Qihao, et autres
Publié: (2025)
par: Liu, Qihao, et autres
Publié: (2025)
Beyond ImageNet: Understanding Cross-Dataset Robustness of Lightweight Vision Models
par: Zhang, Weidong, et autres
Publié: (2025)
par: Zhang, Weidong, et autres
Publié: (2025)
Common3D: Self-Supervised Learning of 3D Morphable Models for Common Objects in Neural Feature Space
par: Sommer, Leonhard, et autres
Publié: (2025)
par: Sommer, Leonhard, et autres
Publié: (2025)
Geometry aware 3D generation from in-the-wild images in ImageNet
par: Shen, Qijia, et autres
Publié: (2024)
par: Shen, Qijia, et autres
Publié: (2024)
Spatial457: A Diagnostic Benchmark for 6D Spatial Reasoning of Large Multimodal Models
par: Wang, Xingrui, et autres
Publié: (2025)
par: Wang, Xingrui, et autres
Publié: (2025)
F3D-Gaus: Feed-forward 3D-aware Generation on ImageNet with Cycle-Aggregative Gaussian Splatting
par: Wang, Yuxin, et autres
Publié: (2025)
par: Wang, Yuxin, et autres
Publié: (2025)
Every9D-21M: Large-Scale Real-World 9D Canonicalization of Everyday Objects
par: Sommer, Leonhard, et autres
Publié: (2026)
par: Sommer, Leonhard, et autres
Publié: (2026)
Interpretable 3D Neural Object Volumes for Robust Conceptual Reasoning
par: Pham, Nhi, et autres
Publié: (2025)
par: Pham, Nhi, et autres
Publié: (2025)
iNeMo: Incremental Neural Mesh Models for Robust Class-Incremental Learning
par: Fischer, Tom, et autres
Publié: (2024)
par: Fischer, Tom, et autres
Publié: (2024)
VoGE: A Differentiable Volume Renderer using Gaussian Ellipsoids for Analysis-by-Synthesis
par: Wang, Angtian, et autres
Publié: (2022)
par: Wang, Angtian, et autres
Publié: (2022)
Toward Errorless Training ImageNet-1k
par: Deng, Bo, et autres
Publié: (2025)
par: Deng, Bo, et autres
Publié: (2025)
HECTOR: Hybrid Editable Compositional Object References for Video Generation
par: Zhang, Guofeng, et autres
Publié: (2026)
par: Zhang, Guofeng, et autres
Publié: (2026)
Speedrunning ImageNet Diffusion
par: Bhanded, Swayam
Publié: (2025)
par: Bhanded, Swayam
Publié: (2025)
Geometry Matters: 3D Foundation Priors for Learning Semantic Correspondence
par: Jesslen, Artur, et autres
Publié: (2026)
par: Jesslen, Artur, et autres
Publié: (2026)
How Well Do Supervised 3D Models Transfer to Medical Imaging Tasks?
par: Li, Wenxuan, et autres
Publié: (2025)
par: Li, Wenxuan, et autres
Publié: (2025)
Accessing Vision Foundation Models via ImageNet-1K
par: Zhang, Yitian, et autres
Publié: (2024)
par: Zhang, Yitian, et autres
Publié: (2024)
Can Biases in ImageNet Models Explain Generalization?
par: Gavrikov, Paul, et autres
Publié: (2024)
par: Gavrikov, Paul, et autres
Publié: (2024)
Can These Views Be One Scene? Evaluating Multiview 3D Consistency when 3D Foundation Models Hallucinate
par: Paul, Soumava, et autres
Publié: (2026)
par: Paul, Soumava, et autres
Publié: (2026)
Documents similaires
-
PASR: Pose-Aware 3D Shape Retrieval from Occluded Single Views
par: Shi, Jiaxin, et autres
Publié: (2026) -
DIRECT-3D: Learning Direct Text-to-3D Generation on Massive Noisy 3D Data
par: Liu, Qihao, et autres
Publié: (2024) -
Generating Images with 3D Annotations Using Diffusion Models
par: Ma, Wufei, et autres
Publié: (2023) -
NOVUM: Neural Object Volumes for Robust Object Classification
par: Jesslen, Artur, et autres
Publié: (2023) -
DINeMo: Learning Neural Mesh Models with no 3D Annotations
par: Guo, Weijie, et autres
Publié: (2025)