Diffusion-Driven Self-Supervised Learning for Shape Reconstruction and Pose Estimation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Sun, Jingtao, Wang, Yaonan, Feng, Mingtao, Ding, Chao, Shou, Mike Zheng, Mian, Ajmal Saeed |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Learning Coherent Matrixized Representation in Latent Space for Volumetric 4D Generation
par: Yang, Qitong, et autres
Publié: (2024)
par: Yang, Qitong, et autres
Publié: (2024)
3D Object Detection from Point Cloud via Voting Step Diffusion
par: Hou, Haoran, et autres
Publié: (2024)
par: Hou, Haoran, et autres
Publié: (2024)
Referring Human Pose and Mask Estimation in the Wild
par: Miao, Bo, et autres
Publié: (2024)
par: Miao, Bo, et autres
Publié: (2024)
External Knowledge Enhanced 3D Scene Generation from Sketch
par: Wu, Zijie, et autres
Publié: (2024)
par: Wu, Zijie, et autres
Publié: (2024)
PointDiffuse: A Dual-Conditional Diffusion Model for Enhanced Point Cloud Semantic Segmentation
par: He, Yong, et autres
Publié: (2025)
par: He, Yong, et autres
Publié: (2025)
DiffCom: Decoupled Sparse Priors Guided Diffusion Compression for Point Clouds
par: Zhang, Xiaoge, et autres
Publié: (2024)
par: Zhang, Xiaoge, et autres
Publié: (2024)
Towards Real-World Aerial Vision Guidance with Categorical 6D Pose Tracker
par: Sun, Jingtao, et autres
Publié: (2024)
par: Sun, Jingtao, et autres
Publié: (2024)
Simultaneous Multiple Object Detection and Pose Estimation using 3D Model Infusion with Monocular Vision
par: Li, Congliang, et autres
Publié: (2022)
par: Li, Congliang, et autres
Publié: (2022)
Occlusion-Aware 3D Hand-Object Pose Estimation with Masked AutoEncoders
par: Yang, Hui, et autres
Publié: (2025)
par: Yang, Hui, et autres
Publié: (2025)
MonoDiff9D: Monocular Category-Level 9D Object Pose Estimation via Diffusion Model
par: Liu, Jian, et autres
Publié: (2025)
par: Liu, Jian, et autres
Publié: (2025)
FLaTEC: Frequency-Disentangled Latent Triplanes for Efficient Compression of LiDAR Point Clouds
par: Zhang, Xiaoge, et autres
Publié: (2025)
par: Zhang, Xiaoge, et autres
Publié: (2025)
Multiview Point Cloud Registration Based on Minimum Potential Energy for Free-Form Blade Measurement
par: Wu, Zijie, et autres
Publié: (2025)
par: Wu, Zijie, et autres
Publié: (2025)
Deep Learning-Based Object Pose Estimation: A Comprehensive Survey
par: Liu, Jian, et autres
Publié: (2024)
par: Liu, Jian, et autres
Publié: (2024)
UniRL: Self-Improving Unified Multimodal Models via Supervised and Reinforcement Learning
par: Mao, Weijia, et autres
Publié: (2025)
par: Mao, Weijia, et autres
Publié: (2025)
GenHOI: Generalized Hand-Object Pose Estimation with Occlusion Awareness
par: Yang, Hui, et autres
Publié: (2026)
par: Yang, Hui, et autres
Publié: (2026)
Class-Partitioned VQ-VAE and Latent Flow Matching for Point Cloud Scene Generation
par: Edirimuni, Dasith de Silva, et autres
Publié: (2026)
par: Edirimuni, Dasith de Silva, et autres
Publié: (2026)
Scalable Unseen Objects 6-DoF Absolute Pose Estimation with Robotic Integration
par: Liu, Jian, et autres
Publié: (2025)
par: Liu, Jian, et autres
Publié: (2025)
Diff9D: Diffusion-Based Domain-Generalized Category-Level 9-DoF Object Pose Estimation
par: Liu, Jian, et autres
Publié: (2025)
par: Liu, Jian, et autres
Publié: (2025)
Diffusion Masked Pretraining for Dynamic Point Cloud
par: Zhang, Zhuoyue, et autres
Publié: (2026)
par: Zhang, Zhuoyue, et autres
Publié: (2026)
VISTA: Triplet-Supervised Video Style Transfer with Diffusion Transformers
par: Song, Yiren, et autres
Publié: (2026)
par: Song, Yiren, et autres
Publié: (2026)
Auto-Regressive Diffusion for Generating 3D Human-Object Interactions
par: Geng, Zichen, et autres
Publié: (2025)
par: Geng, Zichen, et autres
Publié: (2025)
TPDiff: Temporal Pyramid Video Diffusion Model
par: Ran, Lingmin, et autres
Publié: (2025)
par: Ran, Lingmin, et autres
Publié: (2025)
D-AR: Diffusion via Autoregressive Models
par: Gao, Ziteng, et autres
Publié: (2025)
par: Gao, Ziteng, et autres
Publié: (2025)
Mantis: Mamba-native Tuning is Efficient for 3D Point Cloud Foundation Models
par: Guo, Zihao, et autres
Publié: (2026)
par: Guo, Zihao, et autres
Publié: (2026)
Skip Mamba Diffusion for Monocular 3D Semantic Scene Completion
par: Liang, Li, et autres
Publié: (2025)
par: Liang, Li, et autres
Publié: (2025)
Deep Learning Based 3D Segmentation: A Survey
par: He, Yong, et autres
Publié: (2021)
par: He, Yong, et autres
Publié: (2021)
Soft Masked Transformer for Point Cloud Processing with Skip Attention-Based Upsampling
par: He, Yong, et autres
Publié: (2024)
par: He, Yong, et autres
Publié: (2024)
Deeper Diffusion Models Amplify Bias
par: Hakemi, Shahin, et autres
Publié: (2025)
par: Hakemi, Shahin, et autres
Publié: (2025)
Faithful Extreme Image Rescaling with Learnable Reversible Transformation and Semantic Priors
par: Wei, Hao, et autres
Publié: (2026)
par: Wei, Hao, et autres
Publié: (2026)
Exploiting Semantic and Pixel Representations for Ultra-Low Bitrate Image Compression
par: Wei, Hao, et autres
Publié: (2026)
par: Wei, Hao, et autres
Publié: (2026)
RI-Mamba: Rotation-Invariant Mamba for Robust Text-to-Shape Retrieval
par: Nguyen, Khanh, et autres
Publié: (2026)
par: Nguyen, Khanh, et autres
Publié: (2026)
SkelFormer: Markerless 3D Pose and Shape Estimation using Skeletal Transformers
par: Davoodnia, Vandad, et autres
Publié: (2024)
par: Davoodnia, Vandad, et autres
Publié: (2024)
D3Seg: Dependency-Aware Diffusion for Brain Tumor Segmentation with Missing Modalities
par: Ali, Danish, et autres
Publié: (2026)
par: Ali, Danish, et autres
Publié: (2026)
Enhancing Physical Plausibility in Video Generation by Reasoning the Implausibility
par: Hao, Yutong, et autres
Publié: (2025)
par: Hao, Yutong, et autres
Publié: (2025)
DiffSim: Taming Diffusion Models for Evaluating Visual Similarity
par: Song, Yiren, et autres
Publié: (2024)
par: Song, Yiren, et autres
Publié: (2024)
Controlled Data Rebalancing in Multi-Task Learning for Real-World Image Super-Resolution
par: Lin, Shuchen, et autres
Publié: (2025)
par: Lin, Shuchen, et autres
Publié: (2025)
Navigating Large-Pose Challenge for High-Fidelity Face Reenactment with Video Diffusion Model
par: Guo, Mingtao, et autres
Publié: (2025)
par: Guo, Mingtao, et autres
Publié: (2025)
Edit2Perceive: Image Editing Diffusion Models Are Strong Dense Perceivers
par: Shi, Yiqing, et autres
Publié: (2025)
par: Shi, Yiqing, et autres
Publié: (2025)
MakeAnything: Harnessing Diffusion Transformers for Multi-Domain Procedural Sequence Generation
par: Song, Yiren, et autres
Publié: (2025)
par: Song, Yiren, et autres
Publié: (2025)
LayerTracer: Cognitive-Aligned Layered SVG Synthesis via Diffusion Transformer
par: Song, Yiren, et autres
Publié: (2025)
par: Song, Yiren, et autres
Publié: (2025)
Documents similaires
-
Learning Coherent Matrixized Representation in Latent Space for Volumetric 4D Generation
par: Yang, Qitong, et autres
Publié: (2024) -
3D Object Detection from Point Cloud via Voting Step Diffusion
par: Hou, Haoran, et autres
Publié: (2024) -
Referring Human Pose and Mask Estimation in the Wild
par: Miao, Bo, et autres
Publié: (2024) -
External Knowledge Enhanced 3D Scene Generation from Sketch
par: Wu, Zijie, et autres
Publié: (2024) -
PointDiffuse: A Dual-Conditional Diffusion Model for Enhanced Point Cloud Semantic Segmentation
par: He, Yong, et autres
Publié: (2025)