ConDense: Consistent 2D/3D Pre-training for Dense and Sparse Features from Multi-View Images
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Xiaoshuai, Wang, Zhicheng, Zhou, Howard, Ghosh, Soham, Gnanapragasam, Danushen, Jampani, Varun, Su, Hao, Guibas, Leonidas |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
View-Consistent Hierarchical 3D Segmentation Using Ultrametric Feature Fields
di: He, Haodi, et al.
Pubblicazione: (2024)
di: He, Haodi, et al.
Pubblicazione: (2024)
SV4D: Dynamic 3D Content Generation with Multi-Frame and Multi-View Consistency
di: Xie, Yiming, et al.
Pubblicazione: (2024)
di: Xie, Yiming, et al.
Pubblicazione: (2024)
SparseDFF: Sparse-View Feature Distillation for One-Shot Dexterous Manipulation
di: Wang, Qianxu, et al.
Pubblicazione: (2023)
di: Wang, Qianxu, et al.
Pubblicazione: (2023)
3D-Adapter: Geometry-Consistent Multi-View Diffusion for High-Quality 3D Generation
di: Chen, Hansheng, et al.
Pubblicazione: (2024)
di: Chen, Hansheng, et al.
Pubblicazione: (2024)
SV4D 2.0: Enhancing Spatio-Temporal Consistency in Multi-View Video Diffusion for High-Quality 4D Generation
di: Yao, Chun-Han, et al.
Pubblicazione: (2025)
di: Yao, Chun-Han, et al.
Pubblicazione: (2025)
Unified Dense Prediction of Video Diffusion
di: Yang, Lehan, et al.
Pubblicazione: (2025)
di: Yang, Lehan, et al.
Pubblicazione: (2025)
From Sparse to Dense: Spatio-Temporal Fusion for Multi-View 3D Human Pose Estimation with DenseWarper
di: Li, Ling, et al.
Pubblicazione: (2026)
di: Li, Ling, et al.
Pubblicazione: (2026)
Stable Part Diffusion 4D: Multi-View RGB and Kinematic Parts Video Generation
di: Zhang, Hao, et al.
Pubblicazione: (2025)
di: Zhang, Hao, et al.
Pubblicazione: (2025)
Generic 3D Diffusion Adapter Using Controlled Multi-View Editing
di: Chen, Hansheng, et al.
Pubblicazione: (2024)
di: Chen, Hansheng, et al.
Pubblicazione: (2024)
ObjFiller3D: Scaling 3D Object Inpainting to Dense Multi-View Consistency
di: Feng, Haitang, et al.
Pubblicazione: (2025)
di: Feng, Haitang, et al.
Pubblicazione: (2025)
HumANDiff: Articulated Noise Diffusion for Motion-Consistent Human Video Generation
di: Hu, Tao, et al.
Pubblicazione: (2026)
di: Hu, Tao, et al.
Pubblicazione: (2026)
Interpret and Control Dense Retrieval with Sparse Latent Features
di: Kang, Hao, et al.
Pubblicazione: (2024)
di: Kang, Hao, et al.
Pubblicazione: (2024)
DOR3D-Net: Dense Ordinal Regression Network for 3D Hand Pose Estimation
di: Mao, Yamin, et al.
Pubblicazione: (2024)
di: Mao, Yamin, et al.
Pubblicazione: (2024)
Enhancing One-shot Pruned Pre-trained Language Models through Sparse-Dense-Sparse Mechanism
di: Li, Guanchen, et al.
Pubblicazione: (2024)
di: Li, Guanchen, et al.
Pubblicazione: (2024)
Event Camera Data Dense Pre-training
di: Yang, Yan, et al.
Pubblicazione: (2023)
di: Yang, Yan, et al.
Pubblicazione: (2023)
Is Pre-training Applicable to the Decoder for Dense Prediction?
di: Ning, Chao, et al.
Pubblicazione: (2025)
di: Ning, Chao, et al.
Pubblicazione: (2025)
Probing the 3D Awareness of Visual Foundation Models
di: Banani, Mohamed El, et al.
Pubblicazione: (2024)
di: Banani, Mohamed El, et al.
Pubblicazione: (2024)
ConDL: Detector-Free Dense Image Matching
di: Kwiatkowski, Monika, et al.
Pubblicazione: (2024)
di: Kwiatkowski, Monika, et al.
Pubblicazione: (2024)
BlenderAlchemy: Editing 3D Graphics with Vision-Language Models
di: Huang, Ian, et al.
Pubblicazione: (2024)
di: Huang, Ian, et al.
Pubblicazione: (2024)
Multiview Equivariance Improves 3D Correspondence Understanding with Minimal Feature Finetuning
di: You, Yang, et al.
Pubblicazione: (2024)
di: You, Yang, et al.
Pubblicazione: (2024)
Streetscapes: Large-scale Consistent Street View Generation Using Autoregressive Video Diffusion
di: Deng, Boyang, et al.
Pubblicazione: (2024)
di: Deng, Boyang, et al.
Pubblicazione: (2024)
MVD-Fusion: Single-view 3D via Depth-consistent Multi-view Generation
di: Hu, Hanzhe, et al.
Pubblicazione: (2024)
di: Hu, Hanzhe, et al.
Pubblicazione: (2024)
Sparse2DGS: Sparse-View Surface Reconstruction using 2D Gaussian Splatting with Dense Point Cloud
di: Takama, Natsuki, et al.
Pubblicazione: (2025)
di: Takama, Natsuki, et al.
Pubblicazione: (2025)
Sparse and Dense Retrievers Learn Better Together: Joint Sparse-Dense Optimization for Text-Image Retrieval
di: Song, Jonghyun, et al.
Pubblicazione: (2025)
di: Song, Jonghyun, et al.
Pubblicazione: (2025)
The Journey Matters: Average Parameter Count over Pre-training Unifies Sparse and Dense Scaling Laws
di: Jin, Tian, et al.
Pubblicazione: (2025)
di: Jin, Tian, et al.
Pubblicazione: (2025)
T3D: Advancing 3D Medical Vision-Language Pre-training by Learning Multi-View Visual Consistency
di: Liu, Che, et al.
Pubblicazione: (2023)
di: Liu, Che, et al.
Pubblicazione: (2023)
Refining Pre-Trained Motion Models
di: Sun, Xinglong, et al.
Pubblicazione: (2024)
di: Sun, Xinglong, et al.
Pubblicazione: (2024)
PhysMem: Scaling Test-Time Memory for Embodied Physical Reasoning
di: Li, Haoyang, et al.
Pubblicazione: (2026)
di: Li, Haoyang, et al.
Pubblicazione: (2026)
Human Video Generation from a Single Image with 3D Pose and View Control
di: Wang, Tiantian, et al.
Pubblicazione: (2026)
di: Wang, Tiantian, et al.
Pubblicazione: (2026)
SF3D: Stable Fast 3D Mesh Reconstruction with UV-unwrapping and Illumination Disentanglement
di: Boss, Mark, et al.
Pubblicazione: (2024)
di: Boss, Mark, et al.
Pubblicazione: (2024)
SPAR3D: Stable Point-Aware Reconstruction of 3D Objects from Single Images
di: Huang, Zixuan, et al.
Pubblicazione: (2025)
di: Huang, Zixuan, et al.
Pubblicazione: (2025)
Zero-Shot Image Feature Consensus with Deep Functional Maps
di: Cheng, Xinle, et al.
Pubblicazione: (2024)
di: Cheng, Xinle, et al.
Pubblicazione: (2024)
Collaborative Video Diffusion: Consistent Multi-video Generation with Camera Control
di: Kuang, Zhengfei, et al.
Pubblicazione: (2024)
di: Kuang, Zhengfei, et al.
Pubblicazione: (2024)
S2D: Sparse to Dense Lifting for 3D Reconstruction with Minimal Inputs
di: Ji, Yuzhou, et al.
Pubblicazione: (2026)
di: Ji, Yuzhou, et al.
Pubblicazione: (2026)
Sparse Meets Dense: Unified Generative Recommendations with Cascaded Sparse-Dense Representations
di: Yang, Yuhao, et al.
Pubblicazione: (2025)
di: Yang, Yuhao, et al.
Pubblicazione: (2025)
GaussianLens: Localized High-Resolution Reconstruction via On-Demand Gaussian Densification
di: Weng, Yijia, et al.
Pubblicazione: (2025)
di: Weng, Yijia, et al.
Pubblicazione: (2025)
SyncNoise: Geometrically Consistent Noise Prediction for Text-based 3D Scene Editing
di: Li, Ruihuang, et al.
Pubblicazione: (2024)
di: Li, Ruihuang, et al.
Pubblicazione: (2024)
Why not Collaborative Filtering in Dual View? Bridging Sparse and Dense Models
di: Guo, Hanze, et al.
Pubblicazione: (2026)
di: Guo, Hanze, et al.
Pubblicazione: (2026)
G2D: From Global to Dense Radiography Representation Learning via Vision-Language Pre-training
di: Liu, Che, et al.
Pubblicazione: (2023)
di: Liu, Che, et al.
Pubblicazione: (2023)
From Sparse to Dense: Multi-View GRPO for Flow Models via Augmented Condition Space
di: Bu, Jiazi, et al.
Pubblicazione: (2026)
di: Bu, Jiazi, et al.
Pubblicazione: (2026)
Documenti analoghi
-
View-Consistent Hierarchical 3D Segmentation Using Ultrametric Feature Fields
di: He, Haodi, et al.
Pubblicazione: (2024) -
SV4D: Dynamic 3D Content Generation with Multi-Frame and Multi-View Consistency
di: Xie, Yiming, et al.
Pubblicazione: (2024) -
SparseDFF: Sparse-View Feature Distillation for One-Shot Dexterous Manipulation
di: Wang, Qianxu, et al.
Pubblicazione: (2023) -
3D-Adapter: Geometry-Consistent Multi-View Diffusion for High-Quality 3D Generation
di: Chen, Hansheng, et al.
Pubblicazione: (2024) -
SV4D 2.0: Enhancing Spatio-Temporal Consistency in Multi-View Video Diffusion for High-Quality 4D Generation
di: Yao, Chun-Han, et al.
Pubblicazione: (2025)