DeCoTR: Enhancing Depth Completion with 2D and 3D Attentions
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Shi, Yunxiao, Singh, Manish Kumar, Cai, Hong, Porikli, Fatih |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
H3O: Hyper-Efficient 3D Occupancy Prediction with Heterogeneous Supervision
par: Shi, Yunxiao, et autres
Publié: (2025)
par: Shi, Yunxiao, et autres
Publié: (2025)
MAMo: Leveraging Memory and Attention for Monocular Video Depth Estimation
par: Yasarla, Rajeev, et autres
Publié: (2023)
par: Yasarla, Rajeev, et autres
Publié: (2023)
FutureDepth: Learning to Predict the Future Improves Video Depth Estimation
par: Yasarla, Rajeev, et autres
Publié: (2024)
par: Yasarla, Rajeev, et autres
Publié: (2024)
ToSA: Token Selective Attention for Efficient Vision Transformers
par: Singh, Manish Kumar, et autres
Publié: (2024)
par: Singh, Manish Kumar, et autres
Publié: (2024)
BePo: Dual Representation for 3D Occupancy Prediction
par: Shi, Yunxiao, et autres
Publié: (2025)
par: Shi, Yunxiao, et autres
Publié: (2025)
PADRe: A Unifying Polynomial Attention Drop-in Replacement for Efficient Vision Transformer
par: Letourneau, Pierre-David, et autres
Publié: (2024)
par: Letourneau, Pierre-David, et autres
Publié: (2024)
DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos
par: Yasarla, Rajeev, et autres
Publié: (2025)
par: Yasarla, Rajeev, et autres
Publié: (2025)
Improving Optical Flow and Stereo Depth Estimation by Leveraging Uncertainty-Based Learning Difficulties
par: Jeong, Jisoo, et autres
Publié: (2025)
par: Jeong, Jisoo, et autres
Publié: (2025)
Neural Mesh Fusion: Unsupervised 3D Planar Surface Understanding
par: Zanjani, Farhad G., et autres
Publié: (2024)
par: Zanjani, Farhad G., et autres
Publié: (2024)
ODG: Occupancy Prediction Using Dual Gaussians
par: Shi, Yunxiao, et autres
Publié: (2025)
par: Shi, Yunxiao, et autres
Publié: (2025)
HexaGen3D: StableDiffusion is just one step away from Fast and Diverse Text-to-3D Generation
par: Mercier, Antoine, et autres
Publié: (2024)
par: Mercier, Antoine, et autres
Publié: (2024)
FALO: Fast and Accurate LiDAR 3D Object Detection on Resource-Constrained Devices
par: Han, Shizhong, et autres
Publié: (2025)
par: Han, Shizhong, et autres
Publié: (2025)
CoReDiT: Spatial Coherence-Guided Token Pruning and Reconstruction for Efficient Diffusion Transformers
par: Li, Zhuojin, et autres
Publié: (2026)
par: Li, Zhuojin, et autres
Publié: (2026)
RoCA: Robust Cross-Domain End-to-End Autonomous Driving
par: Yasarla, Rajeev, et autres
Publié: (2025)
par: Yasarla, Rajeev, et autres
Publié: (2025)
Planar Gaussian Splatting
par: Zanjani, Farhad G., et autres
Publié: (2024)
par: Zanjani, Farhad G., et autres
Publié: (2024)
3D Gaussian Splatting for Efficient Retrospective Dynamic Scene Novel View Synthesis with a Standardized Benchmark
par: Zhang, Yunxiao, et autres
Publié: (2026)
par: Zhang, Yunxiao, et autres
Publié: (2026)
Learning Optical Flow Field via Neural Ordinary Differential Equation
par: Mirvakhabova, Leyla, et autres
Publié: (2025)
par: Mirvakhabova, Leyla, et autres
Publié: (2025)
SciFlow: Empowering Lightweight Optical Flow Models with Self-Cleaning Iterations
par: Lin, Jamie Menjay, et autres
Publié: (2024)
par: Lin, Jamie Menjay, et autres
Publié: (2024)
OCAI: Improving Optical Flow Estimation by Occlusion and Consistency Aware Interpolation
par: Jeong, Jisoo, et autres
Publié: (2024)
par: Jeong, Jisoo, et autres
Publié: (2024)
Segmentation-Free Guidance for Text-to-Image Diffusion Models
par: Azarian, Kambiz, et autres
Publié: (2024)
par: Azarian, Kambiz, et autres
Publié: (2024)
Resolving the Identity Crisis in Text-to-Image Generation
par: Borse, Shubhankar, et autres
Publié: (2025)
par: Borse, Shubhankar, et autres
Publié: (2025)
LoRA-X: Bridging Foundation Models with Training-Free Cross-Model Adaptation
par: Farhadzadeh, Farzad, et autres
Publié: (2025)
par: Farhadzadeh, Farzad, et autres
Publié: (2025)
Repurposing 2D Diffusion Models for 3D Shape Completion
par: He, Yao, et autres
Publié: (2025)
par: He, Yao, et autres
Publié: (2025)
Generative Scenario Rollouts for End-to-End Autonomous Driving
par: Yasarla, Rajeev, et autres
Publié: (2026)
par: Yasarla, Rajeev, et autres
Publié: (2026)
Attention Guided Alignment in Efficient Vision-Language Models
par: Mahajan, Shweta, et autres
Publié: (2025)
par: Mahajan, Shweta, et autres
Publié: (2025)
MAPLE: Latent Multi-Agent Play for End-to-End Autonomous Driving
par: Yasarla, Rajeev, et autres
Publié: (2026)
par: Yasarla, Rajeev, et autres
Publié: (2026)
Gated Cross-Attention Network for Depth Completion
par: Jia, Xiaogang, et autres
Publié: (2023)
par: Jia, Xiaogang, et autres
Publié: (2023)
DDIL: Diversity Enhancing Diffusion Distillation With Imitation Learning
par: Garrepalli, Risheek, et autres
Publié: (2024)
par: Garrepalli, Risheek, et autres
Publié: (2024)
OriCon3D: Effective 3D Object Detection using Orientation and Confidence
par: Rajani, Dhyey Manish, et autres
Publié: (2023)
par: Rajani, Dhyey Manish, et autres
Publié: (2023)
DepthSSC: Monocular 3D Semantic Scene Completion via Depth-Spatial Alignment and Voxel Adaptation
par: Yao, Jiawei, et autres
Publié: (2023)
par: Yao, Jiawei, et autres
Publié: (2023)
Enhanced Mixture 3D CGAN for Completion and Generation of 3D Objects
par: Hamdi, Yahia, et autres
Publié: (2026)
par: Hamdi, Yahia, et autres
Publié: (2026)
HAViT: Historical Attention Vision Transformer
par: Banik, Swarnendu, et autres
Publié: (2026)
par: Banik, Swarnendu, et autres
Publié: (2026)
PlaneRecTR++: Unified Query Learning for Joint 3D Planar Reconstruction and Pose Estimation
par: Shi, Jingjia, et autres
Publié: (2023)
par: Shi, Jingjia, et autres
Publié: (2023)
Propagating Sparse Depth via Depth Foundation Model for Out-of-Distribution Depth Completion
par: Chen, Shenglun, et autres
Publié: (2025)
par: Chen, Shenglun, et autres
Publié: (2025)
Sparsity-Aware Voxel Attention and Foreground Modulation for 3D Semantic Scene Completion
par: Xue, Yu, et autres
Publié: (2026)
par: Xue, Yu, et autres
Publié: (2026)
InFusion: Inpainting 3D Gaussians via Learning Depth Completion from Diffusion Prior
par: Liu, Zhiheng, et autres
Publié: (2024)
par: Liu, Zhiheng, et autres
Publié: (2024)
Any to Full: Prompting Depth Anything for Depth Completion in One Stage
par: Zhou, Zhiyuan, et autres
Publié: (2026)
par: Zhou, Zhiyuan, et autres
Publié: (2026)
TPA3D: Triplane Attention for Fast Text-to-3D Generation
par: Wu, Bin-Shih, et autres
Publié: (2023)
par: Wu, Bin-Shih, et autres
Publié: (2023)
MoViE: Mobile Diffusion for Video Editing
par: Karjauv, Adil, et autres
Publié: (2024)
par: Karjauv, Adil, et autres
Publié: (2024)
CustomKD: Customizing Large Vision Foundation for Edge Model Improvement via Knowledge Distillation
par: Lee, Jungsoo, et autres
Publié: (2025)
par: Lee, Jungsoo, et autres
Publié: (2025)
Documents similaires
-
H3O: Hyper-Efficient 3D Occupancy Prediction with Heterogeneous Supervision
par: Shi, Yunxiao, et autres
Publié: (2025) -
MAMo: Leveraging Memory and Attention for Monocular Video Depth Estimation
par: Yasarla, Rajeev, et autres
Publié: (2023) -
FutureDepth: Learning to Predict the Future Improves Video Depth Estimation
par: Yasarla, Rajeev, et autres
Publié: (2024) -
ToSA: Token Selective Attention for Efficient Vision Transformers
par: Singh, Manish Kumar, et autres
Publié: (2024) -
BePo: Dual Representation for 3D Occupancy Prediction
par: Shi, Yunxiao, et autres
Publié: (2025)